Sviluppo
Tutto ciò che sta dietro recito è software libero. Quattro repository trasformano ebook di pubblico dominio e copyleft nel catalogo di audiolibri di questo sito:
recito — il narratore
Un’applicazione a riga di comando in Python che converte un PDF o EPUB in un
audiolibro finito — un solo .m4b con segnalibri dei capitoli,
metadati e copertina — narrato interamente sulla tua macchina. pip install recito e poi recito speak mybook.pdf.
Nessun account, nessun caricamento: niente esce dal computer.
- Estrazione del testo consapevole del layout: l’analisi dei PDF a livello di segmento con PyMuPDF gestisce impaginazioni a due colonne, testatine, filigrane e numeri di pagina; gli EPUB sono letti capitolo per capitolo con un analizzatore proprio che segue l’indice del libro.
- La narrazione usa Qwen3-TTS, un modello a pesi aperti (Apache-2.0), dietro un protocollo di motore intercambiabile: in processo su una GPU NVIDIA locale per impostazione predefinita, oppure contro un server vLLM-Omni auto-ospitato per prestazioni su scala di lotto.
- Nove voci predefinite, clonazione zero-shot da pochi secondi di audio di riferimento e voci progettate da descrizioni in prosa. I numeri e le abbreviazioni sono pronunciati come li leggerebbe una persona: «$3.5mn» diventa «three point five million dollars».
- La qualità è verificata a orecchio: ogni passaggio viene riascoltato, e ciò che suona male viene rinarrato automaticamente. Le renderizzazioni interrotte riprendono da dove erano rimaste.
Documentazione: Uso · Installazione · Meccanismi interni · Motori TTS
recito-voices — le voci
Produce i pacchetti di voci con cui narra l’ecosistema, perché il catalogo non resti limitato alle voci predefinite di un modello TTS. Ogni pacchetto è validato, versionato e pubblicato da questo repository, ed entrambe le vie di produzione terminano nello stesso artefatto.
- Clonazione: clip di riferimento estratti da audio di pubblico dominio — registrazioni d’autore dell’era del cilindro di cera e dei primi dischi (Browning 1889, Tennyson 1890, Joyce 1924), o voci d’epoca da vecchi film e radio — impacchettati per la clonazione vocale zero-shot. Uno strumento di scoperta setaccia archive.org e il web in cerca di registrazioni candidate, così un libro può essere narrato dal suo stesso autore.
- Progettazione: una descrizione in prosa di una voce è renderizzata in un clip di riferimento con Qwen3-TTS VoiceDesign e poi impacchettata esattamente come un clone. Multilingue per progettazione: progetta la voce in francese, clonala in inglese, e I tre moschettieri è narrato in inglese con accento francese.
- Uno strumento di abbinamento legge l’intero catalogo, arricchisce gli autori con dati di Wikidata (genere, nazionalità, lingue, anni di vita), deduce la voce che ogni libro richiede, ordina le voci disponibili e segnala i vuoti: così decidere quale voce creare dopo è una decisione, non un’ipotesi.
recito-catalog — la pipeline del catalogo
Costruisce il catalogo di audiolibri: acquisisce titoli da Standard Ebooks e dal Progetto Gutenberg, renderizza ciascuno con recito ed emette gli artefatti — record JSON, audio e copertine — che questo sito pubblica.
- Fonti: l’organizzazione di Standard Ebooks su GitHub, dove ogni ebook vive come un repository di sorgenti completo — i repository non pubblicano rilasci, quindi gli epub sono costruiti dai sorgenti con la toolchain bloccata di SE — e il Progetto Gutenberg, i cui epub sono scaricati dai mirror ufficiali e normalizzati (il preambolo e le pagine di licenza di PG sono rimossi) prima della renderizzazione.
- Nomenclatura: ogni libro riceve uno slug con spazio dei nomi della fonte
preso alla lettera dal suo URL originale —
se/jane-austen/pride-and-prejudice— globalmente unico per costruzione e abbastanza stabile da servire anche come percorso pubblico del file audio. - Le copertine sono pubblicate così come sono dall’epub costruito, e il credito di copertina di Standard Ebooks — copiato alla lettera dal colophon — è mostrato sotto la copertina in ogni pagina di libro. Nessuna copertina è generata o commissionata.
- Le narrazioni di testi di pubblico dominio sono dedicate al pubblico dominio, seguendo la stessa dedica di Standard Ebooks; le narrazioni di testi copyleft portano la licenza del testo, mostrata nella pagina di ogni libro. Il codice della pipeline è AGPL.
Documentazione: Piano · Uso · Alternative scartate
recito-web — questo sito
Il sito che stai leggendo: un front-end interamente statico e prerenderizzato per il catalogo, senza applicazione lato server.
- SvelteKit 2 e Svelte 5 (runes) con TypeScript, prerenderizzato con adapter-static: qualsiasi hosting statico può servire il risultato, senza server runtime né regole di riscrittura.
- Flusso dei dati: le pagine di elenco e di dettaglio sono prerenderizzate
dai record del catalogo al momento della compilazione; il browser scarica
un unico indice di ricerca leggero (
/catalog/search.json), una sola volta, al primo uso della ricerca. Audio e copertine sono semplici risorse statiche. - Nessun libro è pubblicato senza la sua copertina: la compilazione fallisce se ne manca una. Se l’immagine di una copertina non si carica a runtime, la pagina ripiega su un disegno tipografico generato dal libro.
- Il deploy è una compilazione più rsync verso un hosting Apache. I commenti sono gestiti da un piccolo script CGI in Python che scrive un file per commento: nessun database, nessuna email, nessun PHP.
Documentazione: Installazione · Uso
Mirror dell’archivio audio
Ogni narrazione pubblicata è un .m4b autonomo — audio,
segnalibri dei capitoli e copertina in un solo file — e l’intero albero è
disponibile per il download in blocco tramite rsync anonimo e di sola lettura:
rsync -av --progress rsync://recito.org/recito-audio/ recito-audio/ Questo crea un mirror dell’intera biblioteca— attualmente 1392,2 GB in una directory locale recito-audio/; ripetendo il comando si
raccolgono i libri nuovi e le narrazioni ri-renderizzate, e aggiungendo --delete si eliminano i ritirati. I pattern di inclusione
ridimensionano l’albero — una voce in tutta la biblioteca: --include='*.qwen3-tts.aiden.m4b' --exclude='*.m4b' — o una sola
fonte sincronizzando solo recito-audio/se/. La configurazione
dell’host è nella documentazione di installazione di recito-web.
Licenze
I quattro progetti sono software libero AGPL-3.0-or-later. I pesi dei modelli di IA devono avere una licenza approvata dalla OSI o essere di pubblico dominio: i modelli non commerciali o a uso limitato sono rifiutati per politica. I testi originali portano le proprie licenze: oggi edizioni di pubblico dominio di Standard Ebooks e del Progetto Gutenberg, con testi copyleft (CC BY-SA) accettati come fonti. Le narrazioni di recito seguono il testo: le narrazioni di testi di pubblico dominio sono dedicate al pubblico dominio; le narrazioni di testi copyleft portano la licenza del testo, mostrata nella pagina di ogni libro. Le illustrazioni di copertina conservano la licenza registrata dalla fonte, con il credito preservato alla lettera e mostrato accanto a ogni copertina.
Domande, patch e segnalazioni di errori: moe@recito.org, oppure lascia una nota nella pagina dei commenti.