Voci TTS
Confronto voci TTS — Anthilla
Ogni voce legge lo stesso testo. Ascolta, confronta e vota la voce che preferisci per il sito Anthilla. Il voto va inviato via WhatsApp o email indicando il nome della voce.
Voci attive in produzione: Isabella (IT) + Giuseppe Multilingue (EN). Tutte le altre sono state valutate e scartate (bannate) — restano qui per riferimento e confronto.
Indice
1. Italiano — voci attive in produzione
Testo letto: "Anthilla: infrastruttura, sicurezza, intelligenza artificiale locale. Dal 2013, con esperienza dal 2001. Soluzioni IT modulari, libere e resilienti."
| Voce | Stack | Genere | Stato | Audio |
|---|---|---|---|---|
| Isabella | Edge-TTS (Microsoft Neural) | Femminile | ATTIVA |
Nota: Isabella (it-IT-IsabellaNeural) è la voce scelta da Ivan per la produzione IT. Prosodia naturale, timbro professionale, adatta a contenuti tecnici e istituzionali.
2. Italiano — voci bannate (scartate)
Voci valutate e non selezionate per la produzione. Restano disponibili per confronto e future revisioni.
| Voce | Stack | Genere | Stato | Motivo bannata | Audio |
|---|---|---|---|---|---|
| Diego | Edge-TTS (Microsoft Neural) | Maschile | BANNATA | Timbro troppo gioviale per contenuti tecnici B2B | |
| Elsa | Edge-TTS (Microsoft Neural) | Femminile | BANNATA | Timbro troppo acuto, meno autorevole di Isabella | |
| Giuseppe Multilingue | Edge-TTS (Microsoft Neural) | Maschile | BANNATA IT | Bannata per IT (troppo maschile), ma ATTIVA per EN — vedi sezione 3 | |
| Paola | Piper (locale, ONNX) | Femminile | BACKUP | Ex voce attiva S45-32, ora backup locale offline. Qualità inferiore alle neurali Microsoft | |
| Ugo | Piper (locale, ONNX) | Maschile | BANNATA | Timbro robotico, qualità Piper medium non sufficiente | |
| Aurora | Piper (locale, ONNX) | Femminile | BANNATA | Qualità medium, timbro meno professionale di Paola | |
| Leonardo | Piper (locale, ONNX) | Maschile | BANNATA | Qualità high ma timbro non adatto a contenuti B2B | |
| Riccardo | Piper (locale, ONNX) | Maschile | BANNATA | Timbro robotico, non selezionato |
3. Inglese — voci attive in produzione
Testo letto: "Anthilla builds custom software systems. Since 2022, working on mnemonic cognitive prompt framework, self-hosted management software, fog and edge infrastructure, AI knowledge base. Independent, open source, self-funded."
| Voce | Stack | Genere | Stato | Audio |
|---|---|---|---|---|
| Giuseppe Multilingue | Edge-TTS (Microsoft Neural) | Maschile multilingue | ATTIVA |
Nota: Giuseppe Multilingue (it-IT-GiuseppeMultilingualNeural) è la voce scelta da Ivan per la produzione EN. Pur essendo un modello IT multilingue, pronuncia l'inglese con accento neutro e prosodia naturale. Coerenza cross-lingua: stessa voce per IT e EN.
4. Inglese — voci bannate (scartate)
Voci valutate e non selezionate per la produzione EN.
| Voce | Stack | Genere | Stato | Motivo bannata | Audio |
|---|---|---|---|---|---|
| Guy | Edge-TTS (Microsoft Neural, US) | Maschile | BANNATA | Ex top rated, accento US troppo marcato. Giuseppe Multilingue preferito per coerenza cross-lingua | |
| Sonia | Edge-TTS (Microsoft Neural, GB) | Femminile | BANNATA | Accento British, timbro non coerente con la voce IT | |
| LJSpeech | Piper (locale, ONNX high) | Maschile | BACKUP | Ex top rated locale, ora backup offline. Timbro british, qualità high | |
| Lessac | Piper (locale, ONNX high) | Maschile | BANNATA | Qualità high ma timbro meno naturale di LJSpeech | |
| Amy | Piper (locale, ONNX medium) | Femminile | BANNATA | Qualità medium, timbro non professionale | |
| Ryan | Piper (locale, ONNX high) | Maschile | BANNATA | Qualità high, timbro non coerente | |
| LibriTTS | Piper (locale, ONNX high) | Maschile | BANNATA | Timbro da audiobook, non adatto a contenuti tecnici | |
| Norman | Piper (locale, ONNX medium) | Maschile | BANNATA | Qualità medium, non selezionato | |
| Bryce | Piper (locale, ONNX medium) | Maschile | BANNATA | Qualità medium, non selezionato | |
| Joe | Piper (locale, ONNX medium) | Maschile | BANNATA | Qualità medium, non selezionato | |
| HFC Male | Piper (locale, ONNX medium) | Maschile | BANNATA | Qualità medium, non selezionato | |
| Alan | Piper (locale, ONNX medium, GB) | Maschile | BANNATA | Accento British, qualità medium, non selezionato | |
| Cori | Piper (locale, ONNX high, GB) | Femminile | BANNATA | Accento British, non selezionata | |
| Northern English Male | Piper (locale, ONNX medium, GB) | Maschile | BANNATA | Accento Northern English troppo marcato | |
| Semaine | Piper (locale, ONNX medium, GB) | Femminile | BANNATA | Accento British, non selezionata |
5. Stack e pipeline audio
Stack asset — per lingua
| Lingua | Stack primario | Voce attiva | Stack backup | Voce backup | Formato |
|---|---|---|---|---|---|
| IT | Edge-TTS (Microsoft Neural) | Isabella (it-IT-IsabellaNeural) | Piper (ONNX, locale) | Paola (it_IT-paola-medium) | MP3 (edge) / OPUS (Piper) |
| EN | Edge-TTS (Microsoft Neural) | Giuseppe Multilingue (it-IT-GiuseppeMultilingualNeural) | Piper (ONNX, locale) | LJSpeech (en_US-ljspeech-high) | MP3 (edge) / OPUS (Piper) |
Edge-TTS (primario)
Voci neurali Microsoft (Isabella per IT, Giuseppe Multilingue per EN). Qualità superiore, naturalita prosodica, streaming-ready. Richiede connettivita per la generazione, file statici cacheati in MP3 e OPUS.
TTS neurale locale (backup)
TTS neurale ONNX, inference su CPU, fully offline. Nessuna dipendenza cloud. Qualita inferiore alle neurali Microsoft ma completamente autonomo. Voci IT: Paola (medium). Voci EN: LJSpeech (high), Lessac (high), e altre 12 voci bannate.
Formato audio
MP3 (edge-tts primario, 96k) + OPUS 32kbps VBR (Piper legacy + conversione edge). File 3-5x piu piccoli di MP3 96k, qualita superiore, streaming-ready, near-zero latency. Plugin supporta entrambi i formati con fallback automatico.
Pipeline
Batch post-process: generazione offline, file statici cacheati in MP3/OPUS, playback streaming via HTML5 audio. Hash md5(lang|testo_normalizzato) per coerenza batch runtime.
Pause prosodiche
Inserite automaticamente dopo ogni heading (h1-h6) e tra blocchi di paragrafo, per rendere naturale la lettura TTS.
Anglicizzazione fonetica
~70 termini EN mappati foneticamente per la voce IT (cloud to claud, edge to egg, workflow to uorkflou, ecc.). Applicata solo alla stringa audio, non al testo visibile.
6. Vota
Indica la voce che preferisci (una per lingua) e invia via WhatsApp o modulo di contatto:
Esempio: "Voce IT: Isabella, Voce EN: Giuseppe Multilingue"
Voci attive in produzione: Isabella (IT) + Giuseppe Multilingue (EN). Tutte le altre sono bannate o backup.