---
title: "Sintesi vocale online gratuita, 31 lingue | Yaps"
description: "Sintesi vocale interna al browser eseguita sul tuo dispositivo. Rilascia un PDF, EPUB, TXT, Markdown, RTF, DOCX o incolla il testo. 31 lingue, quattro voci, nessun caricamento e nessuna registrazione. Scarica gratuitamente WAV da Yaps."
canonical: "https://www.yaps.ai/it/strumenti/sintesi-vocale"
language: "it-IT"
---

[Strumento gratuito](/it/strumenti)Di Yaps

# Sintesi vocale, in 31 languages.

Quattro voci, 31 lingue, un modello che si scarica una volta e poi viene eseguito nella tua scheda. Incolla testo o rilascia un documento; nulla di ciò che carichi viene caricato, perché non c'è nessun posto dove andare.

Funziona sul tuo computer · Lo stesso motore utilizzato dall'app Yaps.

Avvio di le voci in corso

Voce Ogni voce legge ogni lingua.

Lingua
31 lingue, un modello

Cosa dovrebbe dire?120 / 600

Rilascia un documento da leggere

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX — elaborato su questo dispositivo

Le voci sono generate da Supertonic 3, © Supertone Inc., sotto la licenza BigScience Open RAIL-M. Consente l'uso commerciale ma limita alcuni usi di ciò che generi, incluso impersonare una persona reale senza il suo consenso. [Vedi i termini](/it/termini).

## Informazioni su questo strumento

## Cosa significa effettivamente la sintesi vocale nel browser

La maggior parte dei siti di sintesi vocale sono un modulo. Scrivi, le tue parole viaggiano su un server, un modello produce l'audio e un file ritorna. La sintesi vocale nel browser rimuove il passaggio intermedio. Il modello ti viene invece inviato, una volta, e il tuo browser lo esegue.

Questa pagina utilizza Supertonic 3, lo stesso motore vocale fornito dall'app desktop Yaps. È di circa 145 MB e arriva come un normale download la prima volta che apri la pagina. Il tuo browser lo memorizza nella cache. Ogni clip successivo viene realizzato sul tuo processore, motivo per cui non ci sono code, contatori di credito e account.

Esistono alcuni modi in cui un browser può parlare e non sono uguali. L'API Web Speech integrata prende in prestito qualunque voce abbia il tuo sistema operativo, quindi la stessa pagina suona in modo diverso su un Mac e su un vecchio telefono Android. Un'API cloud sembra coerente ma legge tutto ciò che incolli. Tra i due si colloca un piccolo modello locale: una voce ovunque e il testo resta fermo.

## Sintesi vocale privata: nessun caricamento, nessuna registrazione e nessuna chiave API

Niente di ciò che incolli nella casella o carichi da un documento lascia il tuo computer. Questa non è una promessa a cui devi credere, è il modo in cui è costruita la pagina. Non esiste alcun endpoint in attesa di ricevere il tuo testo.

Puoi controllarlo in circa dieci secondi. Spegni il Wi-Fi una volta scaricate le voci e genera comunque una clip. Parla ancora, perché il tuo testo non sarebbe mai andato da nessuna parte. Meglio ancora, disattiva la connessione dopo che il modello è stato memorizzato nella cache. Lo strumento continua a parlare.

La stessa struttura rimuove il solito attrito. Nessun account, nessun indirizzo email, nessuna chiave API, nessun livello gratuito che scende mentre provi uno script. Non paghiamo l'inferenza per parola, quindi non c'è nulla da misurare.

È più importante quando il testo non è tuo da distribuire. Copia sotto NDA, una sceneggiatura clinica, materiale di formazione interno, un nome di prodotto non annunciato, un capitolo di un manoscritto. Queste sono esattamente le cose che le persone incollano in uno strumento gratuito senza pensare a dove finiscono.

## Sintesi vocale in 31 lingue da un modello

Scegli una lingua, scegli una delle quattro voci e si legge. Spagnolo, tedesco, italiano, polacco, olandese, turco, coreano, giapponese, arabo, hindi, vietnamita e altri venti, tutti dallo stesso file da 145 MB.

Ciò è insolito per un modello così piccolo. La maggior parte dei motori locali necessita di un fonemiser per ogni lingua, un componente separato che trasforma l'ortografia in pronuncia, quindi ogni nuova lingua significa spedire un altro dizionario. Questo è il motivo per cui gli altri strumenti interni al browser sono solo in inglese o in inglese più un paio di extra. Supertonic elabora la pronuncia direttamente dall'ortografia, quindi un set di pesi copre tutto.

L'elenco completo: inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, polacco, russo, ucraino, ceco, slovacco, sloveno, croato, bulgaro, rumeno, ungherese, greco, svedese, danese, finlandese, estone, lettone, lituano, turco, arabo, hindi, indonesiano, vietnamita, coreano, giapponese.

La qualità non è identica in tutti i 31. L'inglese e le principali lingue europee sono le più forti. Imposta il selettore della lingua in modo che corrisponda al tuo testo, perché la lettura dipende da questo.

## Come trasformare il testo in un file WAV nel tuo browser

1. Incolla o digita il testo oppure rilascia un file PDF, EPUB, TXT, Markdown, HTML, RTF o DOCX nel lettore. I documenti importati vengono analizzati sul tuo dispositivo. Il limite è di 600 caratteri per sequenza, ovvero all'incirca un breve paragrafo o 20 secondi di discorso.

2. Scegli la lingua del testo. Ciò cambia il modo in cui viene letta l'ortografia, quindi è più importante di quanto sembri.

3. Scegli una voce. Ce ne sono quattro qui: Nora, Luna, Watson e Keld. Tutti e quattro leggono tutte le 31 lingue.

4. Premere il pulsante parla. Alla prima visita, il motore da 145 MB viene scaricato per primo e verrà visualizzata una barra di avanzamento. Dopodiché non c'è più attesa.

5. Premere download per salvare un file WAV a 44,1kHz.

La generazione avviene più velocemente del tempo reale e la riproduzione inizia dalla prima frase anziché attendere l'intero passaggio, quindi puoi sentire la voce quasi immediatamente. Se desideri una ripresa diversa, modifica il testo ed eseguilo di nuovo. Nulla viene salvato tra le esecuzioni e nulla viene messo in coda dietro i lavori di altre persone.

## Sintesi vocale offline dopo il primo download

Una volta che il modello è nella cache del browser, lo strumento non ha più bisogno di Internet. Carica la pagina, entra in un tunnel o su un aereo e continua a produrre audio. Questo è un effetto collaterale dell'esecuzione locale piuttosto che una funzionalità su cui ci siamo concentrati.

Il costo è il download di 145 MB una tantum. Con una connessione decente che dura meno di un minuto; sui dati mobili collegati vale la pena aspettarne uno migliore. Il tuo browser decide per quanto tempo conservare la cache, quindi se cancelli i dati del sito verranno recuperati di nuovo.

Funziona su WebAssembly, quindi non è richiesta alcuna scheda grafica e non è coinvolta alcuna estensione o installazione. Le versioni attuali di Chrome, Edge, Firefox e Safari funzionano tutte, su desktop e su telefoni. I telefoni più vecchi o con poca memoria saranno più lenti, perché un modello da 145 MB deve rimanere in memoria mentre parla.

## Come si confronta con i siti di sintesi vocale che caricano il tuo testo

I principali siti gratuiti pubblicizzano centinaia di voci e cento lingue. Possono, perché il lavoro è svolto da un data center. Lo scambio è che il tuo script viene inviato loro, di solito insieme a una registrazione, un limite di parola giornaliero, una filigrana o una coda nelle ore di punta e un'informativa sulla privacy che devi leggere per scoprire cosa succede al testo in seguito.

Questa pagina ha la forma opposta. Quattro voci, 600 caratteri alla volta, e l'attesa della prima visita. In cambio: nessun account, nessun limite al numero di volte in cui lo esegui, niente che invii le tue parole ovunque e continua a funzionare anche senza connessione.

Rispetto agli altri strumenti locali interni al browser il confronto è più diretto. La maggior parte di essi esegue Kokoro, che è un download più grande e, sotto forma di browser, solitamente solo in inglese. Supertonic è grande circa la metà e legge 31 lingue con lo stesso peso.

## Sintesi vocale libera per uso commerciale e cosa richiede la licenza

È possibile utilizzare l'audio a fini commerciali. Non è previsto alcun requisito di attribuzione a Yaps, nessuna filigrana nel file e nessuna licenza separata da acquistare.

I pesi dei modelli sono rilasciati sotto la licenza BigScience Open RAIL M, che ne consente l'uso commerciale ma impone condizioni su ciò che si fa con l'output. Quelli importanti in parole povere: non usarlo per imitare una persona reale specifica senza il suo consenso, non far passare il discorso sintetico per una registrazione autentica di qualcuno e non usarlo per ingannare, molestare o generare contenuti che potrebbero danneggiare le persone. Queste restrizioni viaggiano con l'audio, quindi si applicano a chiunque passi un file.

Il testo completo è collegato ai nostri Termini ed è abbastanza breve da poter essere letto. Se stai producendo una narrazione, una spiegazione, un video dimostrativo, una versione audio di un articolo o un messaggio vocale per un prodotto, niente di tutto questo è sulla tua strada.

## Cosa non può fare questo strumento e cosa aggiunge l'app Yaps.

Per essere chiari: questa pagina legge il testo digitato, incollato o importato da un file PDF locale, EPUB, TXT, Markdown, HTML, RTF o DOCX. Non raggiungerà l'articolo che stai guardando, un'e-mail, un documento in un'altra finestra o una selezione da qualche altra parte sullo schermo. Non c'è modo per una pagina web di raggiungere queste cose, e non ne vorremmo una che possa farlo.

L'app desktop Yaps è dove tutto cambia. Evidenzia il testo ovunque sul tuo computer Mac, Windows o Linux, premi una scorciatoia e lo leggerà ad alta voce con le stesse voci. Porta il set completo di dieci stili vocali anziché quattro, non ha un limite di 600 caratteri, gestisce la lettura di formati lunghi un paragrafo alla volta e aggiunge un motore espressivo con la clonazione della voce. Funziona anche sul dispositivo, quindi la storia della privacy è identica.

Se tutto ciò di cui hai bisogno è una breve clip e un file WAV, resta qui. È gratuito e non è una prova.

## Come utilizzare la sintesi vocale nel browser

1. ### Digita, incolla o rilascia un file

Digita o incolla fino a 600 caratteri oppure rilascia un file PDF, EPUB, TXT, Markdown, HTML, RTF o DOCX. Il testo importato rimane sul tuo dispositivo.
2. ### Imposta la lingua

Scegli la lingua in cui è scritto il tuo testo, tra le 31 disponibili. Ciò modifica il modo in cui l'ortografia viene trasformata in pronuncia, quindi influisce sul risultato più di quanto sembri.
3. ### Scegli una voce

Scegli Nora, Luna, Watson o Keld. Tutti e quattro leggono tutte le lingue supportate.
4. ### Genera il discorso

Premi il pulsante parla. Alla prima visita il motore vocale da 145 MB viene scaricato e memorizzato nella cache; dopodiché la generazione inizia subito e la riproduzione inizia dalla prima frase.
5. ### Scarica il file WAV

Premi download per salvare l'audio come file WAV a 44,1 kHz. Non è presente alcuna filigrana ed è possibile utilizzarla commercialmente secondo le condizioni di licenza del modello.

## Domande

**Il mio testo è caricato da qualche parte?**

No. Il modello vocale viene scaricato sul tuo browser e l'audio viene generato sul tuo computer. Non esiste un server di sintesi a cui inviare il testo. Puoi confermarlo disconnettendoti da Internet dopo che le voci sono state memorizzate nella cache e generando comunque una clip.

**Ho bisogno di un account o di una chiave API?**

No. Non è prevista alcuna registrazione, nessun indirizzo email, nessuna chiave API e nessun saldo del credito. Poiché la sintesi viene eseguita sul tuo dispositivo, non dobbiamo recuperare alcun costo per parola, quindi non c'è nulla da bloccare.

**La sintesi vocale nel browser funziona offline?**

Sì, dopo la prima visita. Il motore vocale da 145 MB deve essere scaricato una volta, quindi il browser lo memorizza nella cache. Da quel momento in poi la pagina produce audio senza alcuna connessione. Se cancelli i dati del tuo sito, il modello verrà scaricato nuovamente.

**Perché il primo caricamento richiede un download di 145 MB?**

Perché il modello stesso arriva da te invece di rimanere su un server. 145 MB sono pochi per un modello vocale multilingue ed è un caso unico. La maggior parte delle alternative nel browser eseguono Kokoro, che è un download più grande e tipicamente solo in inglese nel browser.

**Quali lingue sono supportate?**

31: inglese, spagnolo, francese, tedesco, italiano, portoghese, olandese, polacco, russo, ucraino, ceco, slovacco, sloveno, croato, bulgaro, rumeno, ungherese, greco, svedese, danese, finlandese, estone, lettone, lituano, turco, arabo, hindi, indonesiano, vietnamita, coreano e giapponese. Tutti usano lo stesso modello e una qualsiasi delle quattro voci.

**Che formato di file ottengo?**

Un file WAV a 44,1kHz. Puoi convertirlo in MP3 in qualsiasi editor se hai bisogno di un file più piccolo. Non c'è filigrana né marchio nell'audio.

**Perché esiste un limite di 600 caratteri?**

Per la qualità e per la pazienza. Il modello è più affidabile sui passaggi brevi e una singola corsa lunga non fornisce alcun feedback mentre funziona. Se hai bisogno di leggere testi lunghi, l'app desktop Yaps la gestisce un paragrafo alla volta senza limiti.

**Posso utilizzare l'audio a fini commerciali?**

Sì. I pesi del modello utilizzano la licenza BigScience Open RAIL M, che consente l'uso commerciale con restrizioni sull'output: nessuna imitazione di una determinata persona reale senza consenso, nessun discorso generato spacciato per una registrazione reale e nessun uso ingannevole o dannoso. I termini completi sono collegati dalla nostra pagina Termini.

**In quali browser funziona?**

Versioni attuali di Chrome, Edge, Firefox e Safari, su desktop e su telefoni. Funziona su WebAssembly, quindi non sono necessarie né scheda grafica né estensioni. I telefoni più vecchi o con poca memoria verranno generati più lentamente perché il modello deve rimanere in memoria.

**Può leggere una pagina web, un PDF o un documento per me?**

Puoi trascinare un file PDF locale, EPUB, TXT, Markdown, HTML, RTF o DOCX e la pagina ne estrarrà il testo sul tuo dispositivo. Non può raggiungere una pagina Web, un'e-mail o un documento aperto in un'altra applicazione; l'app desktop Yaps legge il testo evidenziato da qualsiasi applicazione con una scorciatoia da tastiera.

**Sono le stesse voci dell'app Yaps?**

Stesso motore e stessi pesi. Questa pagina offre quattro stili vocali, l'app ne offre dieci, rimuove il limite di caratteri e aggiunge un motore espressivo con la clonazione della voce.

**Come si confronta con gli strumenti TTS del browser basati su Kokoro?**

Entrambi vengono eseguiti localmente nel browser, quindi la posizione sulla privacy è la stessa. La differenza sta nella copertura e nelle dimensioni: Supertonic 3 legge 31 lingue da circa 145 MB, mentre le build del browser di Kokoro sono solitamente un download più grande e solo in inglese, perché necessitano di un dizionario di pronuncia per lingua.

## Altri strumenti gratuiti

[Discorso al testo Parla e guardalo diventare testo, nel tuo browser.](/it/strumenti/voce-in-testo) [Dall'audio al testo Hai già una registrazione? Trascrivi invece il file.](/it/strumenti/audio-in-testo) [Generatore di sottotitoli Trasforma un video in un file .srt o .vtt temporizzato.](/it/strumenti/generatore-di-sottotitoli) [Tutti gli strumenti gratuiti Tutti gli strumenti del browser Yaps, tutti in esecuzione sul tuo computer.](/it/strumenti)

Inizia ad abbaiare Mac · Windows · Linux · Android

## Leggi anything, non solo questa scatola.

Evidenzia il testo in qualsiasi app e ascoltalo con una scorciatoia.

[Scarica per Mac](https://github.com/richawo/yaps-releases/releases/latest)

Richiede macOS 13.0+ (Apple Silicon consigliato)iOS in arrivo
