Libertà di parola per inviare messaggi di testo, direttamente nel tuo browser.
Tocca il microfono, parla normalmente e guardalo trasformarsi in testo. Il modello vocale viene scaricato una volta e poi viene eseguito sul tuo computer, quindi non viene caricato alcun audio, non esiste un account e non ci sono limiti di tempo.
Funziona sul tuo computer · La tua voce non lascia mai questo dispositivo
Avvio di digitazione vocale in corso
Mi sto appena preparando...
Informazioni su questo strumento
Come funziona la digitazione vocale online senza caricare la tua voce
Quando la pagina viene caricata, scarica un modello di riconoscimento vocale chiamato Whisper nel tuo browser. È la dimensione base, quantizzata a int8, e arriva a circa 80 MB. Una barra di avanzamento mostra il download. Il modello viaggia verso te invece che la tua voce viaggi verso un server.
Successivamente lo strumento è push-to-talk. Tocchi il microfono, il tuo browser richiede l'autorizzazione del microfono e un misuratore di livello mostra che ti sta ascoltando. Tocca di nuovo e la registrazione passa direttamente al modello in esecuzione nella stessa scheda. L'audio viene gestito in finestre di 30 secondi con una sovrapposizione di 5 secondi, quindi un lungo periodo di conversazione non viene interrotto a metà frase.
Laddove il tuo browser supporta WebGPU, il modello funziona sulla scheda grafica ed è molte volte più veloce. Dove ciò non avviene, si ricorre a WebAssembly sulla CPU, che è più lento ma funziona comunque. Il tuo browser memorizza nella cache i file del modello dopo la prima esecuzione, quindi le visite successive iniziano immediatamente. Un conteggio delle parole e una cifra approssimativa di parole al minuto si trovano sopra la casella di testo.
Digitazione vocale senza caricamento, senza registrazione e senza account
La maggior parte dei siti di digitazione vocale gratuiti assumono due forme. Alcuni registrano il tuo audio e lo pubblicano sui loro server per la trascrizione. Altri chiamano il riconoscimento vocale integrato in Chrome o Edge, che invia l'audio al servizio del fornitore del browser. In ogni caso la tua voce lascia la tua macchina e ti fidi di un'informativa sulla privacy che non hai scritto.
Questa pagina ha una forma diversa. Non è previsto alcun caricamento, nessun account e nessun server di trascrizione. Il file del modello è un download statico e la trascrizione viene eseguita nella scheda di fronte a te. Puoi verificarlo tu stesso. Carica la pagina, attendi l'arrivo del modello, quindi spegni il wifi e continua a dettare. Continua a funzionare, perché il riconoscimento non è mai avvenuto tramite la rete.
Questa struttura ha anche effetti pratici. Niente è misurato, quindi non c'è un limite di minuti, nessun limite giornaliero e nessun muro che ti chiede di iscriverti a metà della registrazione. Significa anche che non possiamo leggere, archiviare o perdere la tua trascrizione. Se chiudi la scheda, il testo scompare, quindi copia o scarica tutto ciò che desideri conservare.
Come utilizzare lo strumento di digitazione vocale, passo dopo passo
Attendi il completamento del download del modello. Il pulsante del microfono rimane inattivo finché non è pronto, perché prima di allora non c'è nulla su cui trascrivere. In una connessione normale ciò richiede alcuni secondi e si verifica solo alla prima visita.
Tocca il microfono. La prima volta, il tuo browser ti chiederà l'autorizzazione per utilizzare il microfono. Permettilo. Osserva il movimento del misuratore di livello mentre parli: questo è il modo più rapido per verificare che sia selezionato il dispositivo di input corretto. Se il misuratore è scarico, modifica l'ingresso nelle impostazioni audio del sistema e ricarica.
Parla al tuo ritmo normale. Non è necessario rallentare o enunciare troppo, e urlare peggiora i risultati anziché migliorarli. Tocca di nuovo il microfono quando termini un pensiero. Il testo appare nella casella sottostante.
Puoi andare avanti. Ogni nuova registrazione viene aggiunta alla fine di quella già presente, in modo da poter dettare in brevi sequenze. La casella è un normale campo modificabile, quindi correggi tutto ciò che desideri, quindi copialo o scaricalo come file .txt.
Quanto è accurato e quali lingue e accenti gestisce?
Il modello è multilingue e rileva automaticamente la lingua, quindi puoi iniziare a parlare senza scegliere nulla dal menu. In pratica copre la maggior parte delle lingue principali, ed è notevolmente più forte in quelle con il maggior numero di dati di formazione, primo fra tutti l'inglese.
Sii realistico riguardo alle dimensioni del modello. Questa è la base Whisper, scelta perché un download da 80 MB è qualcosa che un visitatore effettivamente aspetterà. È bravo nel parlato ordinario e regge una vasta gamma di accenti, ma non è il modello più grande disponibile e commetterà più errori di uno dieci volte più grande. I nomi propri, i nomi dei prodotti, il gergo tecnico e i nomi delle persone sono i luoghi in cui scivola più spesso.
Una stanza tranquilla e un microfono decente aiutano più di qualsiasi altra cosa che puoi cambiare. I microfoni dei laptop rilevano il rumore della tastiera e l'eco della stanza ed entrambi peggiorano il testo. Se imponi molto, un headset economico è il più grande aggiornamento a tua disposizione.
Per cosa le persone usano la digitazione vocale gratuita
L'utilizzo più comune è una prima bozza. Per la maggior parte delle persone parlare è più veloce che digitare e una bozza parlata approssimativa che poi modifichi tende a battere una pagina vuota. Saggi, post di blog, lettere di accompagnamento, lunghe e-mail, voci di diario e appunti di riunioni funzionano tutti bene in questo modo.
È anche uno strumento di accessibilità semplice. Se la digitazione è faticosa, se hai un infortunio o se la tastiera è semplicemente lenta, dettare in una scheda del browser non richiede installazione, diritti di amministratore o acquisto. Ciò è importante su un laptop da lavoro bloccato o su una macchina con libreria condivisa in cui non è possibile installare software.
Gli studenti lo usano per gli appunti e per annotare rapidamente citazioni lunghe. Le persone che scrivono in una seconda lingua spesso trovano più facile pronunciare una frase che scriverla. Ed è utile come blocco appunti: cattura l'idea mentre ce l'hai, riordinala dopo.
Se quello che hai è una registrazione esistente piuttosto che una voce dal vivo, è un lavoro diverso. Utilizza invece lo strumento audio-testo.
Digitazione vocale offline, senza connessione Internet
Una volta che il modello è nella cache del browser, questa pagina continua a funzionare senza connessione. La trascrizione non ha mai utilizzato la rete, quindi un aereo, un treno o il wifi di un hotel morto non la fermano. È necessario caricare la pagina stessa, quindi aprila prima di perdere il segnale.
Due cose ti rimandano al download. Cancellando la memoria del browser viene rimosso il modello memorizzato nella cache e una finestra privata o di navigazione in incognito di solito inizia con una cache vuota, quindi recupera nuovamente il file. Anche browser diversi mantengono cache separate, quindi passare da uno all'altro significa un download in più.
Il primo download è l'unico momento in cui questo strumento ha bisogno di Internet. Tutto il resto, la registrazione, il riconoscimento e il testo, avviene sul tuo hardware. Vale la pena dirlo chiaramente perché è insolito. La maggior parte dei siti di dettatura gratuita smette di funzionare nel momento in cui sei offline, perché il riconoscimento avviene altrove.
I limiti della digitazione vocale del browser e cosa aggiunge l'app desktop
Questo strumento digita in una casella su una pagina web. Questo è il confine onesto. Non può inserire testo nel tuo editor, nel tuo client di posta elettronica, in Slack o in un documento, quindi copi il risultato a mano ogni volta. Se vuoi dettare qualcos'altro, questo è un lavoro in due fasi.
Il testo arriva anche dopo che ti fermi, non parola per parola mentre parli, perché la registrazione viene trascritta in un unico passaggio quando tocchi nuovamente il microfono. E non esiste alcun pass di pulizia. Qualunque cosa tu abbia detto è ciò che ottieni, compresi gli ehm, le false partenze e la frase che hai abbandonato a metà.
L'app desktop Yaps è la stessa idea su dispositivo senza questi limiti. Tieni premuto un tasto di scelta rapida, parli nell'app in cui ti trovi già e il testo si posiziona sul cursore. Pulisce le parole di riempimento e la punteggiatura man mano che procede e funziona offline una volta installato. C'è anche una tastiera Android, che è molto più adatta per la dettatura telefonica rispetto a una scheda del browser.
Come utilizzare la digitazione vocale nel browser
Attendi il download del modello
Alla prima visita la pagina recupera un modello di riconoscimento vocale di circa 80 MB e mostra una barra di avanzamento. Il microfono rimane inattivo finché non è pronto. Il tuo browser lo memorizza nella cache, quindi ciò accade solo una volta.
Tocca il microfono e consenti l'accesso al microfono
Il tuo browser chiederà l'autorizzazione per utilizzare il microfono la prima volta. Consentilo, quindi controlla che il misuratore di livello si muova quando parli in modo da sapere che è selezionato il dispositivo di input corretto.
Parla al tuo ritmo normale
Parla come faresti con una persona. Non è necessario rallentare, pronunciare troppo o alzare la voce. Una stanza silenziosa e un auricolare danno risultati migliori rispetto al microfono di un laptop in uno spazio pieno di eco.
Tocca di nuovo il microfono per interrompere
La registrazione viene trascritta sul tuo dispositivo e il testo viene visualizzato nella casella sottostante. Ogni nuova registrazione viene aggiunta alla fine, quindi puoi dettare in brevi sequenze anziché in una lunga ripresa.
Modifica, quindi copia o scarica
La casella di testo è completamente modificabile, quindi correggi eventuali errori del modello. Quindi copia il testo negli appunti o scaricalo come file .txt. Nulla viene salvato una volta chiusa la scheda.
Domande
Questo strumento di digitazione vocale è davvero gratuito?
Sì, e non c'è niente a cui iscriversi. Lo strumento funziona sul tuo computer, quindi non è necessario inoltrarti alcuna fattura di trascrizione. Non esiste un limite massimo di minuti, nessun limite giornaliero e nessuna prova che termina.
La mia voce è caricata da qualche parte?
No. Il modello di riconoscimento vocale viene scaricato nel tuo browser la prima volta che visiti il sito e tutto ciò che avviene successivamente viene eseguito sul tuo dispositivo. L'audio del tuo microfono non lascia mai la tua macchina. Non esiste un server di trascrizione a cui inviarlo. Puoi confermarlo spegnendo il wifi una volta scaricato il modello e dettando comunque.
Devo installare qualcosa?
No. È una pagina web. L'unico download è il modello vocale stesso, che il tuo browser recupera e memorizza automaticamente nella cache e che non vedi mai come file sul tuo computer.
Perché c'è un'attesa la prima volta che apro la pagina?
Lo strumento scarica un modello di riconoscimento vocale di circa 80 MB prima di poter trascrivere qualsiasi cosa. Una barra di avanzamento mostra quanto è avanti. Successivamente il tuo browser lo memorizza nella cache, quindi ogni visita successiva inizia immediatamente.
La digitazione vocale funziona senza una connessione Internet?
Sì, una volta memorizzato il modello nella cache. Il riconoscimento non ha mai utilizzato la rete, quindi continua a funzionare offline. È necessaria una connessione per la prima visita e per caricare la pagina stessa. Cancellare i dati del browser o utilizzare una finestra privata significa che il modello verrà nuovamente scaricato.
Perché il testo non appare mentre sto ancora parlando?
Lo strumento registra prima e trascrive quando tocchi nuovamente il microfono, quindi il testo arriva in una volta sola anziché parola per parola. Dettare in brevi sequenze ti dà qualcosa di simile alla digitazione dal vivo, poiché ogni nuova registrazione viene aggiunta alla fine di ciò che è già presente.
Posso usarlo per digitare in Google Docs, Word o nella mia posta elettronica?
Non direttamente. Questa pagina digita solo nella propria casella di testo, quindi copi il risultato a mano. Dettare direttamente in qualsiasi app è ciò che fa l'app desktop Yaps: tieni premuto un tasto di scelta rapida e il testo si posiziona sul cursore ovunque tu sia.
Aggiunge la punteggiatura e le lettere maiuscole?
Il modello scrive ciò che sente, inclusa la punteggiatura di base, ma non vi è alcuna correzione successiva. Le parole di riempimento, le parole ripetute e le frasi abbandonate vengono tutte pronunciate così come le hai pronunciate. L'app desktop lo pulisce mentre parli.
Per quanto tempo posso parlare in una volta sola?
Non esiste un limite stabilito. L'audio lungo viene elaborato in finestre di 30 secondi con una sovrapposizione in modo che le frasi non vengano tagliate a metà. Il limite pratico è la pazienza: più lunga è la registrazione, più lunga sarà la pausa dopo che ci si ferma mentre viene trascritta.
Quali lingue gestisce?
Il modello è multilingue e rileva automaticamente la lingua, quindi puoi semplicemente iniziare a parlare. È più forte in inglese e nelle altre lingue ampiamente parlate e commette più errori nelle lingue con meno dati di addestramento alle spalle.
Funziona su un telefono?
Funziona nei browser mobili, ma il download del modello e l'elaborazione sul dispositivo sono notevolmente più lenti rispetto a un laptop. Su Android, la tastiera Yaps offre un'esperienza decisamente migliore perché la dettatura è integrata nella tastiera stessa.
Cosa succede al mio testo quando chiudo la scheda?
Scompare. Niente viene salvato su un account, perché non esiste un account e nessun posto dove inviare il tuo testo. Copia il testo o scaricalo come file .txt prima di lasciare la pagina se vuoi conservarlo.
Altri strumenti gratuiti
Adesso fallo everywhere.
Una chiave, qualsiasi app, ripulita mentre parli.
Richiede macOS 13.0+ (Apple Silicon consigliato)iOS in arrivo