Svoboda řeči k textu přímo ve vašem browser.
Klepněte na mikrofon, mluvte normálně a sledujte, jak se mění na text. Model řeči se stáhne jednou a poté běží na vašem vlastním počítači, takže se nenahrává žádný zvuk, neexistuje žádný účet a neexistuje žádný časový limit.
Běží na vašem počítači · Váš hlas nikdy neopustí toto zařízení
Spouštění hlasové psaní
Právě se nastavuje…
O tomto nástroji
Jak funguje hlasové zadávání online bez nahrání vašeho hlasu
Když se stránka načte, stáhne do vašeho prohlížeče model rozpoznávání řeči s názvem Whisper. Je to základní velikost, kvantovaná na int8 a dosahuje přibližně 80 MB. Ukazatel průběhu zobrazuje stahování. Model putuje k vám místo toho, aby váš hlas putoval na server.
Poté je nástrojem push to talk. Klepnete na mikrofon, váš prohlížeč požádá o povolení mikrofonu a měřič úrovně ukazuje, že vás slyší. Klepněte znovu a záznam přejde přímo na model běžící na stejné kartě. Zvuk je zpracován v 30sekundových oknech s 5sekundovým překrytím, takže dlouhý úsek mluvení není přerušen uprostřed věty.
Pokud váš prohlížeč podporuje WebGPU, model běží na grafické kartě a je několikanásobně rychlejší. Kde tomu tak není, vrátí se zpět k WebAssembly na CPU, které je pomalejší, ale stále funguje. Váš prohlížeč ukládá soubory modelu po prvním spuštění do mezipaměti, takže pozdější návštěvy začnou okamžitě. Nad textovým polem se nachází počet slov a hrubý počet slov za minutu.
Hlasové zadávání bez nahrávání, bez registrace a bez účtu
Většina bezplatných webů pro hlasové zadávání má jeden ze dvou tvarů. Někteří nahrávají váš zvuk a zveřejňují jej na svých serverech pro přepis. Jiní nazývají rozpoznávání řeči zabudované do Chrome nebo Edge, které odesílá zvuk službě dodavatele prohlížeče. V každém případě váš hlas opustí váš počítač a důvěřujete zásadám ochrany osobních údajů, které jste nenapsali.
Tato stránka má jiný tvar. Neexistuje žádný upload, žádný účet a žádný přepisový server. Soubor modelu je statické stažení a přepis běží na kartě před vámi. Můžete si to ověřit sami. Načtěte stránku, počkejte, až model dorazí, pak vypněte wifi a pokračujte v diktování. Pokračuje v práci, protože rozpoznávání nikdy nepoužívalo síť.
Tato struktura má také praktické účinky. Nic se neměří, takže neexistuje žádný limit minut, žádný denní limit a žádná zeď, která by vás žádala, abyste se v polovině nahrávání zaregistrovali. Znamená to také, že váš přepis nemůžeme číst, ukládat ani ztratit. Pokud kartu zavřete, text zmizí, takže si zkopírujte nebo stáhněte vše, co si chcete ponechat.
Jak používat nástroj pro psaní hlasem, krok za krokem
Počkejte, až model dokončí stahování. Tlačítko mikrofonu zůstane neaktivní, dokud nebude připraveno, protože předtím není do čeho přepisovat. Při normálním připojení to trvá několik sekund a stane se to pouze při vaší první návštěvě.
Klepněte na mikrofon. Poprvé vás prohlížeč požádá o povolení k použití mikrofonu. Nechte to. Sledujte, jak se měřič úrovně pohybuje, když mluvíte, což je nejrychlejší způsob, jak potvrdit, že je vybráno správné vstupní zařízení. Pokud je měřič plochý, změňte vstup v nastavení zvuku systému a znovu jej načtěte.
Talk at your normal pace. Není třeba zpomalovat nebo přehnaně vyslovovat a křik výsledky spíše zhoršuje než zlepšuje. Tap the mic again when you finish a thought. Text se zobrazí v rámečku níže.
Můžete pokračovat. Každá nová nahrávka je přidána na konec toho, co již existuje, takže můžete diktovat v krátkých dávkách. Pole je normální upravitelné pole, takže si cokoli opravte, pak to zkopírujte nebo stáhněte jako soubor .txt.
Jak přesné je a které jazyky a akcenty zvládá?
Model je vícejazyčný a automaticky detekuje jazyk, takže můžete začít mluvit, aniž byste si něco vybrali z nabídky. V praxi, která pokrývá většinu hlavních jazyků, a je znatelně silnější na těch s nejvíce tréninkovými daty, mezi nimi i šéfem angličtiny.
Buďte realističtí ohledně velikosti modelu. Toto je základ Whisper, který byl vybrán, protože 80 MB stažení je něco, na co bude návštěvník skutečně čekat. Je dobrý v běžné spojené řeči a snese řadu přízvuků, ale není to největší dostupný model a udělá více chyb než desetinásobek velikosti. Vlastní podstatná jména, názvy produktů, odborný žargon a jména lidí jsou tam, kde to klouže nejčastěji.
Tichá místnost a slušný mikrofon pomáhají víc než cokoli jiného, co můžete změnit. Mikrofony notebooků zachycují hluk klávesnice a ozvěnu místnosti a obojí zhoršuje text. Pokud hodně diktujete, levná náhlavní souprava je tím největším upgradem, který máte k dispozici.
K čemu lidé používají bezplatné hlasové psaní
Nejběžnější použití je první návrh. Mluvení je pro většinu lidí rychlejší než psaní a hrubý mluvený koncept, který poté upravíte, má tendenci překonat prázdnou stránku. Eseje, příspěvky na blogu, motivační dopisy, dlouhé e-maily, záznamy v deníku a poznámky ze schůzek, to vše funguje tímto způsobem.
Je to také jednoduchý nástroj pro usnadnění přístupu. Pokud vás psaní bolí, máte zranění nebo vám klávesnice prostě jde pomalu, diktování na kartu prohlížeče nevyžaduje instalaci, žádná práva správce ani nákup. To záleží na uzamčeném pracovním notebooku nebo počítači se sdílenou knihovnou, kde nemůžete nainstalovat software.
Studenti jej používají pro poznámky a pro rychlé získání dlouhých citací. Pro lidi píšící v druhém jazyce je často snazší větu říct, než ji napsat. A je užitečný jako zápisník: zachyťte myšlenku, dokud ji máte, ukliďte ji později.
Pokud to, co máte, je stávající nahrávka, nikoli živý hlas, je to jiná práce. K tomu použijte nástroj pro převod zvuku na text.
Hlasové zadávání offline, bez připojení k internetu
Jakmile je model v mezipaměti vašeho prohlížeče, tato stránka nadále funguje bez připojení. Přepis nikdy nepoužíval síť, takže letadlo, vlak nebo mrtvá hotelová wifi ho nezastaví. K načtení potřebujete samotnou stránku, takže ji otevřete, než ztratíte signál.
Dvě věci vás vrátí zpět ke stažení. Vymazáním úložiště prohlížeče odstraníte model uložený v mezipaměti a soukromé nebo anonymní okno obvykle začíná prázdnou mezipamětí, takže soubor znovu načte. Různé prohlížeče také uchovávají samostatné mezipaměti, takže přechod z jednoho do druhého znamená ještě jedno stažení.
První stažení je jediný okamžik, kdy tento nástroj potřebuje internet. Všechno ostatní, nahrávání, rozpoznávání a text, se děje na vašem vlastním hardwaru. Stojí to za to říct jasně, protože je to neobvyklé. Většina stránek s bezplatnými diktáty přestane fungovat v okamžiku, kdy přejdete do režimu offline, protože rozpoznávání probíhá někde jinde.
Limity hlasového zadávání v prohlížeči a co přidává aplikace pro stolní počítače
Tento nástroj píše do jednoho pole na jedné webové stránce. To je poctivá hranice. Nemůže vložit text do vašeho editoru, vašeho e-mailového klienta, Slacku nebo dokumentu, takže výsledek pokaždé zkopírujete ručně. Pokud chcete diktovat do něčeho jiného, je to práce ve dvou krocích.
Text také dorazí poté, co zastavíte, nikoli slovo po slovu, když mluvíte, protože záznam se přepíše v jednom průchodu, když znovu klepnete na mikrofon. A není tam žádný úklidový průkaz. Cokoli jste řekli, dostanete, včetně um, falešných začátků a věty, kterou jste v polovině opustili.
Počítačová aplikace Yaps je stejný nápad na zařízení bez těchto omezení. Podržíte jednu klávesovou zkratku, mluvíte do jakékoli aplikace, ve které se již nacházíte, a text přistane na vašem kurzoru. Průběžně čistí výplňová slova a interpunkci a po instalaci funguje offline. K dispozici je také klávesnice Android, která se mnohem lépe hodí pro diktování telefonu než karta prohlížeče.
Jak používat hlasové zadávání v prohlížeči
Počkejte, až se model stáhne
Při vaší první návštěvě stránka načte model rozpoznávání řeči o velikosti přibližně 80 MB a zobrazí ukazatel průběhu. Mikrofon zůstane neaktivní, dokud nebude připraven. Váš prohlížeč jej ukládá do mezipaměti, takže se to stane pouze jednou.
Klepněte na mikrofon a povolte přístup k mikrofonu
Váš prohlížeč požádá o povolení k prvnímu použití mikrofonu. Povolte to a poté zkontrolujte, zda se měřič úrovně pohybuje, když mluvíte, abyste věděli, že je vybráno správné vstupní zařízení.
Mluvte běžným tempem
Mluvte tak, jak byste k člověku mluvili. Není třeba zpomalovat, přehnaně vyslovovat nebo zvyšovat hlas. Tichá místnost a sluchátka poskytují lepší výsledky než mikrofon notebooku v prostoru ozvěny.
Dalším klepnutím na mikrofon zastavíte
Záznam se přepíše na vaše zařízení a text se zobrazí v poli níže. Každá nová nahrávka je přidána na konec, takže můžete diktovat v krátkých dávkách místo jednoho dlouhého záběru.
Upravte a poté zkopírujte nebo stáhněte
Textové pole je plně upravitelné, takže opravte vše, co se v modelu pokazilo. Poté text zkopírujte do schránky nebo si jej stáhněte jako soubor .txt. Po zavření karty se nic neuloží.
Otázky
Je tento nástroj pro psaní hlasem opravdu zdarma?
Ano a není se k čemu přihlašovat. Nástroj běží na vašem vlastním stroji, takže vám nemusíme předat žádný účet za přepis. Neexistuje žádný limit minut, žádný denní limit a žádná zkušební verze, která končí.
Je můj hlas někde nahrán?
Ne. Model rozpoznávání řeči se stáhne do vašeho prohlížeče při první návštěvě a vše poté běží na vašem zařízení. Zvuk mikrofonu nikdy neopustí váš počítač. Neexistuje žádný přepisový server, na který by se to mělo poslat. Můžete to potvrdit vypnutím Wi-Fi, jakmile se model stáhne, a přesto budete diktovat.
Musím něco instalovat?
Ne. Je to webová stránka. Jediným stažením je samotný model řeči, který váš prohlížeč automaticky načte a uloží do mezipaměti a který nikdy nevidíte jako soubor ve svém počítači.
Proč se při prvním otevření stránky čeká?
Nástroj si stáhne model rozpoznávání řeči o velikosti asi 80 MB, než bude moci cokoliv přepsat. Ukazatel průběhu ukazuje, jak daleko to je. Váš prohlížeč jej poté uloží do mezipaměti, takže každá další návštěva začne okamžitě.
Funguje hlasové zadávání bez připojení k internetu?
Ano, jakmile je model uložen do mezipaměti. Rozpoznávání nikdy síť nepoužívalo, takže funguje offline. Pro první návštěvu a pro načtení samotné stránky potřebujete připojení. Vymazání dat prohlížeče nebo použití soukromého okna znamená, že se model stáhne znovu.
Proč se text nezobrazuje, když stále mluvím?
Nástroj nejprve nahrává a přepisuje, když znovu klepnete na mikrofon, takže text dorazí najednou, nikoli slovo po slovu. Diktování v krátkých sekvencích vám dává něco blízkého živému psaní, protože každá nová nahrávka je přidána na konec toho, co už tam je.
Mohu to použít k psaní do Dokumentů Google, Wordu nebo mého e-mailu?
Ne přímo. Tato stránka píše pouze do vlastního textového pole, takže výsledek zkopírujete ručně. Aplikace pro stolní počítače Yaps dělá diktování přímo do jakékoli aplikace: podržíte klávesovou zkratku a text přistane na vašem kurzoru, ať jste kdekoli.
Přidává interpunkci a velká písmena?
Model zapíše, co slyší, včetně základní interpunkce, ale poté již nedochází k žádnému opravnému průchodu. Výplňová slova, opakovaná slova a opuštěné věty, to vše přichází tak, jak jste je řekli. Desktopová aplikace to vyčistí, když mluvíte.
Jak dlouho mohu mluvit jedním tahem?
Neexistuje žádný stanovený limit. Dlouhý zvuk je zpracován v 30sekundových oknech s překrytím, takže věty nejsou zkráceny na polovinu. Praktickým limitem je trpělivost: čím delší je nahrávka, tím delší je pauza po zastavení během přepisu.
Které jazyky zvládá?
Model je vícejazyčný a automaticky detekuje jazyk, takže můžete jen začít mluvit. Nejsilnější je v angličtině a v dalších široce mluvených jazycích a dělá více chyb v jazycích s menším množstvím tréninkových dat.
Funguje to na telefonu?
Běží v mobilních prohlížečích, ale stahování modelu a zpracování na zařízení jsou znatelně pomalejší než na notebooku. V systému Android je klávesnice Yaps mnohem lepším zážitkem, protože diktování je zabudováno do samotné klávesnice.
Co se stane s mým textem, když zavřu kartu?
zmizí. Na účet se nic neukládá, protože neexistuje žádný účet a nikam, kam by byl váš text odeslán. Před opuštěním stránky zkopírujte text nebo jej stáhněte jako soubor .txt, pokud si jej chcete ponechat.
Více bezplatných nástrojů
Teď to udělej everywhere.
Jedna klávesa, libovolná aplikace, vyčištěná, když mluvíte.
Vyžaduje macOS 13.0+ (doporučeno Apple Silicon)iOS již brzy