---
title: "Texto para fala on-line gratuito, 31 idiomas | Yaps"
description: "Conversão de texto em fala no navegador executada em seu dispositivo. Solte um PDF, EPUB, TXT, Markdown, RTF, DOCX ou cole texto. 31 idiomas, quatro vozes, sem upload e sem inscrição. Baixe o WAV gratuitamente em Yaps."
canonical: "https://www.yaps.ai/pt-br/ferramentas/texto-para-fala"
language: "pt-BR"
---

[Ferramenta gratuita](/pt-br/ferramentas)Por Yaps

# Texto para fala, em 31 languages.

Quatro vozes, 31 idiomas, um modelo que baixa uma vez e depois roda dentro da sua aba. Cole texto ou solte um documento; nada do que você carrega é carregado, porque não há para onde ir.

Funciona na sua máquina · O mesmo mecanismo que o aplicativo Yaps usa

Iniciando as vozes

Voz Cada voz lê todos os idiomas.

Idioma
31 idiomas, um modelo

O que deveria dizer?120 / 600

Deixe um documento para ler

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX — processado neste dispositivo

As vozes são geradas pelo Supertonic 3, © Supertone Inc., sob a licença BigScience Open RAIL-M. Ela permite o uso comercial, mas restringe alguns usos do que você gera, incluindo a representação de uma pessoa real sem o seu consentimento. [Veja os termos](/pt-br/termos).

## Sobre esta ferramenta

## O que realmente significa conversão de texto em fala no navegador

A maioria dos sites de conversão de texto em fala são um formulário. Você digita, suas palavras vão para um servidor, um modelo lá faz o áudio e um arquivo volta. A conversão de texto em fala no navegador remove a etapa intermediária. O modelo é enviado a você uma vez e seu navegador o executa.

Esta página usa Supertonic 3, o mesmo mecanismo de voz fornecido pelo aplicativo de desktop Yaps. Tem cerca de 145 MB e chega como um download normal na primeira vez que você abre a página. Seu navegador o armazena em cache. Cada clipe depois disso é feito em seu próprio processador, por isso não há fila, contador de crédito e conta.

Existem algumas maneiras pelas quais um navegador pode falar e elas não são iguais. A API Web Speech integrada empresta todas as vozes que seu sistema operacional possui, de modo que a mesma página soa diferente em um Mac e em um telefone Android antigo. Uma API em nuvem parece consistente, mas lê tudo o que você cola. Um pequeno modelo local fica entre os dois: uma voz em todos os lugares e o texto permanece onde está.

## Conversão de texto em fala privada: sem upload, sem inscrição e sem chave de API

Nada do que você cola na caixa ou carrega de um documento sai da sua máquina. Essa não é uma promessa que você deve assumir com fé, é como a página é construída. Não há endpoint esperando para receber seu texto.

Você pode verificar isso em cerca de dez segundos. Desligue seu wifi assim que as vozes forem baixadas e gere um clipe de qualquer maneira. Ele ainda fala, porque seu texto nunca iria a lugar nenhum. Melhor ainda, desligue sua conexão depois que o modelo for armazenado em cache. A ferramenta continua falando.

A mesma estrutura elimina o atrito habitual. Nenhuma conta, nenhum endereço de e-mail, nenhuma chave de API, nenhum nível gratuito sendo desativado enquanto você testa um script. Não estamos pagando pela inferência por palavra, portanto não há nada para medir.

É mais importante quando o texto não é seu para distribuir. Cópia sob NDA, um roteiro clínico, material de treinamento interno, um nome de produto não anunciado, um capítulo de um manuscrito. Essas são exatamente as coisas que as pessoas colam em uma ferramenta gratuita sem pensar onde vão parar.

## Conversão de texto em fala em 31 idiomas a partir de um modelo

Escolha um idioma, escolha qualquer uma das quatro vozes e ele lê. Espanhol, alemão, italiano, polonês, holandês, turco, coreano, japonês, árabe, hindi, vietnamita e mais vinte, todos no mesmo arquivo de 145 MB.

Isso é incomum para um modelo tão pequeno. A maioria dos mecanismos locais precisa de um phonemiser para cada idioma, um componente separado que transforma a ortografia em pronúncia, portanto, cada novo idioma significa enviar outro dicionário. É por isso que as outras ferramentas do navegador são apenas em inglês ou em inglês com alguns extras. Supertonic calcula a pronúncia diretamente a partir da ortografia, portanto, um conjunto de pesos cobre tudo.

A lista completa: inglês, espanhol, francês, alemão, italiano, português, holandês, polonês, russo, ucraniano, tcheco, eslovaco, esloveno, croata, búlgaro, romeno, húngaro, grego, sueco, dinamarquês, finlandês, estoniano, letão, lituano, turco, árabe, hindi, indonésio, vietnamita, coreano, japonês.

A qualidade não é idêntica em todos os 31 países. O inglês e as principais línguas europeias são os mais fortes. Defina o seletor de idioma de acordo com o seu texto, pois a leitura depende disso.

## Como transformar texto em um arquivo WAV no seu navegador

1. Cole ou digite seu texto ou solte um arquivo PDF, EPUB, TXT, Markdown, HTML, RTF ou DOCX no leitor. Os documentos importados são analisados ​​no seu dispositivo. O limite é de 600 caracteres por execução, o que equivale aproximadamente a um parágrafo curto ou 20 segundos de discurso.

2. Escolha o idioma do texto. Isso muda a forma como a ortografia é lida, por isso é mais importante do que parece.

3. Escolha uma voz. Existem quatro aqui: Nora, Luna, Watson e Keld. Todos os quatro leem todos os 31 idiomas.

4. Pressione o botão falar. Na primeira visita, o mecanismo de 145 MB é baixado primeiro e você verá uma barra de progresso. Depois disso não há espera.

5. Pressione download para salvar um arquivo WAV em 44,1kHz.

A geração é mais rápida que o tempo real e a reprodução começa na primeira frase em vez de esperar pela passagem inteira, então você ouve a voz quase imediatamente. Se quiser uma tomada diferente, edite o texto e execute-o novamente. Nada é salvo entre as execuções e nada fica na fila atrás dos trabalhos de outras pessoas.

## Conversão de texto em fala off-line após o primeiro download

Depois que o modelo estiver no cache do navegador, a ferramenta não precisará mais da internet. Carregue a página, entre em um túnel ou avião e ela ainda produz áudio. Esse é um efeito colateral da execução local, e não um recurso que implementamos.

O custo é o download de 145 MB. Em uma conexão decente que dura menos de um minuto; em dados móveis conectados, vale a pena esperar por um melhor. Seu navegador decide por quanto tempo manter o cache, portanto, se você limpar os dados do site, eles serão buscados novamente.

Ele é executado em WebAssembly, portanto, nenhuma placa gráfica é necessária e nenhuma extensão ou instalação está envolvida. As versões atuais do Chrome, Edge, Firefox e Safari funcionam em desktops e telefones. Telefones mais antigos ou com pouca memória serão mais lentos, porque um modelo de 145 MB precisa ficar na memória enquanto fala.

## Como ele se compara aos sites de conversão de texto em fala que carregam seu texto

Os principais sites gratuitos anunciam centenas de vozes e uma centena de idiomas. Eles podem, porque um data center está fazendo o trabalho. A vantagem é que seu script seja enviado a eles, geralmente junto com uma inscrição, um limite diário de palavras, uma marca d'água ou uma fila em horários de pico e uma política de privacidade que você deve ler para descobrir o que acontece com o texto depois.

Esta página tem o formato oposto. Quatro vozes, 600 caracteres por vez e uma espera na primeira visita. Em troca: sem conta, sem limite de quantas vezes você o executa, nada que envie suas palavras para qualquer lugar e ele continua funcionando com a conexão desligada.

Com outras ferramentas locais no navegador, a comparação é mais direta. A maioria deles executa o Kokoro, que é um download maior e, em formato de navegador, geralmente apenas em inglês. Supertonic tem aproximadamente metade do tamanho e lê 31 idiomas com os mesmos pesos.

## Conversão de texto em fala gratuita para uso comercial e o que a licença exige

Você pode usar o áudio comercialmente. Não há exigência de atribuição para Yaps, nenhuma marca d'água no arquivo e nenhuma licença separada para compra.

Os pesos do modelo são liberados sob a licença BigScience Open RAIL M, que permite o uso comercial, mas impõe condições sobre o que você faz com a saída. Os mais importantes em termos simples: não o utilize para imitar uma pessoa real específica sem o seu consentimento, não faça passar o discurso sintético como uma gravação genuína de alguém e não o utilize para enganar, assediar ou gerar conteúdo que possa prejudicar as pessoas. Essas restrições acompanham o áudio, portanto se aplicam a qualquer pessoa para quem você repassar um arquivo.

O texto completo está vinculado aos nossos Termos e é curto o suficiente para ser lido. Se você estiver produzindo uma narração, um explicador, um vídeo de demonstração, uma versão em áudio de um artigo ou uma mensagem de voz para um produto, nada disso o impedirá.

## O que esta ferramenta não pode fazer e o que o aplicativo Yaps adiciona

Sendo direto: esta página lê o texto que você digita, cola ou importa de um arquivo PDF local, EPUB, TXT, Markdown, HTML, RTF ou DOCX. Ele não alcançará o artigo que você está vendo, um e-mail, um documento em outra janela ou uma seleção em algum outro lugar da tela. Não há como uma página da web alcançar essas coisas, e não quereríamos uma que pudesse.

O aplicativo de desktop Yaps é onde isso muda. Destaque o texto em qualquer lugar da sua máquina Mac, Windows ou Linux, pressione um atalho e ele o lerá em voz alta nas mesmas vozes. Ele carrega o conjunto completo de dez estilos de voz em vez de quatro, não tem limite de 600 caracteres, lida com a leitura longa de um parágrafo por vez e adiciona um mecanismo expressivo com clonagem de voz. Ele também funciona no dispositivo, portanto a história da privacidade é idêntica.

Se tudo que você precisa é de um clipe curto e um arquivo WAV, fique aqui. É gratuito e não é um teste.

## Como usar texto para fala em seu navegador

1. ### Digite, cole ou solte um arquivo

Digite ou cole até 600 caracteres ou solte um arquivo PDF, EPUB, TXT, Markdown, HTML, RTF ou DOCX. O texto importado permanece no seu dispositivo.
2. ### Defina o idioma

Escolha o idioma em que seu texto está escrito, entre os 31 disponíveis. Isso muda a forma como a ortografia é transformada em pronúncia, afetando mais o resultado do que parece.
3. ### Escolha uma voz

Escolha Nora, Luna, Watson ou Keld. Todos os quatro leem todos os idiomas suportados.
4. ### Gere o discurso

Pressione o botão falar. Na primeira visita, os downloads e caches do mecanismo de voz de 145 MB; depois dessa geração começa imediatamente e a reprodução começa na primeira frase.
5. ### Baixe o WAV

Pressione download para salvar o áudio como um arquivo WAV de 44,1 kHz. Não há marca d'água e você pode usá-la comercialmente sob as condições de licença do modelo.

## Perguntas

**Meu texto é carregado em algum lugar?**

Não. O modelo de voz é baixado em seu navegador e o áudio é gerado em sua própria máquina. Não há servidor de síntese para o envio do seu texto. Você pode confirmar desconectando-se da Internet depois que as vozes forem armazenadas em cache e gerando um clipe de qualquer maneira.

**Preciso de uma conta ou de uma chave de API?**

Não. Não há inscrição, endereço de e-mail, chave de API e saldo de crédito. Como a síntese é executada no seu dispositivo, não há custo por palavra para recuperarmos, portanto não há nada para bloquear.

**A conversão de texto em fala no navegador funciona offline?**

Sim, após a primeira visita. O mecanismo de voz de 145 MB precisa ser baixado uma vez e, em seguida, seu navegador o armazena em cache. A partir daí a página produz áudio sem nenhuma conexão. Se você limpar os dados do seu site, o modelo será baixado novamente.

**Por que o primeiro carregamento é um download de 145 MB?**

Porque o modelo em si chega até você, em vez de permanecer em um servidor. 145 MB é pouco para um modelo de voz multilíngue e é único. A maioria das alternativas no navegador executa o Kokoro, que é um download maior e normalmente em inglês apenas no navegador.

**Quais idiomas são suportados?**

31: inglês, espanhol, francês, alemão, italiano, português, holandês, polaco, russo, ucraniano, checo, eslovaco, esloveno, croata, búlgaro, romeno, húngaro, grego, sueco, dinamarquês, finlandês, estónio, letão, lituano, turco, árabe, hindi, indonésio, vietnamita, coreano e japonês. Todos eles usam o mesmo modelo e qualquer uma das quatro vozes.

**Que formato de arquivo eu obtenho?**

Um arquivo WAV a 44,1kHz. Você pode convertê-lo para MP3 em qualquer editor se precisar de um arquivo menor. Não há marca d’água nem branding no áudio.

**Por que existe um limite de 600 caracteres?**

Pela qualidade e pela paciência. O modelo é mais confiável em passagens curtas, e uma corrida longa e única não fornece feedback enquanto funciona. Se você precisar de uma leitura longa, o aplicativo de desktop Yaps lida com um parágrafo por vez, sem limite.

**Posso usar o áudio comercialmente?**

Sim. Os pesos do modelo usam a licença BigScience Open RAIL M, que permite o uso comercial com restrições de saída: não é permitido imitar uma pessoa real específica sem consentimento, não é permitido passar o discurso gerado como uma gravação real e não é permitido o uso enganoso ou prejudicial. Os termos completos estão vinculados em nossa página de Termos.

**Em quais navegadores ele funciona?**

Versões atuais do Chrome, Edge, Firefox e Safari, em desktops e telefones. Ele roda em WebAssembly, portanto, nenhuma placa gráfica e nenhuma extensão são necessárias. Telefones mais antigos ou com pouca memória gerarão mais lentamente porque o modelo precisa permanecer na memória.

**Ele pode ler uma página da web, PDF ou documento para mim?**

Você pode soltar um arquivo PDF local, EPUB, TXT, Markdown, HTML, RTF ou DOCX e a página extrai seu texto em seu dispositivo. Não é possível acessar uma página da web, e-mail ou documento aberto em outro aplicativo; o aplicativo de desktop Yaps lê o texto destacado de qualquer aplicativo com um atalho de teclado.

**Essas são as mesmas vozes do aplicativo Yaps?**

Mesmo motor e mesmos pesos. Esta página oferece quatro estilos de voz, o aplicativo oferece dez, remove o limite de caracteres e adiciona um mecanismo expressivo com clonagem de voz.

**Como isso se compara às ferramentas TTS do navegador baseadas em Kokoro?**

Ambos são executados localmente no navegador, portanto a posição de privacidade é a mesma. A diferença é a cobertura e o tamanho: o Supertonic 3 lê 31 idiomas em aproximadamente 145 MB, onde as versões do Kokoro para navegador geralmente são um download maior e apenas em inglês, porque precisam de um dicionário de pronúncia por idioma.

## Mais ferramentas gratuitas

[Fala para texto Fale e veja-o virar texto, no seu navegador.](/pt-br/ferramentas/voz-para-texto) [Áudio para texto Já tem uma gravação? Transcreva o arquivo.](/pt-br/ferramentas/audio-para-texto) [Gerador de legendas Transforme um vídeo em um arquivo .srt ou .vtt cronometrado.](/pt-br/ferramentas/gerador-de-legendas) [Todas as ferramentas gratuitas Cada ferramenta de navegador Yaps, todas rodando em sua própria máquina.](/pt-br/ferramentas)

Comece a latir Mac · Windows · Linux · Android

## Leia anything, não apenas esta caixa.

Destaque o texto em qualquer aplicativo e ouça-o com um atalho.

[Baixar para Mac](https://github.com/richawo/yaps-releases/releases/latest)

Requer macOS 13.0+ (Apple Silicon recomendado)iOS em breve
