---
title: "Texto a voz en línea gratuito, 31 idiomas | Yaps"
description: "Texto a voz en el navegador que se ejecuta en su dispositivo. Suelte un PDF, EPUB, TXT, Markdown, RTF, DOCX o pegue texto. 31 idiomas, cuatro voces, sin carga ni registro. Descarga el WAV gratis desde Yaps."
canonical: "https://www.yaps.ai/es/herramientas/texto-a-voz"
language: "es-ES"
---

[herramienta gratuita](/es/herramientas)Por Yaps

# Texto a voz, en 31 languages.

Cuatro voces, 31 idiomas, un modelo que se descarga una vez y luego se ejecuta dentro de tu pestaña. Pegue texto o suelte un documento; nada de lo que cargas se carga, porque no hay ningún lugar al que ir.

Se ejecuta en tu máquina · El mismo motor que usa la aplicación Yaps

Iniciando las voces

Voz Cada voz lee todos los idiomas.

Idioma
31 Idiomas, un modelo.

¿Qué debería decir?120 / 600

Suelta un documento para leer

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX — procesado en este dispositivo

Las voces son generadas por Supertonic 3, © Supertone Inc., bajo la licencia BigScience Open RAIL-M. Permite el uso comercial pero restringe algunos usos de lo que generas, incluida la suplantación de una persona real sin su consentimiento. [Ver los términos](/es/terminos).

## Acerca de esta herramienta

## Lo que realmente significa texto a voz en el navegador

La mayoría de los sitios de texto a voz son un formulario. Escribes, tus palabras viajan a un servidor, un modelo allí hace el audio y regresa un archivo. La conversión de texto a voz en el navegador elimina el paso intermedio. En su lugar, el modelo se le envía a usted una vez y su navegador lo ejecuta.

Esta página utiliza Supertonic 3, el mismo motor de voz que incluye la aplicación de escritorio Yaps. Tiene aproximadamente 145 MB y llega como una descarga normal la primera vez que abres la página. Su navegador lo almacena en caché. Cada clip posterior se crea en su propio procesador, por lo que no hay cola, contador de crédito ni cuenta.

Hay algunas formas en que un navegador puede hablar y no son iguales. La API Web Speech incorporada toma prestadas las voces que tenga su sistema operativo, por lo que la misma página suena diferente en una Mac y en un teléfono Android antiguo. Una API en la nube suena consistente pero lee todo lo que pegas. Un pequeño modelo local se sitúa entre los dos: una voz en todas partes y el texto permanece.

## Texto a voz privado: sin carga, sin registro y sin clave API

Nada de lo que pegue en la caja o cargue desde un documento sale de su máquina. Esa no es una promesa que debas asumir por fe, así es como se construye la página. No hay ningún punto final esperando recibir su mensaje de texto.

Puedes comprobarlo en unos diez segundos. Apague su wifi una vez que las voces se hayan descargado y genere un clip de todos modos. Todavía habla, porque tu texto nunca llegó a ninguna parte. Mejor aún, apague la conexión después de que el modelo se haya almacenado en caché. La herramienta sigue hablando.

La misma estructura elimina la fricción habitual. Sin cuenta, sin dirección de correo electrónico, sin clave API, sin nivel gratuito bajando mientras pruebas un script. No pagamos por la inferencia por palabra, por lo que no hay nada que medir.

Lo más importante es cuando el texto no es tuyo para repartirlo. Copia bajo acuerdo de confidencialidad, un guión clínico, material de capacitación interno, un nombre de producto no anunciado, un capítulo de un manuscrito. Esas son exactamente las cosas que la gente pega en una herramienta gratuita sin pensar en dónde aterrizan.

## Texto a voz en 31 idiomas desde un modelo

Elija un idioma, elija cualquiera de las cuatro voces y se leerá. Español, alemán, italiano, polaco, holandés, turco, coreano, japonés, árabe, hindi, vietnamita y veinte más, todos desde el mismo archivo de 145 MB.

Esto es inusual para un modelo tan pequeño. La mayoría de los motores locales necesitan un fonemisor para cada idioma, un componente separado que convierte la ortografía en pronunciación, por lo que cada nuevo idioma significa enviar otro diccionario. Es por eso que las otras herramientas del navegador están solo en inglés o en inglés más un par de extras. Supertonic resuelve la pronunciación a partir de la ortografía directamente, por lo que un conjunto de pesos cubre todo.

La lista completa: inglés, español, francés, alemán, italiano, portugués, holandés, polaco, ruso, ucraniano, checo, eslovaco, esloveno, croata, búlgaro, rumano, húngaro, griego, sueco, danés, finlandés, estonio, letón, lituano, turco, árabe, hindi, indonesio, vietnamita, coreano, japonés.

La calidad no es idéntica en los 31. El inglés y los idiomas europeos más importantes son los más fuertes. Configure el selector de idioma para que coincida con su texto, porque la lectura depende de ello.

## Cómo convertir texto en un archivo WAV en su navegador

1. Pegue o escriba su texto, o suelte un archivo PDF, EPUB, TXT, Markdown, HTML, RTF o DOCX en el lector. Los documentos importados se analizan en su dispositivo. El límite es de 600 caracteres por ejecución, lo que equivale aproximadamente a un párrafo corto o 20 segundos de discurso.

2. Elige el idioma del texto. Esto cambia la forma en que se lee la ortografía, por lo que importa más de lo que parece.

3. Elige una voz. Hay cuatro aquí: Nora, Luna, Watson y Keld. Los cuatro leen los 31 idiomas.

4. Presione el botón de hablar. En una primera visita, el motor de 145 MB se descarga primero y verá una barra de progreso. Después de eso no hay que esperar.

5. Presione descargar para guardar un archivo WAV a 44,1 kHz.

La generación se ejecuta más rápido que el tiempo real y la reproducción comienza en la primera frase en lugar de esperar a todo el pasaje, por lo que escuchas la voz casi de inmediato. Si desea una toma diferente, edite el texto y ejecútelo nuevamente. No se guarda nada entre ejecuciones y nada se pone en cola detrás de los trabajos de otras personas.

## Texto a voz sin conexión después de la primera descarga

Una vez que el modelo está en la memoria caché de su navegador, la herramienta ya no necesita Internet. Cargue la página, entre en un túnel o en un avión y seguirá produciendo audio. Ese es un efecto secundario de la ejecución local en lugar de una característica que incorporamos.

El costo es el de la descarga de 145 MB. Con una conexión decente de menos de un minuto; con datos móviles conectados, vale la pena esperar por uno mejor. Su navegador decide cuánto tiempo conservar el caché, por lo que si borra los datos del sitio, se recuperarán nuevamente.

Se ejecuta en WebAssembly, por lo que no se requiere tarjeta gráfica ni requiere ninguna extensión ni instalación. Las versiones actuales de Chrome, Edge, Firefox y Safari funcionan, tanto en computadoras de escritorio como en teléfonos. Los teléfonos más antiguos o con poca memoria serán más lentos, porque un modelo de 145 MB tiene que permanecer en la memoria mientras habla.

## Cómo se compara con los sitios de texto a voz que cargan su texto

Los principales sitios gratuitos anuncian cientos de voces y cien idiomas. Pueden hacerlo, porque un centro de datos está haciendo el trabajo. El intercambio es que se les envía su guión, generalmente junto con un registro, un límite de palabras diario, una marca de agua o una cola en las horas punta, y una política de privacidad que debe leer para saber qué sucede con el texto después.

Esta página tiene la forma opuesta. Cuatro voces, 600 personajes a la vez y una espera en la primera visita. A cambio: sin cuenta, sin límite de veces que lo ejecutas, nada que envíe tus palabras a ninguna parte y sigue funcionando con la conexión apagada.

Con otras herramientas locales del navegador, la comparación es más directa. La mayoría de ellos ejecuta Kokoro, que es una descarga más grande y, en forma de navegador, generalmente solo en inglés. Supertonic tiene aproximadamente la mitad del tamaño y lee 31 idiomas con los mismos pesos.

## Texto a voz libre para uso comercial y lo que pide la licencia

Puedes utilizar el audio comercialmente. No hay ningún requisito de atribución a Yaps, ni marca de agua en el archivo ni licencia separada para comprar.

Los pesos del modelo se publican bajo la licencia BigScience Open RAIL M, que permite el uso comercial pero impone condiciones sobre lo que se hace con el resultado. Las importantes, en términos sencillos: no lo utilices para imitar a una persona real específica sin su consentimiento, no hagas pasar el discurso sintético como una grabación genuina de alguien y no lo utilices para engañar, acosar o generar contenido que pueda dañar a las personas. Esas restricciones viajan con el audio, por lo que se aplican a cualquier persona a la que le pases un archivo.

El texto completo está vinculado desde nuestros Términos y es lo suficientemente breve como para leerlo. Si está produciendo una narración, una explicación, un vídeo de demostración, una versión en audio de un artículo o un mensaje de voz para un producto, nada de esto se interpone en su camino.

## Qué no puede hacer esta herramienta y qué agrega la aplicación Yaps

Para ser claro: esta página lee el texto que usted escribe, pega o importa desde un archivo PDF local, EPUB, TXT, Markdown, HTML, RTF o DOCX. No accederá al artículo que estás viendo, a un correo electrónico, a un documento en otra ventana o a una selección en otro lugar de la pantalla. No hay manera de que una página web llegue a esas cosas, y no querríamos una que pudiera hacerlo.

La aplicación de escritorio Yaps es donde eso cambia. Resalte texto en cualquier lugar de su máquina Mac, Windows o Linux, presione un atajo y lo leerá en voz alta con las mismas voces. Incluye el conjunto completo de diez estilos de voz en lugar de cuatro, no tiene límite de 600 caracteres, maneja la lectura de formato largo de un párrafo a la vez y agrega un motor expresivo con clonación de voz. También se ejecuta en el dispositivo, por lo que la historia de privacidad es idéntica.

Si todo lo que necesitas es un clip corto y un archivo WAV, quédate aquí. Es gratis y no es una prueba.

## Cómo utilizar texto a voz en tu navegador

1. ### Escribe, pega o suelta un archivo

Escriba o pegue hasta 600 caracteres, o suelte un archivo PDF, EPUB, TXT, Markdown, HTML, RTF o DOCX. El texto importado permanece en su dispositivo.
2. ### Establecer el idioma

Elige el idioma en el que está escrito tu texto, entre los 31 disponibles. Esto cambia la forma en que la ortografía se convierte en pronunciación, por lo que afecta el resultado más de lo que parece.
3. ### Elige una voz

Elija Nora, Luna, Watson o Keld. Los cuatro leen todos los idiomas admitidos.
4. ### generar el discurso

Presione el botón de hablar. En una primera visita, el motor de voz de 145 MB descarga y almacena en caché; después de esa generación comienza inmediatamente y la reproducción comienza en la primera oración.
5. ### Descarga el WAV

Presione descargar para guardar el audio como un archivo WAV de 44,1 kHz. No hay marca de agua y puede utilizarlo comercialmente bajo las condiciones de la licencia del modelo.

## Preguntas

**¿Mi texto está subido a alguna parte?**

No. El modelo de voz se descarga en su navegador y el audio se genera en su propia máquina. No existe un servidor de síntesis al que enviar su texto. Puedes confirmarlo desconectándote de Internet después de que las voces se hayan almacenado en caché y generando un clip de todos modos.

**¿Necesito una cuenta o una clave API?**

No. No hay registro, ni dirección de correo electrónico, ni clave API ni saldo de crédito. Debido a que la síntesis se ejecuta en su dispositivo, no tenemos ningún costo por palabra para recuperarla, por lo que no hay nada que bloquear.

**¿El texto a voz en el navegador funciona sin conexión?**

Sí, después de la primera visita. El motor de voz de 145 MB debe descargarse una vez y luego su navegador lo almacena en caché. A partir de ese momento, la página produce audio sin conexión alguna. Si borra los datos de su sitio, el modelo se descargará nuevamente.

**¿Por qué la primera carga es una descarga de 145 MB?**

Porque el modelo en sí llega a usted en lugar de permanecer en un servidor. 145 MB es poco para un modelo de voz multilingüe y es único. La mayoría de las alternativas en el navegador ejecutan Kokoro, que es una descarga más grande y, por lo general, solo está en inglés en el navegador.

**¿Qué idiomas son compatibles?**

31: inglés, español, francés, alemán, italiano, portugués, holandés, polaco, ruso, ucraniano, checo, eslovaco, esloveno, croata, búlgaro, rumano, húngaro, griego, sueco, danés, finlandés, estonio, letón, lituano, turco, árabe, hindi, indonesio, vietnamita, coreano y japonés. Todos ellos utilizan el mismo modelo y cualquiera de las cuatro voces.

**¿Qué formato de archivo obtengo?**

Un archivo WAV a 44,1 kHz. Puedes convertirlo a MP3 en cualquier editor si necesitas un archivo más pequeño. No hay marca de agua ni marca en el audio.

**¿Por qué hay un límite de 600 caracteres?**

Por calidad y por paciencia. El modelo es más confiable en pasajes cortos y una sola ejecución larga no proporciona información mientras funciona. Si necesita una lectura extensa, la aplicación de escritorio Yaps la procesa párrafo a párrafo sin límite.

**¿Puedo utilizar el audio comercialmente?**

Sí. Los pesos modelo utilizan la licencia BigScience Open RAIL M, que permite el uso comercial con restricciones en la salida: no imitar a una persona real específica sin consentimiento, no hacer pasar el discurso generado como una grabación real y no hacer uso engañoso o dañino. Los términos completos están vinculados desde nuestra página de Términos.

**¿En qué navegadores funciona?**

Versiones actuales de Chrome, Edge, Firefox y Safari, en computadoras de escritorio y en teléfonos. Se ejecuta en WebAssembly, por lo que no se necesita tarjeta gráfica ni extensión. Los teléfonos más antiguos o con poca memoria generarán más lentamente porque el modelo tiene que permanecer en la memoria.

**¿Puede leer una página web, PDF o documento por mí?**

Puede colocar un archivo PDF, EPUB, TXT, Markdown, HTML, RTF o DOCX local y la página extrae su texto en su dispositivo. No puede acceder a una página web, correo electrónico o documento abierto en otra aplicación; la aplicación de escritorio Yaps lee el texto resaltado desde cualquier aplicación con un atajo de teclado.

**¿Son estas las mismas voces que las de la aplicación Yaps?**

Mismo motor y mismos pesos. Esta página ofrece cuatro estilos de voz, la aplicación ofrece diez, elimina el límite de caracteres y agrega un motor expresivo con clonación de voz.

**¿Cómo se compara esto con las herramientas TTS del navegador basadas en Kokoro?**

Ambos se ejecutan localmente en el navegador, por lo que la posición de privacidad es la misma. La diferencia es la cobertura y el tamaño: Supertonic 3 lee 31 idiomas en aproximadamente 145 MB, mientras que las versiones de navegador de Kokoro suelen ser una descarga más grande y solo en inglés, porque necesitan un diccionario de pronunciación por idioma.

## Más herramientas gratuitas

[Discurso a texto Habla y mira cómo se convierte en texto en tu navegador.](/es/herramientas/voz-a-texto) [Audio a texto¿Ya tienes una grabación? En su lugar, transcriba el archivo.](/es/herramientas/audio-a-texto) [Generador de subtítulos Convierta un vídeo en un archivo .srt o .vtt cronometrado.](/es/herramientas/generador-de-subtitulos) [Todas las herramientas gratuitas Cada Yaps herramienta del navegador, todas ejecutándose en su propia máquina.](/es/herramientas)

empieza a ladrar Mac · Windows · Linux · Android

## leer anything, no solo esta caja.

Resalta texto en cualquier aplicación y escúchalo con un atajo.

[Descargar para Mac](https://github.com/richawo/yaps-releases/releases/latest)

Requiere macOS 13.0+ (se recomienda Apple Silicon)iOS próximamente
