---
title: "Бесплатный онлайн-преобразование текста в речь, 31 язык | Yaps"
description: "Преобразование текста в речь в браузере, которое работает на вашем устройстве. Перетащите PDF-файл, EPUB, TXT, Markdown, RTF, DOCX или вставьте текст. 31 язык, четыре голоса, без загрузки и регистрации. Загрузите WAV бесплатно с сайта Yaps."
canonical: "https://www.yaps.ai/ru/%D0%B8%D0%BD%D1%81%D1%82%D1%80%D1%83%D0%BC%D0%B5%D0%BD%D1%82%D1%8B/%D1%82%D0%B5%D0%BA%D1%81%D1%82-%D0%B2-%D1%80%D0%B5%D1%87%D1%8C"
language: "ru-RU"
---

[Бесплатный инструмент](/ru/инструменты)Автор: Yaps

# Преобразование текста в речь, в 31 languages.

Четыре голоса, 31 язык, одна модель, которая загружается один раз, а затем запускается на вашей вкладке. Вставьте текст или перетащите документ; ничего из того, что вы загружаете, не загружается, потому что ему некуда идти.

Работает на вашем компьютере · Тот же движок, который использует приложение Yaps

Запускаем голоса

ГолосКаждый голос читает каждый язык.

Язык
31 языки, одна модель

Что там должно быть сказано?120 / 600

Перетащите документ, чтобы прочитать

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX — обработано на этом устройстве

Голоса генерируются программой Supertonic 3, © Supertone Inc., по лицензии BigScience Open RAIL-M. Он разрешает коммерческое использование, но ограничивает некоторые виды использования того, что вы создаете, включая выдачу себя за реального человека без его согласия. [Посмотреть условия](/ru/условия).

## Об этом инструменте

## Что на самом деле означает преобразование текста в речь в браузере

Большинство сайтов преобразования текста в речь представляют собой форму. Вы печатаете, ваши слова отправляются на сервер, модель воспроизводит звук, и файл возвращается обратно. Преобразование текста в речь в браузере удаляет средний шаг. Вместо этого модель отправляется вам один раз, и ваш браузер запускает ее.

На этой странице используется Supertonic 3, тот же голосовой движок, что и настольное приложение Yaps. Его размер составляет около 145 МБ, и он загружается как обычная загрузка при первом открытии страницы. Ваш браузер кэширует его. Каждый клип после этого делается на вашем собственном процессоре, поэтому нет ни очереди, ни счетчика кредитов, ни аккаунта.

Есть несколько способов, которыми может говорить браузер, и они не равны. Встроенный API Web Speech заимствует любые голоса, которые есть в вашей операционной системе, поэтому одна и та же страница звучит по-разному на Mac и старом телефоне Android. Облачный API звучит согласованно, но читает все, что вы вставляете. Между ними находится небольшая локальная модель: повсюду один голос, а текст остается на месте.

## Частный текст в речь: без загрузки, без регистрации и без ключа API

Ничто из того, что вы вставляете в поле или загружаете из документа, не покидает ваш компьютер. Это не обещание, которому вы должны верить, это то, как устроена страница. Нет конечной точки, ожидающей получения вашего сообщения.

Проверить это можно секунд за десять. Выключите Wi-Fi, как только голоса загрузятся, и все равно создайте клип. Он все еще говорит, потому что ваш текст никуда не делся. А еще лучше отключите соединение после кэширования модели. Инструмент продолжает говорить.

Эта же структура устраняет обычное трение. Никакой учетной записи, никакого адреса электронной почты, никакого ключа API или уровня бесплатного пользования, пока вы тестируете скрипт. Мы не платим за вывод за слово, поэтому измерять нечего.

Это особенно важно, когда текст не принадлежит вам. Копия под NDA, сценарий клиники, внутренние обучающие материалы, необъявленное название продукта, глава рукописи. Это именно то, что люди вставляют в бесплатный инструмент, не задумываясь о том, куда они попадут.

## Преобразование текста в речь на 31 языке из одной модели

Выберите язык, выберите любой из четырех голосов, и он прочитает. Испанский, немецкий, итальянский, польский, голландский, турецкий, корейский, японский, арабский, хинди, вьетнамский и еще двадцать — все из одного файла размером 145 МБ.

Это необычно для такой маленькой модели. Большинству локальных движков требуется фонемайзер для каждого языка — отдельный компонент, который преобразует правописание в произношение, поэтому каждый новый язык означает поставку еще одного словаря. Вот почему другие инструменты в браузере либо только на английском языке, либо на английском плюс пара дополнительных функций. Supertonic напрямую определяет произношение по правописанию, поэтому один набор весов покрывает все.

Полный список: английский, испанский, французский, немецкий, итальянский, португальский, голландский, польский, русский, украинский, чешский, словацкий, словенский, хорватский, болгарский, румынский, венгерский, греческий, шведский, датский, финский, эстонский, латышский, литовский, турецкий, арабский, хинди, индонезийский, вьетнамский, корейский, японский.

Качество неодинаково во всех 31 странах. Английский и более крупные европейские языки являются самыми сильными. Установите селектор языка в соответствии с вашим текстом, потому что от этого зависит чтение.

## Как превратить текст в файл WAV в браузере

1. Вставьте или введите свой текст или перетащите файл PDF, EPUB, TXT, Markdown, HTML, RTF или DOCX в программу чтения. Импортированные документы анализируются на вашем устройстве. Ограничение составляет 600 символов за один проход, что примерно соответствует короткому абзацу или 20 секундам речи.

2. Выберите язык текста. Это меняет способ чтения орфографии, поэтому это имеет большее значение, чем кажется.

3. Выберите голос. Их здесь четверо: Нора, Луна, Ватсон и Келд. Все четверо читают все 31 язык.

4. Нажмите кнопку разговора. При первом посещении сначала загружается движок размером 145 МБ, и вы увидите индикатор выполнения. После этого ждать не приходится.

5. Нажмите «Загрузить», чтобы сохранить файл WAV с частотой 44,1 кГц.

Генерация происходит быстрее, чем в реальном времени, а воспроизведение начинается с первого предложения, а не ждет всего отрывка, поэтому вы слышите голос почти сразу. Если вам нужен другой вариант, отредактируйте текст и запустите его еще раз. Между запусками ничего не сохраняется и ничего не ставится в очередь после заданий других людей.

## Преобразование текста в речь в автономном режиме после первой загрузки

Как только модель окажется в кеше вашего браузера, инструменту больше не нужен Интернет. Загрузите страницу, зайдите в туннель или в самолет, а звук все равно воспроизводится. Это побочный эффект локальной работы, а не функция, которую мы включили.

Стоимость указана за единовременную загрузку размером 145 МБ. При приличном соединении менее минуты; по привязным мобильным данным стоит подождать лучшего. Ваш браузер решает, как долго хранить кеш, поэтому, если вы очистите данные сайта, они будут получены снова.

Он работает на WebAssembly, поэтому не требуется видеокарта, а также не требуется никаких расширений или установки. Текущие версии Chrome, Edge, Firefox и Safari работают как на настольных компьютерах, так и на телефонах. Старые телефоны или телефоны с малым объемом памяти будут работать медленнее, поскольку модели с объемом памяти 145 МБ приходится находиться в памяти, пока они говорят.

## Чем он отличается от сайтов преобразования текста в речь, которые загружают ваш текст

Основные бесплатные сайты рекламируют сотни голосов и сотни языков. Могут, потому что всю работу выполняет центр обработки данных. Суть в том, что ваш сценарий отправляется им, обычно вместе с регистрацией, ежедневным ограничением слов, водяным знаком или очередью в часы пик, а также политикой конфиденциальности, которую вы должны прочитать, чтобы узнать, что происходит с текстом потом.

Эта страница имеет противоположную форму. Четыре голоса, 600 символов одновременно и ожидание при первом же посещении. Взамен: никакой учетной записи, никакого ограничения на количество запусков, ничего, что куда-то отправляло бы ваши слова, и оно продолжало работать даже при отключенном соединении.

С другими локальными браузерными инструментами сравнение более прямое. Большинство из них используют Kokoro, более крупную версию программы, которая в браузерной форме обычно работает только на английском языке. Supertonic примерно в два раза меньше и читает 31 язык при том же весе.

## Преобразование текста в речь для коммерческого использования и что требует лицензия

Вы можете использовать аудио в коммерческих целях. Для Yaps нет требований к указанию авторства, нет водяных знаков в файле и нет отдельной лицензии для покупки.

Веса моделей выпускаются по лицензии BigScience Open RAIL M, которая разрешает коммерческое использование, но налагает условия на то, что вы делаете с выходными данными. Важные из них простыми словами: не используйте его для имитации конкретного реального человека без его согласия, не выдавайте синтетическую речь за подлинную запись кого-либо и не используйте ее для обмана, преследования или создания контента, который может нанести вред людям. Эти ограничения распространяются на аудио, поэтому они применяются ко всем, кому вы передаете файл.

Полный текст приведен в наших Условиях по ссылке, и он достаточно короткий, чтобы его можно было прочитать. Если вы создаете повествование, пояснение, демонстрационное видео, аудиоверсию статьи или голосовую подсказку для продукта, ничто из этого вам не помешает.

## Чего этот инструмент не может и что добавляет приложение Yaps

Честно говоря: эта страница читает текст, который вы вводите, вставляете или импортируете из локального PDF-файла, EPUB, TXT, Markdown, HTML, RTF или DOCX файла. Он не затронет статью, которую вы просматриваете, электронное письмо, документ в другом окне или выделенный фрагмент в другом месте на экране. Веб-страница не может достичь этих целей, и нам не нужна такая возможность.

В настольном приложении Yaps ситуация меняется. Выделите текст в любом месте вашего компьютера Mac, Windows или Linux, нажмите ярлык, и он прочитает его вслух тем же голосом. Он содержит полный набор из десяти голосовых стилей вместо четырех, не имеет ограничения на 600 символов, поддерживает чтение длинных форм по абзацу за раз и добавляет выразительный движок с голосовым клонированием. Он также работает на устройстве, поэтому история конфиденциальности идентична.

Если все, что вам нужно, это короткий клип и файл WAV, оставайтесь здесь. Это бесплатно и не является пробной версией.

## Как использовать преобразование текста в речь в вашем браузере

1. ### Введите, вставьте или перетащите файл

Введите или вставьте до 600 символов или перетащите PDF-файл, EPUB, TXT, Markdown, HTML, RTF или DOCX файл. Импортированный текст останется на вашем устройстве.
2. ### Установить язык

Выберите язык, на котором написан ваш текст, из 31 доступного. Это меняет способ преобразования правописания в произношение, поэтому влияет на результат больше, чем кажется.
3. ### Выберите голос

Выберите Нору, Луну, Ватсона или Келда. Все четверо читают все поддерживаемые языки.
4. ### Генерация речи

Нажмите кнопку разговора. При первом посещении загружается и кэшируется голосовой движок размером 145 МБ; после этого сразу начинается генерация и воспроизведение начинается с первого предложения.
5. ### Загрузите WAV

Нажмите «Загрузить», чтобы сохранить звук в формате WAV с частотой 44,1 кГц. Водяной знак отсутствует, и вы можете использовать его в коммерческих целях на условиях типовой лицензии.

## Вопросы

**Мой текст где-нибудь загружен?**

Нет. Модель голоса загружается в ваш браузер, а звук создается на вашем компьютере. Не существует сервера синтеза для отправки вашего текста. Вы можете подтвердить это, отключившись от Интернета после кэширования голосов и все равно создав клип.

**Нужна ли мне учетная запись или ключ API?**

Нет. Здесь нет регистрации, адреса электронной почты, ключа API и кредитного баланса. Поскольку синтез выполняется на вашем устройстве, нам не нужно платить за каждое слово для восстановления, поэтому нечего шлюзовать.

**Работает ли преобразование текста в речь в браузере в автономном режиме?**

Да, после первого посещения. Голосовой движок размером 145 МБ необходимо загрузить один раз, а затем ваш браузер кеширует его. С этого момента на странице воспроизводится звук вообще без подключения. Если вы очистите данные своего сайта, модель загрузится снова.

**Почему первая загрузка занимает 145 МБ?**

Потому что модель сама приходит к вам, а не остается на сервере. 145 МБ — это мало для многоязычной голосовой модели, и она уникальна. Большинство альтернатив в браузере используют Kokoro, который является более крупной загрузкой и обычно работает только на английском языке в браузере.

**Какие языки поддерживаются?**

31: английский, испанский, французский, немецкий, итальянский, португальский, голландский, польский, русский, украинский, чешский, словацкий, словенский, хорватский, болгарский, румынский, венгерский, греческий, шведский, датский, финский, эстонский, латвийский, литовский, турецкий, арабский, хинди, индонезийский, вьетнамский, корейский и японский. Все они используют одну и ту же модель и любой из четырех голосов.

**Какой формат файла я получу?**

WAV-файл с частотой 44,1 кГц. Вы можете конвертировать его в MP3 в любом редакторе, если вам нужен файл меньшего размера. В аудио нет водяных знаков и фирменного оформления.

**Почему существует ограничение в 600 символов?**

За качество и за терпение. Модель более надежна на коротких проходах, а длинный одиночный проход не дает никакой обратной связи, пока она работает. Если вам нужно чтение длинных форм, настольное приложение Yaps обрабатывает их по абзацу без ограничения.

**Могу ли я использовать аудио в коммерческих целях?**

Да. Веса модели используют лицензию BigScience Open RAIL M, которая разрешает коммерческое использование с ограничениями на выходные данные: нельзя имитировать конкретного реального человека без согласия, не выдавать сгенерированную речь за реальную запись, а также не использовать в целях обмана или вреда. Полные условия доступны на нашей странице «Условия».

**В каких браузерах это работает?**

Текущие версии Chrome, Edge, Firefox и Safari для настольных компьютеров и телефонов. Он работает на WebAssembly, поэтому не требуется ни видеокарта, ни расширение. Старые телефоны или телефоны с малым объемом памяти будут генерироваться медленнее, поскольку модель должна оставаться в памяти.

**Может ли он прочитать за меня веб-страницу, PDF-файл или документ?**

Вы можете перетащить локальный PDF-файл, EPUB, TXT, Markdown, HTML, RTF или DOCX файл, и страница извлечет его текст на ваше устройство. Он не может получить доступ к веб-странице, электронной почте или документу, открытому в другом приложении; настольное приложение Yaps читает выделенный текст из любого приложения с помощью сочетания клавиш.

**Это те же голоса, что и в приложении Yaps?**

Тот же двигатель и тот же вес. На этой странице представлены четыре стиля голоса, в приложении — десять, убрано ограничение на количество символов и добавлен выразительный движок с клонированием голоса.

**Как это соотносится с инструментами TTS браузера на основе Kokoro?**

Оба запускаются локально в браузере, поэтому положение конфиденциальности одинаковое. Разница заключается в охвате и размере: Supertonic 3 читает 31 язык из примерно 145 МБ, тогда как браузерные сборки Kokoro обычно загружаются больше и только на английском языке, потому что им нужен словарь произношения для каждого языка.

## Больше бесплатных инструментов

[Речь в текстГоворите и наблюдайте, как оно превращается в текст в вашем браузере.](/ru/инструменты/речь-в-текст) [Аудио в текстУже есть запись? Вместо этого перепишите файл.](/ru/инструменты/аудио-в-текст) [Генератор субтитровПревратите видео в синхронизированный файл .srt или .vtt.](/ru/инструменты/генератор-субтитров) [Все бесплатные инструментыВсе инструменты браузера Yaps работают на вашем компьютере.](/ru/инструменты)

Начни тявкатьMac · Windows · Linux · Android

## Читать anything, а не только эта коробка.

Выделите текст в любом приложении и прослушайте его с помощью одного ярлыка.

[Скачать для Mac](https://github.com/richawo/yaps-releases/releases/latest)

Требуется macOS 13.0+ (рекомендуется Apple Silicon)iOS скоро появится
