---
title: "Bezpłatny tekst na mowę online, 31 języków | Yaps"
description: "Tekst na mowę w przeglądarce, który działa na Twoim urządzeniu. Upuść plik PDF, EPUB, TXT, Markdown, RTF, DOCX lub wklej tekst. 31 języków, cztery głosy, bez przesyłania i bez rejestracji. Pobierz WAV bezpłatnie z Yaps."
canonical: "https://www.yaps.ai/pl/narzedzia/tekst-na-mowe"
language: "pl-PL"
---

[Bezpłatne narzędzie](/pl/narzedzia)Do Yaps

# Tekst na mowę, w 31 languages.

Cztery głosy, 31 języków, jeden model, który można pobrać raz, a następnie uruchomić na karcie. Wklej tekst lub upuść dokument; nic, co ładujesz, nie jest przesyłane, ponieważ nie ma dokąd pójść.

Działa na Twoim komputerze · Ten sam silnik, z którego korzysta aplikacja Yaps.

Zaczynam od głosy w górę

Głos Każdy głos czyta w każdym języku.

Język
31 języki, jeden model

Co powinno być napisane?120 / 600

Upuść dokument do przeczytania

PDF, EPUB, TXT, Markdown, HTML, RTF, DOCX – przetwarzane na tym urządzeniu

Głosy są generowane przez Supertonic 3, © Supertone Inc., na licencji BigScience Open RAIL-M. Pozwala na wykorzystanie komercyjne, ale ogranicza niektóre sposoby wykorzystania tego, co generujesz, w tym podszywanie się pod prawdziwą osobę bez jej zgody. [Zobacz warunki](/pl/warunki).

## O tym narzędziu

## Co właściwie oznacza zamiana tekstu na mowę w przeglądarce

Większość witryn zajmujących się zamianą tekstu na mowę to formularz. Piszesz, Twoje słowa trafiają na serwer, tam model generuje dźwięk i plik wraca. Zamiana tekstu na mowę w przeglądarce usuwa środkowy krok. Zamiast tego model jest wysyłany do Ciebie jednorazowo i uruchamiany przez Twoją przeglądarkę.

Ta strona wykorzystuje Supertonic 3, ten sam silnik głosowy, który dostarcza aplikacja komputerowa Yaps. Zajmuje około 145 MB i jest pobierany normalnie przy pierwszym otwarciu strony. Twoja przeglądarka buforuje je. Każdy kolejny klip jest tworzony na Twoim własnym procesorze, dlatego nie ma kolejki, licznika kredytów ani konta.

Przeglądarka może komunikować się na kilka sposobów, ale nie są one sobie równe. Wbudowany interfejs Web Speech API pożycza głosy dostępne w systemie operacyjnym, dzięki czemu ta sama strona brzmi inaczej na komputerze Mac i na starym telefonie z Androidem. Interfejs API chmury brzmi spójnie, ale czyta wszystko, co wkleisz. Mały lokalny model znajduje się pomiędzy nimi: jeden głos wszędzie, a tekst pozostaje niezmieniony.

## Prywatny tekst na mowę: bez przesyłania, bez rejestracji i bez klucza API

Nic, co wkleisz do pudełka lub załadujesz z dokumentu, nie opuści Twojej maszyny. To nie jest obietnica, którą musisz przyjąć na wiarę, tak jest zbudowana strona. Żaden punkt końcowy nie oczekuje na odbiór Twojego tekstu.

Możesz to sprawdzić w około dziesięć sekund. Wyłącz Wi-Fi po pobraniu głosów i mimo to wygeneruj klip. Nadal mówi, ponieważ Twój tekst nigdy donikąd nie szedł. Jeszcze lepiej, wyłącz połączenie po zapisaniu modelu w pamięci podręcznej. Narzędzie wciąż mówi.

Ta sama struktura eliminuje zwykłe tarcie. Żadnego konta, żadnego adresu e-mail, żadnego klucza API, żadnego darmowego poziomu zaznaczającego się podczas testowania skryptu. Nie płacimy za wnioskowanie za słowo, więc nie ma czego mierzyć.

Ma to największe znaczenie, gdy tekst nie należy do Ciebie i możesz go rozdać. Kopia w ramach NDA, scenariusz kliniki, wewnętrzne materiały szkoleniowe, niezapowiedziana nazwa produktu, rozdział rękopisu. To są dokładnie te rzeczy, które ludzie wklejają do bezpłatnego narzędzia, nie myśląc o tym, gdzie wylądują.

## Tekst na mowę w 31 językach z jednego modelu

Wybierz język, wybierz dowolny z czterech głosów, a on przeczyta. Hiszpański, niemiecki, włoski, polski, holenderski, turecki, koreański, japoński, arabski, hindi, wietnamski i dwadzieścia innych, wszystko z tego samego pliku 145 MB.

To niezwykłe w przypadku tak małego modelu. Większość lokalnych wyszukiwarek potrzebuje fonemizera dla każdego języka, osobnego komponentu zamieniającego pisownię na wymowę, więc każdy nowy język oznacza konieczność dostarczenia kolejnego słownika. Z tego powodu pozostałe narzędzia dostępne w przeglądarce są dostępne wyłącznie w języku angielskim lub w języku angielskim i z kilkoma dodatkami. Supertonic sprawdza wymowę bezpośrednio na podstawie pisowni, więc jeden zestaw wag pokrywa wszystko.

Pełna lista: angielski, hiszpański, francuski, niemiecki, włoski, portugalski, holenderski, polski, rosyjski, ukraiński, czeski, słowacki, słoweński, chorwacki, bułgarski, rumuński, węgierski, grecki, szwedzki, duński, fiński, estoński, łotewski, litewski, turecki, arabski, hindi, indonezyjski, wietnamski, koreański, japoński.

Jakość nie jest identyczna we wszystkich 31. Angielski i większe języki europejskie są najsilniejsze. Ustaw selektor języka tak, aby pasował do Twojego tekstu, ponieważ od tego zależy odczyt.

## Jak zamienić tekst na plik WAV w przeglądarce

1. Wklej lub wpisz tekst albo upuść plik PDF, EPUB, TXT, Markdown, HTML, RTF lub DOCX do czytnika. Zaimportowane dokumenty są analizowane na Twoim urządzeniu. Limit wynosi 600 znaków na przebieg, co odpowiada mniej więcej krótkiemu akapitowi lub 20 sekundom mowy.

2. Wybierz język tekstu. Zmienia to sposób odczytywania pisowni, więc ma większe znaczenie niż się wydaje.

3. Wybierz głos. Jest ich tutaj czterech: Nora, Luna, Watson i Keld. Wszyscy czterej czytają we wszystkich 31 językach.

4. Naciśnij przycisk mówienia. Podczas pierwszej wizyty najpierw pobierany jest silnik o rozmiarze 145 MB i widoczny jest pasek postępu. Potem nie ma już czekania.

5. Naciśnij przycisk pobierania, aby zapisać plik WAV w częstotliwości 44,1 kHz.

Generowanie przebiega szybciej niż w czasie rzeczywistym, a odtwarzanie rozpoczyna się od pierwszego zdania, a nie czeka na cały fragment, dzięki czemu głos słychać niemal natychmiast. Jeśli chcesz innego ujęcia, edytuj tekst i uruchom go ponownie. Nic nie jest zapisywane pomiędzy uruchomieniami i nic nie jest umieszczane w kolejce za zadaniami innych osób.

## Tekst na mowę offline po pierwszym pobraniu

Gdy model znajdzie się w pamięci podręcznej przeglądarki, narzędzie nie będzie już potrzebowało Internetu. Załaduj stronę, wejdź do tunelu lub na samolot, a dźwięk nadal będzie odtwarzany. To raczej efekt uboczny działania lokalnego niż funkcja, na której się skupiliśmy.

Koszt to jednorazowe pobranie 145MB. Na przyzwoitym łączu trwającym krócej niż minutę; na mobilnej transmisji danych na tetheringu warto poczekać na lepszą. Twoja przeglądarka decyduje, jak długo ma przechowywać pamięć podręczną, więc jeśli wyczyścisz dane witryny, pobranie zostanie wznowione.

Działa na WebAssembly, więc nie jest wymagana żadna karta graficzna i nie jest wymagane żadne rozszerzenie ani instalacja. Aktualne wersje przeglądarek Chrome, Edge, Firefox i Safari działają na komputerach stacjonarnych i telefonach. Starsze telefony lub telefony z małą ilością pamięci będą wolniejsze, ponieważ model 145MB musi znajdować się w pamięci podczas mówienia.

## Porównanie z witrynami zajmującymi się zamianą tekstu na mowę, które przesyłają Twój tekst

Główne bezpłatne witryny reklamują setki głosów i sto języków. Mogą, ponieważ centrum danych wykonuje całą pracę. Rzecz w tym, że wysyłany jest do nich Twój skrypt, zwykle wraz z rejestracją, dzienną czapką słowa, znakiem wodnym lub kolejką w godzinach szczytu oraz polityką prywatności, którą musisz przeczytać, aby dowiedzieć się, co później stanie się z tekstem.

Ta strona ma odwrotny kształt. Cztery głosy, 600 znaków na raz i oczekiwanie na pierwszą wizytę. W zamian: brak konta, brak limitu liczby uruchomień, nic, co powoduje, że Twoje słowa dokądkolwiek zostaną wysłane, i nadal działa przy wyłączonym połączeniu.

W porównaniu z innymi lokalnymi narzędziami dostępnymi w przeglądarce porównanie jest bardziej bezpośrednie. Większość z nich uruchamia Kokoro, które jest większym plikiem do pobrania iw formie przeglądarki zwykle dostępne jest tylko w języku angielskim. Supertonic jest mniej więcej o połowę mniejszy i odczytuje 31 języków przy tej samej wadze.

## Dowolny tekst na mowę do użytku komercyjnego i wymagania licencji

Możesz używać dźwięku komercyjnie. Nie ma wymogu przypisania autorstwa Yaps, znaku wodnego w pliku ani osobnej licencji na zakup.

Ciężary modeli są udostępniane na podstawie licencji BigScience Open RAIL M, która zezwala na wykorzystanie komercyjne, ale wiąże się z warunkami dotyczącymi tego, co zrobisz z danymi wyjściowymi. Najważniejsze w prostych słowach: nie używaj go do naśladowania konkretnej prawdziwej osoby bez jej zgody, nie przedstawiaj mowy syntetycznej jako autentycznego nagrania czyjejś osoby i nie używaj jej do oszukiwania, nękania lub generowania treści, które mogłyby zaszkodzić ludziom. Ograniczenia te są przesyłane wraz z dźwiękiem, więc mają zastosowanie do każdej osoby, której przekazujesz plik.

Link do pełnego tekstu znajduje się w naszych Warunkach i jest na tyle krótki, że można go przeczytać. Jeśli tworzysz narrację, objaśnienie, wideo demonstracyjne, wersję audio artykułu lub komunikat głosowy dotyczący produktu, nic nie stoi na Twojej drodze.

## Czego nie potrafi to narzędzie i co dodaje aplikacja Yaps.

Mówiąc wprost: ta strona czyta tekst, który wpisujesz, wklejasz lub importujesz z lokalnego pliku PDF, EPUB, TXT, Markdown, HTML, RTF lub DOCX. Nie dotrze do artykułu, na który patrzysz, wiadomości e-mail, dokumentu w innym oknie ani zaznaczenia w innym miejscu na ekranie. Strona internetowa nie ma możliwości dotarcia do tych rzeczy i nie chcielibyśmy takiej, która by to umożliwiała.

Aplikacja komputerowa Yaps to miejsce, w którym to się zmienia. Zaznacz tekst w dowolnym miejscu na komputerze Mac, Windows lub Linux, naciśnij skrót, a czytnik odczyta go na głos tymi samymi głosami. Obsługuje pełny zestaw dziesięciu stylów głosu zamiast czterech, nie ma limitu 600 znaków, obsługuje długie formy czytania akapitu na raz i dodaje silnik ekspresji z klonowaniem głosu. Działa również na urządzeniu, więc historia prywatności jest identyczna.

Jeśli potrzebujesz tylko krótkiego klipu i pliku WAV, zostań tutaj. Jest bezpłatny i nie jest to okres próbny.

## Jak korzystać z zamiany tekstu na mowę w przeglądarce

1. ### Wpisz, wklej lub upuść plik

Wpisz lub wklej maksymalnie 600 znaków albo upuść plik PDF, EPUB, TXT, Markdown, HTML, RTF lub DOCX. Zaimportowany tekst pozostaje na Twoim urządzeniu.
2. ### Ustaw język

Wybierz język, w którym napisany jest Twój tekst, spośród 31 dostępnych. Zmienia to sposób, w jaki pisownia przekształca się w wymowę, więc wpływa na wynik bardziej, niż się wydaje.
3. ### Wybierz głos

Wybierz Norę, Lunę, Watsona lub Kelda. Wszystkie cztery czytają każdy obsługiwany język.
4. ### Wygeneruj mowę

Naciśnij przycisk mówienia. Podczas pierwszej wizyty silnik głosowy pobiera 145MB i buforuje; po tym generacja rozpoczyna się od razu, a odtwarzanie rozpoczyna się od pierwszego zdania.
5. ### Pobierz plik WAV

Naciśnij przycisk Pobierz, aby zapisać dźwięk jako plik WAV o częstotliwości 44,1 kHz. Nie ma znaku wodnego i można go używać komercyjnie zgodnie z warunkami licencji modelowej.

## Pytania

**Czy mój tekst jest gdzieś przesłany?**

Nie. Model głosu jest pobierany do Twojej przeglądarki, a dźwięk jest generowany na Twoim komputerze. Nie ma serwera syntezy, do którego można wysłać tekst. Możesz to potwierdzić, odłączając się od Internetu po zapisaniu głosów w pamięci podręcznej i mimo to generując klip.

**Czy potrzebuję konta lub klucza API?**

Nie. Nie ma rejestracji, adresu e-mail, klucza API ani salda kredytowego. Ponieważ synteza odbywa się na Twoim urządzeniu, nie musimy płacić za słowo, aby je odzyskać, więc nie ma nic do stracenia.

**Czy funkcja zamiany tekstu na mowę w przeglądarce działa w trybie offline?**

Tak, już po pierwszej wizycie. Silnik głosowy o wielkości 145 MB należy pobrać raz, a następnie przeglądarka zapisuje go w pamięci podręcznej. Od tego momentu strona odtwarza dźwięk bez żadnego połączenia. Jeśli wyczyścisz dane witryny, model zostanie pobrany ponownie.

**Dlaczego pierwsze ładowanie zajmuje 145 MB?**

Ponieważ sam model przychodzi do Ciebie, a nie zostaje na serwerze. 145 MB to mało jak na wielojęzyczny model głosu i jest to jednorazowy przypadek. Większość alternatyw w przeglądarce uruchamia Kokoro, które jest większym plikiem do pobrania i zazwyczaj w języku angielskim tylko w przeglądarce.

**Jakie języki są obsługiwane?**

31: angielski, hiszpański, francuski, niemiecki, włoski, portugalski, holenderski, polski, rosyjski, ukraiński, czeski, słowacki, słoweński, chorwacki, bułgarski, rumuński, węgierski, grecki, szwedzki, duński, fiński, estoński, łotewski, litewski, turecki, arabski, hindi, indonezyjski, wietnamski, koreański i japoński. Wszystkie korzystają z tego samego modelu i dowolnego z czterech głosów.

**Jaki format pliku otrzymuję?**

Plik WAV o częstotliwości 44,1 kHz. Jeśli potrzebujesz mniejszego pliku, możesz przekonwertować go na MP3 w dowolnym edytorze. W dźwięku nie ma znaku wodnego ani brandingu.

**Dlaczego istnieje limit 600 znaków?**

Za jakość i cierpliwość. Model jest bardziej niezawodny w przypadku krótkich fragmentów, a długi pojedynczy przebieg nie daje żadnej informacji zwrotnej podczas działania. Jeśli potrzebujesz czytać długie formularze, aplikacja komputerowa Yaps obsługuje to akapit po akapicie, bez górnego limitu.

**Czy mogę wykorzystać dźwięk komercyjnie?**

Tak. Wagi modeli korzystają z licencji BigScience Open RAIL M, która umożliwia wykorzystanie komercyjne z ograniczeniami dotyczącymi wyników: zakaz imitowania konkretnej prawdziwej osoby bez zgody, zakaz przekazywania wygenerowanej mowy jako prawdziwego nagrania oraz zakaz oszukańczego lub szkodliwego użycia. Link do pełnych warunków znajduje się na naszej stronie Warunki.

**W jakich przeglądarkach to działa?**

Aktualne wersje przeglądarek Chrome, Edge, Firefox i Safari na komputerach stacjonarnych i telefonach. Działa na WebAssembly, więc nie jest potrzebna żadna karta graficzna ani rozszerzenie. Starsze telefony lub telefony z małą ilością pamięci będą generować wolniej, ponieważ model musi pozostać w pamięci.

**Czy może odczytać za mnie stronę internetową, plik PDF lub dokument?**

Możesz upuścić lokalny plik PDF, EPUB, TXT, Markdown, HTML, RTF lub DOCX, a strona wyodrębni jego tekst na Twoim urządzeniu. Nie może dotrzeć do strony internetowej, wiadomości e-mail lub dokumentu otwartego w innej aplikacji; aplikacja komputerowa Yaps odczytuje zaznaczony tekst z dowolnej aplikacji za pomocą skrótu klawiaturowego.

**Czy to te same głosy, co w aplikacji Yaps?**

Ten sam silnik i ta sama masa. Ta strona oferuje cztery style głosu, aplikacja oferuje dziesięć, usuwa limit znaków i dodaje silnik ekspresji z klonowaniem głosu.

**Jak to się ma do narzędzi TTS w przeglądarce opartych na Kokoro?**

Obydwa działają lokalnie w przeglądarce, więc poziom prywatności jest taki sam. Różnica polega na zasięgu i rozmiarze: Supertonic 3 odczytuje 31 języków z około 145 MB, gdzie wersje przeglądarki Kokoro są zwykle do pobrania w większym rozmiarze i tylko w języku angielskim, ponieważ wymagają słownika wymowy dla każdego języka.

## Więcej darmowych narzędzi

[Mowa na tekst Rozmawiaj i patrz, jak zmienia się w tekst w Twojej przeglądarce.](/pl/narzedzia/mowa-na-tekst) [Dźwięk do tekstu Masz już nagranie? Zamiast tego dokonaj transkrypcji pliku.](/pl/narzedzia/audio-na-tekst) [Generator napisów Zamień wideo w plik .srt lub .vtt z określonym czasem.](/pl/narzedzia/generator-napisow) [Wszystkie bezpłatne narzędzia Każde Yaps narzędzie przeglądarki, wszystkie działające na Twoim komputerze.](/pl/narzedzia)

Zacznij szczekaćMac · Windows · Linux · Android

## Przeczytaj anything, nie tylko to pudełko.

Zaznacz tekst w dowolnej aplikacji i odsłuchaj go za pomocą jednego skrótu.

[Pobierz na komputer Mac](https://github.com/richawo/yaps-releases/releases/latest)

Wymaga macOS 13.0+ (zalecane Apple Silicon)Już wkrótce iOS
