---
title: "無料のオンライン テキスト読み上げ、31 言語 | Yaps"
description: "デバイス上で実行されるブラウザ内テキスト読み上げ。 PDF、EPUB、TXT、Markdown、RTF、DOCX をドロップするか、テキストを貼り付けます。 31 言語、4 つの音声、アップロードやサインアップは不要です。 Yaps から WAV を無料でダウンロードします。"
canonical: "https://www.yaps.ai/ja/%E3%83%84%E3%83%BC%E3%83%AB/%E3%83%86%E3%82%AD%E3%82%B9%E3%83%88%E8%AA%AD%E3%81%BF%E4%B8%8A%E3%81%92"
language: "ja-JP"
---

[無料ツール](/ja/ツール)Yaps によって

# テキスト読み上げ、31 年 languages.

4 つの音声、31 の言語、1 つのモデルを一度ダウンロードするとタブ内で実行できます。テキストを貼り付けるか、ドキュメントをドロップします。ロードする場所がないため、ロードしたものはアップロードされません。

あなたのマシン上で実行されます · Yaps アプリが使用するのと同じエンジン

声 を起動中

声あらゆる声があらゆる言語を読み上げます。

言語
31 言語、1 つのモデル

何と言うべきでしょうか？120 / 600

文書をドロップして読む

PDF、EPUB、TXT、Markdown、HTML、RTF、DOCX - このデバイスで処理されます

音声は、BigScience Open RAIL-M ライセンスに基づいて Supertonic 3 (© Supertone Inc.) によって生成されます。商用利用は許可されていますが、同意なしに実在の人物になりすますなど、生成したものの一部の使用が制限されます。 [規約を参照](/ja/利用規約).

## このツールについて

## ブラウザ内のテキスト読み上げの実際の意味

ほとんどのテキスト読み上げサイトはフォームです。あなたが入力すると、あなたの言葉がサーバーに送信され、そこにあるモデルが音声を作り、ファイルが戻ってきます。ブラウザ内のテキスト読み上げでは、中間のステップが削除されます。代わりにモデルが 1 回だけ送信され、ブラウザーでそれが実行されます。

このページでは、Yaps デスクトップ アプリに付属しているのと同じ音声エンジンである Supertonic 3 を使用しています。サイズは約 145 MB で、最初にページを開いたときに通常のダウンロードとして到着します。ブラウザがそれをキャッシュします。それ以降のすべてのクリップは独自のプロセッサーで作成されるため、キュー、クレジット カウンター、アカウントは存在しません。

ブラウザが話す方法はいくつかありますが、それらは同じではありません。組み込みの Web Speech API は、オペレーティング システムが持つあらゆる音声を借用するため、Mac と古い Android スマートフォンでは同じページが異なって聞こえます。クラウド API は一貫しているように見えますが、貼り付けたものをすべて読み取ります。小さなローカル モデルが 2 つの間に位置します。どこにでも 1 つの音声があり、テキストは固定されます。

## プライベートテキスト読み上げ: アップロード、サインアップ、API キーなし

ボックスに貼り付けたものやドキュメントから読み込んだものは、マシンの外に残りません。それはあなたが信じなければならない約束ではなく、ページがどのように構築されるかです。テキストの受信を待っているエンドポイントはありません。

10秒ほどで確認できます。音声がダウンロードされたら Wi-Fi をオフにし、とにかくクリップを生成します。あなたのテキストは決してどこにも行かないので、それはまだ話します。さらに良いのは、モデルがキャッシュされた後、接続をオフにすることです。ツールは話し続けます。

同じ構造により、通常の摩擦が解消されます。スクリプトのテスト中にアカウント、電子メール アドレス、API キー、無料利用枠が制限されることはありません。単語ごとの推論に料金を支払わないため、計測するものは何もありません。

テキストが自分のものではない場合、それが最も重要です。 NDA に基づいて、診療台本、社内トレーニング資料、未発表の製品名、原稿の章をコピーします。これらはまさに人々がどこに着地するかを考えずに無料ツールに貼り付けるものです。

## 1 つのモデルで 31 言語のテキスト読み上げが可能

言語を選択し、4 つの音声のいずれかを選択すると、読み上げられます。スペイン語、ドイツ語、イタリア語、ポーランド語、オランダ語、トルコ語、韓国語、日本語、アラビア語、ヒンディー語、ベトナム語、その他 20 語がすべて同じ 145 MB ファイルに含まれています。

これほど小さいモデルでは珍しいことです。ほとんどのローカル エンジンは、言語ごとにフォンマイザー、つまりスペルを発音に変換する個別のコンポーネントを必要とするため、新しい言語ごとに別の辞書が提供されることを意味します。他のブラウザ内ツールが英語のみ、または英語といくつかの追加機能が含まれているのはこのためです。 Supertonic はスペルから直接発音を計算するため、1 セットのウェイトで多くの作業をカバーします。

完全なリスト: 英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語、ポーランド語、ロシア語、ウクライナ語、チェコ語、スロバキア語、スロベニア語、クロアチア語、ブルガリア語、ルーマニア語、ハンガリー語、ギリシャ語、スウェーデン語、デンマーク語、フィンランド語、エストニア語、ラトビア語、リトアニア語、トルコ語、アラビア語、ヒンディー語、インドネシア語、ベトナム語、韓国語、日本語。

品質はすべての 31 言語で同じではありません。英語とヨーロッパの主要言語が最も強力です。読み方はテキストに依存するため、テキストに一致するように言語セレクターを設定します。

## ブラウザでテキストを WAV ファイルに変換する方法

1. テキストを貼り付けるか入力するか、PDF、EPUB、TXT、Markdown、HTML、RTF、または DOCX ファイルをリーダーにドロップします。インポートされたドキュメントはデバイス上で解析されます。制限は 1 回あたり 600 文字で、これはおよそ短い段落または 20 秒のスピーチに相当します。

2. テキストの言語を選択します。これによりスペルの読み方が変わるため、見た目よりも重要です。

3. 音声を選択します。ここにはノラ、ルナ、ワトソン、ケルドの4人がいます。 4 人全員が 31 言語すべてを読みました。

4. 発言ボタンを押します。初めてアクセスすると、最初に 145MB エンジンがダウンロードされ、進行状況バーが表示されます。その後は待ち時間はありません。

5. ダウンロードを押して、44.1kHz の WAV ファイルを保存します。

生成はリアルタイムよりも高速に実行され、パッセージ全体を待つのではなく最初の文から再生が開始されるため、ほぼすぐに音声が聞こえます。別のテイクが必要な場合は、テキストを編集して再実行します。実行の間に何も保存されず、他の人のジョブの後ろに何もキューに入れられません。

## 最初のダウンロード後のオフラインテキスト読み上げ

モデルがブラウザのキャッシュに保存されると、ツールはインターネットを必要としなくなります。ページをロードし、トンネルや飛行機に乗り込んでも、依然として音声が生成されます。これは、私たちが追加した機能ではなく、ローカルで実行することによる副作用です。

料金は 145MB のダウンロードに 1 回限りです。適切な接続では 1 分以内です。テザリングされたモバイルデータに関しては、より良いものを待つ価値があります。キャッシュを保持する期間はブラウザによって決定されるため、サイト データをクリアすると、再度キャッシュが取得されます。

WebAssembly で実行されるため、グラフィック カードは必要なく、拡張機能やインストールも必要ありません。 Chrome、Edge、Firefox、Safari の現在のバージョンはすべて、デスクトップでも携帯電話でも動作します。古い携帯電話やメモリの少ない携帯電話では、145 MB モデルは通話中にメモリに常駐する必要があるため、速度が遅くなります。

## テキストをアップロードするテキスト読み上げサイトとの比較

主流の無料サイトでは、数百の音声と百の言語が宣伝されています。データセンターが作業を行っているため、それが可能です。通常、サインアップ、毎日のワードキャップ、透かしまたは混雑時のキュー、およびテキストがその後どうなるかを知るために読まなければならないプライバシーポリシーと一緒に、あなたのスクリプトが彼らに送信されるという取引です。

このページは逆の形状です。 4 つの音声、一度に 600 文字、最初の訪問で待機。その代わりに、アカウントはなく、実行回数の上限もなく、あなたの言葉をどこにも送信するものはなく、接続をオフにしても動作し続けます。

他のローカルのブラウザ内ツールと比較すると、より直接的な比較になります。ほとんどの場合、ダウンロードサイズが大きく、ブラウザ形式で通常は英語のみの Kokoro が実行されます。 Supertonic はサイズが約半分で、同じウェイトで 31 の言語を読み取ります。

## 商業利用のための無料テキスト読み上げとライセンスの要求事項

音声は商用利用可能です。 Yaps への帰属要件はなく、ファイルに透かしも含まれず、別途ライセンスを購入する必要もありません。

モデルの重みは BigScience Open RAIL M ライセンスに基づいてリリースされており、商用利用は許可されていますが、出力をどのように扱うかについては条件が付いています。重要なことを簡単に言うと、同意なしに特定の実在の人物を模倣するためにそれを使用しないこと、合成音声を誰かの本物の録音であるかのように偽装しないこと、そして人を欺いたり、嫌がらせをしたり、人々に害を及ぼすコンテンツを生成するためにそれを使用しないことです。これらの制限はオーディオとともに伝わるため、ファイルを渡す相手全員に適用されます。

全文は規約からリンクされており、読むのに十分な短さです。ナレーション、説明、デモ ビデオ、記事のオーディオ バージョン、または製品の音声プロンプトを作成している場合、これらはいずれも邪魔にはなりません。

## このツールでできないこと、および Yaps アプリで追加されること

単刀直入に言うと、このページは、ローカル PDF、EPUB、TXT、Markdown、HTML、RTF、または DOCX ファイルから入力、貼り付け、またはインポートしたテキストを読み取ります。あなたが見ている記事、電子メール、別のウィンドウ内の文書、または画面上の別の場所の選択範囲には影響しません。 Web ページがそれらのものに到達する方法はありませんし、それができるページは望ましくありません。

Yaps デスクトップ アプリが変更になります。 Mac、Windows、または Linux マシン上の任意の場所でテキストを強調表示し、ショートカットを押すと、同じ音声で読み上げられます。 4 つではなく 10 個の音声スタイルの完全なセットが搭載されており、600 文字の制限はなく、一度に段落を読む長い形式を処理し、音声クローンによる表現力豊かなエンジンが追加されています。デバイス上でも実行できるため、プライバシーに関する話は同じです。

短いクリップと WAV ファイルだけが必要な場合は、ここに留まってください。それは無料であり、試用版ではありません。

## ブラウザでテキスト読み上げを使用する方法

1. ### ファイルを入力、貼り付け、またはドロップします

最大 600 文字を入力または貼り付けるか、PDF、EPUB、TXT、Markdown、HTML、RTF、または DOCX ファイルをドロップします。インポートされたテキストはデバイス上に残ります。
2. ### 言語を設定する

テキストを記述する言語を 31 言語から選択します。これにより、スペルが発音に変換される方法が変わるため、見た目以上に結果に影響します。
3. ### 声を選ぶ

ノラ、ルナ、ワトソン、またはケルドを選択してください。 4 人全員が、サポートされているすべての言語を読みます。
4. ### スピーチを生成する

話すボタンを押します。最初のアクセスでは、145MB の音声エンジンがダウンロードされ、キャッシュされます。その後、生成がすぐに開始され、最初の文から再生が始まります。
5. ### WAVをダウンロードする

ダウンロードを押して、オーディオを 44.1kHz WAV ファイルとして保存します。ウォーターマークはありませんので、モデルライセンス条件に基づいて商用利用できます。

## 質問

**私のテキストはどこかにアップロードされていますか?**

いいえ。音声モデルはブラウザにダウンロードされ、オーディオは自分のマシンで生成されます。テキストの送信先となる合成サーバーがありません。音声がキャッシュされた後にインターネットから切断し、とにかくクリップを生成することで確認できます。

**アカウントまたは API キーが必要ですか?**

いいえ。サインアップ、電子メール アドレス、API キー、クレジット残高は必要ありません。合成はデバイス上で実行されるため、ワードごとに回復コストは発生せず、ゲートするものは何もありません。

**ブラウザ内のテキスト読み上げはオフラインでも機能しますか?**

はい、初回訪問後は可能です。 145MB の音声エンジンは一度ダウンロードする必要があり、その後ブラウザーにキャッシュされます。それ以降、ページではまったく接続されずに音声が生成されます。サイトのデータをクリアすると、モデルが再度ダウンロードされます。

**最初のロードが 145MB のダウンロードになるのはなぜですか?**

モデル自体がサーバー上に留まるのではなく、あなたのところにやってくるからです。 145MB は多言語音声モデルとしては小さく、1 回限りです。ブラウザ内の代替手段のほとんどは、ダウンロードサイズが大きく、通常はブラウザ内で英語のみとなる Kokoro を実行します。

**どの言語がサポートされていますか?**

31: 英語、スペイン語、フランス語、ドイツ語、イタリア語、ポルトガル語、オランダ語、ポーランド語、ロシア語、ウクライナ語、チェコ語、スロバキア語、スロベニア語、クロアチア語、ブルガリア語、ルーマニア語、ハンガリー語、ギリシャ語、スウェーデン語、デンマーク語、フィンランド語、エストニア語、ラトビア語、リトアニア語、トルコ語、アラビア語、ヒンディー語、インドネシア語、ベトナム語、韓国語、日本語。それらはすべて同じモデルと 4 つのボイスのいずれかを使用します。

**どのようなファイル形式を取得できますか?**

44.1kHzのWAVファイルです。より小さいファイルが必要な場合は、任意のエディタで MP3 に変換できます。音声には透かしやブランドマークはありません。

**なぜ 600 文字という制限があるのですか?**

品質と忍耐力のために。このモデルは短い通路ではより信頼性が高く、長い 1 回の実行では動作中にフィードバックがありません。長い形式で読む必要がある場合、Yaps デスクトップ アプリは、キャップなしで一度に段落ずつ処理します。

**音声を商用利用できますか?**

はい。モデルの重み付けには BigScience Open RAIL M ライセンスが使用されており、出力に制限付きで商用利用が許可されています。同意なしに特定の実在の人物を模倣すること、生成された音声を実際の録音として偽装すること、欺瞞的または有害な使用は禁止されています。規約全文は規約ページからリンクされています。

**どのブラウザで動作しますか?**

デスクトップおよび携帯電話上の Chrome、Edge、Firefox、Safari の最新バージョン。 WebAssembly で実行されるため、グラフィック カードや拡張機能は必要ありません。古い携帯電話やメモリの少ない携帯電話では、モデルをメモリ内に保持する必要があるため、生成が遅くなります。

**Web ページ、PDF、またはドキュメントを読み取ることができますか?**

ローカル PDF、EPUB、TXT、Markdown、HTML、RTF、または DOCX ファイルをドロップすると、ページのテキストがデバイス上に抽出されます。別のアプリケーションで開いている Web ページ、電子メール、またはドキュメントにアクセスすることはできません。 Yaps デスクトップ アプリは、キーボード ショートカットを使用して、任意のアプリケーションから強調表示されたテキストを読み取ります。

**これらは Yaps アプリと同じ音声ですか?**

同じエンジン、同じ重量。このページでは 4 つの音声スタイルが提供され、アプリでは 10 の音声スタイルが提供され、文字制限がなくなり、音声クローンによる表現力豊かなエンジンが追加されます。

**これは Kokoro ベースのブラウザ TTS ツールとどう違うのでしょうか?**

どちらもブラウザ内でローカルに実行されるため、プライバシーの立場は同じです。違いはカバー範囲とサイズです。Supertonic 3 は約 145 MB から 31 の言語を読み取りますが、Kokoro のブラウザ ビルドは通常、言語ごとに発音辞書が必要なため、ダウンロードが大きくなり、英語のみになります。

## その他の無料ツール

[音声をテキストに変換ブラウザ上で話して、それがテキストになるのを見てください。](/ja/ツール/音声テキスト変換) [音声からテキストへすでに録音をお持ちですか?代わりにファイルを文字に起こします。](/ja/ツール/音声文字起こし) [字幕ジェネレータービデオを時間指定された .srt または .vtt ファイルに変換します。](/ja/ツール/字幕生成) [すべて無料のツールすべての Yaps ブラウザ ツールはすべて自分のマシン上で実行されます。](/ja/ツール)

わめき始めるMac · Windows · Linux · Android

## 読む anything、このボックスに限らず。

ショートカット 1 つで、アプリ内のテキストを強調表示して音声を聞くことができます。

[Mac 用ダウンロード](https://github.com/richawo/yaps-releases/releases/latest)

macOS 13.0 以降が必要 (Apple Silicon を推奨)iOSは近日公開予定
