コンテンツにスキップ
無料ツールサインアップがありません · 何もアップロードされていません

あなたの環境で動作する無料の AI ツール browser.

ブラウザ内で実行される実際の音声モデル。何もアップロードされず、何も制限されず、アカウントを作成する必要もありません。

01ブラウザツール

ブラウザツール

ライブ

音声からテキストへ

ブラウザ上で自由に音声をテキストに変換できます。マイクをタップして話すと、言葉が表示されます。サインアップや時間制限はなく、何もアップロードされません。

ツールを開く
ライブ

マイクテスト

ライブ波形、周波数表示、デバイスの詳細、実用的な品質評価でマイクをチェックします。音声はアップロードされません。

ツールを開く
ライブ

字幕ジェネレーター

ビデオをドロップすると、クリーンな SRT または VTT が返されます。キューは単語に合わせてタイミングが調整され、編集可能で、ファイルをアップロードせずに生成されます。

ツールを開く
ライブ

音声からテキストへ

録音時間がどんなに長くても、音声をテキストに無料で変換します。モデルはサーバーではなくブラウザーで実行されるため、長さの制限はありません。

ツールを開く
ライブ

テキスト読み上げ

Yaps アプリが使用しているのと同じエンジンを使用した、31 言語の無料オンライン テキスト読み上げ。サインアップも透かしも必要なく、テキストがページから離れることはありません。

ツールを開く
新しい

電子ブックをオーディオに変換

EPUB または PDF を自然な音質のチャプターオーディオに変換します。最初にブラウザで聞いて、準備ができたらオーディオブックをダウンロードします。

ツールを開く
新しい

電子ブックのテキスト読み上げ

音声、言語、章のコントロールを使用して、EPUB または PDF を読み上げます。 Yaps が話している間、書籍はデバイス上に残ります。

ツールを開く
新しい

電子書籍を MP3 に送信

EPUB または PDF の章をダウンロード可能なオーディオに変換し、各セクションの合成中の進行状況が明確になります。章は WAV として保存され、MP3 に変換する準備ができました。

ツールを開く
新しい

PDFからテキストへ

ブラウザでテキストベースの PDF から読み取り可能なプレーンテキストを抽出します。何もアップロードされず、スキャンされたページには OCR のフラグが明確に付けられます。

ツールを開く
新しい

PDF から Markdown へ

PDF の見出しと段落をメモ、調査、執筆用にポータブル Markdown に変換します。アカウントやアップロードを行わずにローカルで実行します。

ツールを開く
新しい

PDFからWordへ

PDF から読み取り可能なテキストを .docx Word ドキュメントとしてエクスポートします。テキストがきれいに伝わります。複雑なレイアウトやスキャンについては、見直しが必要な場合があります。

ツールを開く
新しい

PDF から DOC へ

テキストベースの PDF を最新の編集可能な .docx ファイルに変換します。 Yaps は、廃止されたバイナリ .doc 形式を生成せず、何もアップロードされません。

ツールを開く
新しい

PDF から RTF へ

PDF テキストをワードパッド、テキストエディット、その他のワード プロセッサ用の広範な互換性のあるリッチ テキスト ファイルに抽出します。ブラウザ内でローカルに実行されます。

ツールを開く
ライブ

フィラーワードカウンター

トランスクリプトを貼り付けると、すべての「ええと、ええと、いいね!」が強調表示されます。ひと目でスピーチの成績がわかります。完全にブラウザ内で実行されます。

ツールを開く
ライブ

ヘッドショット背景リムーバー

顔写真から背景を削除し、透明な PNG をダウンロードします。人物の写真用に構築されており、写真がブラウザから離れることはありません。

ツールを開く
ライブ

スピーキングスピードテスト

双方向で1分あたりの単語数を測定するスピーキングスピードテスト。ほとんどの人は、入力するよりも約 3 倍の速さで話します。

ツールを開く

これらのツールについて

当社のサーバーではなくブラウザーで実行される無料の AI ツール

このページのすべてのツールは、独自のマシン上で動作します。音声ツールは音声認識モデルを一度ダウンロードすると、音声とカットアウト モデルが同じように機能し、それ以降、作業しているファイルが現在のタブから離れることはありません。

これは、これらのカテゴリのほとんどの無料ツールの動作とは逆です。通常、録音または写真をアップロードすると、サーバーがそれを処理し、結果が返されます。このモデルは、これらのサイトがアカウントを必要とする理由、時間制限を設けている理由、そしてプライバシー ポリシーがあなたにとって重要である理由を示しています。

私たちのものは形状が異なり、実際の効果はそれに続きます。計測するものが何もないため、アカウントはありません。ファイルが長くても費用はかからないため、文字起こしには長さの制限はありません。また、あなたの作品は私たちに送信されていないため、私たちが読んだり、保存したり、紛失したりすることはありません。

サインアップせずにここでできること

口述する。 Speech to Text ツールは、会話中に音声をテキストに変換します。マイク テストでは、話し始める前に信号をチェックします。また、会話速度テストでは、入力よりもどれだけ早く話すかを測定します。

転写する。音声からテキストへの変換では、任意の長さの既存の録音を取得し、必要に応じてタイムスタンプ付きで単語を返します。字幕ジェネレーターも同じ仕事をしますが、ビデオの時間指定された .srt または .vtt ファイルを生成します。

読んで聞いてください。テキスト読み上げは、貼り付けた内容を 31 言語で読み上げ、WAV ファイルを渡します。電子ブックをオーディオに変換すると、EPUB または PDF が章付きのナレーションに変換されます。また、電子ブックのテキスト読み上げを使用すると、再生コントロールを使用してブラウザーで本を読み上げることができます。

エクスポートします。 MP3 への電子書籍は、同じローカル書籍からダウンロード可能な音声の章を作成します。フィラーワードカウンターは、トランスクリプトまたは草稿の中のすべてのうーん、決まり文句、冗長なフレーズを見つけます。

切り出します。顔写真背景リムーバーは人物の写真を撮り、透明な PNG を返します。

電子ブックをアップロードせずにオーディオに変換する

電子ブックをオーディオに変換することは、すでに所有している本を聞くための最も簡単な方法です。 EPUB または PDF をドロップして、ページにその章を識別させ、最初のセクションが生成されるときに聞き始めます。テキストはブラウザ内で処理されるため、書籍自体は変換サーバーに送信されません。

完成したファイルではなく読み手として読みたい場合は、電子ブックのテキスト読み上げを使用します。一時停止したり、速度を変更したり、章間を移動したり、テキストに沿って読んだりできます。飛行機、通勤中、または他のプレーヤー用に保存できるオーディオ ファイルが必要な場合は、電子ブックを MP3 に使用してください。これらは、同じプライベート読み取りワークフローへの 3 つのエントリ ポイントであり、個別のアップロード ファネルではありません。

最初のバージョンは、テキストベースの DRM フリー書籍用に設計されています。スキャンされたページ、DRM で保護されたファイル、および複雑な PDF の読み取り順序には OCR または追加のクリーンアップが必要な場合があるため、このツールは読み上げる前に、何を確実に抽出できるかを通知します。

PDF をテキスト、Markdown、Word または RTF に変換します

PDF からテキストへの変換は、テキストベースの PDF から単語を取得する最も簡単な方法です。 PDF を Markdown に変換すると、見出しと段落はメモや調査に便利なままになります。一方、PDF から Word および PDF を DOC に変換すると、Word または別のオフィス スイートで開いて編集を続けることができる最新の .docx ファイルが生成されます。ダウンロードは DOCX であり、廃止されたバイナリ .doc 形式ではありません。

これらのコンバータは、読み上げツールと同じブラウザー ローカル ドキュメント パイプラインを使用します。 PDF はテキストが抽出されている間デバイス上に残るため、アップロード、アカウント、変換キューはありません。 RTF は、完全な Word パッケージを必要としないワード プロセッサ向けの、広範な互換性のあるリッチ テキスト エクスポートです。 HTML は、任意のブラウザで開くスタンドアロンのドキュメントが必要な場合に便利です。

テキストベースの PDF が最適に機能します。スキャンされた PDF はページ画像で構成されているため OCR が必要ですが、複数列のレイアウト、表、脚注、および異常な読み上げ順序については、迅速なレビューが必要な場合があります。 PDF to Word は、ピクセル完璧な視覚レイアウトを約束するのではなく、読みやすいコンテンツを保持します。ソース PDF は、アーカイブの忠実性を保つために適切なファイルのままです。

オンデバイスツールが問題なく無料で利用できる理由

無料ツールには通常、その背後にビジネスモデルが隠れています。あなたが製品であるか、無料利用枠が最も痛手となる場所、つまりファイルをアップロードした後、または 15 分間の録音のうちの 10 分に配置された壁のあるじょうごであるかのどちらかです。

ブラウザでモデルを実行すると、それらの壁が存在して回収するコストが削減されます。 GPU 時間に対して料金を支払っているわけではないので、割り当てられる理由はありません。問題の正直なバージョンは次のとおりです。私たちはデスクトップ アプリを構築します。これらのツールは、人々が私たちの存在を知る方法であり、それぞれのツールが、アプリで何ができないのか、アプリが代わりに何をするのかを明確に示します。

あなたが行う取引は一度限りのダウンロードです。音声モデルは約 80 MB、音声は約 145 MB で、一度フェッチされてからブラウザーによってキャッシュされます。その後、即座に起動し、まったく接続されずに動作し続けます。

これらのツールはオフラインでも動作しますか?

ツールのモデルがキャッシュされたら、はい。認識、合成、切り出しはネットワークを使用していないため、接続が失われても停止することはありません。ページ自体を読み込む必要があるため、オフラインになる前にページを開いてください。

フィラーワードカウンターは例外であり、何も必要としません。これはモデルではなく辞書とルールのセットであるため、ページが読み込まれた瞬間から機能します。

ブラウザのストレージをクリアするか、プライベート ウィンドウを開くとキャッシュが空になるため、モデルは次回再度ダウンロードされます。ブラウザごとに個別のキャッシュも保持されます。

どのツールが必要ですか?

話してテキストを取得したい場合は、音声入力を使用します。すでに録音がある場合は、音声をテキストに変換します。違いは、オーディオがライブであるかファイルであるかだけです。

単語をタイミングを合わせてビデオの上に配置する必要がある場合は、音声をテキストに変換するのではなく、字幕ジェネレーターが必要になります。これは、単語に合わせて合図を含む字幕ファイルを生成するためです。

テキストがあり、音声が必要な場合、それはテキスト読み上げです。これは最初の 2 つの逆であり、よく混同されます。

トランスクリプトがあり、それをより整理したい場合は、フィラーワードカウンターを使用してください。人物をきれいに切り抜きたい場合は、背景リムーバーを使用します。

質問

これらのツールは本当に無料ですか?

はい、アカウントもトライアルもありません。これらはお客様ご自身のマシン上で実行されるため、使用ごとに回復コストが発生することはありません。

アップロードしたものは保存されますか?

そもそも何もアップロードされていません。オーディオ、ビデオ、テキスト、写真がページによって読み取られ、目の前のタブで処理されます。関連する処理サーバーはありません。ツールのモデルがダウンロードされたら、Wi-Fi をオフにすることで確認できます。

一部のツールでは最初にダウンロードが必要なのはなぜですか?

スピーチ、音声、カットアウト ツールは実際の機械学習モデルを使用しており、モデルが実行される前にマシンに到達する必要があります。これは 1 回限りです。ブラウザーがキャッシュするため、その後のアクセスはすぐに開始され、オフラインで動作します。

ファイルサイズや長さの制限はありますか?

いいえ。作業は当社のハードウェアではなくお客様のハードウェアで行われるため、当社が制限することは何もありません。 2 時間の録音は問題ありませんが、2 分の録音よりも処理に時間がかかるだけです。

彼らは電話で動作しますか?

これらはモバイル ブラウザーで実行されますが、モデルのダウンロードと処理はラップトップよりも著しく遅くなります。 Android では、ブラウザのタブよりも Yaps キーボードの方が音声入力に優れています。

音声からテキストへの変換とテキストから音声への変換の違いは何ですか?

Speech to Text は聞いて書きます。あなたが話すと入力されます。テキスト読み上げ機能: 入力すると読み上げます。これらは正反対の仕事であり、それぞれに個別のツールを用意しています。

EPUB または PDF をオーディオブックに変換できますか?

はい。電子ブックをオーディオに変換すると、ブラウザでテキストベースの EPUB または PDF を章ごとに読み上げ、電子ブックを MP3 にすると、生成された章をダウンロードできます。 DRM で保護された書籍やスキャンされた書籍はまだサポートされていない可能性があります。

電子ブックの音声への変換と電子ブックのテキストから音声への違いは何ですか?

電子ブックのテキスト読み上げは、すぐに聞き、一時停止し、速度を変更し、テキストに従うという読者エクスペリエンスです。電子ブックからオーディオへの変換は、章の音声を生成するためのより広範なワークフローですが、電子ブックから MP3 へのダウンロードは、ダウンロード可能なファイルに焦点を当てています。

PDF を TXT、Markdown、または Word に変換できますか?

はい、テキストベースの PDF の場合は可能です。 PDF からテキストへはプレーン テキストを抽出し、PDF から Markdown へは便利な見出しと段落構造を維持します。PDF から Word または PDF から DOC へは最新の .docx ドキュメントをエクスポートします。スキャンした PDF には OCR が必要で、複雑な列や表は簡単なレビューが必要な場合があります。

RTF への PDF は何に役立ちますか?

RTF は、ワードパッドやテキストエディットを含む多くのワード プロセッサで開くことができる移植可能なリッチ テキスト形式です。 Yaps は、選択可能な PDF テキストからローカルに生成します。スキャンされたページや複雑なレイアウトは、抽出後に OCR またはレビューが必要です。

わめき始めるMac · Windows · Linux · Android

または、ツールをスキップして、 ただ話してください.

Yaps は、話しているときにあなたの声をクリーン テキストにライブで変換します。クリーンアップパスは必要ありません。

Mac 用ダウンロード

macOS 13.0 以降が必要 (Apple Silicon を推奨)iOSは近日公開予定