---
title: "免费在线语音转文本：私密，无需上传 | Yaps"
description: "一款免费的在线语音转文本工具，可保护您的语音私密性。点击麦克风，说话，您的话语就会变成浏览器中的文本。该模型在您的设备上运行，因此不会上传任何内容。"
canonical: "https://www.yaps.ai/zh-hans/%E5%B7%A5%E5%85%B7/%E8%AF%AD%E9%9F%B3%E8%BD%AC%E6%96%87%E5%AD%97"
language: "zh-Hans"
---

[免费工具](/zh-hans/工具)作者：Yaps

# 自由言论到文本，就在您的手中 browser.

点击麦克风，正常说话，然后看着它变成文本。语音模型下载一次，然后在自己的机器上运行，因此无需上传音频，无需帐户，也没有时间限制。

在您的机器上运行·您的声音永远不会离开此设备

开始 语音打字 向上

刚刚设置……

你的话
0 words

还什么都没有——麦克风在上面。

## 关于这个工具

## 如何在不上传语音的情况下进行在线语音输入

页面加载时，它会将名为 Whisper 的语音识别模型下载到您的浏览器中。它是基本大小，量化为 int8，大小约为 80MB。进度条显示下载。该模型会传送给您，而不是您的声音传送到服务器。

之后该工具即为一键通。您点击麦克风，您的浏览器会请求麦克风许可，并且电平表显示它正在听到您的声音。再次点击，录音将直接进入同一选项卡中运行的模型。音频在 30 秒的窗口中处理，其中有 5 秒的重叠，因此较长的谈话不会在句子中被切断。

如果您的浏览器支持 WebGPU，则该模型将在显卡上运行，并且速度要快几倍。如果没有，它会回退到 CPU 上的 WebAssembly，虽然速度较慢，但​​仍然可以工作。您的浏览器会在首次运行后缓存模型文件，因此以后的访问会立即开始。文本框上方有字数统计和每分钟大致字数数据。

## 语音输入，无需上传、无需注册、无需帐户

大多数免费语音输入网站采用两种形式之一。有些人录制您的音频并将其发布到他们的服务器进行转录。其他人称之为 Chrome 或 Edge 中内置的语音识别，它将音频发送到浏览器供应商的服务。无论哪种方式，您的声音都会离开您的机器，并且您信任不是您编写的隐私政策。

此页面具有不同的形状。没有上传，没有帐户，也没有转录服务器。模型文件是静态下载的，转录在您面前的选项卡中运行。你可以自己检查一下。加载页面，等待模型到达，然后关闭 WiFi 并继续听写。它继续工作，因为识别从未使用网络。

该结构也具有实际效果。没有任何内容是计量的，因此没有分钟上限，没有每日限制，也没有要求您在录制中途注册的墙。这也意味着我们无法读取、存储或丢失您的成绩单。如果关闭选项卡，文本就会消失，因此请复制或下载要保留的任何内容。

## 如何逐步使用语音输入工具

等待模型下载完成。麦克风按钮在准备好之前保持不活动状态，因为在此之前没有任何内容可以转录。在正常连接上，这需要几秒钟的时间，并且仅在您第一次访问时发生。

点击麦克风。第一次，您的浏览器将请求使用麦克风的许可。允许它。说话时观察电平表的移动，这是确认选择了正确的输入设备的最快方法。如果仪表平坦，请更改系统声音设置中的输入并重新加载。

以正常的语速说话。没有必要放慢速度或过度发音，喊叫只会使结果变得更糟而不是更好。当你完成一个想法后，再次点击麦克风。文本出现在下面的框中。

你可以继续前进。每个新录音都会添加到已有录音的末尾，因此您可以短时间听写。该框是一个普通的可编辑字段，因此可以修改您喜欢的任何内容，然后复制它或将其下载为 .txt 文件。

## 它的准确度如何？它可以处理哪些语言和口音？

该模型是多语言的，可以自动检测语言，因此您无需从菜单中选择任何内容即可开始说话。在实践中，它涵盖了大多数主要语言，并且在训练数据最多的语言（其中主要是英语）上明显更强。

对模型的尺寸要切合实际。这是 Whisper 基地，选择它是因为访问者实际上会等待 80MB 的下载。它擅长普通的连接语音，并且可以支持一系列口音，但它不是可用的最大模型，并且它会比十倍大小的模型犯更多的错误。专有名词、产品名称、技术术语和人名是最容易出现错误的地方。

安静的房间和像样的麦克风比您可以改变的任何东西都更有帮助。笔记本电脑麦克风会拾取键盘噪音和室内回声，这两者都会使文本变得更糟。如果您经常口述，那么便宜的耳机是您可以进行的最大升级。

## 人们使用免费语音输入的目的

最常见的用途是初稿。对于大多数人来说，说话比打字更快，然后编辑的粗略口语草稿往往会胜过空白页。散文、博客文章、求职信、长电子邮件、日记条目和会议记录都可以通过这种方式很好地发挥作用。

它也是一个简单的辅助工具。如果打字很痛苦，如果您受伤了，或者键盘对您来说速度很慢，则在浏览器选项卡中进行听写无需安装，无需管理权限，也无需购买。这对于锁定的工作笔记本电脑或无法安装软件的共享库计算机来说很重要。

学生用它来做笔记并快速记下长引文。用第二语言写作的人通常会发现说一个句子比打字更容易。它作为便签本很有用：在你有想法的时候捕捉它，稍后整理它。

如果您拥有的是现有录音而不是现场声音，那就是另一回事了。请改用音频转文本工具。

## 离线语音输入，无需互联网连接

一旦模型进入浏览器缓存，该页面就可以在没有连接的情况下继续工作。转录从一开始就没有使用网络，因此飞机、火车或酒店无线网络失效都无法阻止它。您确实需要加载页面本身，因此请在失去信号之前打开它。

有两件事会让您返回下载。清除浏览器存储会删除缓存的模型，并且私有或隐身窗口通常以空缓存启动，因此它会再次获取文件。不同的浏览器也保留单独的缓存，因此从一种浏览器切换到另一种浏览器意味着多下载一次。

第一次下载是该工具唯一需要互联网的时刻。其他一切，包括录音、识别和文本，都发生在您自己的硬件上。值得直白地说，因为它不寻常。大多数免费听写网站在您离线时就会停止工作，因为识别是在其他地方进行的。

## 浏览器语音输入的限制以及桌面应用程序的添加内容

该工具在一个网页上的一个框中输入内容。这就是诚实的边界。它无法将文本输入到您的编辑器、电子邮件客户端、Slack 或文档中，因此您每次都要手动复制结果。如果你想口授其他东西，这是一个两步的工作。

当您停下来后，文本也会到达，而不是您说话时逐字逐句地到达，因为当您再次点击麦克风时，录音会一次性转录。而且没有清理通行证。无论你说什么，你都会得到什么，包括嗯、错误的开始和中途放弃的句子。

Yaps 桌面应用程序与设备上的想法相同，没有这些限制。您按住一个热键，对您已经使用的任何应用程序说话，文本就会出现在您的光标处。它会清理填充词和标点符号，并且安装后可以离线工作。还有一个 Android 键盘，它比浏览器选项卡更适合手机听写。

## 如何在浏览器中使用语音输入

1. ### 等待模型下载

第一次访问时，该页面会获取约 80MB 的语音识别模型并显示进度条。麦克风在准备就绪之前保持不活动状态。您的浏览器会缓存它，因此这只发生一次。
2. ### 点击麦克风并允许麦克风访问

您的浏览器将在第一次使用麦克风时请求许可。允许它，然后检查说话时电平表的移动，以便您知道选择了正确的输入设备。
3. ### 以正常的语速说话

用你对人说话的方式说话。没有必要放慢速度、过度发音或提高声音。在有回声的空间中，安静的房间和耳机比笔记本电脑麦克风能提供更好的效果。
4. ### 再次点击麦克风即可停止

录音将在您的设备上转录，文本将显示在下面的框中。每个新录音都会添加到末尾，因此您可以短时间听写，而不是长时间听写。
5. ### 编辑，然后复制或下载

文本框是完全可编辑的，因此请修复模型出现的任何错误。然后将文本复制到剪贴板或将其下载为 .txt 文件。关闭选项卡后，不会保存任何内容。

## 问题

**这个语音输入工具真的免费吗？**

是的，而且没有什么可以注册的。该工具在您自己的计算机上运行，​​因此我们无需将转录账单转交给您。没有分钟上限，没有每日限制，也没有结束的试用。

**我的声音上传到任何地方了吗？**

不会。语音识别模型会在您第一次访问时下载到您的浏览器，之后的所有内容都会在您的设备上运行。您的麦克风音频永远不会离开您的机器。没有可将其发送到的转录服务器。您可以在模型下载后关闭 wifi 并进行口述来确认这一点。

**我需要安装什么东西吗？**

不，这是一个网页。唯一下载的是语音模型本身，您的浏览器会自动获取并缓存它，并且您永远不会在计算机上看到它作为文件。

**为什么第一次打开页面需要等待？**

该工具会先下载大约 80MB 的语音识别模型，然后才能转录任何内容。进度条显示进度。您的浏览器随后会对其进行缓存，因此以后的每次访问都会立即开始。

**在没有互联网连接的情况下可以进行语音输入吗？**

是的，一旦模型被缓存。该识别从未使用过网络，因此它可以离线工作。首次访问和加载页面本身需要连接。清除浏览器数据或使用私人窗口意味着模型会再次下载。

**为什么我仍在说话时文本没有出现？**

该工具首先进行录制，然后在您再次点击麦克风时进行转录，因此文本会一次性到达，而不是逐字到达。短时间的听写给你带来了接近现场打字的感觉，因为每个新的录音都会添加到已有录音的末尾。

**我可以用它在 Google 文档、Word 或电子邮件中输入内容吗？**

不直接。该页面仅在其自己的文本框中键入内容，因此您可以手动复制结果。直接听写任何应用程序就是 Yaps 桌面应用程序的功能：只要按住热键，无论您身在何处，文本都会出现在光标处。

**是否添加标点符号和大写字母？**

该模型会写出它听到的内容，包括基本标点符号，但之后没有更正通道。填充词、重复词和废弃的句子都会在你说的时候出现。当您说话时，桌面应用程序会清理这些内容。

**我可以一口气讲多长时间？**

没有设定限制。长音频在 30 秒的窗口中进行重叠处理，因此句子不会被切成两半。实际的限制是耐心：录音越长，转录时停止后的停顿时间就越长。

**它处理哪些语言？**

该模型是多语言的，可以自动检测语言，因此您可以开始说话。它在英语和其他广泛使用的语言中表现最强，并且在训练数据较少的语言中会犯更多错误。

**它可以在手机上使用吗？**

它在移动浏览器中运行，但模型下载和设备上处理速度明显慢于笔记本电脑。在 Android 上，Yaps 键盘的体验要好得多，因为听写功能内置于键盘本身中。

**关闭选项卡后我的文本会发生什么情况？**

它消失了。帐户中不会保存任何内容，因为没有帐户，也没有地方可以发送您的文本。如果您想保留文本，请在离开页面之前复制文本或将其下载为 .txt 文件。

## 更多免费工具

[音频转文字已经有录音了吗？而是转录该文件。](/zh-hans/工具/音频转文字) [填充字计数器](/zh-hans/工具/填充词计数器) [说话速度测试看看你说话比打字快多少。](/zh-hans/工具/语速测试) [字幕生成器将视频转换为定时 .srt 或 .vtt 文件。](/zh-hans/工具/字幕生成器) [所有免费工具每个 Yaps 浏览器工具都在您自己的计算机上运行。](/zh-hans/工具)

开始大喊大叫Mac · Windows · Linux · 安卓

## 现在就做 everywhere.

一键操作任何应用程序，边说话边清理。

[下载 Mac 版](https://github.com/richawo/yaps-releases/releases/latest)

需要 macOS 13.0+（推荐Apple Silicon）iOS 即将推出
