语音转文字 ⚠️ 可能会将音频发送到云服务

实时浏览器语音转录

⚠ 开始之前:这个功能实际是如何运作的

此处的语音识别使用浏览器内置的 Web Speech API——并非私密的本地模型。在 Chrome 及大多数基于 Chromium 的浏览器中,这会将你的音频发送到 Google 的语音识别服务器进行处理。这与本网站其他工具不同,其他工具 100% 在本地运行,不上传任何内容。如果你要说的内容涉及隐私,请在使用本工具前确认你所用浏览器的具体实现方式,或避免用它处理敏感内容。

未在聆听

转写文本

点击"开始聆听"并开始说话——你的话会显示在这里。

关于此工具

此工具封装了浏览器原生的 Web Speech API,可在本页面上实时将语音转换为文字。点击"开始",开始说话,文字会随着你说话逐字出现:尚在识别中的临时文本以较浅的斜体样式显示,一旦浏览器确认识别无误,就会转为最终定稿文本。连续模式会在自然停顿间持续聆听,而不是说完一句就停止,语言选择器还可以让你切换识别语言以匹配你所说的语言。

与本站其他完全离线运行的工具不同,这里的语音识别依赖 Web Speech API 背后的服务——在 Chrome 及其他基于 Chromium 的浏览器中,这意味着你的音频会通过网络发送到 Google 的服务器进行处理。Firefox 和 Safari 目前对该 API 几乎没有支持,因此本工具在基于 Chromium 的浏览器中效果最佳。如果你要转写的内容比较敏感,请在开始前权衡这一点。

常见问题

我的语音录音是私密的吗?

这完全取决于您的浏览器,这是本站其他工具运作方式的一个重要例外。在 Chrome 和大多数基于 Chromium 的浏览器(Edge、Brave 等)中,此工具使用的 Web Speech API 会将您的音频发送到云端语音识别服务(默认为 Google 的服务)进行处理——这与本站其他工具纯粹在设备端运行不同。如果您所转录内容的音频隐私很重要,请在使用此工具前查看您特定浏览器的文档/隐私政策,或者对于敏感内容考虑使用完全离线的转录工具。

为什么这在我的浏览器中不起作用?

此工具所依赖的 Web Speech API 是一项浏览器功能,而非此页面自身能够添加的功能,浏览器支持情况确实参差不齐:Chrome 和大多数基于 Chromium 的浏览器支持良好,而 Firefox 几乎不支持,Safari 在不同版本间的支持历来有限/不一致。此页面会自动检测这一点,并显示明确的"不支持"消息,而不是静默失败——如果您看到该消息,请尝试切换到较新版本的 Chrome 或 Edge。