关于此工具
此工具封装了浏览器原生的 Web Speech API,可在本页面上实时将语音转换为文字。点击"开始",开始说话,文字会随着你说话逐字出现:尚在识别中的临时文本以较浅的斜体样式显示,一旦浏览器确认识别无误,就会转为最终定稿文本。连续模式会在自然停顿间持续聆听,而不是说完一句就停止,语言选择器还可以让你切换识别语言以匹配你所说的语言。
与本站其他完全离线运行的工具不同,这里的语音识别依赖 Web Speech API 背后的服务——在 Chrome 及其他基于 Chromium 的浏览器中,这意味着你的音频会通过网络发送到 Google 的服务器进行处理。Firefox 和 Safari 目前对该 API 几乎没有支持,因此本工具在基于 Chromium 的浏览器中效果最佳。如果你要转写的内容比较敏感,请在开始前权衡这一点。
常见问题
我的语音录音是私密的吗?
这完全取决于您的浏览器,这是本站其他工具运作方式的一个重要例外。在 Chrome 和大多数基于 Chromium 的浏览器(Edge、Brave 等)中,此工具使用的 Web Speech API 会将您的音频发送到云端语音识别服务(默认为 Google 的服务)进行处理——这与本站其他工具纯粹在设备端运行不同。如果您所转录内容的音频隐私很重要,请在使用此工具前查看您特定浏览器的文档/隐私政策,或者对于敏感内容考虑使用完全离线的转录工具。
为什么这在我的浏览器中不起作用?
此工具所依赖的 Web Speech API 是一项浏览器功能,而非此页面自身能够添加的功能,浏览器支持情况确实参差不齐:Chrome 和大多数基于 Chromium 的浏览器支持良好,而 Firefox 几乎不支持,Safari 在不同版本间的支持历来有限/不一致。此页面会自动检测这一点,并显示明确的"不支持"消息,而不是静默失败——如果您看到该消息,请尝试切换到较新版本的 Chrome 或 Edge。