语音体验工具

尝试实时语音识别、转录兼容的音频文件轨道,并使用浏览器或操作系统中安装的语音朗读文本。

文字转语音 检查中
麦克风 STT 检查中
音频文件 STT 检查中
设备端 STT 检查中

STT

语音转文字

正在检查浏览器支持...
默认使用浏览器语言。也可以输入任意 BCP 47 语言标签。
未选择音频文件
在 Chrome 135 及更高版本中为实验性功能。文件会实时播放并转录,不会上传到 ComUtil。
高级识别选项

TTS

文字转语音

正在检查浏览器支持...
1.0
1.0
1.0
Web Speech API 会通过设备播放合成语音,但不会将生成的音频作为可下载文件提供。
什么是 Web Speech API?

Web Speech API 提供由浏览器或操作系统实现的语音识别和语音合成功能。可用语音、语言、识别质量和离线支持因设备和浏览器而异。

此处的语音处理方式

此页面将麦克风或兼容的音频轨道直接传给浏览器的语音识别器,并将文本发送给设备的语音合成器。ComUtil 不会接收这些输入,但未选择设备端识别时,浏览器可能会连接其语音服务提供商。

实用测试
  • 检查某种语言或浏览器的识别支持
  • 通过麦克风口述文本草稿
  • 测试已安装的语音、语速、音调和音量
  • 尝试实时转录兼容的音频文件
常见问题

ComUtil 会上传我的音频或文本吗?

不会。此工具没有上传端点。但如果未明确启用受支持的设备端识别,浏览器或操作系统可能会使用在线语音服务。

为什么音频文件转录不可用?

将音频轨道传入 Web Speech 识别是较新的浏览器功能。请使用 Chrome 135 或更高版本等兼容的 Chromium 浏览器,或改用麦克风识别。

可以下载文字转语音的音频吗?

标准 Web Speech API 不支持。它会通过设备播放语音,但不会提供生成的音频数据供下载。