← 返回工具列表

SpeechToText 语音转文字

浏览器语音识别 · 连续听写 · 语音命令标点

English 简体 繁體

听写

准备就绪:点「开始听写」,对着麦克风说话即可。

识别语言要与你说的话一致:说普通话选「中文(中国大陆)」,说英语选「英语(美国)」。可选项取决于浏览器支持的识别语言,Chrome 与 Edge 支持得最多。

点「开始听写」后允许使用麦克风即可。说话时文字会实时出现在下面;停顿或长时间静默后浏览器会自动重开会话,不用手动点。

听写选项

文本、语言与开关会自动存进本机浏览器(localStorage),刷新或关掉再打开都还在,也可以随时清空。

文本

0 字符 · 0 词

可用语音命令

命令词在识别完成时替换。中文命令适用于中文识别,英文命令适用于英文识别,切换识别语言时会自动切换命令表。

© 2026 knoweave.com

这是什么工具

SpeechToText 对标 speechnotes.co 的在线听写:点「开始听写」,对着麦克风正常说话,浏览器会边说边把语音转成文字并落在光标处;停顿几秒后它会自动重开会话继续听,不用每次手动点。识别期间可以随时切换识别语言、开关语音命令与自动大写,文本会自动存进本机浏览器,关掉页面再打开还在。

与参考站一样,本站不提供任何录音上传:语音识别由浏览器自带的 Web Speech API 完成——Chrome 与 Edge 把音频交给浏览器自己的语音服务,Safari 走系统识别,本站页面只接收识别后的文字,拿不到也存不下任何音频。所以它没有时长限制、不限次数,但离线时无法识别(Chrome/Edge 的识别需要联网)。

功能

怎么用

  1. 选择识别语言(说普通话选「中文(中国大陆)」,说英语选「英语(美国)」)。
  2. 点「开始听写」,在浏览器的权限弹窗里点「允许」使用麦克风。
  3. 正常说话,文字会实时出现;需要标点就说「句号」「逗号」「换行」等命令。
  4. 识别结果落在光标处,可以随时手工修改;长时间静默后会自动继续听。
  5. 听完点「停止听写」,再按需复制、下载 txt/Word 或打印导出 PDF。

常见问题

为什么点了开始没反应或提示不支持?
Web Speech 语音识别只在桌面版 Chrome、Edge 与 Safari 上可用;Firefox、多数移动浏览器(包括 iOS 上的第三方浏览器)和部分内嵌 WebView 都不提供 SpeechRecognition 接口。请用桌面版 Chrome 或 Edge 打开本页,并确认地址栏左侧的站点权限里麦克风是「允许」。
我的语音会被上传吗?
不会上传到本站。识别由浏览器自己的 Web Speech 服务完成:Chrome/Edge 会把音频发往它们各自的云端语音服务,那是你与浏览器厂商之间的事,本站页面只拿到识别后的文字,既没有录音接口也存不下音频。介意云端识别可以在系统里改用 Safari 的系统识别,或使用离线听写软件。
中文标点识别不准怎么办?
中文识别结果本身不带标点,本站靠「语音命令」补:说「句号」得到「。」,说「逗号」得到「,」,说「换行」断行。若识别把命令词听成了别的字,可以把语速放慢、靠近麦克风,或先关掉语音命令手动加标点。识别服务也会按语言自动加一部分标点,两者可以并存。
为什么说一会儿就自己停了?
这是浏览器的行为:连续识别在检测到较长静默或会话超时后会触发 end。本站监听到 end 会自动重开一个新会话(约 0.25 秒后),所以正常情况下你只会看到状态闪一下、文字继续。若一直停着,多半是麦克风被其它程序占用或权限被撤销,检查后重新点「开始听写」。
文本会丢吗?能导出吗?
不会丢:每次识别完成都会把文本写进本机浏览器的 localStorage,刷新或关掉重开都会恢复(除非你手动点了「清空」或清理了浏览器数据)。导出支持复制、下载 .txt、下载 Word(.doc)与打印/另存 PDF 四种方式,方便再加工。

站内其他工具

纯前端实现 · 零依赖 · 免费 · 支持中/繁/英