这是什么工具
SpeechToText 对标 speechnotes.co 的在线听写:点「开始听写」,对着麦克风正常说话,浏览器会边说边把语音转成文字并落在光标处;停顿几秒后它会自动重开会话继续听,不用每次手动点。识别期间可以随时切换识别语言、开关语音命令与自动大写,文本会自动存进本机浏览器,关掉页面再打开还在。
与参考站一样,本站不提供任何录音上传:语音识别由浏览器自带的 Web Speech API 完成——Chrome 与 Edge 把音频交给浏览器自己的语音服务,Safari 走系统识别,本站页面只接收识别后的文字,拿不到也存不下任何音频。所以它没有时长限制、不限次数,但离线时无法识别(Chrome/Edge 的识别需要联网)。
功能
- 连续听写,不用反复点开始浏览器在一段静默后会结束当前识别会话,本工具会自动重开,直到你手动点「停止听写」,适合会议记录、口述草稿这类长内容。
- 语音命令插入标点与换行说「句号」「逗号」「问号」「感叹号」「换行」「另起一段」等词,会直接插入对应标点或换行,并自动清理标点前后的空格、合并重复标点。
- 中英等多语言识别识别语言可选中文(大陆/台湾/香港)、英语(美/英/澳/印)以及日、韩、法、德、西、俄等常用语言,命令表按中文/非中文自动切换。
- 落字到光标,可再手工编辑识别结果插入当前光标位置:想边听边改、插入到段落中间或追加到末尾都行;中间结果以浅色预览显示,不污染正文。
- 自动保存与一键导出文本与设置自动存进本机 localStorage,刷新即恢复;可一键复制、下载 txt、下载 Word(.doc)、打印或另存为 PDF。
- 文本与音频都不上传本站页面纯静态、没有后端接口:识别在浏览器内部完成,本站既收不到音频,也不做任何统计上报。深浅色主题与简体/繁體/English 三套界面随你切。
怎么用
- 选择识别语言(说普通话选「中文(中国大陆)」,说英语选「英语(美国)」)。
- 点「开始听写」,在浏览器的权限弹窗里点「允许」使用麦克风。
- 正常说话,文字会实时出现;需要标点就说「句号」「逗号」「换行」等命令。
- 识别结果落在光标处,可以随时手工修改;长时间静默后会自动继续听。
- 听完点「停止听写」,再按需复制、下载 txt/Word 或打印导出 PDF。
常见问题
- 为什么点了开始没反应或提示不支持?
- Web Speech 语音识别只在桌面版 Chrome、Edge 与 Safari 上可用;Firefox、多数移动浏览器(包括 iOS 上的第三方浏览器)和部分内嵌 WebView 都不提供 SpeechRecognition 接口。请用桌面版 Chrome 或 Edge 打开本页,并确认地址栏左侧的站点权限里麦克风是「允许」。
- 我的语音会被上传吗?
- 不会上传到本站。识别由浏览器自己的 Web Speech 服务完成:Chrome/Edge 会把音频发往它们各自的云端语音服务,那是你与浏览器厂商之间的事,本站页面只拿到识别后的文字,既没有录音接口也存不下音频。介意云端识别可以在系统里改用 Safari 的系统识别,或使用离线听写软件。
- 中文标点识别不准怎么办?
- 中文识别结果本身不带标点,本站靠「语音命令」补:说「句号」得到「。」,说「逗号」得到「,」,说「换行」断行。若识别把命令词听成了别的字,可以把语速放慢、靠近麦克风,或先关掉语音命令手动加标点。识别服务也会按语言自动加一部分标点,两者可以并存。
- 为什么说一会儿就自己停了?
- 这是浏览器的行为:连续识别在检测到较长静默或会话超时后会触发 end。本站监听到 end 会自动重开一个新会话(约 0.25 秒后),所以正常情况下你只会看到状态闪一下、文字继续。若一直停着,多半是麦克风被其它程序占用或权限被撤销,检查后重新点「开始听写」。
- 文本会丢吗?能导出吗?
- 不会丢:每次识别完成都会把文本写进本机浏览器的 localStorage,刷新或关掉重开都会恢复(除非你手动点了「清空」或清理了浏览器数据)。导出支持复制、下载 .txt、下载 Word(.doc)与打印/另存 PDF 四种方式,方便再加工。
站内其他工具
纯前端实现 · 零依赖 · 免费 · 支持中/繁/英