语音听写:识别模型、润色与历史
配置本地识别与可选 AI 润色,完成第一次听写,并查看转写和录音。
核心能力语音先变成文字,再发送任务#
听写把说话转成输入框中的可编辑文本。你检查并发送之后,助手才按消息执行任务。
准备麦克风与识别模型#
- 在桌面应用打开「设置 → 语音」。
- 打开「启用语音输入」,允许系统麦克风权限,在「麦克风」中选择系统默认或实际使用的设备。
- 点击「管理语音识别模型」,在弹窗中下载适合主要语言的模型。等待就绪后点 Use/使用,确认它标为 Active/当前。
- 回到输入框,用一句短话验证声音和识别效果。
模型首次下载需要网络,识别在本机进行。中文可先选择 SenseVoice;需要普通话与英文的整段识别时,可试 Paraformer Large。这两个模型在停止录音后转写,录音时没有逐字文字不代表故障。需要实时识别时,在列表中选择支持流式识别的模型。
模型下载完成不等于已设为当前模型。先用包含数字和专有名词的短句测试,再决定是否更换。
决定是否使用 AI 润色#
| 设置 | 怎么选择 | 需要知道 |
|---|---|---|
| AI transcript polish | 中文同音词、标点需要整理时开启 | 默认开启;可关闭保留原始转写 |
| Polish model | 选择已能正常调用的提供商模型 | 默认使用快且低价的模型角色 |
润色会把转写文本发给所选模型,可能产生模型费用;它不属于纯离线识别。润色失败或超时时检查保留的原始文本,再决定是否发送。模型连接配置见提供商。
设置修正规则与词汇
- 打开设置 → 语音 → 修正偏好,点击管理。
- 在自定义修正规则写一条简短要求,例如「保留英文产品名和缩写,补充标点,不翻译或扩写我的话」。也可先用填入行业模板:它把规则与参考词汇填入可编辑文本,不是切换一个长期生效的行业模式。检查文字后点击保存偏好。
- 在我的词汇点击添加新词条。例如,为虚构产品把正确写法设为
Northstar,常见误写设为North Star,点击添加词条。最多填写三种误写,用逗号分隔;手工词条优先使用。 - 重新打开面板,确认规则和词条分别保存。再听写一句包含产品名的短话,核对结果后发送。偏好是修正参考,保存成功不代表每次识别都会正确。
启用语音输入与 AI 润色后才会使用这些偏好。关闭 AI 修正时也能维护词库,但它不替代本地语音识别模型。
检查从编辑中学习的词汇
开启 AI 润色时,你在发送前对听写文本作出的明确术语修改,可以成为后续同一模型修正时的学习样例;发送消息不会额外发起一次 AI 请求。词条不一定立即出现在已学习词汇中,也不是每次编辑都会被学习:单字歧义、数字、否定变化与大范围改写不会自动学习。
到修正偏好 → 管理 → 已学习词汇检查、编辑、禁用或删除词条。清空已学习词汇还会移除待提炼样例,保留手工词条与自定义规则,确认框会说明范围。必须固定的拼写,直接加入「我的词汇」,不要只等待自动学习。
完成第一次听写#
- 打开目标项目和会话,点击输入框麦克风。默认快捷键为 macOS 的 Shift+Command+D,Windows/Linux 的 Ctrl+Shift+D;自定义后以快捷键设置为准。
- 说出一个小任务:
读取附件中的错误报告。
总结复现步骤和缺少的信息。
先不要修改文件。
- 停止录音,等待识别及已启用的润色。期间输入框暂时锁定,完成后一次性插入文字。
- 如果不想等待润色,按 Escape 跳过润色并保留原始转写;失败或超时也会保留原文。
- 在目标输入框核对文字,修正后再发送。
怎样确认结果正确#
优先检查数字、文件路径、专有名词,以及“不要”“只读”等限制词。确认文字出现在目标会话,不是别的分屏输入框。
出现转写只代表输入完成,不代表任务已执行。发送后仍需检查助手实际处理的范围和结果。
查看历史与本地录音#
在「设置 → 语音 → 听写历史」按时间找到记录:
- 点击复制图标,复制当前采用的文本。
- 点击更多操作 → 查看文本版本,查看当前文本、AI 修正文本与原始转写。只有内容不同时才显示额外版本;选中需要的版本后点击复制转写。原始录音仍会保留。
- 点击「更多操作 → 下载录音」,保存音频后打开核对。
- 不再需要时,选择「更多操作 → 删除录音」,删除选定的录音记录。
- 使用「打开录音文件夹」查看本地音频;记录较多时可翻页。
本地识别不表示不留录音。分享录音或转写前确认内容;不要假定「隐私 → 清除本地数据」会同时清除语音记录。
更多语音控件#
关闭「启用语音输入」会隐藏输入框麦克风并停用听写快捷键;需要时可在设置中重新开启。麦克风列表缺设备时,先允许系统权限,再检查设备连接。各项设置见语音设置参考。
常见问题#
- 不能录音: 检查系统麦克风权限及输入设备;确认「启用语音输入」已开启。
- 没有识别结果: 确认模型已下载、已选中,先用短录音排查。
- 识别不准: 选择适合语言的模型,检查环境噪声,再考虑润色。
- 润色失败: 检查所选提供商和模型,先保留并核对原始文字。
- 词汇修改没生效: 区分「保存偏好」与「添加词条/保存词条」,重新打开面板核对,并确认 AI 润色开启;学习词汇可能在后续修正后才出现。
- 一直等待润色: 按 Escape 保留原文,再检查润色模型连接;不要重复开始同一段录音。