> 内容来源：Onevium 官方文档
> 文章: 语音听写：识别模型、润色与历史
> 原文: https://onevium.com/zh/docs/voice-dictation
> 语言：简体中文
> 更新于: 2026-09-20
> 适用版本: 1.2.1+

---

# 语音听写：识别模型、润色与历史

配置本地识别与可选 AI 润色，完成第一次听写，并查看转写和录音。

## 语音先变成文字，再发送任务

听写把说话转成输入框中的可编辑文本。你检查并发送之后，助手才按消息执行任务。

## 准备麦克风与识别模型

1. 在桌面应用打开「设置 → 语音」。
2. 打开「启用语音输入」，允许系统麦克风权限，在「麦克风」中选择系统默认或实际使用的设备。
3. 点击「管理语音识别模型」，在弹窗中下载适合主要语言的模型。等待就绪后点 Use／使用，确认它标为 Active／当前。
4. 回到输入框，用一句短话验证声音和识别效果。

模型首次下载需要网络，识别在本机进行。中文可先选择 **SenseVoice**；需要普通话与英文的整段识别时，可试 **Paraformer Large**。这两个模型在停止录音后转写，录音时没有逐字文字不代表故障。需要实时识别时，在列表中选择支持流式识别的模型。

模型下载完成不等于已设为当前模型。先用包含数字和专有名词的短句测试，再决定是否更换。

## 决定是否使用 AI 润色

| 设置                   | 怎么选择            | 需要知道           |
| -------------------- | --------------- | -------------- |
| AI transcript polish | 中文同音词、标点需要整理时开启 | 默认开启；可关闭保留原始转写 |
| Polish model         | 选择已能正常调用的提供商模型  | 默认使用快且低价的模型角色  |

润色会把转写文本发给所选模型，可能产生模型费用；它不属于纯离线识别。润色失败或超时时检查保留的原始文本，再决定是否发送。模型连接配置见[提供商](https://onevium.com/zh/docs/providers)。

### 设置修正规则与词汇

1. 打开**设置 → 语音 → 修正偏好**，点击**管理**。
2. 在**自定义修正规则**写一条简短要求，例如「保留英文产品名和缩写，补充标点，不翻译或扩写我的话」。也可先用**填入行业模板**：它把规则与参考词汇填入可编辑文本，不是切换一个长期生效的行业模式。检查文字后点击**保存偏好**。
3. 在**我的词汇**点击**添加新词条**。例如，为虚构产品把正确写法设为 `Northstar`，常见误写设为 `North Star`，点击**添加词条**。最多填写三种误写，用逗号分隔；手工词条优先使用。
4. 重新打开面板，确认规则和词条分别保存。再听写一句包含产品名的短话，核对结果后发送。偏好是修正参考，保存成功不代表每次识别都会正确。

启用语音输入与 AI 润色后才会使用这些偏好。关闭 AI 修正时也能维护词库，但它不替代本地语音识别模型。

### 检查从编辑中学习的词汇

开启 AI 润色时，你在发送前对听写文本作出的明确术语修改，可以成为后续同一模型修正时的学习样例；发送消息不会额外发起一次 AI 请求。词条不一定立即出现在**已学习词汇**中，也不是每次编辑都会被学习：单字歧义、数字、否定变化与大范围改写不会自动学习。

到**修正偏好 → 管理 → 已学习词汇**检查、编辑、禁用或删除词条。**清空已学习词汇**还会移除待提炼样例，保留手工词条与自定义规则，确认框会说明范围。必须固定的拼写，直接加入「我的词汇」，不要只等待自动学习。

## 完成第一次听写

1. 打开目标项目和会话，点击输入框麦克风。默认快捷键为 macOS 的 **Shift+Command+D**，Windows/Linux 的 **Ctrl+Shift+D**；自定义后以快捷键设置为准。
2. 说出一个小任务：

```text
读取附件中的错误报告。
总结复现步骤和缺少的信息。
先不要修改文件。
```

3. 停止录音，等待识别及已启用的润色。期间输入框暂时锁定，完成后一次性插入文字。
4. 如果不想等待润色，按 **Escape** 跳过润色并保留原始转写；失败或超时也会保留原文。
5. 在目标输入框核对文字，修正后再发送。

## 怎样确认结果正确

优先检查数字、文件路径、专有名词，以及“不要”“只读”等限制词。确认文字出现在目标会话，不是别的分屏输入框。

出现转写只代表输入完成，不代表任务已执行。发送后仍需检查助手实际处理的范围和结果。

## 查看历史与本地录音

在「设置 → 语音 → 听写历史」按时间找到记录：

- 点击复制图标，复制当前采用的文本。
- 点击**更多操作 → 查看文本版本**，查看**当前文本**、**AI 修正文本**与**原始转写**。只有内容不同时才显示额外版本；选中需要的版本后点击**复制转写**。原始录音仍会保留。
- 点击「更多操作 → 下载录音」，保存音频后打开核对。
- 不再需要时，选择「更多操作 → 删除录音」，删除选定的录音记录。
- 使用「打开录音文件夹」查看本地音频；记录较多时可翻页。

本地识别不表示不留录音。分享录音或转写前确认内容；不要假定「隐私 → 清除本地数据」会同时清除语音记录。

## 更多语音控件

关闭「启用语音输入」会隐藏输入框麦克风并停用听写快捷键；需要时可在设置中重新开启。麦克风列表缺设备时，先允许系统权限，再检查设备连接。各项设置见[语音设置参考](https://onevium.com/zh/docs/settings/reference#voice)。

## 常见问题

- **不能录音：** 检查系统麦克风权限及输入设备；确认「启用语音输入」已开启。
- **没有识别结果：** 确认模型已下载、已选中，先用短录音排查。
- **识别不准：** 选择适合语言的模型，检查环境噪声，再考虑润色。
- **润色失败：** 检查所选提供商和模型，先保留并核对原始文字。
- **词汇修改没生效：** 区分「保存偏好」与「添加词条／保存词条」，重新打开面板核对，并确认 AI 润色开启；学习词汇可能在后续修正后才出现。
- **一直等待润色：** 按 Escape 保留原文，再检查润色模型连接；不要重复开始同一段录音。

## 下一步

在[语音设置参考](https://onevium.com/zh/docs/settings/reference#voice)查看详细控件，使用[工具菜单](https://onevium.com/zh/docs/tools-menu)附上任务材料。把话说完整后再发送，比反复修正已执行的任务更容易。
