词典与替换规则
侧栏中的两张表会在插入之前修改识别出的文字。两者都在本机运行;任何一张表出错时,听写都会按原来的文字继续完成。
词典
「词典」页列出识别器容易听错的词。每个词条包含:
- 正确写法,例如
kubectl或同事的名字; - 最多 10 个曾听成的写法,例如「酷伯 control」。
识别完成后,文字中所有曾听成的写法会立即替换为正确写法,这一步早于 AI 润色和替换规则。已启用词条的正确写法还会作为提示发送给云端识别和 AI 润色,让它们保持这些写法。本地模型不接收提示,对它们只进行识别后的纠正。
匹配规则如下:
- 字母不区分大小写。
- 在用空格分词的语言中,只匹配完整的词:
cat不会替换concatenate中的部分。 - 中文、日文和韩文在任意位置都会匹配。
- 同一位置取最长的匹配,已替换的文字不会再次匹配。
页面上的「试一试」可以查看词典对一段示例文字的修改;「用最近一次听写」会填入你最近一次的识别结果。在历史记录中,「加入词典」可以把听错的词直接添加为词条。

词典最多容纳 500 个词条。发送给云端服务的提示需要截短时,按词条顺序决定优先级。
替换规则
「规则」页在 AI 润色之后,按列表顺序改写最终文字。每条规则包含:
- 名称;
- 字面匹配或正则表达式;
- 替换内容,留空表示删除匹配的文字;
- 是否区分大小写。
正则表达式使用 Rust 语法:可以用 $1 引用分组,但不支持环视和反向引用。无法编译的规则在保存时就会被拒绝。
规则可以从 TOML 文件导入,也可以导出为 TOML,例如:
toml
version = 1
[[rule]]
name = "git push"
kind = "literal"
pattern = "给他 push"
replacement = "git push"
[[rule]]
name = "PR 编号"
kind = "regex"
pattern = '\bpr (\d+)'
replacement = "PR #$1"
case_sensitive = false导入时可以替换整张表,也可以按名称合并到现有规则中。规则表最多容纳 200 条规则。「试运行」让一段示例文字依次经过词典和全部已启用的规则,不会插入任何内容。
简体与繁体
在「语音模型」页「识别设置」的「中文字形」中,可以选择简体(默认)、繁体或保持原样。字形在识别之后立即转换,因此词典按你选择的字形进行匹配。