音频
不发送到网络。语音识别在设备侧完成。
本地模式
在本地模式下,响牍在设备侧完成语音识别,并使用本地的标点、Vocabulary、Snippets 与确定性规则处理听写结果。当前听写路径不会把本次听写的音频、转写文本或上下文发送到网络。
LOCAL PROCESSING
本地模式并不是简单地把“云端识别”换成“本地识别”。
当前本地模式的听写路径包括:
这些能力共同完成一次从语音输入到文字返回的本地听写流程。
本次听写从语音输入开始。
使用本地语音包在设备侧完成识别。
标点、Vocabulary、Snippets 与确定性规则在本地处理。
文字返回当前输入位置。
DATA PATH
对于当前本地模式的听写路径:
语音识别在设备侧完成。
当前听写结果不需要发送到托管文字服务完成处理。
当前听写路径使用的上下文不会发送到网络。
THREE MODES
云端、混合和本地三种模式最终都服务于同一件事:把你的口述转成可以继续使用的文字。
不同的是中间的数据路径和处理位置。
| 比较项 | CLOUD云端模式 | HYBRID混合模式 | LOCAL本地模式 |
|---|---|---|---|
| 语音识别 | 托管语音服务 | 设备侧 | 设备侧 |
| 本次听写音频 | 进入托管语音识别路径 | 不上传 | 不发送到网络 |
| 文字处理 | 需要时使用托管文字处理 | 需要时可使用配置的文字服务 | 本地规则与个性化能力 |
| 文本 / 经允许上下文 | 需要时可进入托管文字处理 | 需要时可进入配置的文字服务 | 当前听写路径不发送到网络 |
| 本地语音包 | 不需要 | 需要 | 需要 |
| 托管云端语音时长 | 使用 | 不使用托管语音识别 | 不使用 |
不要把“混合模式”和“本地模式”都简单归类为“本地识别”。
混合模式的音频留在设备侧,但必要时文本和经允许的上下文仍可以进入文字服务;本地模式的当前听写路径不会发送本次听写的音频、转写文本或上下文。比较三种处理方式
A COMMON MISUNDERSTANDING
“本地模式”描述的是一次听写的处理路径。
当前本地模式的核心是:
它不应被理解为:在你的电脑上运行一个本地大语言模型,再把每一次听写交给它重新生成。
响牍不会为了让结果显得“更智能”,而把所有听写都强制交给生成式模型处理。
对于不需要语义处理的内容,可以直接返回识别结果或使用确定性规则;只有在允许的模式和设置下,才会进入相应的文字处理路径。
WHEN LOCAL MAKES SENSE
本地模式不是所有人的默认答案。
它更适合这些情况:
例如正在输入:
本地语音识别由设备侧完成。
本地模式不使用响牍托管的云端语音识别额度。
对于直接听写、固定词汇、Snippets 和规则处理,本地模式提供了一条更简单的路径。
BEFORE YOU START
使用本地模式前,需要先安装响牍的本地语音包。
本地语音包用于在设备侧完成语音识别。
本地语音包的实际大小、下载方式和当前状态,应以响牍客户端实际显示的信息为准。
支持当前 Windows 版本。
USAGE