开始使用
如何选择云端、混合与本地模式
了解三种处理方式在语音识别、网络使用和数据路径上的主要区别。
响牍提供 云端模式、混合模式和本地模式。三种模式的主要区别,是语音识别在哪里完成、后续文字处理在哪里完成,以及本次听写的数据会经过哪些路径。
云端模式
云端模式使用托管的语音识别服务完成语音识别。当内容和设置需要时,识别后的文字还可以继续经过托管的文字整理流程。
适合希望直接使用托管语音服务、且当前网络环境稳定的场景。云端模式会使用套餐中的托管云端语音时长。
混合模式
混合模式先在设备侧完成语音识别。
- 本次听写音频不上传到语音识别服务;
- 如果后续确实需要文字处理,文本和经允许的上下文可以发送到当前配置的文字服务;
- 混合模式需要安装本地语音包。
本地模式
本地模式在设备侧完成当前听写路径中的语音识别,并使用本地的标点、词汇、Snippets 和确定性规则处理文字。
当前本地模式听写路径不会把本次听写的:
- 音频;
- 转写文本;
- 上下文
发送到网络。
本地模式同样需要安装本地语音包,而且不消耗响牍托管的云端语音服务额度。
三种模式怎么选
| 你的主要需求 | 更适合从哪种模式开始 |
|---|---|
| 直接使用托管语音识别 | 云端模式 |
| 音频不上传,但需要时仍使用文字服务 | 混合模式 |
| 当前听写的音频、文本和上下文都不发送到网络 | 本地模式 |
模式并不是永久选择,可以根据不同场景调整。
一个容易混淆的概念
本地模式不等于“在电脑上运行一个本地大语言模型”。
响牍当前本地模式的核心是本地语音识别,以及标点、词汇、Snippets 和确定性规则等设备侧处理。
