本地模式

语音留在设备侧,文字也不必离开。

在本地模式下,响牍在设备侧完成语音识别,并使用本地的标点、Vocabulary、Snippets 与确定性规则处理听写结果。当前听写路径不会把本次听写的音频、转写文本或上下文发送到网络。

CURRENT DICTATION当前本地模式听写路径
  1. 01麦克风
  2. 02本地语音识别
  3. 03本地规则与个性化
  4. 04当前输入位置
音频
留在设备侧
转写文本
留在设备侧
上下文
留在设备侧

LOCAL PROCESSING

一次听写,从声音到文字都可以在设备侧完成。

本地模式并不是简单地把“云端识别”换成“本地识别”。

当前本地模式的听写路径包括:

  • 本地语音识别;
  • 标点处理;
  • Vocabulary;
  • Snippets;
  • 确定性规则。

这些能力共同完成一次从语音输入到文字返回的本地听写流程。

  1. 01

    语音输入

    本次听写从语音输入开始。

    INPUT
  2. 02

    本地语音识别

    使用本地语音包在设备侧完成识别。

    LOCAL
  3. 03

    标点 / Vocabulary / Snippets / 规则

    标点、Vocabulary、Snippets 与确定性规则在本地处理。

    LOCAL
  4. 04

    返回当前输入位置

    文字返回当前输入位置。

    OUTPUT

DATA PATH

本次听写的三类核心数据,不需要离开设备。

对于当前本地模式的听写路径:

01

音频

不发送到网络。

语音识别在设备侧完成。

02

转写文本

不发送到网络。

当前听写结果不需要发送到托管文字服务完成处理。

03

上下文

不发送到网络。

当前听写路径使用的上下文不会发送到网络。

这里描述的是 本地模式下的一次听写路径

不要把它扩大理解成:

响牍整个应用的所有功能在任何时候都绝对不联网。

账号、版本更新或其他非听写功能是否需要网络,应根据对应功能本身判断。

查看完整数据路径

THREE MODES

真正的区别,不只是“识别在哪里”。

云端、混合和本地三种模式最终都服务于同一件事:把你的口述转成可以继续使用的文字。

不同的是中间的数据路径和处理位置。

比较项CLOUD云端模式HYBRID混合模式LOCAL本地模式
语音识别托管语音服务设备侧设备侧
本次听写音频进入托管语音识别路径不上传不发送到网络
文字处理需要时使用托管文字处理需要时可使用配置的文字服务本地规则与个性化能力
文本 / 经允许上下文需要时可进入托管文字处理需要时可进入配置的文字服务当前听写路径不发送到网络
本地语音包不需要需要需要
托管云端语音时长使用不使用托管语音识别不使用

语音识别

CLOUD云端模式
托管语音服务
HYBRID混合模式
设备侧
LOCAL本地模式
设备侧

本次听写音频

CLOUD云端模式
进入托管语音识别路径
HYBRID混合模式
不上传
LOCAL本地模式
不发送到网络

文字处理

CLOUD云端模式
需要时使用托管文字处理
HYBRID混合模式
需要时可使用配置的文字服务
LOCAL本地模式
本地规则与个性化能力

文本 / 经允许上下文

CLOUD云端模式
需要时可进入托管文字处理
HYBRID混合模式
需要时可进入配置的文字服务
LOCAL本地模式
当前听写路径不发送到网络

本地语音包

CLOUD云端模式
不需要
HYBRID混合模式
需要
LOCAL本地模式
需要

托管云端语音时长

CLOUD云端模式
使用
HYBRID混合模式
不使用托管语音识别
LOCAL本地模式
不使用

不要把“混合模式”和“本地模式”都简单归类为“本地识别”。

混合模式的音频留在设备侧,但必要时文本和经允许的上下文仍可以进入文字服务;本地模式的当前听写路径不会发送本次听写的音频、转写文本或上下文。
比较三种处理方式

A COMMON MISUNDERSTANDING

本地模式,不等于本地大语言模型。

“本地模式”描述的是一次听写的处理路径。

不是
  • 本地大语言模型
  • 每次听写都进行生成式重写

当前本地模式的核心是:

  • 本地语音识别
  • 本地标点
  • Vocabulary
  • Snippets
  • 确定性规则

它不应被理解为:在你的电脑上运行一个本地大语言模型,再把每一次听写交给它重新生成。

响牍不会为了让结果显得“更智能”,而把所有听写都强制交给生成式模型处理。

对于不需要语义处理的内容,可以直接返回识别结果或使用确定性规则;只有在允许的模式和设置下,才会进入相应的文字处理路径。

WHEN LOCAL MAKES SENSE

当“数据路径”本身就是你的使用条件。

本地模式不是所有人的默认答案。

它更适合这些情况:

01

你不希望本次听写内容进入网络

例如正在输入:

  • 尚未发布的工作内容;
  • 内部材料;
  • 私人笔记;
  • 不希望经过云端文字处理的内容。
02

你希望语音识别不依赖托管语音服务

本地语音识别由设备侧完成。

03

你希望本地听写不消耗托管云端语音时长

本地模式不使用响牍托管的云端语音识别额度。

04

你不需要每一次听写都进行生成式文字处理

对于直接听写、固定词汇、Snippets 和规则处理,本地模式提供了一条更简单的路径。

BEFORE YOU START

本地模式需要本地语音包。

使用本地模式前,需要先安装响牍的本地语音包。

本地语音包用于在设备侧完成语音识别。

本地语音包的实际大小、下载方式和当前状态,应以响牍客户端实际显示的信息为准。

当前支持Windows 10 / 11x64

支持当前 Windows 版本。

USAGE

0托管云端语音时长消耗

本地听写,不消耗托管云端语音时长。

响牍套餐中的语音时长,主要对应托管的云端语音服务。

本地模式的语音识别在设备侧完成,因此不会从套餐中的托管云端语音时长中扣除。

这里需要区分:

语音服务额度其他可能存在的文字服务或账号能力

它们不是同一个概念。

CHOOSE YOUR PATH

你可以根据内容,选择每一次听写走哪条路径。

云端需要托管语音识别时,使用云端模式。

混合希望音频留在设备侧、但仍需要文字服务时,使用混合模式。

本地希望当前听写的音频、转写文本和上下文都不发送到网络时,使用本地模式。