Live Captions
实时字幕
逐字上屏、稳定不乱跳的现场字幕,端到端延迟低于 1.5 秒。
<1.5s
端到端延迟
98%+
专业场景准确率
* 示例数据 — 上线前替换为实测值
为什么"不乱跳"这么重要
大多数实时字幕系统会在识别过程中反复修改已经显示的文字 —— 观众刚读到一半,整句话变了。在会场大屏上,这种跳动会让人无法阅读。
我们的稳定前缀策略把一句话分成两部分:已确认的前缀不再改动,只有句尾的活跃部分会随着识别推进而更新。观众看到的是持续向前延伸的文字,而不是不断重排的段落。
三种状态
字幕在屏幕上有三种状态,运维人员可以实时看到:
- LIVE —— 正在识别,句尾还会变化
- STABLE —— 已稳定,不再回改
- FINAL —— 定稿,进入速记稿
部署方式
支持现场部署与云端两种模式。对网络条件不可控的会场,本地引擎可以完全离线运行,网络恢复后自动同步。
Engineering
不写口号,只列可验证的能力
每一项都是系统真实具备、可以现场实测的工程能力。
CAP-01
实时增量字幕
逐字上屏而非整句刷新,观众始终跟得上讲者节奏。
CAP-02
稳定前缀与动态纠错
已确认文字不再回改,修正只发生在句尾,字幕不乱跳。
CAP-03
多引擎融合
多路识别引擎实时择优,单引擎故障自动切换。
CAP-04
行业术语库
会前预置词表与译名,专有名词识别保持一致。