产品功能

覆盖本地视频、会议直播与学术研究场景的实时双语字幕能力。

本地视频字幕

选择本地视频文件即可播放,识别结果实时叠加于画面底部。视频在浏览器内播放,仅音频用于识别与翻译。

  • 支持拖入文件,无需上传
  • 暂停时停止音频传输,继续播放后字幕自动衔接
  • 兼容浏览器原生播放控件

悬浮字幕,跨应用置顶显示

采集浏览器标签页、整个屏幕或麦克风音频,字幕显示在独立的置顶窗口中,适用于视频会议、直播与在线课程。

  • 三种音频来源:标签页、屏幕、麦克风
  • 字幕窗口支持自由拖动与缩放
  • 需使用 Chrome 或 Edge(文档画中画)

双语对照,原文译文同步输出

单一连接同时返回自动识别的原文与翻译后的译文,可按需选择显示内容。

  • 源语言自动识别,无需手动指定
  • 60 种目标语言,覆盖中、英、日、韩、法、德、西、俄、阿、粤语等
  • 字号与行数可调

呈现策略,可配置的上屏方式

同一识别结果可采用不同的上屏策略,设置同时作用于实时字幕与会话回放。

  • 显示时机:实时显示或仅显示定稿
  • 延迟显示:0–3000 毫秒可调
  • 新词显示:逐词淡入或直接出现;修正提示:高亮或静默替换
  • 术语表:显示时将指定词语替换为统一写法

会话导出与回放分析

会话结束后由浏览器直接生成三个文件,不经过服务器。回放页可读取文件,按原时间线逐句分析延迟与改写。

  • 事件日志:记录每次字幕更新的时间戳与音频位置
  • 分段统计表:每句的首字延迟、改写次数与定稿时间
  • 音频:发送至模型的 16 kHz 单声道 WAV

引擎对照,多引擎并排评估

同一路音频同时接入两个识别引擎,结果并排显示、时间轴对齐,措辞、断句与延迟差异一目了然。

  • 双引擎同步运行,时间轴对齐
  • 适用于模型选型与研究评估
  • 对照结果支持导出

在线体验实时字幕

首页即可使用麦克风试用 20 秒,注册后可使用全部功能。