外语视频,现场同传。

直播、视频、流媒体,实时双语字幕。
任何语言的网页,翻成你的语言,双语对照。

免费使用开源不收集任何数据
Film

46 秒,看完全部。

静音循环播放;点右下角打开英文旁白

Two sources

有字幕翻字幕,没字幕听声音。

视频自带字幕时,直接拿播放器自己请求的字幕文件,整集一次翻完并缓存,再看不花钱。直播或没有字幕时,录下标签页的声音交给本机识别,再由大模型断句翻译。

  • 讲者停顿后 1.5–2.5 秒出译文,质量优先,延迟也不失控
  • 语言随你选:原文、译文语言都能换,讲的是哪种语言自动判断
  • 声音在你自己的电脑上识别,不上传
  • 英语 → 中文
  • 日语 → 中文
  • 中文 → 英语
  • 中文 → 日语
  • 韩语 → 中文
  • 任意语言互译
字幕文件视频自带字幕时
标签页声音直播、没有字幕时
本机识别在你的电脑上运行
大模型
断句 · 纠错 · 翻译你选的翻译服务
The labor market has cooled but remains solid.
劳动力市场有所降温,但依然稳健。
和讲者开口同步上屏看过的集数会缓存
Accuracy

译得准,术语也准。

不是一句一句地直译。大模型连同前后文一起理解:听错的词按上下文改正,专业术语用行业里的说法,may、could、likely 这类分寸照原文保留。

  • 听错了也能翻对:语音识别的错字按上下文纠正
  • 行话译成行内说法:财经、科技等术语按词库统一译法
  • 剧集看前后台词:人名、称呼全集统一,省略的话按场景理解
  • 深度理解(可选):后台再逐段精修一遍,替换掉实时译文
原文The community decided to keep rates unchanged.
逐句直译社区决定维持利率不变。
Simulcap委员会决定维持利率不变。
语音识别把 committee 听成了 community,按上下文改正
Delayed playback

画面、声音、字幕,同一时刻。

识别和翻译总要一点时间。打开延迟播放,画面和声音整体往后推几秒,字幕就能在讲者开口的那一刻出现,像看延时直播。蓝牙耳机的输出延迟也会自动补上。

  • 延迟几秒可以自己设,也可以关掉
  • 有版权保护、没法延迟的画面会自动按实时播放
讲者
开口
画面
画面
声音
声音
字幕
委员会决定…
0 s12345 s
2.0 s
Display modes

三种字幕,按场合挑。

在播放器菜单里随时切换;字号、颜色、背景、位置也都能按自己的习惯调。

实时

边翻边改,像电视直播的滚动字幕:新句在下面,旧句往上推、变淡。

适合直播、发布会
Glossary

专业场合,术语不走样。

按视频自动选用合适的词库,专有名词按你定的译法翻。内置一份美联储财经词库作示例,其他行业可以自己新建,或从表格导入。

  • 词条同时当识别热词,专有名词听得更准
  • 剧集会整集通读一遍,人名、称呼统一译法
  • 可以加自己的翻译规则
示例 20 / 约 840 条
FOMC联邦公开市场委员会
federal funds rate联邦基金利率
basis point基点
target range目标区间
dot plot点阵图
quantitative tightening量化紧缩
balance sheet资产负债表
dual mandate双重使命
data dependent取决于数据
soft landing软着陆
core PCE核心PCE物价指数
neutral rate中性利率
forward guidance前瞻指引
maximum employment充分就业
price stability物价稳定
restrictive policy限制性政策
rate cut降息
Summary of Economic Projections经济预测摘要
Beige Book褐皮书
Warsh沃什
示例:财经词库自带的翻译规则——严格保留 may / could / likely 的语气强弱,不改变鹰鸽倾向;数字写成「25个基点」「3.75%至4%」。
Web pages

浏览器不翻的网页,也能翻。

很多后台、控制台和在线文档会告诉浏览器「不要翻译」,左右分栏的页面右边常常翻不到,翻完链接也点不动了。Simulcap 把任何语言的网页翻成你选的语言,原网页一个字不改,译文另外插进去,随时一键换回原文。

  • 声明了「不要翻译」的页面:单页应用、云服务控制台、在线文档的正文照样翻
  • 分栏和框架页面:路由器后台这种左右两栏的页面,换页后自动接着翻
  • 链接、按钮、菜单翻译后还能点,展开的子菜单不会丢
  • 排版不乱:短文字放旁边,段落另起一行,按钮放不下就缩小译文
  • 双语对照或只看译文,快捷键 ⌥A / Alt+A 一键切换;文本框里的内容也能翻
  • 选中就翻:右键或小图标,译文卡片跟着网页的深浅配色
192.168.1.1/admin

Wireless settings

Changes take effect after the router restarts. Make sure your devices reconnect to the new network name.

Learn more about channel width

示例:左右分栏、声明了「不要翻译」的路由器后台

你可能还想知道

没找到答案的,README 里有完整说明。

支持哪些网站?
YouTube
自动字幕、上传字幕直接翻;直播和没字幕的视频听声音同传。
Netflix
自动选原声语言字幕,日剧直接日译中;没有字幕时听声音。
哔哩哔哩
UP 主字幕和 AI 字幕(AI 字幕要登录);都没有就按段下载音轨识别,几秒出第一句。
U-NEXT
只能听声音翻译,原因见下面。
任何网页
翻译此页(双语对照或仅译文)、选中文字翻译。
怎么安装?

Simulcap 正在完善中,完成后会上架 Chrome 网上应用店,到时点一下就能安装,不需要任何技术操作。

要花钱吗?

扩展免费。翻译用你自己的 Key,按 1 小时连续讲话估算(约 40 万输入、3 万输出 tokens):

翻译服务预设模型输入 / 输出(每百万 tokens)1 小时约
智谱glm-4.7-flash免费$0
谷歌 / 必应机器翻译网页翻译接口免费$0
通义(阿里百炼)qwen-flash¥0.15 / ¥1.5$0.015
火山方舟doubao-seed-1.6-flash¥0.15 / ¥1.5(未核实)$0.015
DeepSeekdeepseek-flash$0.15–0.30 / $0.60–1.20$0.08–0.16
Google Geminigemini-3.1-flash-lite$0.25 / $1.50$0.15
OpenAIgpt-5-mini$0.25 / $2.00$0.16
Anthropicclaude-haiku-4-5$1.00 / $5.00$0.55

2026 年 10 月各家官网价,1 美元 ≈ 7.1 元。字幕文件整集只翻一次,再看走缓存;本机识别和同传语音不收费;打开「深度理解」用量是上表的数倍。

听声音识别需要准备什么?

听声音识别要用扩展附带的本机识别服务,首次启动会自动安装并下载约 1 GB 模型,之后开着就行。只翻字幕文件的话不需要。也可以改用云端识别(内置 Deepgram,用你自己的 Key)。

支持哪些语言?

不限语言对:原文和译文语言都能自己选,默认译成简体中文,大模型能翻的语言都可以,网页翻译同样如此。听声音时自动判断讲的是哪种语言,英语、日语有专用识别模型,其他语言用多语言模型。识别引擎、翻译模型、语言都是可以扩展的。扩展的菜单有中文、日本語、English。

我的数据会上传吗?

没有自己的服务器,不收集任何数据。Key 只存在本机浏览器,只发给你选的那家服务,视频页面里的脚本也拿不到;声音在本机识别,不保存;网页文字只在你点「翻译此页」或选中文字后发给网页翻译服务;诊断日志默认关闭。

为什么 U-NEXT 只能听声音?

U-NEXT 的字幕是烧录在视频画面里的,没有单独的字幕文件可读;画面有版权保护,也不能延迟播放,所以字幕会比声音晚 1–2 秒。

免费的谷歌 / 必应翻译和大模型有什么区别?

机器翻译一句一句地翻,用不上上下文,深度理解、统一人名术语、参考后文这几项会变灰。想免费又要大模型的质量,可以选智谱。

网页翻译用什么翻?要钱吗?

默认用谷歌免费翻译,不用填 Key;也可以在弹窗或设置页单独换成大模型(DeepSeek、智谱等),和视频字幕用的翻译服务分开选。只有你点「翻译此页」或选中文字时,才会把那部分文字发给翻译服务。

哪些网页翻译不了?

嵌在页面里的其他网站(跨域框架)浏览器不允许读取;画在画布或图片里的文字没有文本可翻;网页上的代码编辑器会特意跳过,免得改坏代码。其余包括单页应用、在线文档、分栏页面、Web 组件,都能翻。

能和其他字幕翻译扩展一起用吗?

不建议。同类扩展都会拦截播放器的字幕请求、隐藏原生字幕,同时启用会互相干扰,用 Simulcap 时先停用其他的。