外语视频,现场同传。
直播、视频、流媒体,实时双语字幕。
任何语言的网页,翻成你的语言,双语对照。
46 秒,看完全部。
静音循环播放;点右下角打开英文旁白
有字幕翻字幕,没字幕听声音。
视频自带字幕时,直接拿播放器自己请求的字幕文件,整集一次翻完并缓存,再看不花钱。直播或没有字幕时,录下标签页的声音交给本机识别,再由大模型断句翻译。
- 讲者停顿后 1.5–2.5 秒出译文,质量优先,延迟也不失控
- 语言随你选:原文、译文语言都能换,讲的是哪种语言自动判断
- 声音在你自己的电脑上识别,不上传
- 英语 → 中文
- 日语 → 中文
- 中文 → 英语
- 中文 → 日语
- 韩语 → 中文
- 任意语言互译
断句 · 纠错 · 翻译你选的翻译服务
译得准,术语也准。
不是一句一句地直译。大模型连同前后文一起理解:听错的词按上下文改正,专业术语用行业里的说法,may、could、likely 这类分寸照原文保留。
- 听错了也能翻对:语音识别的错字按上下文纠正
- 行话译成行内说法:财经、科技等术语按词库统一译法
- 剧集看前后台词:人名、称呼全集统一,省略的话按场景理解
- 深度理解(可选):后台再逐段精修一遍,替换掉实时译文
画面、声音、字幕,同一时刻。
识别和翻译总要一点时间。打开延迟播放,画面和声音整体往后推几秒,字幕就能在讲者开口的那一刻出现,像看延时直播。蓝牙耳机的输出延迟也会自动补上。
- 延迟几秒可以自己设,也可以关掉
- 有版权保护、没法延迟的画面会自动按实时播放
三种字幕,按场合挑。
在播放器菜单里随时切换;字号、颜色、背景、位置也都能按自己的习惯调。
实时
边翻边改,像电视直播的滚动字幕:新句在下面,旧句往上推、变淡。
专业场合,术语不走样。
按视频自动选用合适的词库,专有名词按你定的译法翻。内置一份美联储财经词库作示例,其他行业可以自己新建,或从表格导入。
- 词条同时当识别热词,专有名词听得更准
- 剧集会整集通读一遍,人名、称呼统一译法
- 可以加自己的翻译规则
may / could / likely 的语气强弱,不改变鹰鸽倾向;数字写成「25个基点」「3.75%至4%」。浏览器不翻的网页,也能翻。
很多后台、控制台和在线文档会告诉浏览器「不要翻译」,左右分栏的页面右边常常翻不到,翻完链接也点不动了。Simulcap 把任何语言的网页翻成你选的语言,原网页一个字不改,译文另外插进去,随时一键换回原文。
- 声明了「不要翻译」的页面:单页应用、云服务控制台、在线文档的正文照样翻
- 分栏和框架页面:路由器后台这种左右两栏的页面,换页后自动接着翻
- 链接、按钮、菜单翻译后还能点,展开的子菜单不会丢
- 排版不乱:短文字放旁边,段落另起一行,按钮放不下就缩小译文
- 双语对照或只看译文,快捷键 ⌥A / Alt+A 一键切换;文本框里的内容也能翻
- 选中就翻:右键或小图标,译文卡片跟着网页的深浅配色
Wireless settings
Changes take effect after the router restarts. Make sure your devices reconnect to the new network name.
示例:左右分栏、声明了「不要翻译」的路由器后台
你可能还想知道
没找到答案的,README 里有完整说明。
支持哪些网站?
- YouTube
- 自动字幕、上传字幕直接翻;直播和没字幕的视频听声音同传。
- Netflix
- 自动选原声语言字幕,日剧直接日译中;没有字幕时听声音。
- 哔哩哔哩
- UP 主字幕和 AI 字幕(AI 字幕要登录);都没有就按段下载音轨识别,几秒出第一句。
- U-NEXT
- 只能听声音翻译,原因见下面。
- 任何网页
- 翻译此页(双语对照或仅译文)、选中文字翻译。
怎么安装?
Simulcap 正在完善中,完成后会上架 Chrome 网上应用店,到时点一下就能安装,不需要任何技术操作。
要花钱吗?
扩展免费。翻译用你自己的 Key,按 1 小时连续讲话估算(约 40 万输入、3 万输出 tokens):
| 翻译服务 | 预设模型 | 输入 / 输出(每百万 tokens) | 1 小时约 |
|---|---|---|---|
| 智谱 | glm-4.7-flash | 免费 | $0 |
| 谷歌 / 必应机器翻译 | 网页翻译接口 | 免费 | $0 |
| 通义(阿里百炼) | qwen-flash | ¥0.15 / ¥1.5 | $0.015 |
| 火山方舟 | doubao-seed-1.6-flash | ¥0.15 / ¥1.5(未核实) | $0.015 |
| DeepSeek | deepseek-flash | $0.15–0.30 / $0.60–1.20 | $0.08–0.16 |
| Google Gemini | gemini-3.1-flash-lite | $0.25 / $1.50 | $0.15 |
| OpenAI | gpt-5-mini | $0.25 / $2.00 | $0.16 |
| Anthropic | claude-haiku-4-5 | $1.00 / $5.00 | $0.55 |
2026 年 10 月各家官网价,1 美元 ≈ 7.1 元。字幕文件整集只翻一次,再看走缓存;本机识别和同传语音不收费;打开「深度理解」用量是上表的数倍。
听声音识别需要准备什么?
听声音识别要用扩展附带的本机识别服务,首次启动会自动安装并下载约 1 GB 模型,之后开着就行。只翻字幕文件的话不需要。也可以改用云端识别(内置 Deepgram,用你自己的 Key)。
支持哪些语言?
不限语言对:原文和译文语言都能自己选,默认译成简体中文,大模型能翻的语言都可以,网页翻译同样如此。听声音时自动判断讲的是哪种语言,英语、日语有专用识别模型,其他语言用多语言模型。识别引擎、翻译模型、语言都是可以扩展的。扩展的菜单有中文、日本語、English。
我的数据会上传吗?
没有自己的服务器,不收集任何数据。Key 只存在本机浏览器,只发给你选的那家服务,视频页面里的脚本也拿不到;声音在本机识别,不保存;网页文字只在你点「翻译此页」或选中文字后发给网页翻译服务;诊断日志默认关闭。
为什么 U-NEXT 只能听声音?
U-NEXT 的字幕是烧录在视频画面里的,没有单独的字幕文件可读;画面有版权保护,也不能延迟播放,所以字幕会比声音晚 1–2 秒。
免费的谷歌 / 必应翻译和大模型有什么区别?
机器翻译一句一句地翻,用不上上下文,深度理解、统一人名术语、参考后文这几项会变灰。想免费又要大模型的质量,可以选智谱。
网页翻译用什么翻?要钱吗?
默认用谷歌免费翻译,不用填 Key;也可以在弹窗或设置页单独换成大模型(DeepSeek、智谱等),和视频字幕用的翻译服务分开选。只有你点「翻译此页」或选中文字时,才会把那部分文字发给翻译服务。
哪些网页翻译不了?
嵌在页面里的其他网站(跨域框架)浏览器不允许读取;画在画布或图片里的文字没有文本可翻;网页上的代码编辑器会特意跳过,免得改坏代码。其余包括单页应用、在线文档、分栏页面、Web 组件,都能翻。
能和其他字幕翻译扩展一起用吗?
不建议。同类扩展都会拦截播放器的字幕请求、隐藏原生字幕,同时启用会互相干扰,用 Simulcap 时先停用其他的。