沉浸式翻译终极指南:双语网页翻译与多格式翻译深度解析
【免费下载链接】immersive-translate沉浸式双语网页翻译扩展 , 支持输入框翻译, 鼠标悬停翻译, PDF, Epub, 字幕文件, TXT 文件翻译 - Immersive Dual Web Page Translation Extension项目地址: https://gitcode.com/GitHub_Trending/im/immersive-translate
你查一份英文论文、翻一个 GitHub issue,是不是总要开两个窗口来回复制?沉浸式翻译(Immersive Translate)是一个双语网页翻译扩展:原文不动,译文平行显示在下方,还支持 PDF、Epub、字幕文件、TXT 和输入框翻译。装好它,语言障碍这件事基本可以翻篇了。
📍 别再开两个窗口了:双语并行显示到底解决了什么
想象一下以前的操作:看到一段生词,选中、复制、切到翻译网站、粘贴、等结果、再切回来。一个长页面下来,来回切换几十次,阅读节奏完全被打断。
沉浸式翻译的做法是"翻译完就贴在原文下面"。它通过内容脚本扫描页面 DOM(DOM 就是浏览器里页面的结构化数据),把正文拆成一个个可翻译的文本块,逐块请求翻译服务,然后在原文下方以不同颜色插入译文。原文的排版、代码块、表格格式全部保留,你随时可以对照术语。
这个能力的核心在内容脚本 content_main.js 里,超过 16000 行代码,负责文本提取、语言识别、翻译调度和双语渲染四件事。对使用者的意义是:你不需要关心它怎么工作,只需要按Alt+A,整页翻译就开始了。
快捷键也是开箱即用的。打开 manifest.json 能看到预设命令:
"commands": { "toggleTranslatePage": { "suggested_key": { "default": "Alt+A" } }, "translateInputBox": { "suggested_key": { "default": "Alt+I" } }, "toggleSidePanel": { "suggested_key": { "default": "Alt+S" } } }翻译整页、翻译输入框、呼出侧边栏,三个动作各绑定一个快捷键,肌肉记忆一两周就形成了。效果立竿见影。
🚀 浏览器扩展安装步骤:三步装好,Chrome 和 Firefox 都通用
这个仓库发布的是编译好的扩展文件,你不需要懂构建流程,三步就能装上:
- 克隆仓库:
git clone https://gitcode.com/GitHub_Trending/im/immersive-translate - 找到对应目录:Chrome/Edge 用户用
dist/chrome,Firefox 用户用dist/firefox - 打开浏览器扩展管理页,开启"开发者模式",选择"加载已解压的扩展",选中对应目录
装完后建议先做一次"体检":确认扩展图标出现在工具栏,随便打开一个英文网页,按Alt+A看双语效果是否正常。
值得注意的是两个目录的架构差异。Chrome 版是 Manifest V3(新版扩展规范),后台用 Service Worker——一种按需启动、用完即休眠的后台脚本,内存占用更小;Firefox 版目前是 Manifest V2,后台仍是常驻脚本。两者核心功能一致,你选自己用的浏览器装就行。
📚 不止网页:PDF、Epub、字幕文件翻译这样用
网页翻译只是冰山一角。这个项目把"多格式翻译"做成了完整的工具集:
PDF 文档翻译。打开本地或在线的 PDF 论文,扩展会生成一个并排的译文视图,核心逻辑在 pdf/index.html 中。读 arXiv 论文时特别实用——公式、图表位置不会错位。
字幕文件翻译。拿到 SRT/VTT 字幕后想生成双语字幕?字幕模块位于 video-subtitle/inject.js,支持把翻译结果写回字幕流,看英文剧、技术讲座时体验完全不同。
Epub 电子书和 TXT 文本。在扩展选项页里打开阅读器,拖入文件即可逐段双语对照。
图片翻译。页面上的英文图片(比如报错截图、架构图)也能翻,底层用的是tesseract目录下的 OCR 引擎(OCR 即光学字符识别,把图片里的文字"读"出来)。
对经常啃英文资料的人来说,这几个场景基本覆盖了日常 90% 的跨语言需求,不用再往第三个工具里迁移文件了。
🔍 翻译不生效、译文串了?先按这三步排坑
症状一:整页点翻译没反应。先分清是"没翻译"还是"翻译了但没显示"。按F12打开开发者工具看 Console,常见的是翻译 API 网络不通——尤其是需要挂代理才能访问的服务。换一个翻译引擎(选项页里可切换)通常立刻解决。
症状二:译文位置错乱、内容串位。这是复杂页面的老问题,比如重排很激进的瀑布流站点。可以在选项页把翻译起始模式从"动态"改成"静态"(对应配置项translationStartMode,定义在 default_config.json 中)。动态模式跟随页面滚动增量翻译,速度快;静态模式一次处理完整 DOM,稳定但稍慢。页面一乱,就切静态。
症状三:输入框翻译不触发。Alt+I是手动触发翻译输入框的快捷键,部分站点需要焦点明确落在输入框内才生效。如果经常需要,可以把这个快捷键养成习惯,比鼠标操作快得多。
还有一个隐藏杀手:浏览器更新后扩展可能需要重新授权权限,检查扩展详情页的站点访问设置。
⚙️ 高级配置:让翻译引擎按你的习惯工作
装好只是开始,真正舒服的体验来自这几项配置(入口在选项页,源码见 options.html):
- 翻译引擎分层使用。不同引擎性格不同:规则引擎快而稳,适合扫读;AI 大模型(OpenAI、Claude、Gemini 等都支持)更懂上下文,适合精读技术文档。给"快速翻译"和"精确翻译"配置不同的引擎,日常浏览用快的,深读时手动切换,成本和时间都能省。
- 输入框翻译单独指定引擎。配置里
inputTranslationService默认是"继承"主引擎,你也可以让它走更便宜快速的通道。 - 缓存别关。相同文本会命中本地缓存直接返回,翻过的内容二次打开几乎零延迟,这是感知最明显的提速点。
如果你要定制行为,所有默认值都集中在dist/chrome/default_config.json里,逐项对照着改,出问题了对照还原即可,不会翻车。
建议与一句话总结
可执行建议:先按上面的三步装好扩展,把整页翻译(Alt+A)和输入框翻译(Alt+I)两个快捷键用起来,第一周只调一件事——给"快速翻译"和"精确翻译"分别指定引擎。习惯养成后再碰 PDF、字幕这些高级功能,每一步都有明确收益。
一句话总结:沉浸式翻译把"跨语言阅读"从切窗口的手工业,变成了一次按键的流水线。
【免费下载链接】immersive-translate沉浸式双语网页翻译扩展 , 支持输入框翻译, 鼠标悬停翻译, PDF, Epub, 字幕文件, TXT 文件翻译 - Immersive Dual Web Page Translation Extension项目地址: https://gitcode.com/GitHub_Trending/im/immersive-translate
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考