看不懂外语游戏剧情?3 步上手免费开源实时屏幕翻译工具 Translumo 看不懂外语游戏剧情3 步上手免费开源实时屏幕翻译工具 Translumo【免费下载链接】TranslumoAdvanced real-time screen translator for games, hardcoded subtitles in videos, static text and etc.项目地址: https://gitcode.com/gh_mirrors/tr/Translumo深夜两点我卡在一个日系 RPG 的支线任务里NPC 说了长长一段话我只看懂几个假名。退全屏、截图、粘贴到翻译软件、切回游戏循环三遍之后我决定找一个能直接读屏幕的工具然后遇到了 Translumo——一款免费开源的实时屏幕翻译工具框选屏幕上一块区域用 OCR 识别其中文字翻译后把结果以悬浮窗叠加在原位置附近。游戏对话、视频硬字幕、软件界面凡是复制不走的屏幕文字都是它的工作对象。为什么截屏翻译这件事这么难做你可能觉得截个图识别文字没什么技术含量。把 Translumo 拆开看链路其实有四段屏幕捕获、OCR 识别、文本有效性判断、翻译叠加。前两段是成熟技术真正的难点在第三段——游戏画面背景复杂字体自带描边阴影OCR 经常把装饰图案当成字母。如果每一帧结果都直接翻译你会看到满屏乱码。Translumo 的解法是让多个 OCR 引擎并行跑再用基于机器学习的模型给每个结果打分取置信度最高的一条。源码里这个环节叫GetBestDetectionResult多个引擎返回相同文本时直接信任否则逐个比较 ValidityScore 再取舍。相关逻辑都在src/Translumo.Processing/TranslationProcessingService.cs比任何多引擎支持的宣传语都更有说服力。3 步跑起来先说两个我踩过的坑上手比预想简单解压压缩包直接运行Translumo.exe当前最新版 1.0.2。想自己编译也容易Visual Studio 2022 加 .NET 8git clone https://gitcode.com/gh_mirrors/tr/Translumo之后构建会自动拉取 OCR 模型和 Python 运行时大约 400MB——网络不稳定会卡在这里这是我踩的第一个坑。英文界面演示第一步是打开设置右侧列出了全部快捷键操作只需要三个快捷键AltG打开设置选 OCR 源语言和翻译目标语言AltQ在屏幕上框出识别区域~启动/停止翻译。翻译结果出现在一个可拖动、可调透明度的悬浮窗里背景透明度、字号、行距都可在外观设置里改AltT随时隐藏或重新显示。这里有个容易忽略的细节区域尽量框小一点。区域越大背景里的随机字符越容易被当成文本处理耗时也越长。我第一次框了半个屏幕一局游戏飘出七八条莫名其妙的翻译把区域收窄到对话框后立刻清净了。选引擎之前先想清楚谁更值得用设置里默认有三个 OCR 引擎Windows OCR、Tesseract 5.2、EasyOCR。我的建议和项目作者一致——只开 Windows OCR。它由系统内置速度快对游戏字体识别最稳。Tesseract 属于历史上存在过的引擎作者自己在文档里直言它又老又慢错误率高EasyOCR 精度高但吃硬件要求 NVIDIA GPUCUDA 11.8、8GB 内存和 5GB 磁盘识别一帧动辄几百毫秒实时性基本谈不上。翻译服务同理DeepL 质量最好所以是首选Google、Yandex、Papago 当备选。真正容易忽略的是语言 → 代理选项卡翻译接口请求频率高了会被服务商封锁挂 1-2 个 IPv4 代理让请求轮流走不同出口能少踩不少封锁坑。俄语界面演示同样的操作流程界面与文档均做了本地化两个场景的配置思路场景一游戏实时翻译。先把游戏切成无边框窗口或窗口模式——全屏独占模式下翻译悬浮窗会直接沉到游戏画面下面这是很多人以为工具没用的真正原因。然后只保留 Windows OCR区域框住对话框剩下的刷新调度交给工具自己处理屏幕文字没变化时约 115ms 轮询一次识别到新内容进入完整流程约 320ms 一轮检测到连续滚动文本还会自动放慢到 620ms 避免重复翻译这段逻辑写在GetIterationDelayMs源码可查。实测系统占用很低2GB 内存的机器就能跑几乎不影响游戏帧率。场景二视频硬字幕翻译。硬字幕嵌在画面里没法提取正是 OCR 的主场。固定一块字幕区域后开启带预处理的 OCR 变体——它会先把灰度图按阈值 150 做二值化对应src/Translumo.OCR/里的WithPreprocess系列引擎高对比的白字黑底识别率立刻上一个台阶再打开翻译结果朗读TTS 模块在src/Translumo.TTS/支持 Windows 语音和 Silero 两种引擎追生肉番、看外语纪录片时舒服很多。值得知道的边界与限制说点真实的不足OCR 识别语言目前只有英、俄、日、中、韩五种冷门语种无能为力Tesseract 引擎在程序路径含中文时会直接识别失败官方要求路径只用英文字母EasyOCR 的包下载失败只能挂代理重试。另外它只支持 Windows 10 2004build 19041及以上或 Windows 11Linux 和 macOS 用户暂时无缘。两个高频故障也一并记下翻译请求频繁失败时优先检查代理列表和更换服务商其次降低刷新频率点开始翻译后毫无反应先确认目标窗口处于活动状态再不行重启一次工具——多半是屏幕捕获初始化失败。我的上手建议别一上来就三引擎全开、四家翻译服务全配。先只开 Windows OCR DeepL用无边框窗口模式跑一个晚上的游戏确认链路稳定后再按需加代理、开 TTS。工具是开源的遇到解释不清的现象直接翻源码——快捷键默认值都在src/Translumo/HotKeys/HotKeysConfiguration.cs里比翻文档直观得多。【免费下载链接】TranslumoAdvanced real-time screen translator for games, hardcoded subtitles in videos, static text and etc.项目地址: https://gitcode.com/gh_mirrors/tr/Translumo创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考