Skip to content

AutoTranslate

自动翻译 分类:Window 描述:自动翻译并展示目标窗口的文本。

需求

  • 安全级别:常规模块
  • 恶意属性:否
  • 权限需求:无
  • 驱动依赖:否
  • 联网需求:是(语言检测与翻译链路依赖在线服务)
  • 开发状态:稳定/常规
  • 版本属性:普通可用

介绍

AutoTranslate 会对目标窗口(或全屏)截图做 OCR,再按阈值过滤、可选文本合并,并把结果翻译后叠加显示。 推荐调参顺序:先定 Target/Trigger,再定识别质量(置信度与合并),最后再调视觉样式。

配置项

  • Async(异步) 类型:布尔;默认:true。开启后识别流程在异步线程执行,减少主界面阻塞。
  • Target(目标) 类型:组合框;默认:"Foreground"。决定抓图来源。 可选:Screen(屏幕);Foreground(前端);PointAt(指向)。
  • Screen Mode Exclude Client(屏幕模式排除客户端) 类型:布尔;默认:true。Screen 模式时临时排除客户端自身窗口,避免 HUD/菜单文字被重复识别。
  • Action(行为) 类型:组合框;默认:"Translate"。决定是否只做识别或识别+翻译。 可选:Translate(翻译);Recognize(识别)。
  • Source Language(源语言) 类型:组合框;默认:"English"。用于 OCR 语言包与后续翻译判定。 可选:English(英语);Chinese(中文)。
  • Text Color(文本颜色) 类型:组合框;默认:"Rainbow"。普通文本颜色。 可选:见 NAMED_COLOR_BASE_LIST
  • Text Color (Pointed At)(文本颜色 (指向)) 类型:组合框;默认:"Green"。鼠标指向文本时的颜色。 可选:见 NAMED_COLOR_BASE_LIST
  • Translation Result Color(翻译结果颜色) 类型:组合框;默认:"Yellow"。译文文本颜色。 可选:见 NAMED_COLOR_BASE_LIST
  • Text Background Color(文本背景颜色) 类型:组合框;默认:"Red"。普通文本背景色。 可选:见 NAMED_COLOR_BASE_LIST
  • Text Background Color (Pointed At)(文本背景颜色 (指向)) 类型:组合框;默认:"Dark Green"。指向文本背景色。 可选:见 NAMED_COLOR_BASE_LIST
  • Translation Result Background Color(翻译结果背景颜色) 类型:组合框;默认:"Black"。译文背景色。 可选:见 NAMED_COLOR_BASE_LIST
  • Translation Max Thread Count(翻译最大线程数) 类型:数值;默认:20。翻译并发上限;越大吞吐越高,但瞬时占用也更高。
  • Texts Pointed At(指向文本显示) 类型:组合框;默认:"Raw"。鼠标指向文本时显示策略。 可选:Hidden(隐藏);Raw(原始);Result(结果)。
  • Show Texts(显示文本) 类型:布尔;默认:true。HUD 渲染总开关。
  • Text Background(文本背景) 类型:布尔;默认:true。是否绘制文本底板。
  • Text Background Opacity (0~1)(文本背景不透明度 (0~1)) 类型:数值;默认:0.5f。普通文本底板透明度。
  • Text Background Opacity (Mouse Pointed At) (0~1)(文本背景不透明度 (鼠标指向) (0~1)) 类型:数值;默认:0.5f。指向文本底板透明度。
  • Text Min Size(文本最小字号) 类型:数值;默认:20。原文最小字号。
  • Text Max Size(文本最大字号) 类型:数值;默认:80。原文最大字号。
  • Translation Result Min Size(翻译结果最小字号) 类型:数值;默认:30。译文最小字号。
  • Translation Result Max Size(翻译结果最大字号) 类型:数值;默认:100。译文最大字号。
  • Text Opacity (0~1)(文本不透明度 (0~1)) 类型:数值;默认:0.8f。文本本体透明度。
  • Recognize Min Confidence (0~100)(识别最小置信度 (0~100)) 类型:数值;默认:80.0f。低于阈值的 OCR 结果会被过滤。
  • Trigger Mode(触发模式) 类型:组合框;默认:"Manual"。决定识别触发时机。 可选:Periodic(周期性);On Window Change(窗口变化时);Manual(手动)。
  • Merge Texts Into Groups(合并文本为组) 类型:布尔;默认:true。把碎片化 OCR 框合并后再翻译,减少断词断句。
  • Merge Texts Vertical Gap Threshold(Merge Texts 纵向 Gap Threshold) 类型:数值;默认:0.5f。纵向合并阈值。
  • Merge Texts Horizontal Gap Threshold(合并文本横向空隙阈值) 类型:数值;默认:3.0f。横向合并阈值。
  • Recognize Cooldown (ms)(识别冷却(毫秒)) 类型:数值;默认:3000L。Periodic 模式下的最小触发间隔。
  • Toggle Texts Hotkey(切换文本快捷键) 类型:按键/复合;默认:{ { "Keybind", {0 } }}。切换 Show Texts。
  • Trigger Hotkey(触发快捷键) 类型:按键/复合;默认:{ { "Keybind", {0 } }}。手动触发一次识别/翻译。
  • Re-merge Texts Hotkey(重新合并文本快捷键) 类型:按键/复合;默认:{ { "Keybind", {0 } }}。不重新 OCR,仅对现有结果重做合并/翻译流程。
  • Clear Hotkey(清除快捷键) 类型:按键/复合;默认:Caps Lock。清空结果并强制重新显示文本。

历史更新

    1. 添加模块:AutoTranslate,自动识别文本并翻译展示。

备注

Action=Recognize 很适合先调 OCR 质量;确认文本框准确后再切回 Translate,调翻译显示参数。 若 Screen 模式出现“自己翻自己”,优先检查 Screen Mode Exclude Client 是否开启。

相关命令

相关模块

相关资料

新手安装与首次配置

AutoTranslate 由 Tesseract OCR 和在线翻译服务组成。Tesseract 负责从截图中识别文字,在线服务负责语言检测和翻译。两部分都正常时,HUD 才会显示译文。

安装 Tesseract OCR

请从可信来源下载 Tesseract 的 Windows 安装包,推荐使用默认目录:

C:\Program Files\Tesseract-OCR\tesseract.exe

安装时至少准备以下模型文件:

  • eng.traineddata:英语
  • chi_sim.traineddata:简体中文

模型必须位于安装目录的 tessdata 子目录:

C:\Program Files\Tesseract-OCR\tessdata\eng.traineddata
C:\Program Files\Tesseract-OCR\tessdata\chi_sim.traineddata

如果安装程序没有安装中文模型,请下载与 Tesseract 版本兼容的 chi_sim.traineddata 后放入 tessdata。不要把模型文件放在 tesseract.exe 同级目录。

[图片占位:Tesseract Windows 安装程序和语言包选择页面]

打开 ClickGUI,进入 Tesseract OCR 模块,把 Executable Path 设置为 tesseract.exe 的完整路径。留空时客户端会尝试自动查找:

C:\Program Files\Tesseract-OCR\tesseract.exe
C:\Program Files (x86)\Tesseract-OCR\tesseract.exe

自定义安装目录或自动查找失败时必须手动填写。Language 填写模型名 eng 或 chi_sim,不要填写“英语”或“简体中文”。可在 PowerShell 执行以下命令确认模型:

tesseract --list-langs

当前调用只支持单个模型,不要填写 eng;chi_sim 这样的多语言值;多个值只会使用第一个。

[图片占位:ClickGUI 中 Tesseract OCR 的 Executable Path 和 Language 配置]

第一次使用

建议先设置 Target=Foreground、Action=Recognize、Trigger Mode=Manual、Merge Texts Into Groups=true。为 Trigger Hotkey 绑定按键后,把目标窗口置于前台并按键触发。确认原文位置和内容正确后,再将 Action 改为 Translate。

默认 Trigger Mode 是 Manual,Trigger Hotkey 默认未绑定,因此首次使用不能只打开模块等待结果。

[图片占位:绑定触发快捷键、识别原文、显示译文的完整流程]

配置项详细说明

识别与触发

Async(异步)

默认 true。开启后识别流程通过后台更新任务执行,减少 OCR 和网络请求对主界面的影响。关闭后便于调试,但耗时操作可能造成短暂卡顿。通常保持开启;它不会让 Tesseract 本身变快,也不会取消翻译并发限制。

Target(目标)

默认 Foreground,可选 Screen、Foreground、PointAt。Screen 截取整个屏幕,适合全屏游戏或多窗口文字;Foreground 截取当前前台窗口,最容易调试;PointAt 截取鼠标当前指向的窗口,适合在窗口间移动鼠标后识别。多显示器或 Windows 缩放可能造成框位置轻微偏移。

Screen Mode Exclude Client(屏幕模式排除客户端)

默认 true,只对 Screen 生效。截图期间暂时排除 Jackal Client 自身窗口,避免 HUD、菜单和通知被再次识别。建议保持开启;仍然识别到客户端内容时改用 Foreground。

Action(行为)

默认 Translate,可选 Translate 和 Recognize。Recognize 只运行 OCR,适合安装检查和调参;Translate 还会进行语言检测和在线翻译。排查问题时先用 Recognize。

Source Language(源语言)

默认 English,可选 English 和 Chinese。English 使用 eng 模型,Chinese 使用 chi_sim 模型,并且只翻译检测为所选语言的文字。Chinese 指简体中文,繁体中文、日文和大量中英混排不一定能被当前配置正确处理。

Trigger Mode(触发模式)

默认 Manual,可选 Periodic、On Window Change、Manual。Periodic 按冷却时间重复截图,适合持续变化字幕但会增加请求;On Window Change 只在目标窗口句柄变化时识别;Manual 不自动识别,只能由 Trigger Hotkey 触发。所有模式下 Trigger Hotkey 都可以手动触发一次。

Recognize Cooldown (ms)(识别冷却)

默认 3000,主要用于 Periodic。数值越小越及时,但截图、OCR 和翻译请求越频繁;静态窗口可提高到 5000 或更大,不建议盲目降低。

Translation Max Thread Count(翻译最大线程数)

默认 20,限制同时进行的翻译任务数。值大完成更快,但会增加网络并发和服务限流风险。翻译失败或网络拥堵时可降低到 4 到 8。

Recognize Min Confidence (0~100)(最小识别置信度)

默认 80,有效范围 0 到 100。低于阈值的 OCR 结果会被过滤,也不会进入合并和翻译。值高可减少乱码但容易漏小字,值低能保留更多内容但噪声增加。建议从 60 到 80 开始,漏字时降低,错误文字太多时提高。

Merge Texts Into Groups(合并文本为组)

默认 true。把同一段中被 Tesseract 拆开的文字框合并后再翻译,通常能减少断词和逐词翻译。关闭后保留原始文字框,适合检查 OCR 底层结果。

Merge Texts Vertical Gap Threshold(纵向间距阈值)

默认 0.5,是相对于参考文字高度的倍数而非固定像素。提高可能把相邻行合并,降低可能把同一行拆开。通常保持默认,仅在出现跨行合并或同一行拆分时调整。

Merge Texts Horizontal Gap Threshold(横向间距阈值)

默认 3.0,同样相对于参考文字高度。英文句子被拆开时逐步提高;相邻按钮或两列文字被连在一起时降低。修改后可使用 Re-merge Texts Hotkey,无需重新 OCR。

显示与快捷键

  • Show Texts:默认 true,控制结果是否绘制到 HUD。关闭只隐藏,不停止识别或翻译。
  • Text Background:默认 true,控制文字背景矩形,遮挡画面时可关闭。
  • Text Background Opacity (0~1):默认 0.5,普通文字背景透明度。
  • Text Background Opacity (Mouse Pointed At) (0~1):默认 0.5,鼠标指向文字时的背景透明度。
  • Text Opacity (0~1):默认 0.8,文字本体透明度,不影响背景。
  • Text Min Size / Text Max Size:默认 20 / 80,原文字号上下限。
  • Translation Result Min Size / Translation Result Max Size:默认 30 / 100,译文字号上下限。
  • Texts Pointed At:默认 Raw,可选 Hidden、Raw、Result。Hidden 隐藏指向文字;Raw 指向时显示原文,移开后显示译文;Result 始终优先显示译文。

颜色选项包括 Text Color、Text Color (Pointed At)、Translation Result Color、Text Background Color、Text Background Color (Pointed At) 和 Translation Result Background Color,默认依次为 Rainbow、Green、Yellow、Red、Dark Green、Black。颜色来自 NAMED_COLOR_BASE_LIST,调试时建议使用高对比度组合。

快捷键默认值为 {0} 时表示未绑定:

  • Trigger Hotkey:触发一次截图、OCR 和后续处理;Manual 模式必须使用。
  • Toggle Texts Hotkey:切换 Show Texts,只影响显示。
  • Re-merge Texts Hotkey:用已保存 OCR 结果重新过滤、合并和翻译,不重新截图。
  • Clear Hotkey:默认 Caps Lock,清空结果并重新开启 Show Texts。

Notify Result(通知结果)

该键存在于默认配置中,但当前 AutoTranslate 的运行流程不会读取它来控制通知;识别开始、失败等提示仍按客户端既有流程显示。

Tesseract OCR 模块

  • Executable Path:tesseract.exe 完整路径;留空时自动搜索常见 Program Files 目录。
  • Language:其他 OCR 功能默认使用的模型名,例如 eng 或 chi_sim;AutoTranslate 以自身 Source Language 为准。
  • Documentation:打开相关 OCR 文档。
  • Where is Tesseract.exe:通过命令行查找 PATH 中的可执行文件。
  • 简体中文:将默认 Language 改为 chi_sim。

常见问题

识别结果为空

依次检查 Executable Path、tessdata 模型、Source Language 和截图范围。将 Action 改为 Recognize,把置信度临时降到约 60,并确认文字足够大、清晰且有对比度。

识别错误、漏字或句子被拆开

确认语言模型正确。漏字时降低置信度;噪声多时提高。保持合并开启并调整横向阈值。完全识别不到时先改善图像质量,单纯降低阈值通常无效。

有原文但没有译文

确认 Action=Translate,检查网络和语言检测。模块只翻译检测语言与 Source Language 匹配的文本。可先使用客户端普通翻译功能验证在线翻译链路。

识别到客户端自己或位置不对

确认 Screen Mode Exclude Client=true;仍有问题时改用 Foreground。开启 Text Background 检查 OCR 框;多显示器和 Windows 显示缩放可能导致坐标偏移。

使用注意

  • AutoTranslate 读取屏幕截图,不适合密码、验证码等敏感信息;不要把敏感内容提交给在线翻译服务。
  • Periodic 会重复截图并可能重复请求翻译,建议只在需要实时识别时使用。
  • 修改目标、语言或触发模式后,建议清除旧结果并重新触发,避免不同截图的结果混在一起。