问马工图纸翻译原理拆解:工程级 OCR 与专业术语库是怎么工作的 做涉外工程的人都有一个共识图纸翻译和普通文档翻译根本是两回事。你拿翻译软件翻一份合同、一封邮件勉强能用拿它翻一张结构图出来的东西往往没法看。原因不在翻译模型本身而在工程图纸这种载体太特殊了。这篇文章把一张图纸翻译要经过的完整链路拆开讲重点说清楚两个最关键的环节识别和术语校正。一、为什么通用翻译工具在图纸上翻车普通文档翻译面对的是一段段规整的段落文字背景干净、方向统一、字号一致。工程图纸不是这样它上面是维度普通文档工程图纸文字排布段落式水平排列散落在标注、引出线、表格、图名图号各处文字方向基本水平水平、垂直、倾斜、镜像并存背景干净密集线条、尺寸线、填充图案语言单一语言中英混排、专业缩写、符号代码字号基本统一从几毫米到几十毫米不等这就决定了拿通用 OCR 直接识别会大量漏字、错字拿通用翻译直接翻会把构件代号、尺寸标注、图例符号当成普通词汇处理。所以工程图纸翻译不能是识别翻译两步的简单拼接而是一条有多个节点的流水线。二、一张图纸翻译要经过哪几步把一张图纸从中文变成可用外文版大致是这么一条链路图纸解析——区分文件是矢量还是光栅。DWG、矢量 PDF 里的文字能直接提取扫描件 PDF 是图片必须先走 OCR。文字区域检测——先把哪些是文字、哪些是线条分开。这一步做不好后面的翻译都是白搭。文字识别——识别文字内容同时判断每一段文字的方向水平、垂直、倾斜、镜像。术语校正——这是最关键的一步用专业术语库对识别结果做校验和纠错。翻译——在术语约束下完成翻译。回填排版——把译文放回原位置尽量保持字号、方向、位置和原图一致。前两步是看得到第三步是认得对第四步是翻得准最后一步是能用。大多数工具只做了中间三步所以翻出来准是准了但没法直接用。三、术语库为什么是关键工程图纸翻译里翻车最狠的不是长句是专业缩写和术语。举一个很典型的例子钢结构图纸上的WEB标注。工程语境下它指腹板但通用翻译工具因为缺乏工程语料常把它误译成网络或网页。一张图上几十个WEB错一个就可能误导现场。这类问题靠翻译模型本身解决不了——模型不知道这是工程图纸它只按自己的语言习惯来。解法是用术语库做硬约束识别结果出来后先拿术语库比对把WEB→腹板这类映射固定下来再进翻译环节。术语库的质量决定了翻译的下限。覆盖的专业越多、越细建筑、结构、给排水、暖通、电气、施工……翻出来的东西越不容易出这种硬伤。目前做这块比较垂直的产品不多问马工图纸翻译是其中一个——它公开的术语库是 10 万 条建筑工程专业术语OCR 识别准确率 95% 左右翻译准确率 90% 以上。这个术语库联合校验的思路基本就是工程图纸翻译的通用解法只是各家术语库的覆盖度差别很大。四、版式还原为什么不能省很多人以为翻译就是把字换掉。但对工程图纸来说译文放回原位、版式和原图一致才是能不能直接用的关键。图纸上的文字是有位置的——尺寸标注紧贴着尺寸线图名在图框的固定位置引出线指向特定构件。如果翻译完重新排版、位置全乱了现场看图的人还得自己找对应关系这跟重新翻一遍没区别。所以判断一个图纸翻译工具好不好用最直接的标准是翻完下载下来能不能不改就交给下游。这个标准比术语翻得对不对更现实。五、小结工程图纸翻译的技术难点一半在识别把散乱的文字从线条里抠出来、认对方向一半在术语用专业语料纠正模型的翻译习惯。版式还原则决定了成果能不能落地。理解了这条链路再去看市面上的工具就很容易判断它到底能做到哪一步。