同样是一份 PDF有的上传后很快就能得到规整的双语页面有的却会出现漏字、串栏、公式乱码和图注错位。差别通常不在页数而在文件内部。学术论文可能同时包含文本层、嵌入字体、矢量图、位图、公式对象和多栏排版。翻译工具需要先识别这些对象之间的关系才能把译文放回页面。遇到结果异常时重新上传几次作用不大。按文件结构排查往往能更快找到问题。先判断 PDF 里有没有可用的文本层打开 PDF 后尝试选中一句正文。如果能够逐字选择并复制文件通常带有文本层。复制出来的顺序也值得看一眼。双栏论文里鼠标从左栏拖到右栏不代表复制顺序正确。可以把一整段粘贴到记事本检查内容是否从左栏顶部读到左栏底部再进入右栏。若两栏内容交叉出现翻译后大概率也会串行。扫描版论文看起来有文字内部却只有一张页面图片。此时要先经过 OCR。页面倾斜、分辨率太低、背景有阴影都会增加识别错误。常见问题有以下几类。字母O、数字0和希腊字母混淆上标、下标被识别成普通正文连字符被当成减号或在换行处被错误保留页眉、页码和图中的文字混入正文如果原始扫描已经模糊后续翻译再流畅也弥补不了识别阶段丢失的信息。图表页要看关系不要只看文字科研图表通常由标题、坐标轴、图例、标签和图注共同表达结论。检查译文时应该确认这些元素仍然属于同一张图。下面这页包含多个数据分组、颜色图例和较长图注。双语预览保留了左右页面的相同位置核对时可以直接比较图号、横纵轴标签和缩写。图 1 复杂图表页适合在双语视图中逐项核对图表复核可以沿着固定顺序进行。检查图号是否一致正文中的引用是否仍指向这张图。检查横轴、纵轴和图例确认专业缩写没有被擅自扩写。检查颜色与分类名称的对应关系避免标签发生横向偏移。检查单位、负号、小数点和置信区间这些内容不该随语言变化。检查图注中的样本范围、方法名和数据来源。图中文字太小或属于图片的一部分时工具可能不会翻译。这样的结果不一定不可用但正文必须保留原图读者才能回到图中确认含义。公式和特殊符号要单独抽查公式页的问题往往藏得很深。正文读起来正常不代表数学对象完整。抽查时可以搜索公式附近的关键词再并排核对原文与译文。重点检查上下标、分式、根号、希腊字母、向量符号和公式编号。公式编号一旦变化正文里的「见式3」就可能指向错误位置。变量名通常不需要翻译。若变量被转换成普通单词后面的推导会很难读。代码片段、命令和文件路径也应保持原样尤其不能自动替换大小写或标点。技术手册更容易暴露版式错误学术论文之外技术手册也是很好的压力测试文件。它把图形标识、参数、步骤和正文放在同一页任何错位都很显眼。下图左侧是英文技术手册右侧是中文页面。灭火器分类标识、飞机尺寸图和说明文字保持对应用户可以按图号快速回查。图 2 技术手册需要同时检查图号、参数和警告信息手册里最需要人工确认的内容有两类。一类是动作顺序。安装、拆卸、通电和停机的先后不能变化否定词也不能遗漏。另一类是参数包含尺寸、压力、电压、温度范围和材料等级。数字没有变化还不够它必须留在正确的步骤和图示旁边。参考文献看起来没问题也可能已经损坏论文末尾的参考文献常被当成普通段落处理。作者名、期刊名、卷期、页码和 DOI 可能发生不必要的翻译或断行。可以随机抽取三条文献进行核对。作者顺序是否保留年份、卷号、期号和页码是否完整DOI 是否仍是一段连续字符正文中的编号引用能否对应文末条目作者名和期刊名通常维持原文更方便检索。若译文把它们转写成中文复制到学术搜索工具时可能找不到原条目。一页异常时先裁出问题页整份文档只有少数页面异常可以把问题页单独拆出来测试。这样更容易判断故障来自页面对象还是来自文件大小与处理时长。单页仍然异常时可以尝试以下处理。扫描页先校正倾斜并提升清晰度删除空白页、批注层和不必要的附件将特别复杂的矢量图转成高分辨率图片同时保留原文件按章节拆分避免在标题、图表和参考文献中间切开不要为了通过处理而反复压缩。过度压缩会让图中的小字和公式更难识别文件虽然变小结果可能更差。用一张验收表结束复核本文配图使用 PDFTranslator 的双语预览界面制作。无论使用哪种工具复杂 PDF 都可以按同一组项目验收。检查对象通过标准阅读顺序双栏、文本框和脚注没有串行公式符号、上下标与编号完整图表图号、图例、坐标轴和图注对应表格行列、单位与数字位置正确引用正文编号与文末条目一致专业内容术语、参数和警告经过人工复核复杂文档不必从第一页逐字校到末页。先检查最容易出错的对象再扩展到相邻页面。只要能定位故障发生在哪一层修复就会比整份重做省事得多。