客户发来的常常不是一句气泡,而是 PDF、表格、产品说明。Hello GPT翻译器若支持文件翻译,问得最多的是:直接点开附件会不会自动翻、版式会不会乱、一整本手册要扣多少量、扫描件为什么和图片一样认不清。下面只讲聊天或工作台里的文件翻译。不把相册识图、额度总论、安装再写一遍。主线是:先判断文件里有没有真文字层,再只送需要回复的那几页,核对数字后用文字把结论发回去。
文件和图片不是同一种东西,扫描件却往往是
带文字层的 PDF、可复制的 Word,系统可以抽字再译,版式有机会部分保留。纯扫描件、拍照后转的 PDF、加密或只读到图片层的文件,本质是 OCR,清晰度、歪斜、印章和识图是同一类限制。打开文件先试不试得选中一行字。选不中,按图片规则拍清晰页,不要按“文件引擎更聪明”去赌。
表格同样。真表格抽单元格;截成一张图的表,列会串。列一串,单价和数量对错位,通顺的译文是错账。能导出表就导出再译关键列,不整页当海报。
先定这一次要回什么,再决定送哪几页
对方要你确认单价和交期,你只需要价目那一页和备注那一页。整本证书、整本宣传册一起送,额度按篇走,注意力按百页走,真正要回的三行反而埋在里面。内部阅读可以分段慢慢译;对外回复先抽出结论,译结论,发结论。
文件进翻译前看权限和去向。未公开图纸、护照、对账单,能不走在线整篇就不走。能私有部署走内部的,不图省事丢进个人窗口。必须处理时裁出非敏感页,或自己把非敏感字段打成文字再译。
打开进度转圈过久,先看文件是否过大、是否加密、是否损坏。卸密码、另存一份可复制文本、切成小文件,比连点三次同一份坏文件有用。
译出来后不要把排版结果直接当可发送合同
保留原件。译文用于读懂,发出去的承诺用你核对过的短句重写:哪一项多少钱、哪一天、哪个单位。自动排版再整齐,也不能代替你对过的那四列数字。客户要对照原件版式,原件和结论一起发,结论用文字。只发一份排乱的译稿,对方无法对账,你会进入第二轮“以哪一版为准”。
术语对文件同样有效,前提是抽出来的源词和库里一致。抽字吃掉型号连字符,就先在抽出文本里改回再译,或手打型号。不要为识别噪声在库里堆脏词。
多语手册只译当前要答复的语言部分。整本所有语言互译一遍,是在做出版,不是在值班。
失败时按抽得出字、对得上数字来看
抽不出字:当图片处理,或要对方发可复制版本。抽出字但对不上图:扫描质量或加密层问题,换源文件。字对、数字在译文里变了:按数字核对流程改母稿式的抽出文本,再生成对外短句。整份失败、短句文本仍正常:问题在文件通道,不要重装整个翻译器,不要改掉已经对的私聊预设。
按这个顺序做完:先试能不能选中文字、只送要回的页、敏感件少走在线整篇、用核对过的短句对外、原件留作对照。文件翻译才会从“把附件吞进去”变成处理材料的步骤。聊天气泡怎么双向译,仍走文本规则;附件必须先变成可核对的字,你才配把其中几行变成对客户的承诺。先抽出要的那一页,再按下翻译。

