
表格文字的识别与翻译处理
DeepL自动提取并翻译表格内容
DeepL在文档翻译过程中能够自动识别并提取Word、PowerPoint和PDF文档中的所有表格内容,将表格中的每个单元格内的文字作为独立的翻译单元进行处理。系统在翻译过程中保留表格的完整行列结构,每个单元格中的文字被翻译后仍然放置在对应的单元格位置。表格的合并单元格和多层级表头结构在翻译后得以完整保留,用户不需要在译文中重建复杂的表格布局。这一机制确保数据报表、产品规格对比表和价格清单等包含大量结构化信息的文档在翻译后依然保持清晰的信息组织和可读性。
表头与表内文字的统一语境处理
DeepL在翻译包含表格的文档时会建立贯穿整篇文档的术语映射表,表格中的表头术语和表内的数据描述术语能够在术语层面保持一致。当表头中的专业术语和表格数据列中出现的相同术语被翻译时,系统在整个文档范围内维持译法的统一性。表格内嵌的缩写词和专有名词在表头和表内正文中的译法保持一致,不会出现表头意译、表内音译的译法分裂现象。用户在审校表格翻译结果时应当优先检查术语在表头和各数据列之间的译法一致性,如有偏差可通过术语表设置锁定标准译法后重新翻译。
复杂表格格式的保留与还原
DeepL文档翻译在输出译文中保留了原文档表格的边框样式、背景色、单元格宽度和文字对齐方式等视觉属性,用户下载的译文表格看起来与原文档表格基本一致。文档中的嵌套表格(表格内包含表格)在翻译后保持相同的嵌套层级,内层表格的文字同样被完整翻译。表格内包含的编号列表和项目符号在翻译后保留其层级结构和符号样式。对于包含大量格式设置的复杂表格,DeepL的格式保留能力显著减少了用户在翻译后重新调整表格样式的工作量。
图片中文字的识别限制
扫描PDF中的文字无法翻译
DeepL文档翻译功能本身不包含OCR文字识别能力,对于由扫描图片生成的PDF文档或包含嵌入图片的文档,系统无法提取图片中的文字内容进行翻译。这类文档在DeepL的文档翻译处理中文字识别率为零,翻译结果中图片所在区域不会产生对应的译文。用户可以检查文档类型是否为扫描件(文字可选择或复制即表示可翻译),来确定DeepL是否能够处理该文档中的文字。对于扫描PDF,用户需要先使用OCR软件将图片中的文字提取为可选择文本后再通过DeepL翻译。
内嵌图片文字的识别盲区
Word和PowerPoint文档中用户插入的图片、截图或图表中嵌入的文字同样无法被DeepL识别和翻译。图片中的文字作为图像的一部分而非文档的文本层存在,DeepL的文档翻译引擎只处理文档中可选择的文本内容。当文档中包含信息性图片(如带文字说明的产品照片、包含数据标签的图表)时,翻译结果中这些图片上的文字将保持原文不变。用户需要在翻译完成后手动编辑图片中的文字内容,或使用外部OCR工具先提取图片文字完成翻译后再替换原图。
对比文档翻译与图片翻译的区别
DeepL移动应用的拍照翻译功能可以将摄像头画面或相册中的图片中的文字识别出来并进行翻译,此功能与文档翻译的图片文字处理存在根本区别。拍照翻译通过OCR技术从图片中提取文字后翻译并在屏幕上以叠加层显示译文,但这一功能不能应用于文档翻译场景。文档翻译处理的是结构化文档中的文本层,拍照翻译处理的是非结构化的图片文件,两者的技术路径和功能边界完全不同。用户不应期望文档翻译功能能够自动翻译文档中内嵌的图片文字,这类内容需要通过其他独立工具完成处理后再整合到译文中。
可翻译的文档格式与支持范围
标准办公文档格式的表格支持
DeepL文档翻译对Word(.docx/.doc)、PowerPoint(.pptx)和PDF(.pdf)三种核心办公格式中的表格提供了完整的翻译和格式保留支持。Word文档中的表格在翻译后保留原有的单元格合并、文本对齐方式和表格边框样式。PowerPoint演示文稿中的幻灯片表格和图表中的表格数据同样被翻译并保留原始布局和样式。PDF格式中如果文字属于可选择文本层而非扫描图像,其中的表格文字同样可以被识别和翻译。所有支持格式中的表格翻译都基于相同的文本提取和重构机制,翻译质量在格式之间保持一致。
Excel文件的表格翻译特性
DeepL文档翻译对Excel格式的支持相对有限,系统可以处理Excel工作簿中的单元格文字内容,但翻译后的输出格式可能与原始文件存在差异。Excel文件中包含的公式、图表和条件格式等在翻译过程中可能丢失或无法正确保留,用户应对翻译后的Excel文件进行仔细的格式验证和功能检查。Excel文件的表格翻译在处理大规模数据表格时可能面临字符限制和性能问题,建议用户在上传大文件前先评估文件的大小和复杂度。对于关键数据表格,建议用户将Excel内容复制到Word或PDF格式后再通过DeepL翻译,以获得更好的格式保留和翻译质量。
受支持的复杂文档格式
除了标准的办公文档格式外,DeepL还支持IDML(InDesign标记语言)等专业排版文件的翻译,这些文件中的表格和文本同样可被识别和翻译。IDML文件中的母版页、图层和脚注中的文字也会被DeepL提取和翻译,专业出版物的多语言本地化流程大幅简化。用户应在翻译前确认源文件是否在DeepL官方支持的文件格式列表中,不支持的格式无法通过文档翻译功能处理。不断扩展的格式支持让DeepL文档翻译的使用场景从办公文档逐步延伸到专业设计、出版和本地化领域。
文档翻译与拍照翻译的对比
文档翻译处理文本层,拍照翻译处理图像层
DeepL文档翻译和拍照翻译的核心差异在于前者处理的是文档中的可选择文本层,后者处理的是图片中的像素信息。文档翻译直接从文档文件中提取文本内容进行翻译,不受图片中文字识别能力的限制。拍照翻译通过设备的摄像头捕捉图像并运行OCR识别从中提取文字再进行翻译,适用于处理物理文档、路牌和菜单等场景。用户在决定使用哪种翻译方式时,应先确认待翻译的文字存在于什么介质中,数字文档用文档翻译,印刷品或图片用拍照翻译。
两种方式在表格处理上的差异
文档翻译中的表格翻译能够识别并保留完整的表格结构,每行每列的数据在翻译后保持原有的对应关系。拍照翻译中如果捕获的图片包含表格,OCR识别出的文字将以纯文本形式呈现,表格的行列结构在识别过程中通常被破坏。当用户拍摄的图片中包含数据表格时,拍照翻译的输出是表格中文字内容的平铺列表而非保持原始行列关系的结构化数据。需要翻译印刷品上的表格数据时,拍照翻译只能提供文字层面的参考信息,无法还原表格结构,完整的数据表格应通过文档翻译处理数字版文档来获得更好的结果。
何时使用文档翻译而非拍照翻译
用户手中有原始数字文档(Word、PDF、PowerPoint)需要翻译时,直接使用文档翻译功能可以获得格式保留、术语一致和完整结构的最佳翻译效果。文档翻译的处理质量在表格、排版和复杂格式方面远超将文档打印后再拍照翻译的方式。当文档包含大量需要保留格式的结构化信息时,文档翻译是唯一能够保持信息完整性和可读性的选择。在所有可能的情况下,优先使用文档翻译处理数字文档,拍照翻译应作为无法获取数字版本时的备选手段而非默认选择。
图片中文字的替代翻译方案
使用OCR工具提取图片文字
当文档中包含无法直接翻译的图片文字时,用户可以先使用独立的OCR工具(如Adobe Acrobat的OCR功能、ABBYY FineReader或在线OCR服务)将图片中的文字提取为可选择的文本格式。提取出的文本可以通过DeepL的文字翻译功能完成翻译,用户再将翻译后的文字以修改图片或添加注释的方式整合回文档中。OCR工具的文字识别准确率受图片质量和文字清晰度影响较大,识别效果不佳的文字需要人工校对和修正。OCR提取加DeepL文字翻译的组合方案是当前处理文档中不可选择图片文字的最有效路径。
将图片中的文字手动输入翻译
对于内容量较少的关键图片文字(如图表中的标签、关键数据点或产品图片中的说明文字),用户可以手动输入这些文字到DeepL文字翻译器中获取译文。手动输入翻译的方式避免了OCR识别可能产生的错误,适合处理少量但重要的图片内文字。用户获得译文后需要在文档中手动修改图片中的对应文字内容,该操作在PowerPoint和Word中均可通过直接编辑图片内文字或添加文本框覆盖原文字实现。手动输入翻译虽然操作成本较高,但在涉及关键品牌术语和法律条款等重要图片文字时是保障翻译准确性的可靠方式。
翻译后文档中图片文字的处理流程
在文档翻译完成后,用户应将包含图片文字的译文与原文档对照,逐一标记需要处理的图片及其文字内容。对每张图片评估其文字的重要性、数量和翻译难度,决定采用OCR提取、手动输入修改或保留原文后加注释说明等不同处理方式。图片文字的处理应在文档整体翻译完成后的编辑阶段进行,避免在翻译流程中因反复切换工具而打乱工作节奏。处理完所有图片文字后,用户再次通读整篇译文,确保图片文字的修改没有破坏文档的整体布局和视觉一致性。
常见问题FAQ
DeepL文档翻译能翻译表格中的文字吗?
能。DeepL会自动识别并翻译Word、PowerPoint和PDF文档中表格里的所有文字,翻译后表格的行列结构和排版格式保持不变。
DeepL能翻译文档中图片内的文字吗?
不能直接翻译。DeepL文档翻译功能本身不包含OCR文字识别能力,无法提取和处理图片、截图或扫描件中的文字内容。用户需要借助外部OCR工具提取文字后单独翻译。
扫描的PDF文档能用文档翻译处理吗?
扫描PDF中的文字无法被DeepL识别和翻译,因为扫描件本质上是一张图片而非可选择文本的数字文档。用户需要先使用OCR软件将扫描PDF中的文字转换为可选择文本格式后再上传翻译。
翻译后的表格和原文档表格格式一致吗?
基本一致。DeepL保留原文档表格的边框、背景色、单元格宽度和文字对齐方式等视觉属性,嵌套表格的层级结构同样保持。用户下载译文后通常不需要重新调整表格的布局格式。


