文件导入设置

电子表格 - 基于 MS Excel (TMS)

文本由 Phrase Language AI 从英语机器翻译而得。

仅包含数字和函数的单元格会被跳过,因为假定它们不包含与导入相关的内容。

除非隐藏,否则默认导入电子表格文件中的所有工作表。要控制是否应导入隐藏内容,请选择 Import hidden columns, hidden rows, and hidden sheets 选项(多语言文件不可用)。通过 Phrase Portals 处理的作业具有相同的条件。

包含超过 10,000 个带有条件格式的单元格,且使用 Multilingual ExcelExcel with html(处理 HTML 代码)或 Excel with Convert to Phrase TMS tags 格式过滤器处理的电子表格文档,将被拒绝,因为它们太大/太复杂。

重要

tags 问题是导致导出错误的常见原因(例如 File couldn't be generated),特别是对于 spreadsheets(基于 MS Excel)和 .XML 等文件类型。在导出文件之前,请务必通过运行 quality assurance 检查来确保标记和格式正确。

使用上述设置(Multilingual Excel、Excel with html 和 Excel with Convert to Phrase TMS tags 格式过滤器)处理的文件在导入时会转换为 XML。大多数格式、图表和图像都会丢失。嵌入的 .XLSM 格式宏也将丢失。

AI 服务在识别基于 .XML 的文件中的格式问题方面非常有效。

In-context preview 最多只能为导入文件中的 200 列生成。超过 200 列的文件将显示警告 In-context preview was not generated。此限制不适用于在原文件中标记为 Hidden 的列。

提示

Microsoft Excel 文件预览以 SpreadsheetML (.XML) 格式下载,可在任何兼容的电子表格编辑器中打开。如果安装了 MSOffice,它们通常会自动在 Excel 中打开;如果没有,请使用文件 context menu 中的 Open with 操作来选择应用程序。

文件类型

  • .XLSX

  • .XLTX

  • .XLSM

  • .XLTM

重要

October 31, 2025 起,不再支持 Legacy Microsoft Office based file formats .xls 和 .xlt 的导入或处理。

支持 OpenOffice 或 LibreOffice 文档(.ODT、.ODS 或 .ODP),但建议在导入前将其保存为 MS Office 格式。

通过 Google Drive 连接器导入时,Google Docs、Sheets 和 Slides 会自动转换为 .DOCX、.XLSX 或 .PPTX。

导入选项

  • 单元格读取顺序

  • 导入备注

  • 导入表名

  • 导入隐藏列、隐藏行和隐藏工作表。

    默认情况下,隐藏内容不会被导入。

  • 导入其他文本

    提取文件中通常不可译的特殊值/名称/属性。

  • 处理 HTML 代码

    在文件包含 HTML 标记(<b><span> 等)的情况下

    • 禁用 转换为 Phrase TMS 标记 以外的选项

    • HTML 导入设置不能用于编辑默认设置。

    • 应用单元格流“行,从左到右”

  • 转换为 Phrase TMS 标签 

    应用正则表达式将指定文本转换为标签。

    禁用 处理 HTML 代码 以外的选项。

  • 导入已选择的列

    输入以逗号分隔的列列表,例如 A,C,Q。

多语言电子表格文件

多语言文件在导入前会映射语言,并作为多个双语工作导入。它们在工作列表中以 multilingual_xlsx.png 表示。如果导入到多个译文语言中,已完成 文件将包含所有译文语言。

  • 隐藏的工作表不会被处理。

  • 不支持译文列中的合并单元格。

  • 日期和公式(其显示的单元格内容取决于区域或底层值,例如“布尔值”TRUE 或 FALSE)不会被暴露以供翻译,而是自动复制到译文列中。提示:要暴露此类值,您需要在插入值之前将源 MS Excel 文件中的单元格格式设置为文本。

  • 仅包含数字的原文或译文片段不会被导入进行翻译。

  • 由于软件包或这些软件包的版本原因,某些文件无法转换为多语言文件。

  • 共享 .XLSX 文件(共享工作簿)无法作为多语言文件导入。

  • 创建 工作 时,如果文件第一行包含标准 语言代码 且文件类型设置为 自动检测,它将被自动检测为多语言并作为单独的工作导入。从存储库导入的作业不应用自动检测。

  • 虽然 QA 不会返回标记和格式错误,但导出可能会失败并显示 无法生成文件 错误消息。这可能是由于译文端的标记订单不同所致,添加 自定义 QA 检查 即可发现。

    字段中的条目对于原文和译文是相同的。

    对于 标记订单(未配对)

    ^.*\{1\}.*\{2\}.*$ 

    ^.*\{1\}.*\{2\}.*\{3\}.*$ 

    ^.*\{1\}.*\{2\}.*\{3\}.*\{4\}.*$ 

    对于 标记订单(已配对)

    ^.*\\{1\\>.*\\<1\\}.*\\{2\\>.*\\<2\\}.*$ 

    ^.*\\{1\\>.*\\<1\\}.*\\{2\\>.*\\<2\\}.*\\{3\\>.*\\<3\\}.*$ 

    ^.*\\{1\\>.*\\<1\\}.*\\{2\\>.*\\<2\\}.*\\{3\\>.*\\<3\\}.*\\{4\\>.*\\<4\\}$ 

  • 在多语言文件上使用 更新原文 工具时,所有关联的作业必须具有 新建已发邮件已接受 状态。

导入选项

注意

不支持逗号以外的分隔符,否则会触发错误。

  • 使用 HTML 子过滤器 

    导入文件中包含的 HTML 标记。在这种情况下,标记可用于 HTML 文件导入设置。即使未选择 断句多语言 XLS,段落标记 <p> 也会创建新的句段。使用 HTML 子过滤器时,其他选项将被禁用。

    注意

    启用 HTML 子过滤器时,不支持在 Excel 中原生应用的内联文本格式(如粗体、斜体或下划线),并可能导致不必要的断句。这包括原生格式与 HTML 标记混合的文件,以及根本不包含 HTML 标记的文件。

  • 切分多语言 XLS 文件 

    文本由常规 断句规则 进行断句,而不是每个单元格一个句段。

    注意

    对包含译文的文件应用 断句多语言 XLS 可能会导致原文中的句段数量与译文中的不同。

  • 设置非空译文的句段状态 

    选择默认确认状态,以及是否将已确认的句段自动添加到翻译记忆库。

  • 识别原文列 () 

    使用小写或大写字母。若需更多列,请输入以逗号分隔且无空格的字母(A,D,G)。

  • 目标语 (列) 

    每种译文语言对应一列。若需更多列,请输入以逗号分隔且无空格的字母(B,E,H)。

  • 只导入特定的行 

    输入要导入的行(1,4,7)。

  • 识别上下文键(列) 

    指定一个与句段一起保存到 翻译记忆库<1> 中并用于匹配上下文的上下文键。

  • 识别上下文注释(列) 

    列被设置为 上下文注释<1>(B,C)。注释将显示在单独的行上。

  • 识别最大长度(列) 

    设置译文的最大长度。仅支持整数。若需更多列,请输入以逗号分隔且无空格的字母(I,J,K)。每个句段的字符限制显示在编辑器内的 上下文注释 窗口中。所有超出限制的字符都会被标红。

    如果单元格被拆分为多个句段,系统将分别检查每个句段的最大长度限制。

  • 转换为 Phrase TMS 标签 

    应用正则表达式将指定文本转换为标签。

示例: 

Spreadsheet job options
这篇文章有帮助吗?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.