CAT 编辑器

标记 (TMS)

文本由 Phrase Language AI 从英语机器翻译而得。

标记代表非译元素;一些 CAT 工具将其称为占位符。非译元素可以代表变量、特殊格式、正式名称、代码等。

必须将标记从原文复制到译文,以确保格式和变量在导出的译文文件中被正确保留。

重要

标记 问题是导致导出错误的常见原因(例如 无法生成文件),特别是对于 电子表格(基于 MS Excel)和 .XML 等文件类型。在导出文件之前,请务必通过运行 质量保证 检查来确保标记和格式正确。

在网页编辑器中使用 Ctrl+Shift+E、在桌面编辑器中使用 Ctrl+Shift+T 或从 编辑 菜单中展开标记。

标记类型

标记有四种类型:

tags_overview.jpeg
  1. 未配对/单个标记

    例如,表示句段或已合并句段中脚注的位置。

    在文本中所需位置点击并按 F8 即可插入未配对标记。

    未配对标记是单个的。

  2. 自定义标记

    要在译文中插入自定义标记或自定义配对标记:

    • 编辑 菜单中,选择 标记创建自定义标记创建自定义配对标记

      自定义标记显示为灰色而非蓝色。

    自定义标记只能添加到在完成文件中支持标记的文件格式(如 HTML)中。

  3. 已合并标记

    已合并句段 标记是一种特殊的未配对标记类型。合并点由 {j} 标签指示。

  4. 成对标记

    表示跨越一段文本的格式。例如,句段中的某段文本可能具有不同的字体,或者某段文本可能被高亮显示。

    成对标记有开始和结束。

    通过选择要标记的文本并单击 F8 来插入成对标记。

在计算 分析 时,标记不计入字数统计。每个合并标签都会被一个空间替换。

使用标记

错误的标记可能导致不正确的译文。如果译文中缺少标记,Phrase 会在生成已完成的译文文件时尝试自动完成。如果缺少或不正确,请手动将标记添加到译文中,并尽可能使其位置和顺序与原文/源语保持一致。

原文/源语中的标记

如果从原文/源语中删除了标记,QA 将无法正确地将其与译文进行核对。在导出文件且没有 QA 标记警告时,会显示 Can't download file with missing tags... 错误。

如果发生这种情况,请按照以下步骤操作:

  1. 将工作导出为双语 .TMX 文件。

  2. 将 .TMX 文件导入到临时翻译记忆库中。

  3. 重新导入原始文件。

  4. 使用临时 翻译记忆库 对新工作进行预翻译。

  5. 检查预翻译结果,并在启用 格式和标记 的情况下针对新工作运行 QA

  6. 如果成功,可以通过确认句段来填充临时翻译记忆库,并将其导入主翻译记忆库。

将标记插入译文

标记可以通过“编辑”菜单或键盘快捷键 F8CTRL+ALT+#(用于对标记进行特定编号)以及 Ctrl+,(用于按部分插入)来插入。

编辑标记内容

要编辑译文标记内容,请按照以下步骤操作:

  1. 在网页编辑器中按 CTRL+SHIFT+E,在桌面编辑器中按 Ctrl+Shift+T,或者从 编辑 菜单中选择 标记展开标记

    显示标记内容。

  2. 在网页编辑器中单击要编辑的标记,在桌面编辑器中单击标记并按 F2

    已编辑的标记以灰色显示,以指示与原文/源语标记的差异。

质量保证

质量保证功能可用于确保标记到位且准确。

如果项目经理已将项目设置为检查标记,则缺失或不正确的标记将导致无法导出有效的译文文档。

翻译记忆库中的标记

将翻译单元保存到翻译记忆库 (TM) 时,Phrase 会将翻译单元的标记与句段一起存储。导出的 TM 文件(.TMX 和 .XLSX 格式)将行内标记表示为编号占位符,例如 {1}{2},而不是 CAT Editor 中显示的 \...<1\} 表示法。

mdata 属性包含每个占位符的完整详细信息,包括其角色(例如配对标记的开始或结束)及其底层内容(例如嵌入式标记或非译元素)。mdata 属性是一个包含 ID类型内容 字段的对象 JSON 数组,并且在两种导出格式中都使用相同的结构。

MXLIFF 文件中的标记

双语 .MXLIFF 文件使用与翻译记忆库导出相同的编号占位符表示法:行内标记在 <source> 和 <target> 中显示为 {1}{2} 等(配对标记显示为 \可译的<2\}),而不是 CAT Editor 中显示的 \...<1\} 表示法。

每个占位符的完整详细信息,即其类型及其底层内容(例如嵌入式标记、变量或来自创作系统的处理指令),都存储在同一个 <trans-unit><m:tunit-metadata><m:tunit-target-metadata> 元素中,每个占位符对应一个 <m:mark> 条目,并通过 ID 进行匹配。MXLIFF 不使用 XLIFF 内联元素 <g><x><bpt><ept>

要比较原文和译文之间的标记位置,请将编号的占位符与其 <m:mark> 条目一起使用,或者对工作运行 质量保证,它会报告每个句段的标记问题。

导入标记

由于标记用于标记文本中具有不同格式的部分,因此大多数此类格式更改都很明显。常见的标记是不同的字体、字号或颜色。某些标记(例如样式更改)是次要的,可能不那么明显。

如果文件类型具有关于如何导入标记的选项,则在创建 工作时,它们在 文件导入设置 中定义。

包含许多不可见标记的导入文件可能会因元数据过多而生成 TOO_LARGE_INPUT: Too large tag metadata of source text of segment no. ... 错误。这在使用复杂文件类型(例如已转换为文本格式的 .PDF)导入时很容易发生。

导入文本文件时,建议:

  • 如果使用 OCR 程序转换 .PDF 文件,请保存为纯文本或无格式文本。在文本编辑器中打开文件,以应用所需的格式,例如调整字体、字号、颜色、列、间距等。

  • 有许多工具可用于清理文本文件中的多余代码。建议使用 CodeZapper

  • 导入 MS Word 文件或使用 MS Word 文件类型的文本文件时,请使用 最小化标记数量 选项。 此选项尝试从导入用于翻译的原文中移除所有被认为不必要的标记。这是一个自动化过程,可能会移除所需的格式。如果使用此选项,请将完成的文件与原始文档进行比较,以确保所需的格式已到位。

导入的 幻灯片 可能会在 编辑器中显示许多格式标记。在从原始格式(例如 PDF)进行转换期间,可能已经应用了格式标记,以尽可能保留原始外观:宽窄文本间距、下标和上标、不同的文本颜色、不同的字体大小等。

在这种情况下,建议使用在线 标签清理工具

这篇文章有帮助吗?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.