项目管理

分析 (TMS)

文本由 Phrase Language AI 从英语机器翻译而得。

分析功能可计算所选文件中的字符数和字数,并识别:

  • 重复(包括跨文件重复)

    只有重复片段的第一次出现会被单独计算,并归入常规匹配百分比或内部模糊匹配类别中。重复 统计该片段后续出现的次数。示例:一个包含两个完全相同片段的任务显示 重复:1 个片段,而不是 2 个。这反映了统计规则。

    “重复”仅统计后续出现的、没有翻译记忆匹配或仅有模糊匹配的重复片段。符合 100% 或 101% 翻译记忆匹配的片段优先于“重复”类别,并被计入翻译记忆匹配类别,而非“重复”类别。

  • 翻译记忆匹配,

  • 不可翻译内容

  • 内部模糊匹配

  • 机器翻译建议

分析还可以显示审校人员所做的修订次数。

分析可由项目经理或管理员创建。不允许语言专家运行自己的分析。供应商可以为共享任务/项目创建分析。

一些 CAT 工具将分析称为统计。

组织分析由分析仪表板提供。

由于不同国家使用不同的计费单位,因此提供三种计算方法:

  • 字符 

    不含空格。

  • 单词 

    适用于在单词之间使用空格的语言——不包括中文、日语和泰语。

  • 页面 

    1800 个字符(含空格)——与文件中的实际页数无关。

字数统计

由于不同语言的计数方法不同,所显示的字数可能与其它应用程序生成的字数不同。

用于分析的字数与MTU计算的字数不同,也与用于订阅计费的TMS处理字数不同。

  • 每个连接标记都替换为一个空格。

  • 其它标记将被删除。

对于使用空格分隔单词的语言(例如英语):

  • 每个包含+-,.的数字序列都替换为一个字符(使用regex表达式[+-]?[0-9]+([., -]?[0-9]++)*+)。

  • 每个空格序列都替换为一个空格。

  • 片段开头和结尾的空格会被移除。

  • 每个由非空格字符组成的序列都被计为一个单词。

对于不使用空格分隔单词的语言(例如日语):

  • 一些标点符号会从文本中删除(使用正则表达式[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}])。

  • 片段会被拆分为属于非空格 (NWS) 汉字、平假名、片假名和泰语脚本的字符序列,以及不属于这些脚本的字符序列 (WS)。

  • 单词总数 = (来自 NWS 的单词数) + (来自 WS 的单词数)。

  • 来自 WS 的单词数计算方式与英语相同。

  • NWS 的单词数即为不含空格的字符数。

  • 对于泰语,单词数是不含空格的字符数除以 2。

注意

CJK 语言的字符既被计为字符,也被计为单词。

创建分析

要创建分析,请遵循以下步骤:

  1. 在 项目 页面中,选择一个或多个 任务。

  2. 点击 分析。

    分析 窗口随即打开。

  3. 从下拉列表中选择一个 类型。

  4. 如果需要,请提供一个名称。

    • 可用于分析命名的宏:

      • {projectName}

      • {sourceLang}

        添加源语言

      • {targetLang}

        添加目标语言。如果分析了多种语言,则语言项将为空。

      • {userName}

        添加已分配的语言专家或供应商的用户名。如果分配了多名语言专家,则名称项将为空。

      • {workflow}

      • {innerId}

      • {fileName}

        如果分析中使用了多个文件/任务,则 {fileName} 将为空。

  5. 选择分析选项。具体而言:

    • 应用 Exclude numbers 选项会影响字数统计,因为数字将不会被计算为单词。

    • Include internal fuzzies 选项会将分析任务中的片段与文件内部的相似性进行比较,而不是仅将其与翻译记忆库进行比较。

      如果勾选了 Separate internal fuzzies,内部模糊匹配将在新建的分析中显示为一个单独的类别。例如:

      一个包含 10 个源单词的翻译任务包含以下片段,其中仅最后一个字符不同:

      • 我买了一辆新车。

      • 我买了一辆新车!

      如果翻译记忆库中没有找到匹配项,默认分析将显示:

      IF 选项

      TM类别:0%-49%

      TM类别:95%-99%

      IF类别:95%-99%

      包含IF已禁用

      10 个字词

      包含IF已启用 + 分离IF已禁用

      5 个字词

      5 个字词

      包含IF + 分离IF已启用

      5 个字词

      5 个字词

  6. 点击 分析。

    已将分析或多项分析添加到列表中。

  7. 点击列表中的分析,即可在分析详情页面中查看,或将其下载以在项目管理应用程序中进行渲染。

注意

分析选项可在创建分析时、在项目级别进行设置,或在“设置”Setup_gear.png下进行全局设置。

分析结果是针对每种语言对,根据该语言自身的TM独立计算得出的。即使项目在多种目标语言间使用共享TM,每个语言对仍会维护其自己的一套翻译单元。同一源片段在每种语言中的得分可能不同,从而导致同一项目内不同目标语言的匹配百分比和净费率存在差异,即使分析设置完全相同也是如此。

提供三种分析类型:

默认分析

默认分析是在翻译之前对源片段运行的标准分析。它提供了任务的基准分析,可与译后编辑分析结合使用,以确定该任务翻译上投入了多少工作量。此基准也用作向客户生成报价的基础。

默认使用在 预翻译 中设置的 TM 阈值,但如有需要可以更改。

生成片段/字数/字符数明细;如果用于项目中,则会识别 TM 匹配以及不可译内容、内部模糊匹配和 QPS(如果已启用)。

重要

在翻译后运行默认分析会产生不正确的分析结果。

分析结果是针对每种目标语言根据该语言自身的翻译记忆库独立计算的。在包含多种目标语言的项目中,同一个源片段在每个语言对中可能会获得不同的匹配百分比,或者根本没有匹配,因为每个语言对在翻译记忆库 (TM) 中都有其自己的翻译历史。因此,即使分析设置完全相同,匹配类别中的字数分布以及由此产生的净费率在同一项目的不同目标语言之间也可能存在差异。

译后编辑分析

译后编辑分析在目标片段上运行,用于指示编辑工作量;即文本需要语言专家或校对员进行多少编辑。它在译后编辑完成后运行。

当语言专家点击未翻译的片段时,当前最高的翻译记忆库匹配、机器翻译建议和/或不可译内容会保存到该片段中,并用于译后编辑分析。

译后编辑分析可以从任何工作流步骤启动,其计算方式为从可用源(例如 TM/MT)插入的文本与片段目标中译后编辑结果之间的差异。

译后编辑分析扩展了传统的翻译记忆库分析,纳入了机器翻译 (MT) 和不可译内容 (NT)。同时也支持 第三方 MT 引擎。

重要

禁用 分析 TM 译后编辑 和 分析 NT/MT 译后编辑 并不会将 TM/MT 匹配从分析中排除。在这种情况下,分析会考虑较高可用匹配的分数,而不是译后编辑工作量。

译后编辑分析中的 101% TM 结果并不一定意味着该片段是从 TM 翻译的。

示例

如果禁用了 分析 TM 译后编辑 且在打开片段时存在 101% 的 TM 匹配,则使用 MT 翻译的作业仍可能显示为 101% TM。

分析后选项

译后编辑选项用于计算翻译记忆库 (TM)、不可译内容 (NT) 和机器翻译 (MT) 匹配项所需的译后编辑工作量。

启用 TM 译后编辑分析 

  • 适用于包含需要译员编辑的高百分比匹配项的低质量 TM。

  • 指示 TM 的译后编辑工作量。

  • 分析中仅包含 100% 匹配项。来自 TM 的上下文 101% 匹配项对计算没有影响。

禁用 TM 译后编辑分析 

  • 适用于高质量 TM,其中匹配项应尽可能少地进行编辑以降低成本。

  • 同时指示 101% 和 100%。

  • 指示在打开片段时提供给译员的 TM 匹配项(而非译员实际的译后编辑工作量)。

  • 指示机器翻译和不可译内容的译后编辑工作量。

启用 NT/MT 译后编辑分析 

  • 如果 MT 或 NT 建议在未经进一步编辑的情况下被接受,则在分析中将其显示为 100% 匹配。

  • 如果译员更改了 MT,匹配率将会降低。评分计算算法与用于计算翻译记忆库模糊匹配得分的算法相同。

  • 编辑 NT 将导致该片段显示为 0-49% NT。

禁用 NT/MT 译后编辑分析 

  • 来自 MT/NT 且没有任何预估得分的条目将被视为 TM 0%-49% 匹配。它们将被标记为由译员翻译,且不考虑 MT。

  • QPS 和 Phrase Language AI 匹配项若超过 75% 的匹配度,则分别显示在各自的 MT 列中。

  • 指示在打开片段时提供给译员的 NT/MT 匹配项(而非译员实际的译后编辑工作量)。

在源更新前自动生成译后编辑分析 

  • 创建分析:

    • 针对每个已更新的任务。

    • 针对每个供应商分别创建分析,并分配给相应的供应商。

  • 在以下情况下不创建分析:

    • 未分配译员或供应商。

  • 分析会统计已确认和已翻译的片段。

  • 分析遵循以下命名约定:

    • 更新源 #{innerID}{workflow} 

  • 分析将通过选中 统计单位(源)、分析 NT 译后编辑、分析 TM 译后编辑 和 分析 MT 译后编辑 来创建。

统计以下单位: 

  • 源/目标 

    选择分析中将显示的字数统计方式。目标字数统计可能会高于源字数统计。

    不影响匹配评分。

比较分析

适用于

  • Team、Ultimate 和 Enterprise 计划(旧版)

如有许可相关问题,请联系 销售部门。

“比较”分析功能仅适用于具有工作流步骤的项目。它会在片段级别比较不同工作流步骤中文件的两个版本,并分析这两个版本之间的差异。如果项目没有特定的分析设置,则会使用默认设置,这可能会导致报告不准确。

示例

通过比较翻译和审校步骤,识别翻译在审校阶段发生的更改,从而反映审校人员的实际工作量。

分析可以在多个作业上运行,并可通过两种方式进行分组:

  • 按提供商分析 

    • 适用于分配给不同语言专家或供应商的多个作业的项目。用于:

      • 为每位语言专家或供应商分别创建包含其分配文件的独立分析。

      • 将分析分配给提供商,使其下属的语言专家/供应商能够查看这些分析。

      如果已为提供商应用了净费率方案,则该选项将被预选。

  • 按语言分析 

    • 如果项目包含多种目标语言,则可以批量运行所有文件的分析,并为每种语言分别创建分析。

      要按语言进行分析,请按照以下步骤操作:

      1. 在项目页面中,选择所有作业文件。

      2. 点击 分析。

        分析窗口随即打开。

      3. 保持默认设置并选择按语言分析。

      4. 点击 分析。

        作业分析将按语言分别准备。

      注意

      取消选择此选项可为多语言项目创建一个单一的分析。

分析重新计算

当分析的源文件更新时,它会在分析表中被标记为过期 yellow_warning.jpg。

重新计算将应用原始分析所使用的设置。

供应商 不允许重新计算由买方创建的分析。

要使用新的源文件进行重新计算,请按照以下步骤操作:

  1. 选择过期的分析

  2. 点击 重新计算。

    “重新计算分析”窗口会一直打开,直到重新计算处理完毕。关闭后,重新计算即完成,过期指示符也会被清除。

自定义分析视图

分析表中可以显示或隐藏 句段、页面、字数、字符数 和 百分比 列。编辑时间 列也可用于译后编辑分析,并显示编辑一个句段所花费的秒数。

下载分析

要下载分析,请按照以下步骤操作:

  1. 点击 下载 以显示下拉菜单并选择:

    • CSV(逗号分隔值),可包含字符数据,也可不包含,并可由电子表格应用程序读取。

    • LOG(类似于 SDL Trados 格式),可由大多数项目管理应用程序读取。

    • JSON(JavaScript 对象表示法),一种轻量级的数据交换格式。

    只有以 JSON 格式下载的分析才会包含按匹配类型细分的 NT、MT、TM 和内部模糊匹配 (IF) 数据。 

  2. 选择文件类型即可触发下载。

这些文件可以导入到大多数项目管理软件系统中。

应用净费率方案

可以在分析中应用针对字数/字符数/页数的折扣。折扣后的翻译量会立即计算出来,并直接显示在分析的净费率行中。

若要从分析中移除净费率方案,请将应用净费率按钮旁边的字段留空。

当分析应用了净费率方案时,下载的分析文件会显示每个匹配类别中的加权字数。

将分析分配给提供商

要将分析分配给提供商,请按照以下步骤操作:

  1. 从列表中选择一个分析并点击编辑。

    编辑页面随即打开。

  2. 从下拉列表中选择一个提供商。

  3. 点击保存。

    该分析将在 Linguist 门户 上对被分配的提供商开放。

这篇文章有帮助吗?
★ ★ ★ ★ ★

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.