分析会计算所选文件中的字符数和字数,并识别:
分析还可以显示审校所做的修订次数。
分析可由项目经理或管理员创建。译员不能被允许运行他们自己的分析。供应商可以为共享的工作/项目创建分析。
一些 CAT 工具将分析称为统计信息。
组织 Analytics 由 Analytics 仪表盘 提供。
由于不同国家使用不同的计费单位,因此提供三种计算方法:
-
字符
不含空格。
-
字数
对于在单词之间使用空格的语言——不包括中文、日语和泰语。
-
页
1800 个字符(含空间)——与文件中的实际页数无关。
由于不同语言的计数方法不同,所显示的字数统计可能与其它应用程序生成的字数统计不同。
用于分析的字数统计与 MTU 计算 的字数统计不同。
-
每个合并标签都被替换为一个空间。
-
其它标签会被移除。
在使用 空格 分隔单词的语言中(例如:英语):
-
每个包含
+-,.的数字序列都被替换为一个字符(使用 regex 表达式[+-]?[0-9]+([., -]?[0-9]++)*+)。 -
每个空格序列都被替换为一个空间。
-
句段开头和结尾的空间会被移除。
-
每个不同于空间的字符序列都被计为一个字。
对于不使用空格分隔单词的语言(例如:日语):
-
一些标点符号会从文本中移除(使用 regex 表达式
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}])。 -
句段被拆分为属于非空格 (NWS) 汉字、平假名、片假名和泰语脚本的字符序列,以及不属于这些脚本的字符序列 (WS)。
-
总字数 = (来自 NWS 的字数) + (来自 WS 的字数)。
-
来自 WS 的字数计算方式与英语相同。
-
来自 NWS 的字数是不含空间的字符数。
-
对于泰语,字数是不含空间的字符数除以 2。
注释
CJK语言的字符既被计为字符,也被计为字数。
要创建分析,请遵循以下步骤:
-
在 页面中,选择一个或多个 。
-
点击 分析。
窗口随即打开。
-
从下拉列表选择一个 。
-
如果需要,请提供名称。
-
可用于分析命名的宏:
-
{projectName} -
{sourceLang}添加源语言
-
{targetLang}添加译文语言。如果分析多种语言,则语言将为空。
-
{userName}添加已分配译员或供应商的用户名。如果分配了多名译员,则名称将为空。
-
{workflow} -
{innerId} -
{fileName}如果分析使用了多个文件/工作,则
{fileName}将为空。
-
-
-
选择分析选项。具体包括:
-
应用 选项会影响字数统计,因为数字不会被计算为字数。
-
选项会将分析工作中的片段与文件内的相似内容进行比较,而不是仅将其与翻译记忆库进行比较。
如果勾选了 ,内部模糊匹配将在新建的分析中显示为一个单独的类别。例如:
一个包含 10 个原文词汇的翻译工作包括以下句段,其中仅最后一个字符不同:
-
我买了一辆新车。
-
我买了一辆新车!
如果翻译记忆库中未找到匹配项,默认分析将显示:
IF 选项
翻译记忆库类别:0%-49%
翻译记忆库类别:95%-99%
IF 类别:95%-99%
Include IF 已禁用
10 字数
Include IF 已启用 + Separate IF 已禁用
5 字数
5 字数
Include IF + Separate IF 已启用
5 字数
5 字数
-
-
-
点击 分析。
分析或多个分析将被添加到列表中。
-
点击列表中的分析,即可在 详情页面中查看,或将其下载以便在项目管理应用程序中呈现。
注释
分析选项可在创建分析时、项目级别或在“设置”下的全局范围内进行设置。
分析结果是针对每个语言对及其各自的翻译记忆库独立计算的。即使项目在多个译文语言间使用共享的翻译记忆库,每个语言对也会维护其自己的一套翻译单元。同一个原文句段在每种语言中的分数可能不同,从而导致同一项目内不同译文语言的匹配百分比和净费率存在差异,即使分析设置完全相同。
提供三种分析类型:
默认分析是在翻译之前对原文句段运行的标准分析。它提供了工作的基础分析,可与译后编辑分析结合使用,以确定在该工作中投入了多少翻译工作量。此基准也用作向客户生成报价的基础。
默认使用在预翻译中设置的翻译记忆库阈值,但如有需要可以更改。
系统会生成句段/字数/字符数的明细,如果用于项目中,还会识别翻译记忆库匹配以及非译元素、内部模糊匹配和QPS(质量评估分数)(如果已启用)。
重要
在翻译后运行默认分析会产生错误的分析结果。
分析结果是针对每种译文语言,根据该语言自身的翻译记忆库独立计算的。在包含多个译文语言的项目中,同一个原文句段在每个语言对中可能会获得不同的匹配百分比,甚至完全没有匹配,因为每个语言对在翻译记忆库中都有其各自的翻译历史。因此,即使分析设置完全相同,不同译文语言在同一项目中的匹配类别字数统计分布以及最终的净费率也可能存在差异。
译后编辑分析在译文句段上运行,用于指示编辑工作量;即文本需要译员或校对员进行多少编辑。它在译后编辑完成后运行。
当译员点击一个未翻译句段时,当前最高的翻译记忆库匹配、机器翻译建议和/或非译元素会被保存到该句段,并用于译后编辑分析。
译后编辑分析可以从任何工作流步骤启动,其计算方式为从可用原文(例如翻译记忆库/机器翻译)插入的文本与句段译文中译后编辑结果之间的差异。
译后编辑分析扩展了传统的翻译记忆库分析,纳入了机器翻译 (MT) 和非译元素 (NT)。第三方机器翻译引擎也受支持。
重要
禁用 和 并不会将翻译记忆库/机器翻译匹配从分析中排除。在这种情况下,分析会考虑较高可用匹配的分数,而不是译后编辑工作量。
在译后编辑分析中,101% 的翻译记忆库结果并不一定意味着该句段是由翻译记忆库翻译的。
示例
如果禁用了 ,且在打开句段时存在 101% 的翻译记忆库匹配,则使用机器翻译翻译的工作仍可能显示为 101% 翻译记忆库匹配。
分析后选项
译后编辑选项用于计算翻译记忆库 (TM)、非译元素 (NT) 和机器翻译 (MT) 匹配所需的译后编辑工作量。
启用分析翻译记忆库译后编辑
-
适用于包含需要译员编辑的高百分比匹配的低质量翻译记忆库。
-
表示翻译记忆库的译后编辑工作量。
-
分析中仅包含 100% 匹配。来自翻译记忆库的上下文 101% 匹配对计算没有影响。
禁用分析翻译记忆库译后编辑
-
适用于高质量翻译记忆库,在此情况下应尽可能少地编辑匹配内容以降低成本。
-
表示 101% 和 100% 的匹配。
-
表示在打开句段时提供给译员的翻译记忆库匹配(而非译员实际的译后编辑工作量)。
-
表示机器翻译和非译元素的译后编辑工作量。
启用分析非译元素/机器翻译译后编辑
-
如果机器翻译或非译元素建议在未经进一步编辑的情况下被接受,则在分析中将其显示为 100% 匹配。
-
如果译员更改了机器翻译,匹配率将会降低。分数计算算法与用于计算翻译记忆库模糊匹配分数的算法相同。
-
对非译元素进行编辑将导致该句段显示为 0-49% 非译元素。
禁用分析非译元素/机器翻译译后编辑
-
来自机器翻译/非译元素的条目,若无预估分数,将被视为翻译记忆库 0%-49% 匹配。它们将被标记为由译员翻译,且不考虑机器翻译。
-
QPS(质量评估分数) 和 Phrase Language AI 高于 75% 的匹配项将显示在各自匹配项的机器翻译列中。
-
指在打开句段时提供给译员的非译元素/机器翻译匹配项(而非译员实际的译后编辑工作量)。
在原文更新前自动生成译后编辑分析
-
分析创建于:
-
针对每项更新的工作。
-
针对每位服务商单独创建,并分配给相应的服务商。
-
-
若出现以下情况,则不创建分析:
-
未指派译员或供应商。
-
-
分析会统计已确认和已翻译的句段。
-
分析遵循以下命名规范:
-
更新原文 #{innerID}{工作流}
-
-
分析创建时将选中 统计单位(原文)、分析非译元素译后编辑、分析翻译记忆库译后编辑 和 分析机器翻译译后编辑。
统计以下单位:
-
选择分析中将呈现的字数统计。译文字数统计可能高于原文字数统计。
不影响匹配分数。
比较分析功能仅适用于具有工作流步骤的项目。它会在句段级别比较不同工作流步骤中的两个文件版本,并分析这两个版本之间的差异。如果分析没有项目特定的设置,则会使用默认设置,这可能会导致报告不准确。
示例
分析可以在多个工作上运行,并可以通过以下两种方式进行分组:
-
按服务商分析
-
适用于分配给不同译员或供应商的多个工作项目。用于:
-
创建包含分配给个人译员或供应商的文件的独立分析。
-
将分析分配给服务商,使服务商的译员/供应商能够查看这些分析。
如果已为服务商应用了净计费方案,则该选项将被预选。
-
-
-
按语言分析
自定义分析视图
、、、 和 列可以在分析表中显示或隐藏。 列也适用于译后编辑分析,并指示编辑一个句段所花费的秒数。
下载分析
要下载分析,请按照以下步骤操作:
-
点击 下载 以显示下拉菜单并选择:
-
CSV(逗号分隔值),包含或不包含字符,可使用电子表格应用程序读取。
-
LOG(类似于 SDL Trados 格式),可使用大多数项目管理应用程序读取。
-
JSON(JavaScript 对象表示法),一种轻量级的数据交换格式。
只有以 JSON 格式下载的分析才会包含按匹配类型细分的非译元素、机器翻译、翻译记忆库和内部模糊匹配 (IF) 数据。
-
-
选择文件类型会触发下载。
这些文件可以导入到大多数项目管理软件系统中。
应用净计费方案
可以在分析中应用针对字数/字符数/页数的折扣。折扣后的翻译量会立即计算并直接显示在分析的行中。
若要从分析中移除净计费方案,请将按钮旁边的字段留空。
当净计费方案应用于分析时,下载的分析文件会显示每个匹配类别中的加权字数。