可从导航面板上的 Phrase 分析 按钮访问 Analytics 仪表盘。
根据我们的内部 数据存储 政策,来自永久删除内容的所有客户输入文本(例如项目名称、文件名、域)不会出现在 Phrase 分析中。永久删除的内容将替换为 已删除。来自永久删除内容的所有数值、日期、时间戳和布尔数据类型保持可用。这确保了历史 KPI、趋势和预测聚合随时间保持一致。
-
显示 按服务商 的图表包括译员和服务商。
-
语言对显示为原文语言到译文语言的连接。
-
显示 按项目 的图表仅显示前 10,000 个项目,而下载时会包含完整的项目列表。
-
仪表盘显示 UTC 时区的数据。
-
仪表盘每天刷新两次:
-
欧盟实例为 UTC 时间凌晨 12:00 和中午 12:00
-
美国实例为 UTC 时间上午 07:00 和下午 19:00
每个仪表盘都会显示上次数据刷新完成的时间。需要注意的是,显示的注释时间戳可能不包含在此前 3 小时内生成的数据。这是因为在触发数据刷新流程时,可能无法及时捕获交易。
-
-
数据报告提供过去 12 个完整月份的数据,使用户在任何时间点都能获得全年的数据。
仪表盘视频回顾:
管理员在 用户 设置中设置每个项目经理的分析访问级别。提供三个级别:
-
查看所有公司数据。
-
仅查看项目经理拥有的项目中的数据。
-
无仪表盘访问权限。
每个仪表盘都支持不同的筛选以在图表中显示所选数据。特别是,工作状态 筛选会考虑以下工作状态:
-
。
-
。
当工作或项目被删除时,只要它还在回收站中,该工作就会被标记为此状态。
-
。
通过手动或自动清空回收站而移除的工作。
-
。
注释
当工作被归档时,其状态会更改为 已归档。当项目被归档时,工作的状态不会更改。
建议不要运行超过一年的日期筛选,因为性能可能会下降,且图表可能无法再保持定义。
每个图表都可以下载为 .csv、.xlsx、.json 和 .png 文件格式。点击图表右上角的三点按钮,然后选择 下载结果:
-
要下载包含大数字逗号分隔符的格式化结果,请从 窗口中选择所需的格式。
-
要下载未格式化的结果,请按住 Shift (Windows) 或 Option (Mac) 键,并从 窗口中选择所需的格式。
所有仪表盘均支持来自 共享 内容的数据。
无法保证已删除的共享内容对于内容所有者以外的任何公司仍然可见。
多个仪表盘包含所有权筛选,有助于区分公司拥有的数据和跨公司共享的数据:
-
筛选用于识别该公司是否为该工作的创建者。
-
由该公司创建的工作(可能已共享,也可能未共享)。
-
与该公司共享或由该公司共享的工作,无论由谁创建。
-
-
筛选用于识别该公司是否为该 LQA 评估的创建者。
审核服务商被视为所有者,因此公司的视图会将评估显示为 。来自其他公司(例如翻译服务商、项目买方或供应商)的用户将在 下看到相同的评估。
如果服务商来自您的公司,则会显示其用户名和全名。如果服务商来自不同的公司,则会显示其用户 ID 和公司名称,如记分卡中所示。
-
筛选用于识别该公司是否为该报价的创建者。
-
筛选用于识别该公司是否为该分析的创建者。
图表显示了根据定价指标(例如字数统计、字符统计、页数或小时数)计算并乘以 价格列表 得出的公司实际支出。
成本仪表盘基于:
-
项目中所有工作流步骤的 报价。
注释
为同一工作流步骤创建新报价会覆盖先前创建的报价的数据。
-
项目的所有按小时计费报价,以及每项工作中标准报价的最新报价。
在 共享项目(或已分配服务商的报价)中,报价对所有用户可见,但最新报价可能因用户而异。
为工作分配服务商时,请考虑:
-
如果在创建工作时分配了服务商,他们的价格列表将覆盖项目的价格列表。
-
如果稍后分配服务商,成本不会自动重新计算。
为已分配的用户生成报价以相应地更新数据。
-
如果为工作部分分配了多个服务商,则使用第一个列出的服务商的数据。
生成新报价以使用任何其他用户的定价信息。
选项卡提供了有关 Phrase TMS 和 Strings、Phrase Portal 以及 通过 API 使用的 Phrase Language AI<3> 的机器翻译单位和已翻译字符消耗量的见解。它提供了随时间、区域对、机器翻译引擎和机器翻译个人资料,按项目和工作流步骤划分的消耗概览。
访问时,默认显示 Phrase TMS,但用户也可以通过调整 Phrase 产品仪表盘筛选器来查看所有/特定 Phrase 产品的消耗情况。
TMS 机器翻译来源筛选器显示了 Phrase TMS 中机器翻译单位的拆分情况:
-
TMS 预翻译
-
TMS 分析
-
TMS CAT Editor
图表显示了翻译记忆库 (TM)、机器翻译 (MT)、重复内容和非译元素 (NT) 在工作中的利用情况。
利用率的计算方法是:应用任何净计费方案前特定匹配类别的字数统计与应用净计费方案后同一匹配类别的字数统计之差。
该仪表盘基于:
-
来自默认 分析 的数据。
-
针对任何给定工作的最后一次分析运行数据。
仅当在创建分析之前,将净计费方案添加到项目或分配给工作的服务商时,才会生成数据。如果项目或分析中的净计费方案发生更改,分析将显示最新信息。
在以下情况下,图表不显示任何数据:
-
没有净计费方案的项目和工作。
-
杠杆率为 0 的分析(例如针对项目、语言对等)。
-
包含内部模糊匹配的分析。
-
已删除的分析。
只有属于查看者所在公司的用户所创建的分析,才会被纳入仪表盘的计算中。因此,当买方共享工作给供应商,且由供应商创建分析时:
-
买方无法在仪表盘中看到与这些分析相关的数据。
-
由于供应商是分析的创建者,他们能够在仪表盘中查看相关数据。
质量评估分数(QPS)在句段级别评估机器翻译质量,以确定哪些句段足以进行自动确认。QPS(质量评估分数)由 Language AI 自动生成,与 语言质量评估(LQA)分数不同,后者反映了人工审校的评估,并在 质量仪表盘 中单独跟踪。
预翻译<1>的句段可以根据预翻译设置中设定的 QPS(质量评估分数)<2>阈值自动确认。QPS(质量评估分数)仅适用于通过 Language AI 翻译的机器翻译句段。
如需机器翻译质量数据,请使用 QPS(质量评估分数)洞察仪表盘。如需人工审校分数,请使用质量仪表盘。
仪表盘有助于找到最佳的QPS(质量评估分数)阈值,以平衡成本节约和质量风险。
仪表盘中的过滤器有助于为不同的内容类别找到最佳值,因为技术、法律和营销文本可能有不同的质量要求。
这些洞察基于句段级指标。通过Phrase Data Premium可以解锁自定义洞察,该功能提供对原始句段级数据的访问。
包含的数据
-
过去6个月,从2025年1月1日开始(跟踪开始时间)
-
仅限Language AI,因为QPS(质量评估分数)仅适用于通过Language AI处理的机器翻译。
-
所有Language AI句段,无论其来源如何(预翻译或编辑器建议)
-
QPS(质量评估分数)是最初通过Language AI翻译后给出的分数,而非译员编辑后的分数。
-
买方(而非供应商)可查看共享项目的数据
过滤较长的编辑时间
有时,句段的编辑时间会异常长。这可能是由于分心(例如,查看手机或休息)所致。为保持数据准确性,平均编辑时间约为20秒。应用了50%的缓冲,并排除了编辑时间超过30秒的句段。
虽然一些长时间的编辑可能是合理的,但大多数是异常值,会引入干扰。
过滤的影响:
-
在大型数据集上,过滤这些长句段的影响微乎其微。
-
在较小的数据集上,这种影响更为显著,因为单次延长的编辑可能会不成比例地影响总编辑时间。
此过滤确保了更清晰、更可靠的时间跟踪数据。
图表描述
-
图表 1:
显示在选定时间范围内基于其 QPS(质量评估分数)分数的句段数量分布。
-
图表 2:
显示由语言专家编辑的句段百分比。预计较高的 QPS(质量评估分数)分数编辑次数较少。
-
图表 3:
显示语言专家在编辑句段上花费的时间。
-
图表 4:
包含已编辑和未编辑的句段(编辑时间为 0 的句段)。这提供了处理所有句段所耗费总工作量的更清晰视图,结合了前两个图表的见解。
-
图表 5:
估算如果降低 QPS(质量评估分数)阈值,无需人工验证的已核准字数。例如,如果 QPS(质量评估分数)阈值从 95 降低到 90,平均已核准字数可能会从 950 增加到 1,750。
-
图表 6:
显示如果降低 QPS(质量评估分数)阈值,可以节省多少编辑时间。
-
图表 7:
通过比较自动化句段(已确认或已锁定)与已编辑机器翻译句段的百分比,跟踪已编辑句段随时间的减少情况。它显示了自动化如何通过减少需要人工编辑的句段数量来提高效率。
仪表盘专注于 LQA 功能,并包含以各自独立行呈现的已完成评估结果。评估结果可能包含也可能不包含问题,图表基于工作创建日期。
仪表盘提供以下洞察:
-
整个公司的平均质量得分以及随时间变化的错误数量。
-
哪些类别具有最高严重程度的 LQA 错误。
-
哪些服务商保持着较高的质量得分。
-
每个项目的按严重程度划分的错误数量。
-
质量得分随时间在语言对和客户维度的表现。
LQA 错误计数包含重复的问题。重复和非重复问题在“按项目”和“按服务商”表格中分别显示。
LQA 和自动 LQA 洞察之间有一个切换开关。
该仪表盘显示用于工作付款的供应商报价信息,并包含所有处于新建、已核准、待核准和已拒绝状态的 报价。
已删除项目的报价不包含在仪表盘中。
-
是为报价内所有工作设定的最低价格。
-
是报价内每项工作产生的价格。
-
显示实际支付的成本,在所有工作工作流步骤、语言对等项之间平均拆分。
包含在仪表盘(以及 报价表格)中:
-
在所有工作流步骤中平均拆分的工作报价。这包括仅有一个工作流步骤的拆分工作报价。
-
拆分前创建的报价。
未包含在仪表盘(及报价表)中:
-
在所有工作流步骤中拆分不均的工作报价。
此仪表盘比较报价中的原始价格和净价格,以计算相关节省额。
当最低价格高于计算价格时,报价中使用最低价格。在这种情况下,节省额为零,因为净计费方案与最低价格无关。
如果存在最低收费,则不再应用字数统计计算。
注释
在原仪表盘中,当最低价格为0时,节省额被视为原始价格与净价格之间的差额。
此仪表盘侧重于基于工作创建日期和工作截止日期的准时与逾期工作交付情况。仪表盘包含所有有截止日期且最后状态不是已取消、已拒绝或译员已拒绝的准时和逾期工作。
如果工作尚未标记为已完成,则将工作截止日期与当前日期进行比较。
在此仪表盘中可视化数据有两个先决条件:
-
工作需要有截止日期。
-
除图表外,工作需要遵循正确的状态顺序——新建、已发邮件、已接受和已完成:
-
工作已发邮件的日期/时间小于或等于服务商接受工作的日期/时间。
-
服务商接受工作的日期/时间小于或等于服务商交付工作或完成工作的日期/时间。
-
由于工作可能会多次经历相同的状态,因此计算基于分配的第一次实例以及接受和完成的最后一次实例。
注释
所有工作工作流步骤均计入 图表中。例如,如果工作包含 翻译 步骤和 修订 步骤,则每个步骤都会根据其各自的状态(可能相同,也可能不同)进行统计。
仪表盘提供以下方面的洞察:
-
随时间推移的按时完成和逾期工作数量。
-
基于元数据(即客户和领域)跟踪工作交付情况。
-
哪些项目进展顺利,哪些项目进展不顺利。
-
哪些客户和提供商表现良好。
-
按语言对拆分的工作分配、接受和完成的平均耗时。这有助于了解在每种状态下通常需要更多或更少时间的语言。
-
每个工作流步骤的平均编辑时间。
如果使用 Phrase Data,状态命名会有所不同,对应关系如下:
以下标准适用于该数据:
-
包含由翻译记忆库或机器翻译预翻译的片段。由翻译记忆库预翻译的片段必须已确认。
-
包含多个工作部分的句段被视为一个句段并进行统计。编辑时间的总和取自所有工作部分的句段,并考虑了 思考时间。
-
编辑时间超过 30 秒的句段不计入平均编辑时间,但计入预翻译句段图表的统计中。
-
包含来自所有工作部分在某一点上 或
-
包含过去 6 个日历月内及当前月份内创建的句段。
图表重点:
-
此图表显示了预翻译句段的平均编辑时间。对于由翻译记忆库预翻译的句段,它显示了按翻译记忆库匹配类别分数划分的编辑时间。对于由机器翻译预翻译的句段,水平线显示了机器翻译句段的平均编辑时间。这有助于指示设置阈值的最佳值。
-
未编辑的句段以 0 编辑时间计入。
-
翻译记忆库匹配分数被分为多个类别(0-69%、70-74%、...、95-99%、100-101%),以便更好地呈现数据。
-
-
此图表显示了来自所有来源的预翻译句段的总体平均编辑时间。这可用于检查阈值的更改是否有影响。调整阈值应能缩短编辑时间。
-
此图表显示了有多少句段正在进行预翻译,以及翻译记忆库返回的匹配类别分数。
筛选条件包括:
-
日期 - 即句段创建的日期。
-
默认设置为 6 个月,以与Phrase 翻译记忆库阈值值建议所使用的标准保持一致。
-
-
项目模板
-
领域(项目元数据)
-
子领域(项目元数据)
-
译文区域(项目元数据)
这些图表提供的分析有助于通过确定最佳翻译记忆库阈值来最大限度地减少语言工作量,并应作为利用自动化的起点。设置多个筛选组合可能会导致显示一小部分句段,这些句段可能没有足够的数据来提供结论性的分析。
字数统计考虑了在翻译记忆库系统中处理(上传)的所有原文/源语字数,例如提交完成、创建工作或完成持续本地化和更新原文/源语时。调整仪表盘筛选以包含已丢弃或已删除的工作。对于持续工作,计算基于最新版本中的所有原文/源语字数。
仪表盘提供有关已处理字数统计的分析:
-
订购套餐期间使用的字数。
-
逐月字数消耗量。
-
字数在不同提供商之间的分布情况。
-
哪些语言对占据最高的字数。
-
按客户和领域等元数据拆分的字数。
可通过高级分析中提供的可自定义图表显示由项目创建者或工作创建者统计的字数统计。
如有需要,可以查看基于字符或统计而非字数统计的图表。通过切换开关选择所需的指标,以在图表中显示相关数据。
由于不同语言的计数方法不同,所显示的字数统计可能与其它应用程序生成的字数统计不一致。
用于分析的字数统计与 MTU 计算 的字数统计不同。
-
每个合并标签都被替换为一个空间。
-
其他标签会被移除。
-
每个包含
+-,.的数字序列都被替换为一个字符(使用 regex 表达式[+-]?[0-9]+([., -]?[0-9]++)*+)。 -
每个空间序列都被替换为一个空间。
-
句段开头和结尾的空间会被移除。
-
每个不同于空间的字符序列被计为一个单词。
在不使用空间分隔单词的语言中(例如日语):
-
一些标点符号会从文本中移除(使用正则表达式
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}])。 -
句段被拆分为属于非空间 (NWS) 汉字、平假名、片假名和泰语脚本的字符序列,以及不属于这些脚本的字符序列 (WS)。
-
单词总数 = (来自 NWS 的单词数) + (来自 WS 的单词数)。
-
来自 WS 的单词数计算方式与英语相同。
-
来自 NWS 的单词数即为不含空间的字符数。
-
对于泰语,单词数是不含空间的字符数除以 2。
如果需要其他仪表盘标准,欢迎提交 功能请求。