分析仪表板为标准指标提供现成的看板,包括 MT 使用量、成本、数量、杠杆率、节省量、时间、质量、报价和 TM 阈值,每个看板都有其各自的筛选器。使用 高级分析,用于构建任何预定义仪表板未涵盖的指标、细分或组合的图表。
可通过导航面板上的 Phrase Analytics 按钮访问分析仪表板。
根据我们的内部 数据存储 政策,来自永久删除内容的任何客户输入文本(例如项目名称、文件名、域)都不会出现在 Phrase Analytics 中。永久删除的内容将替换为 已删除。来自永久删除内容的所有数值、日期、时间戳和布尔数据类型均保持可用。这确保了历史 KPI、趋势和预测聚合随时间保持一致。
-
显示 按提供商 的图表包括语言专家和供应商。
-
语言对显示为源语言到目标语言的连接。
-
显示 按项目 的图表仅展示前 10,000 个项目,而下载时会包含完整的项目列表。
-
仪表板以 UTC 时区显示数据。
-
仪表板每天刷新两次:
-
欧盟实例为 UTC 时间凌晨 12:00 和中午 12:00
-
美国实例为 UTC 时间上午 07:00 和下午 19:00
每个仪表板都会显示上次数据刷新完成的时间。需要注意的是,显示的时间戳可能不包含在此前 3 小时内生成的数据。这是因为在触发数据刷新流程时,可能无法及时捕获交易。
-
-
数据报告提供过去 12 个完整月份的数据,使用户在任何时间点都能获得全年的数据。
仪表板视频回顾:
管理员在用户设置中设置每个项目经理的分析访问级别。提供三个级别:
-
查看所有组织数据。
-
仅查看项目经理拥有的项目中的数据。
-
无仪表板访问权限。
每个仪表板都支持不同的筛选器,以在图表中显示所选数据。特别是,作业状态筛选器会考虑以下作业状态:
-
。
-
。
当作业或项目被删除时,只要作业位于回收站中,该作业就会被标记为此状态。
-
。
通过手动或自动清空回收站而移除的作业。
-
。
注意
当作业被归档时,其状态会更改为已归档。当项目被归档时,作业的状态不会更改。
建议日期筛选器的时间跨度不要超过一年,否则性能可能会下降,图表也可能无法保持清晰度。
每个图表都可以下载为 .csv、.xlsx、.json 和 .png 文件格式。点击图表右上角的 3 点按钮,然后选择 下载结果:
-
要下载包含大数字逗号分隔符的格式化结果,请从窗口中选择所需的文件格式。
-
要下载未格式化的结果,请按住 Shift(Windows)或 Option(Mac)键,并从窗口中选择所需的文件格式。
所有仪表板均支持来自共享内容的数据。
对于内容所有者以外的任何组织,无法保证已删除的共享内容仍保持可见。
多个仪表板包含所有权筛选器,有助于区分本组织拥有的数据和跨组织共享的数据:
-
筛选器用于识别该组织是否为作业的创建者。
-
由该组织创建的作业(可能已共享,也可能未共享)。
-
与该组织共享或由该组织共享的作业,无论创建者是谁。
-
-
筛选器用于识别该组织是否为 LQA 评估的创建者。
审校提供商被视为所有者,因此该组织的视图会将评估显示为。来自其他组织(如翻译提供商、项目采购方或供应商)的用户将在下看到相同的评估列表。
如果提供商来自您的组织,则会显示其用户名和全名。如果提供商来自其他组织,则会显示其用户 ID 和组织名称,如记分卡中所示。
-
筛选器用于识别该组织是否为报价的创建者。
-
筛选器用于识别该组织是否为分析的创建者。
图表显示了组织基于定价指标(例如字数、字符数、页数或小时数)计算并乘以价目表后的实际支出。
成本仪表板基于:
-
项目中所有工作流步骤的报价。
注意
为同一工作流步骤创建新报价会覆盖先前创建的报价数据。
-
项目中所有按小时计费的报价,以及每个作业的标准报价的最新报价。
在共享项目(或已分配提供商的报价)中,所有用户均可见该报价,但每个用户的最新报价可能有所不同。
为作业分配提供商时,请考虑:
-
如果在创建作业时分配了提供商,则其价目表将覆盖项目的价目表。
-
如果稍后分配提供商,则不会自动重新计算成本。
为已分配的用户生成报价以相应地更新数据。
-
如果为作业部分分配了多个提供商,则使用第一个列出的提供商的数据。
生成新报价以使用任何其他用户的定价信息。
选项卡提供了有关 Phrase TMS 和 Strings、Phrase Portal 以及 通过 API 使用的 Phrase Language AI 中机器翻译单位和已翻译字符消耗量的见解。它按项目和工作流步骤提供了随时间、语言环境对、机器翻译引擎和机器翻译配置文件的消耗概览。
访问时,它默认为 Phrase TMS,但用户也可以通过调整“Phrase 产品”仪表板筛选器来查看所有/特定 Phrase 产品的消耗情况。
TMS MT 来源筛选器显示了 Phrase TMS 中 MT 单位的分配情况:
-
TMS 预翻译
-
TMS 分析
-
TMS CAT 编辑器
图表显示了翻译记忆库 (TM)、机器翻译 (MT)、重复内容和不可翻译内容 (NT) 在作业中的利用情况。
杠杆率的计算方法是:应用任何净费率方案之前的特定匹配类别字数与应用净费率方案后同一匹配类别字数之间的差值。
仪表板基于:
-
来自默认 分析 的数据。
-
来自任何给定作业的最后一次运行分析的数据。
仅当在创建分析之前,将 净费率方案 添加到项目或分配给作业的提供商时,才会生成数据。如果项目或分析中的净费率方案发生更改,分析将显示最新信息。
在以下情况下,图表不显示任何数据:
-
没有净费率方案的项目和作业。
-
杠杆率为 0 的分析(例如,针对项目、语言对等)。
-
包含内部模糊匹配的分析。
-
已删除的分析。
只有属于查看者所在组织的用户创建的分析才会被计入仪表板的计算中。因此,当买方 共享作业 给供应商且供应商创建分析时:
-
买方无法在仪表板中看到与分析相关的数据。
-
由于供应商是分析的创建者,他们能够在仪表板中看到相关数据。
质量绩效评分 (QPS) 在片段级别估算机器翻译质量,以确定哪些片段足以进行自动确认。QPS 由 Language AI 自动生成,与 语言质量评估 (LQA) 分数不同,后者反映了人工评审的评估,并在 质量仪表板 中单独跟踪。
预翻译的片段可以根据预翻译设置中设置的 QPS 阈值自动确认。QPS 仅适用于通过 Language AI 翻译的机器翻译片段。
如需机器翻译质量数据,请使用 QPS 见解仪表板。如需人工审校评分,请使用质量仪表板。
该仪表板有助于找到最佳 QPS 阈值,以平衡成本节约和质量风险。
仪表板中的筛选器有助于为不同内容类别找到最佳值,因为技术、法律和营销文本可能有不同的质量要求。
这些见解基于片段级指标。通过 Phrase Data Premium 可以解锁自定义见解,该功能提供对原始片段级数据的访问权限。
包含的数据
-
过去 6 个月,从 2025 年 1 月 1 日开始(跟踪开始时间)
-
仅限 Language AI,因为 QPS 仅适用于通过 Language AI 处理的机器翻译。
-
所有 Language AI 片段,无论来源如何(预翻译或编辑器建议)
-
QPS 评分是通过 Language AI 翻译后给出的原始评分,而非语言学家编辑后的评分。
-
买家(而非供应商)可以看到共享项目的数据。
过滤过长的编辑时间
有时,片段的编辑时间会异常长。这可能是由于分心(例如,查看手机或休息)造成的。为了保持数据准确性,平均编辑时间约为 20 秒。应用了 50% 的缓冲,并排除了编辑时间超过 30 秒的片段。
虽然一些长时间的编辑可能是合理的,但大多数是异常值并会引入噪声。
过滤的影响:
-
在大型数据集上,过滤这些长片段的影响微乎其微。
-
在较小的数据集上,这种影响更为显著,因为单次长时间的编辑可能会不成比例地影响总编辑时间。
此过滤确保了更清晰、更可靠的时间跟踪数据。
图表说明
-
图表 1:
显示在选定时间范围内,基于 QPS 分数的片段数量分布。
-
图表 2:
显示由语言专家编辑的片段百分比。QPS 分数越高,预期的编辑次数越少。
-
图表 3:
显示语言学家在编辑片段上花费的时间。
-
图表 4:
包括已编辑和未编辑的片段(编辑时间为0的片段)。这结合了前两个图表的见解,更清晰地展示了在所有已处理片段上花费的总工作量。
-
图表 5:
估算如果降低QPS阈值,无需人工验证的自动批准字数。例如,如果 QPS 阈值从 95 降低到 90,自动批准的平均字数可能会从 950 增加到 1,750。
-
图表 6:
显示如果降低QPS阈值可以节省多少编辑时间。
-
图表 7:
通过比较自动化片段(自动确认或自动锁定)与已编辑机器翻译片段的百分比,跟踪已编辑片段随时间的减少情况。它展示了自动化如何通过减少需要人工编辑的片段数量来提高效率。
仪表板专注于 LQA 功能,并包含以各自独立行呈现的已完成评估结果。评估结果可能包含也可能不包含问题,图表基于作业创建日期。
仪表板提供以下方面的洞察:
-
整个组织内的平均质量得分以及随时间变化的错误数量。
-
哪些类别具有最高严重性的 LQA 错误。
-
哪些供应商保持了高质量得分。
-
每个项目按严重性划分的错误数量。
-
质量得分随时间推移在语言对和客户方面的表现。
LQA 错误计数包含重复的问题。重复和非重复的问题在“按项目”和“按供应商”的表格中分别显示。
可以在 LQA 和自动 LQA 洞察之间进行切换。
仪表板中显示的“平均 LQA 分数”计算为所有包含的评估的 LQA 分数的简单平均值:即各评估分数的总和除以评估次数。该计算不应用基于字数、句段数或任何其他因素的加权。没有分数的评估将从计算中排除。所有已完成且有分数的评估都包含在平均值中,无论评估是通过还是失败。
仪表板显示用于作业付款的供应商报价信息,并包含所有处于新建、已批准、待批准和已拒绝状态的 报价。
已删除项目的报价将从仪表板中排除。
-
是为报价内所有作业设定的最低价格。
-
是报价内每个作业产生的价格。
-
显示了实际支付的成本,并在所有工作流步骤、语言对等项之间平均分摊。
包含在仪表板(以及报价表)中:
-
在所有工作流步骤中平均分摊的作业报价。这包括仅有一个工作流步骤的拆分作业的报价。
-
拆分前创建的报价。
不包含在仪表板(以及报价表)中:
-
在所有工作流步骤中不平均分摊的作业报价。
此仪表板比较报价中的原始价格和净价格,以计算相关节省金额。
当最低价格高于计算价格时,报价中使用最低价格。在这种情况下,节省金额为零,因为净费率方案与最低价格无关。
如果存在最低收费,则不再应用字数统计计算。
注意
在旧版仪表板中,当最低价格为 0 时,节省金额被视为原始价格与净价格之间的差额。
此仪表板侧重于基于作业创建日期和作业截止日期的准时交付与逾期交付。仪表板包含所有具有截止日期且最后状态不是已取消、已拒绝或译员已拒绝的准时和逾期作业。
如果作业尚未标记为已完成,则将作业截止日期与当前日期进行比较。
在此仪表板中可视化数据有两个先决条件:
-
作业需要有截止日期。
-
除图表外,作业需要遵循正确的状态顺序——新建、已发送邮件、已接受和已完成:
-
作业通过电子邮件发送的日期/时间早于或等于服务提供商接受作业的日期/时间。
-
服务提供商接受作业的日期/时间早于或等于服务提供商交付或完成作业的日期/时间。
-
由于作业可能会多次经历相同的状态,因此计算基于分配的首次实例以及接受和完成的最后实例。
注意
所有作业工作流步骤都计入 图表中。例如,如果作业包含 翻译 步骤和 修订 步骤,则每个步骤都将根据其各自的状态(可能相同,也可能不同)进行统计。
仪表板可提供以下数据洞察:
-
随时间变化的按时完成和逾期作业的数量。
-
基于元数据(即客户和领域)的作业交付跟踪。
-
哪些项目进展顺利,哪些项目进展不顺利。
-
哪些客户和提供商倾向于表现良好。
-
按语言对划分的作业分配、接受和完成的平均耗时。这有助于了解在每种状态下通常耗时较长或较短的语言。
-
每个工作流步骤的平均编辑时间。
如果使用 Phrase Data,状态命名会有所不同,对应关系如下:
以下标准适用于该数据:
-
包含由 TM 或 MT 预翻译的片段。由 TM 预翻译的片段必须经过确认。
-
包含多个工作部分的片段被视为并计为一个片段。编辑时间的总和取自所有工作部分的片段,并考虑了 思考时间。
-
编辑时间超过 30 秒的片段不计入平均编辑时间,但会计入预翻译片段图表的统计中。
-
包含所有工作部分在某一时刻曾 或 的片段。
-
包含过去 6 个日历月内及当前月份内创建的片段。
图表重点:
-
此图表显示了预翻译片段的平均编辑时间。对于由 TM 预翻译的片段,它显示了按 TM 匹配类别得分划分的编辑时间。对于由 MT 预翻译的片段,水平线显示了 MT 片段的平均编辑时间。这应有助于指示设置阈值的最佳值。
-
未编辑的片段将以 0 编辑时间计入。
-
TM 匹配分数被分为多个类别(0-69%、70-74%、...、95-99%、100-101%),以便更好地呈现数据。
-
-
此图表显示了来自所有来源的预翻译片段的总体平均编辑时间。这可用于检查阈值的变化是否有影响。调整阈值应能缩短编辑时间。
-
此图表显示了正在进行预翻译的片段数量以及 TM 返回的匹配类别分数。
筛选器包括:
-
日期 - 即片段创建的日期。
-
默认设置为 6 个月,以与 Phrase TM阈值建议值所使用的标准保持一致。
-
-
项目模板
-
领域 (项目元数据)
-
子领域(项目元数据)
-
目标语言区域(项目元数据)
这些图表提供的见解有助于通过确定最佳 TM 阈值来最大限度地减少语言工作量,并应作为利用自动化的起点。设置多种筛选器组合可能会导致显示一小部分片段,这些片段可能包含的数据不足以提供结论性的见解。
字数统计考虑了 TMS 中处理(上传)的所有源语言字数,例如提交任务、创建作业或完成持续本地化和更新源文件时。调整仪表板筛选器以包含已丢弃或已删除的作业。对于连续作业,计算基于上一版本中的所有源字数。
仪表板提供有关已处理字数的见解:
-
订阅期间使用的字数。
-
逐月字数消耗。
-
单词在各提供商之间的分布情况。
-
哪些语言对占据最高的字数。
-
按客户和领域等元数据划分的字数。
可以通过 高级分析 中提供的可自定义图表显示项目创建者或作业创建者的字数。
如果需要,可以查看基于 字符 或 计数而不是字数的图表。通过 开关选择所需的指标,以在图表中显示相关数据。
由于不同语言的计数方法不同,所显示的字数可能与其它应用程序生成的字数不同。
用于分析的字数与 MTU 计算 的字数不同,也与用于订阅计费的 TMS 处理字数 不同。
-
每个连接标记都替换为一个空格。
-
其它标记将被删除。
在使用 空格 分隔单词的语言中(例如英语):
-
每个包含
+、-、,、.的数字序列都被替换为一个字符(使用 regex 表达式[+-]?[0-9]+([., -]?[0-9]++)*+)。 -
每个空白字符序列都替换为一个空格。
-
片段开头和结尾的空白字符将被删除。
-
每个不同于空格的字符序列都被计为一个单词。
在不使用空格分隔单词的语言中(例如日语):
-
部分标点符号将从文本中移除(使用正则表达式
[\u2000-\u206F\u2E00-\u2E7F\u3000-\u3004\u3006-\u301F\\p{P}])。 -
片段被拆分为属于非空格 (NWS) 的汉字、平假名、片假名和泰语字符序列,以及不属于这些脚本的字符序列 (WS)。
-
单词总数 = (来自 NWS 的单词数) + (来自 WS 的单词数)。
-
来自 WS 的单词数计算方式与英语相同。
-
NWS 的单词数即为不含空格的字符数。
-
对于泰语,单词数是不含空格的字符数除以 2。
如果需要其他仪表板标准,欢迎提交 功能请求。