每个 MT 模型都提供自动评估。点击模型名称或列中的省略号即可查看。
Phrase Custom AI 提供丰富的数据和先进的视觉支持,旨在让您更深入地了解自定义 NextMT 模型的质量:
-
选项卡提供了评估结果的摘要,包含直观的可视化效果和有关 MT 模型的元数据。
-
表比较了通用 NextMT 模型与自定义 NextMT 模型在四项MT 质量指标下的性能。该表包含两个主要部分:
-
显示 Phrase NextMT 和不利用 TM 的自定义 NextMT 模型的自动 MT 质量评分。
-
显示利用 TM 模糊匹配来调整 MT 输出时的自动 MT 质量评分。
列突出显示了每项指标中表现最好的模型。
-
-
面板提供了有关已评估自定义 NextMT 模型的基本信息。
-
-
选项卡通过环形图提供 MT 评估结果的图形表示,按质量类别细分已评估的翻译片段。
-
从顶部的下拉菜单中选择所需的 MT 质量指标,以将自定义 NextMT 模型与通用 Phrase NextMT 模型进行基准对比。
-
将鼠标悬停在环形图的每个类别上,即可查看该类别的受影响片段的百分比和数量。
-
-
选项卡展示了评估集中的片段样本预览,显示了包含相关基线和 RAG 性能评分的源片段列表。
选中片段后,右侧面板会显示:
-
基线和 RAG 性能的片段特定评分及质量水平指标。
-
自定义和通用 NextMT 模型生成的翻译输出与数据集中参考翻译的对比。选择 以突出显示与参考译文的差异。
-