Custom AI

自动化评估

文本由 Phrase Language AI 从英语机器翻译而得。

每个 MT 模型都提供自动评估。点击模型名称或更多列中的省略号ellipses.png即可查看。

Phrase Custom AI 提供丰富的数据和先进的视觉支持,旨在让您更深入地了解自定义 NextMT 模型的质量:

  • 概览选项卡提供了评估结果的摘要,包含直观的可视化效果和有关 MT 模型的元数据。

    • 性能对比表比较了通用 NextMT 模型与自定义 NextMT 模型在四项MT 质量指标下的性能。该表包含两个主要部分:

      • 基线性能

        显示 Phrase NextMT 和不利用 TM 的自定义 NextMT 模型的自动 MT 质量评分。

      • RAG 性能

        显示利用 TM 模糊匹配来调整 MT 输出时的自动 MT 质量评分。

      最佳引擎列突出显示了每项指标中表现最好的模型。

    • 模型元数据面板提供了有关已评估自定义 NextMT 模型的基本信息。

  • 可视化选项卡通过环形图提供 MT 评估结果的图形表示,按质量类别细分已评估的翻译片段。

    • 从顶部的下拉菜单中选择所需的 MT 质量指标,以将自定义 NextMT 模型与通用 Phrase NextMT 模型进行基准对比。

    • 将鼠标悬停在环形图的每个类别上,即可查看该类别的受影响片段的百分比和数量。

  • 评估样本选项卡展示了评估集中的片段样本预览,显示了包含相关基线和 RAG 性能评分的源片段列表。

    选中片段后,右侧面板会显示:

    • 基线和 RAG 性能的片段特定评分及质量水平指标。

    • 自定义和通用 NextMT 模型生成的翻译输出与数据集中参考翻译的对比。选择 显示引擎输出中的差异 以突出显示与参考译文的差异。

这篇文章有帮助吗?
★ ★ ★ ★ ★

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.