Phrase Next GenMTは、最新の大規模言語モデルを活用して自動翻訳を行う、Phraseが開発した生成AI翻訳エンジンです。さらに、MT用語集の使用、タグ処理、および検索拡張生成(RAG)による動的なリアルタイムカスタマイズをサポートしています。
Phrase Next GenMTは、Language AIを介したネイティブMTエンジンとして利用可能で、MTUsを消費します。お客様は、使用を開始するために独自のLLM認証情報を必要としません。
最先端の生成AI技術を基盤とするPhrase Next GenMTは、流暢さを最適化し、MT用語集が参考資料として添付されていない場合でも、用語を容易に処理します。
主な機能
-
生成AI技術
従来のニューラル機械翻訳(NMT)ソリューションとは異なり、Phrase Next GenMTは生成AI技術を活用することで、より幅広いドメインにおいて、お客様に高い流暢さと翻訳精度を提供します。
-
マルチセグメント翻訳
Phrase Next GenMTは、個々のセグメントではなくテキストブロック全体を一度に処理するため、より正確で一貫性のある翻訳結果が得られます。これにより、不一致なトーン、誤った代名詞、用語の不一致など、セグメント単位の処理によって生じるエラーが解消されます。
コンテキストを保持することで、マルチセグメント翻訳は翻訳品質を向上させ、ポストエディットの作業を軽減できます。
-
高度なMT用語集サポート
MT用語集が添付されている場合、Phrase Next GenMTの実装は、単純な検索と置換ではなく、形態論的な屈折をサポートし、正確な用語の使用を保証します。
-
自動タグ配置
書式設定タグとプレースホルダータグの両方をサポートしており、Phrase Next GenMTは複雑なシーケンスをシームレスに処理できます。
-
ロケールバリアント
Phrase Next GenMTは、イギリス英語(en-GB)、カナダフランス語(fr-CA)、ブラジルポルトガル語(pt-BR)、メキシコスペイン語(es-MX)などのロケールバリアント間でも流暢に翻訳します。
-
TB 文体制御
Phrase Next GenMTでは、ユーザーが翻訳出力のTB 文体を定義できます。関連するMTプロファイルにおいて、エンジンに対して以下のオプションを設定できます。
-
-
-
(デフォルト設定):原文のTB 文体に合わせます。
TB 文体は語彙や代名詞に影響を与えますが、その影響は文法の枠を超えて広がります。それは、翻訳されたコンテンツの全体的なレジスター(専門的か親しみやすいか)を決定します。
例:
-
英語からドイツ語へ
ニュートラルな英語の原文「How can I help you?」は、TB 文体の設定によって翻訳が異なります。
-
どのようなご用件でしょうか?
-
インフォーマル: 「どうすれば君を助けられる?」
代名詞はあなたから君へと変化し、それに応じて動詞の構文も変わります。Behilflich sein(「支援する」)は、カジュアルな文脈では堅苦しく聞こえる硬い表現であり、そのような場面では ヘルプ(「助ける」)が自然な選択です。英語の原文は完全にニュートラルですが、2つのドイツ語訳はそれぞれ異なる社会的レジスターに属しています。
-
-
英語から日本語へ
日本語の場合、TB 文体設定によって丁寧体と常体とが切り替わります。
-
常体(じょうたい):文末は だ または である で終わる。日常会話で使われるほか、学術論文やニュース記事などのフォーマルな書き言葉の文脈でも使われます。
-
丁寧体(敬体、keitai):文末はですまたはますで終わります。Businessメールや、上司、同僚、親しくない人との会話で使用されます。
ニュートラルな英語の原文「The meeting starts at 10.」は次のように翻訳されます:
-
会議は10時に始まる。" (Kaigi wa jūji ni hajimaru.)"
-
Polite (敬体, keitai): "会議は10時に始まります。" (Kaigi wa jūji ni hajimarimasu.)"
意味は同じで、動詞の語尾のみが変化します。Hajimaruは普通形であり、hajimarimasuは読者への敬意を示すmasu語尾を追加したものです。
-
利用可能な言語
TB 文体の設定は、Phrase Next GenMTでサポートされているすべての言語<1>で利用可能です。
備考
TB 文体の設定は、Phrase Next GenMTによって新しく翻訳されたセグメントに適用されます。ただし、翻訳メモリ(TM)からの1:1一致は、TB 文体の設定をバイパスします。TMに異なるトーンの翻訳が含まれている場合、ジョブ内でTB 文体に不整合が生じる可能性があります。
-
RAGによるリアルタイムカスタマイズ
翻訳メモリ(TM)を使用して、翻訳のリアルタイムカスタマイズを可能にします。Few-shotプロンプティングを関連するTMのあいまい一致と共に使用することで、モデルの動作を即座に適応させ、ブランドボイス、スタイル、および用語との整合性を確保します。
RAGの仕組み:
-
RAGは、プロジェクトに割り当てられたTMからあいまい一致のセットを特定して取得します。
-
取得されたTMのセグメントは、モデルの例(ショット)として使用されます。Few-shotプロンプティングを通じて、これらの例が翻訳の出力の指針となり、お客様固有の要件との整合性を確保します。
他のMTエンジンとは異なり、Phrase Next GenMTはコンテキストを考慮して翻訳します。このエンジンは複数のセグメントをまとめて処理するため、一貫したテキストの翻訳が可能になります。マルチセグメントでコンテキストを認識した翻訳により、代名詞、動詞の形式、TB 文体のエラーが削減されます。
使用例
-
モデルの微調整を必要とせずに高品質な翻訳を求めるコンテンツマネージャー。
-
ブランドボイス、スタイル、コンテンツが頻繁に進化する動的なワークフロー。
-
多様なドメインやオーディエンスに合わせて迅速なカスタマイズが必要なコンテンツ。
-
あるロケールバリアント(例:en-US、pt-BR)から別のロケールバリアント(例:en-GB、pt-PT)へコンテンツをローカライズまたは適応させること。
言語サポート
大規模言語モデルの多言語という性質を考慮し、Phrase Next GenMTは、多様な使用ケースと言語ニーズに対応する多言語ソリューションであり、幅広い言語を翻訳可能です。このソリューションは多くの言語の組み合わせをサポートしていますが、Phraseの高品質基準に従うために選定された推奨言語ペアのセットを決定しました(翻訳の双方向において):
-
英語 - チェコ語
-
英語 - スペイン語
-
英語 - フランス語
-
英語 - ロシア語
-
英語 - ドイツ語
-
英語 - イタリア語
-
英語 - オランダ語
-
英語 - 中国語(簡体字)
-
英語 - スウェーデン語
-
英語 - 日本語
-
英語 - ポルトガル語
-
英語 - 韓国語
-
英語 - ポーランド語
-
英語 - デンマーク語
-
英語 - ギリシャ語
-
英語 - ノルウェー語(ブークモール)
-
英語 (インドネシア)
-
英語 (ハンガリー)
-
英語 - アラビア語
-
英語 (トルコ)
-
英語 (タイ)