Phrase Next GenMTは、最新の大規模言語モデルを活用して自動翻訳を行う、Phraseが開発した生成AI翻訳エンジンです。さらに、MT用語集の使用、タグの処理、および検索拡張生成(RAG)による動的なリアルタイムのカスタマイズをサポートしています。
Phrase Next GenMTは、Phrase Language AIを介したネイティブMTエンジンとして利用可能で、MTUsを消費します。お客様は、使用を開始するために独自のLLM認証情報を必要としません。
最先端の生成AI技術に基づいたPhrase Next GenMTは、流暢さを最適化し、用語集が参考資料として添付されていない場合でも、用語を容易に処理します。
主な機能
-
生成AI技術
従来のニューラル機械翻訳(NMT)ソリューションとは異なり、Phrase Next GenMTは生成AI技術を活用して、より幅広いドメインにおいて、お客様に向上した流暢さと翻訳精度を提供します。
-
マルチセグメント翻訳
Phrase Next GenMTは、個々のセグメントではなくテキストブロック全体を一度のリクエストで処理するため、より正確で一貫性のある翻訳結果が得られます。これにより、不一致なトーン、誤った代名詞、用語の不一致など、セグメント単位の処理によって生じるエラーが解消されます。
コンテキストを保持することで、マルチセグメント翻訳は翻訳品質を向上させ、ポストエディットの作業を軽減できます。
-
高度なMT用語集サポート
MT用語集が添付されている場合、Phrase Next GenMTの実装は、単純な検索と置換ではなく、形態素の屈折をサポートしており、正確な用語の使用を保証します。
-
自動タグ配置
書式設定タグとプレースホルダータグの両方をサポートしており、Phrase Next GenMTは複雑なシーケンスでもシームレスに機能します。
-
ロケールバリアント
Phrase Next GenMTは、イギリス英語(en-GB)、カナダフランス語(fr-CA)、ブラジルポルトガル語(pt-BR)、メキシコスペイン語(es-MX)などのロケールバリアント間でも流暢に翻訳します。
-
文体制御
Phrase Next GenMTでは、ユーザーが翻訳出力の文体を定義できます。関連するMTプロファイルにおいて、エンジンに対して以下のオプションを設定できます。
-
-
-
(デフォルト設定):原文の文体に合わせます。
文体は語彙や代名詞に影響を与えますが、その影響は文法の枠を超えて広がります。それは、翻訳されたコンテンツの全体的なレジスター、つまり専門的なものとして読まれるか、親しみやすいものとして読まれるかを決定します。
例:
-
英語からドイツ語へ
ニュートラルな英語の原文「How can I help you?」は、文体設定によって翻訳が異なります。
-
フォーマル: 「Wie kann ich Ihnen behilflich sein?」
-
インフォーマル: 「Wie kann ich dir helfen?」
代名詞はIhnenからdirへと変化し、それに応じて動詞の構文も変わります。Behilflich sein(「支援する」)は、カジュアルな文脈では堅苦しく聞こえるフォーマルな表現であり、そのような場面ではhelfen(「助ける」)が自然な選択です。原文は完全にニュートラルですが、2つのドイツ語訳はそれぞれ異なる社会的レジスターに属しています。
-
-
英語から日本語へ
日本語の場合、文体設定は敬体と常体との間で切り替わります。
-
常体(じょうたい):文末は だ または である で終わる。日常会話で使われるほか、学術論文やニュース記事などのフォーマルな書き言葉の文脈でも使われます。
-
敬体(keitai):文末は です または ます で終わります。ビジネスメールや上司、同僚、または親しくない人との会話で使用されます。
ニュートラルな英語の原文「The meeting starts at 10.」の翻訳は以下の通りです:
-
会議は10時に始まる。\" (会議は10時に始まる。)
-
敬体(keitai):"会議は10時に始まります。\" (会議は10時に始まります。)
意味は同じで、動詞の語尾のみが変化します。Hajimaruは普通形であり、hajimarimasuは読者への敬意を示すmasu語尾を追加したものです。
-
利用可能な言語
文体設定は、Phrase Next GenMTがサポートするすべての言語で利用可能です。
備考
文体設定は、Phrase Next GenMTによって新しく翻訳されたセグメントに適用されます。ただし、翻訳メモリ(TM)からの1:1一致は、文体設定をバイパスします。TMに異なるトーンの翻訳が含まれている場合、ジョブ内で文体に不整合が生じる可能性があります。
-
リアルタイムカスタマイズ(RAGによる)
翻訳メモリ(TM)を使用して、翻訳をリアルタイムでカスタマイズできます。フューショットプロンプティングを関連するTMの一致と共に使用することで、モデルの動作を即座に適応させ、ブランドボイス、スタイル、用語との整合性を確保します。
RAGの仕組み:
-
RAGは、プロジェクトに割り当てられたTMからあいまい一致のセットを特定し、取得します。
-
取得されたTMのセグメントは、モデルの例(ショット)として使用されます。フューショットプロンプティングを通じて、これらの例が翻訳の出力に指針を与え、お客様固有の要件との整合性を確保します。
他のMTエンジンとは異なり、Phrase Next GenMTはコンテキストを考慮して翻訳します。エンジンは複数のセグメントをまとめて処理するため、一貫したテキストの翻訳が可能になります。マルチセグメントでコンテキストを考慮した翻訳により、代名詞、動詞の形式、および文体レベルのエラーが削減されます。
使用例
-
モデルの微調整を必要とせずに高品質な翻訳を求めるローカリゼーションマネージャー。
-
ブランドボイス、スタイル、用語が頻繁に進化する動的なワークフロー。
-
多様なドメインやオーディエンスに合わせて迅速なカスタマイズが必要なコンテンツ。
-
あるロケールバリアント(例:en-US、pt-BR)から別のロケールバリアント(例:en-GB、pt-PT)へコンテンツをローカライズまたは適応させること。
言語サポート
大規模言語モデルの多言語的な性質を考慮し、Phrase Next GenMTは、多様な使用ケースと言語ニーズに対応する多言語ソリューションであり、幅広い言語を翻訳可能です。このソリューションは多数の言語組み合わせをサポートしていますが、Phraseの高品質基準に沿って選定された推奨言語ペアを採用しています(翻訳の両方向について):
-
英語 - チェコ語
-
英語 - スペイン語
-
英語 - フランス語
-
英語 - ロシア語
-
英語 - ドイツ語
-
英語 - イタリア語
-
英語 - オランダ語
-
英語 - 中国語(簡体字)
-
英語 - スウェーデン語
-
英語 - 日本語
-
英語 - ポルトガル語
-
英語 - 韓国語
-
英語 - ポーランド語
-
英語 - デンマーク語
-
英語 - ギリシャ語
-
英語 - ノルウェー語(ブークモール)
-
英語 - インドネシア語
-
英語 - ハンガリー語
-
英語 - アラビア語
-
英語 - トルコ語
-
英語 - タイ語