解析は、選択したファイルの文字数と単語数を計算し、以下を特定します。
-
繰り返し(ファイル間の繰り返しを含む)
複製されたセグメントの最初の出現のみが、通常の一致率または内部あいまい一致バケットで個別にカウントされます。繰り返しは、同じセグメントのその後の出現をカウントします。例:まったく同じセグメントが2つあるジョブでは、繰り返し: 1セグメントと表示され、2とはなりません。これはカウントルールを反映しています。
繰り返しは、翻訳メモリの一致がない、またはあいまい一致のみがある重複セグメントのその後の出現のみをカウントします。100%または101%の翻訳メモリ一致に該当するセグメントは、繰り返しカテゴリよりも優先され、繰り返しではなく翻訳メモリ一致カテゴリでカウントされます。
-
翻訳不要箇所
-
内部あいまい一致
-
機械翻訳の提案
解析では、レビュワーが行った修正数も表示できます。
解析は、プロジェクトマネージャーまたは管理者が作成できます。リンギストは、独自の解析を実行することはできません。ベンダーは、共有ジョブ/プロジェクトの解析を作成できます。
一部のCATツールでは、解析を統計と呼ぶことがあります。
組織の分析は、分析ダッシュボードによって提供されます。
国によって異なる課金単位が使用されるため、3つの計算方法が用意されています。
-
文字
スペースなし。
-
ワード
中国語、日本語、タイ語を除く、単語間にスペースを使用する言語の場合。
-
ページ
スペースを含む1800文字。ファイル内の実際のページ数とは無関係です。
言語によってカウント方法が異なるため、表示されるワードカウントは、他のアプリケーションで生成されるワードカウントと異なる場合があります。
解析用のワードカウントは、MTU計算のワードカウントとは異なります。
-
各結合タグは、1つのスペースに置き換えられます。
-
その他のタグは削除されます。
ホワイトスペースを単語の区切りに使用する言語(例:英語)の場合:
-
+-,.を含む各数値シーケンスは、1文字に置き換えられます(regex式[+-]?[0-9]+([., -]?[0-9]++)*+を使用)。 -
各スペースのシーケンスは、1つのスペースに置き換えられます。
-
セグメントの先頭と末尾にあるスペースは削除されます。
-
スペース以外の各文字シーケンスは、1ワードとしてカウントされます。
単語の区切りにホワイトスペースを使用しない言語(例:日本語)の場合:
-
一部の句読点はテキストから削除されます(regex式
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]を使用)。 -
セグメントは、スペース以外の(NWS)漢字、ひらがな、カタカナ、タイ語スクリプトに属する文字のシーケンスと、それらのスクリプトに属さない文字のシーケンス(WS)に分割されます。
-
ワード数の合計 = (NWSからのワード数) + (WSからのワード数)。
-
WSからのワード数は、英語の場合と同様に計算されます。
-
NWSのワード数は、空白を除いた文字数です。
-
タイ語の場合、ワード数は空白を除いた文字数を2で割った値です。
備考
CJK言語の文字は、文字数とワード数の両方としてカウントされます。
解析を作成するには、以下の手順に従ってください。
-
ページから、1つ以上のを選択します。
-
解析するをクリックします。
ウィンドウが開きます。
-
ドロップダウンリストからを選択します。
-
必要に応じて名前を入力します。
-
解析の命名に使用できるマクロ:
-
{projectName} -
{sourceLang}原文言語を追加します
-
{targetLang}訳文言語を追加します。複数の言語が解析される場合、言語は空欄になります。
-
{userName}割り当てられたリンギストまたはベンダーのユーザー名を追加します。複数のリンギストが割り当てられている場合、名前は空欄になります。
-
{workflow} -
{innerId} -
{fileName}解析により多くのファイル/ジョブが使用される場合、
{fileName}は空欄になります。
-
-
-
解析オプションを選択してください。特に:
-
オプションを適用すると、数字はワードとして計算されないため、ワード数に影響します。
-
オプションは、TMとの比較のみを行うのではなく、解析対象のジョブ内のセグメントをファイル内で比較して類似性を確認します。
がチェックされている場合、内部あいまい一致は、新しく作成された解析において別のカテゴリとして表示されます。以下に例を挙げます。
10ワードの翻訳ジョブには、以下のセグメントが含まれ、最後の文字のみが異なります:
-
新しい車を買いました。
-
新しい車を買いました!
TMで一致が見つからない場合、デフォルトの解析が以下のように表示されます:
IFオプション
TMカテゴリ:0%-49%
TMカテゴリ:95%-99%
IFカテゴリ:95%-99%
IFを含めるが無効
10ワード
IFを含めるが有効 + IFを分離が無効
5ワード
5ワード
IFを含める + IFを分離が有効
5ワード
5ワード
-
-
-
Click 解析する.
解析(複数可)が一覧に追加されます。
-
一覧から解析をクリックすると、詳細ページで表示したり、プロジェクト管理アプリケーションで表示するためにダウンロードしたりできます。
備考
解析オプションは、解析の作成時、プロジェクトレベル、または設定でグローバルに設定できます。
解析結果は、各言語ペアに対して、その言語独自のTMを基準として個別に計算されます。プロジェクトが複数の訳文言語間で共有TMを使用している場合でも、各言語ペアは独自の翻訳ユニットセットを保持します。同じ原文セグメントであっても、言語ごとにスコアが異なる場合があり、解析設定が同一であっても、同じプロジェクト内の訳文言語間で一致率やネットレートが異なる結果となります。
3種類の解析タイプが提供されています:
デフォルト解析は、原文セグメントに対して翻訳前に実行される標準的な解析です。これは、ジョブのベースライン解析を提供するもので、ポストエディット解析と併用することで、そのジョブの翻訳にどれだけの労力が費やされたかを判断できます。このベースラインは、クライアント向けの見積もりを作成する際の基礎としても使用されます。
TMしきい値は事前翻訳で設定されており、デフォルトで使用されますが、必要に応じて変更可能です。
セグメント/ワード数/文字数の内訳が生成され、プロジェクトで使用されている場合は、TM一致、非翻訳項目、内部あいまい一致、およびQPS(有効な場合)が特定されます。
注意
翻訳後にデフォルト解析を実行すると、不正確な解析結果が生成されます。
解析結果は、各ターゲット言語に対して、その言語固有の翻訳メモリを基に個別に計算されます。複数の訳文言語を持つプロジェクトでは、各言語ペアがTM内に独自の翻訳履歴を持っているため、同じ原文セグメントであっても、言語ペアごとに異なる一致率になったり、一致が全くなかったりすることがあります。その結果、解析設定が同一であっても、同じプロジェクト内でターゲット言語ごとに一致カテゴリごとのワード数分布やネットレートが異なる場合があります。
ポストエディット解析は訳文セグメントに対して実行され、編集作業量、つまりリンギストや校正者がテキストを編集するのにどれだけの作業を要したかを示します。これはポストエディットが完了した後に実行されます。
リンギストが未翻訳セグメントをクリックすると、その時点で最も高い翻訳メモリ一致、機械翻訳の提案、および/または翻訳不要箇所がそのセグメントに対して保存され、ポストエディット解析で使用されます。
ポストエディット解析はどのワークフローステップからでも開始でき、利用可能な原文(例:TM/MT)から挿入されたテキストと、セグメント訳文におけるポストエディット後の結果との差分として計算されます。
ポストエディット解析は、従来の翻訳メモリ解析を拡張し、機械翻訳(MT)および翻訳不要箇所(NT)を含めるようにしたものです。サードパーティ製MTエンジンもサポートされています。
注意
およびを無効にしても、解析からTM/MT一致が除外されるわけではありません。この場合、解析はポストエディット作業量ではなく、利用可能なより高い一致のスコアを考慮します。
ポストエディット解析における101%のTM結果は、必ずしもそのセグメントがTMから翻訳されたことを意味するわけではありません。
例:
が無効になっており、セグメントを開いた時点で101%のTM一致が存在していた場合、MTを使用して翻訳されたジョブであっても101%のTMとして表示されることがあります。
ポスト解析オプション
ポストエディットオプションは、翻訳メモリ(TM)、翻訳不要箇所(NT)、および機械翻訳(MT)からの一致に対して必要なポストエディット作業量を計算するために使用されます。
TMポストエディット解析を有効にする
-
リンギストによる編集が必要な高パーセント一致を含む、低品質のTMを対象としています。
-
TMのポストエディット作業量を示します。
-
解析には100%一致のみが含まれます。TMからのコンテキスト一致(101%)は、計算には影響しません。
TMポストエディット解析を無効にする
-
コストを削減するために一致を可能な限り編集しない、高品質のTMを対象としています。
-
101%と100%の両方を示します。
-
セグメントが開かれたときにリンギストに提示されるTM一致を示します(リンギストの実際のポストエディット作業ではありません)。
-
機械翻訳およびNTのポストエディット作業を示します。
NT/MTポストエディット解析を有効にする
-
MTまたはNTの提案が編集なしで受け入れられた場合、解析では100%一致として提示されます。
-
リンギストがMTを変更した場合、一致率は低くなります。スコア計算アルゴリズムは、翻訳メモリのあいまい一致のスコア計算に使用されるものと同じです。
-
NTを編集すると、そのセグメントは0-49%のNTとして提示されます。
NT/MTポストエディット解析を無効にする
-
推定スコアのないMT/NTからのエントリは、TM 0%-49%の一致とみなされます。これらは、MTが考慮されず、リンギストによって翻訳されたものとして示されます。
-
QPS(品質評価スコア)およびPhrase Language AIの75%を超える一致は、それぞれのマッチのMT列に表示されます。
-
セグメントが開かれたときにリンギストに提示されるNT/MT一致を示します(リンギストの実際のポストエディット作業ではありません)。
ソース更新前にポストエディット解析を自動生成する
-
解析が作成されます:
-
更新された各ジョブに対して。
-
各プロバイダごとに個別に作成され、それぞれのプロバイダに割り当てられます。
-
-
以下の場合、解析は作成されません。
-
リンギストまたはベンダーが割り当てられていない場合。
-
-
解析は確定済および翻訳済のセグメントをカウントします。
-
解析は以下の命名規則に従います:
-
UpdateSource #{innerID}{workflow}
-
-
解析は、ユニット数(原文)、NTポストエディットを解析する、TMポストエディットを解析する、およびMTポストエディットを解析するを選択して作成されます。
ユニット数をカウントする
-
解析でどのワードカウントを表示するかを選択します。訳文のワードカウントは、原文のワードカウントより大きくなる場合があります。
一致スコアリングには影響しません。
比較解析機能は、ワークフローのステップがあるプロジェクトでのみ利用可能です。異なるワークフローのステップにあるファイルの2つのバージョンをセグメントレベルで比較し、2つのバージョンがどのように異なるかを解析します。解析用のプロジェクト固有の設定がない場合、デフォルトの設定が使用され、レポートが不正確になる可能性があります。
例:
解析は複数のジョブに対して実行でき、2つの方法でグループ化できます。
-
プロバイダ別に解析する
-
さまざまなリンギストやベンダーに多くのジョブが割り当てられているプロジェクトの場合。以下の目的で使用されます。
-
個々のリンギストやベンダーに割り当てられたファイルを含む個別の解析を作成する。
-
解析をプロバイダに割り当て、リンギストやベンダーが解析を閲覧できるようにする。
プロバイダにネットレートスキームが適用されている場合、オプションとしてネットレートスキームが事前に選択されます。
-
-
-
言語別に解析する
解析の原文ファイルが更新されると、解析テーブル内で期限切れとしてマークされます。
再解析では、元の解析で使用された設定が適用されます。
ベンダーは、バイヤーが作成した解析を再解析することはできません。
新しい原文ファイルを使用して再解析するには、以下の手順に従います。
解析ビューをカスタマイズする
、、、、およびの列は、解析テーブルで表示/非表示を切り替えることができます。列はポストエディット解析でも利用可能で、セグメントの編集に費やされた秒数を示します。
解析をダウンロードする
解析をダウンロードするには、以下の手順に従ってください:
-
ダウンロードをクリックしてドロップダウンメニューを表示し、選択します:
-
CSV(カンマ区切り値):文字の有無にかかわらず、スプレッドシートアプリケーションで読み取り可能です。
-
LOG(SDL Tradosファイル形式に類似):ほとんどのプロジェクト管理アプリケーションで読み取り可能です。
-
JSON(JavaScript Object Notation):軽量なデータ交換用ファイル形式です。
JSONファイル形式でダウンロードされた解析のみに、一致タイプごとのNT、MT、TM、および内部ファジー(IF)データの詳細が含まれます。
-
-
ファイル形式を選択すると、ダウンロードが開始されます。
これらのファイルは、ほとんどのプロジェクト管理ソフトウェアシステムにインポートできます。
ネットレートスキームを適用する
解析では、単語/文字/ページに対する割引を適用できます。割引後の翻訳ボリュームが即座に計算され、解析内の行に直接表示されます。
解析からネットレートスキームを削除するには、ボタンの横にある空欄を空のままにします。
解析にネットレートスキームが適用されると、ダウンロードされた解析ファイルには、各一致カテゴリの加重単語数が表示されます。
解析をプロバイダに割り当てるには、以下の手順に従ってください:
-
一覧から解析を選択し、編集をクリックします。
編集ページが開きます。
-
ドロップダウン一覧からプロバイダを選択します。
-
保存をクリックします。
解析は、割り当てられたプロバイダがリンギストポータルで利用できるようになります。