分析では、選択したファイル内の文字数と単語数を計算し、以下を特定します。
-
繰り返し(ファイル間の繰り返しを含む)
重複するセグメントの最初の出現のみが、通常の翻訳一致率または内部ファジー一致バケットで個別にカウントされます。繰り返しは、同じセグメントのその後の出現をカウントします。例:まったく同じセグメントが2つあるジョブでは、繰り返し: と表示されます。1セグメントであり、2ではありません。これはカウントルールを反映しています。
繰り返しは、翻訳メモリ一致がない、またはファジー一致のみがある重複セグメントのその後の出現のみをカウントします。100%または101%の翻訳メモリ一致と判定されたセグメントは、Repetitions(繰り返し)バケットよりも優先され、RepetitionsではなくTM一致カテゴリでカウントされます。
-
翻訳不要箇所
-
内部ファジー一致
-
機械翻訳の提案
分析では、レビュアーが行った修正数も表示できます。
分析は、プロジェクトマネージャーまたは管理者が作成できます。言語担当者は、独自の分析を実行することはできません。ベンダーは、共有ジョブ/プロジェクトの分析を作成できます。
一部のCATツールでは、分析を統計と呼ぶことがあります。
組織の分析は、分析ダッシュボードによって提供されます。
国によって異なる課金単位が使用されるため、3つの計算方法が用意されています。
-
文字
スペースなし。
-
ワード数
単語間にスペースを使用する言語用(中国語、日本語、タイ語を除く)。
-
枚数
スペースを含む1800文字—ファイル内の実際のページ数とは無関係です。
ワードカウント
言語によってカウント方法が異なるため、表示される単語数は他のアプリケーションで生成される単語数と異なる場合があります。
分析用の単語数は、MTU計算や、サブスクリプション請求に使用されるTMS処理済み単語数とは異なります。
-
各結合タグは1つのスペースに置き換えられます。
-
その他のタグは削除されます。
単語の区切りにスペースを使用する言語(例:英語)の場合:
-
+-,.を含む各数値シーケンスは、1文字に置き換えられます(regex式[+-]?[0-9]+([., -]?[0-9]++)*+を使用)。 -
各空白文字の連続は1つの空白に置き換えられます。
-
セグメントの先頭と末尾にある空白文字は削除されます。
-
空白文字以外の各文字シーケンスは1単語としてカウントされます。
単語の区切りにスペースを使用しない言語(例:日本語)の場合:
-
一部の句読点はテキストから削除されます(正規表現
[\u2000-\u206F\u2E00-\u2E7F\u3000-\u3004\u3006-\u301F\\p{P}]を使用)。 -
セグメントは、スペース以外の(NWS)漢字、ひらがな、カタカナ、タイ文字のシーケンスと、それらのスクリプトに属さない文字のシーケンス(WS)に分割されます。
-
単語の総数 = (NWSからの単語数) + (WSからの単語数)。
-
WSからの単語数は、英語の場合と同様に計算されます。
-
NWSの単語数は、空白文字を除いた文字数です。
-
タイ語の場合、単語数は空白文字を除いた文字数を2で割った値です。
備考
CJK言語の文字は、文字としても単語としてもカウントされます。
分析を作成するには、以下の手順に従ってください:
-
ページから、1つまたは複数のを選択します。
-
分析をクリックします。
ウィンドウが開きます。
-
ドロップダウンリストからを選択します。
-
必要に応じて名前を入力します。
-
分析の命名に使用できるマクロ:
-
{projectName} -
{sourceLang}ソース言語を追加します。
-
{targetLang}ターゲット言語を追加します。複数の言語が分析される場合、言語は空になります。
-
ユーザー名割り当てられた言語スペシャリストまたはベンダーのユーザー名を追加します。複数の言語スペシャリストが割り当てられている場合、名前は空になります。
-
ワークフロー
-
{innerId} -
ファイル名
分析に複数のファイル/ジョブが使用される場合、
{fileName}は空になります。
-
-
-
分析オプションを選択します。特に、以下の点に注意してください。
-
オプションを適用すると、数字は単語として計算されないため、単語数に影響します。
-
オプションは、TMとの比較だけでなく、分析対象ジョブ内のセグメント同士をファイル内で比較して類似性を確認します。
がオンの場合、内部ファジーの一致は、新しく作成された分析において別のカテゴリとして表示されます。以下に例を挙げます。
10個のソース単語を含む翻訳ジョブには、最後の文字のみが異なる以下のセグメントが含まれます。
-
新しい車を買いました。
-
新しい車を買いました!
TMで一致が見つからない場合、デフォルトの分析が次のように表示されます。
IFオプション
TMカテゴリ:0 9 * * 1
TMカテゴリ:0 9 * * 1
IFカテゴリ:0 9 * * 1
IFを含めるが無効
ワード数
IFを含めるが有効 + IFを分離が無効
ワード数
ワード数
IFを含める + IFを分離が有効
ワード数
ワード数
-
-
-
分析をクリックします。
分析(または複数の分析)がリストに追加されます。
-
リスト内の分析をクリックすると、詳細ページで表示したり、プロジェクト管理アプリケーションでレンダリングするためにダウンロードしたりできます。
備考
分析オプションは、分析の作成時、プロジェクトレベル、または設定 からグローバルに設定できます。
分析結果は、言語ペアごとに、その言語独自のTMに対して個別に計算されます。プロジェクトが複数のターゲット言語間で共有TMを使用している場合でも、各言語ペアは独自の翻訳単位セットを保持します。同じソースセグメントでも言語ごとにスコアが異なる場合があり、分析設定が同一であっても、同じプロジェクト内のターゲット言語間で一致率やネットレートが異なる結果となります。
3種類の分析タイプが用意されています。
デフォルト分析は、翻訳前のソースセグメントに対して実行される標準の分析です。これは、ジョブのベースライン分析を提供し、ポストエディット分析と併用することで、そのジョブの翻訳にどれだけの労力が費やされたかを判断するために使用できます。このベースラインは、クライアント向けの見積もりを作成する際の基準としても使用されます。
TMしきい値は、プリトランスレーションで設定されており、デフォルトで使用されますが、必要に応じて変更可能です。
セグメント/単語/文字数の内訳が作成され、プロジェクトで使用される場合は、TM一致、翻訳不要項目、内部ファジー一致、およびQPS(有効な場合)が特定されます。
注意
翻訳後にデフォルトの分析を実行すると、不正確な分析結果になります。
分析結果は、各ターゲット言語に対して、その言語独自の翻訳メモリに基づいて個別に計算されます。複数のターゲット言語を持つプロジェクトでは、各言語ペアがTM内に独自の翻訳履歴を持っているため、同じソースセグメントであっても、言語ペアごとに異なる一致率になったり、一致が全くなかったりすることがあります。その結果、分析設定が同一であっても、一致カテゴリごとの単語数の分布や、それによって算出される正味料金が、同じプロジェクト内のターゲット言語間で異なる場合があります。
ポストエディット解析
ポストエディット分析はターゲットセグメントに対して実行され、編集の労力、つまり言語担当者や校正者がそのテキストを編集するのにどれだけの作業を要したかを示します。これはポストエディットが完了した後に実行されます。
言語担当者が未翻訳のセグメントをクリックすると、その時点で最も高い翻訳メモリ一致、機械翻訳の提案、および/または翻訳不要項目がそのセグメントに対して保存され、ポストエディット分析に使用されます。
ポストエディット分析はどのワークフローステップからでも開始でき、利用可能なソース(TM/MTなど)から挿入されたテキストと、セグメントターゲット内のポストエディット後の結果との差として計算されます。
ポストエディット分析は、従来の翻訳メモリ分析を拡張し、機械翻訳(MT)および翻訳不要項目(NT)を含めるようにしたものです。サードパーティ製MTエンジンもサポートされています。
注意
およびを無効にしても、分析からTM/MT一致が除外されるわけではありません。この場合、分析ではポストエディットの労力ではなく、利用可能なより高い一致スコアが考慮されます。
ポストエディット分析における101%のTM結果は、必ずしもそのセグメントがTMから翻訳されたことを意味するわけではありません。
例:
が無効になっており、セグメントを開いた時点で101%のTM一致が利用可能であった場合、MTを使用して翻訳されたジョブであっても101%のTMとして表示されることがあります。
ポスト分析オプション
ポストエディットオプションは、翻訳メモリ(TM)、非翻訳(NT)、および機械翻訳(MT)からの一致に対して必要なポストエディットの労力を計算するために使用されます。
TMポストエディット分析を有効にする
-
翻訳者の編集が必要な高一致率を含む、低品質の翻訳メモリ(TM)を対象としています。
-
TMのポストエディット作業を示します。
-
分析において100%一致のみを含みます。TMからのコンテキスト一致(101%一致)は、計算に影響しません。
TMのポストエディット分析を無効にする
-
コスト削減のために一致を可能な限り編集しない、高品質のTMを対象としています。
-
101%一致と100%一致の両方を示します。
-
セグメントを開いたときに翻訳者に提示されるTM一致を示します(翻訳者による実際のポストエディット作業ではありません)。
-
機械翻訳および非翻訳(NT)のポストエディット作業を示します。
NT/MTのポストエディット分析を有効にする
-
MTまたはNTの提案が編集されずにそのまま採用された場合、分析では100%一致として表示されます。
-
翻訳者がMTを変更した場合、一致率は低下します。スコア計算アルゴリズムは、翻訳メモリのあいまい一致のスコア計算に使用されるものと同じです。
-
NTを編集すると、そのセグメントは0~49%のNTとして表示されます。
NT/MTのポストエディット分析を無効にする
-
推定スコアのないMT/NTからのエントリは、TMの0%~49%一致とみなされます。これらは、MTが考慮されず、翻訳者によって翻訳されたものとして示されます。
-
QPSおよびPhrase Language AIの75%を超える一致は、それぞれのマッチのMT列に表示されます。
-
セグメントを開いたときに翻訳者に提示されるNT/MT一致を示します(翻訳者による実際のポストエディット作業ではありません)。
ソース更新前にポストエディット分析を自動生成する
-
分析が作成されます:
-
更新されたジョブごとに。
-
各プロバイダーごとに個別に、そのプロバイダーに割り当てられます。
-
-
以下の場合、分析は作成されません:
-
言語スペシャリストまたはベンダーが割り当てられていない場合。
-
-
分析は、確定済みセグメントと翻訳済みセグメントをカウントします。
-
分析は以下の命名規則に従います:
-
更新ソース #{innerID}{workflow}
-
-
分析は、ユニット数(ソース)、NTポストエディットの分析、TMポストエディットの分析、およびMTポストエディットの分析を選択して作成されます。
次のカウント単位:
-
原文/訳文
分析に表示するワード数を選択します。ターゲットのワードカウントがソースのワードカウントより多くなる場合があります。
一致スコアリングには影響しません。
比較解析
比較分析機能は、ワークフローステップがあるプロジェクトでのみ利用可能です。これは、異なるワークフローステップにあるファイルの2つのバージョンをセグメントレベルで比較し、それら2つのバージョンがどのように異なるかを分析します。分析用のプロジェクト固有の設定がない場合、デフォルト設定が使用され、レポートが不正確になる可能性があります。
例:
分析は複数のジョブに対して実行でき、以下の2つの方法でグループ化できます:
-
プロバイダー別に解析
-
さまざまな言語スペシャリストやベンダーに割り当てられた多数のジョブがあるプロジェクトの場合。用途:
-
個々の言語スペシャリストやベンダーに割り当てられたファイルを含む個別の分析を作成します。
-
分析をプロバイダーに割り当て、そのプロバイダーの言語担当者/ベンダーが分析を閲覧できるようにします。
プロバイダーに適用されている場合、ネットレートスキームがオプションとしてあらかじめ選択されます。
-
-
-
言語別に解析
分析のソースファイルが更新されると、分析テーブル内で期限切れとしてマークされます。
再計算では、元の分析で使用された設定が適用されます。
ベンダーは、バイヤーが作成した分析を再計算することはできません。
新しいソースファイルを使用して再計算するには、次の手順に従います。
分析ビューのカスタマイズ
、、、、およびの各列は、分析テーブルで表示/非表示を切り替えることができます。列は、ポストエディット分析にも利用でき、セグメントの編集に何秒費やしたかを示します。
分析をダウンロードする
分析をダウンロードするには、次の手順に従ってください。
-
ダウンロードをクリックしてドロップダウンメニューを表示し、以下を選択します。
-
CSV(カンマ区切り値):文字数を含めるか含めないかを選択でき、スプレッドシートアプリケーションで読み取り可能です。
-
LOG(SDL Trados形式に類似):ほとんどのプロジェクト管理アプリケーションで読み取り可能です。
-
JSON(JavaScript Object Notation):軽量なデータ交換形式です。
JSON形式でダウンロードされた分析のみに、一致タイプごとのNT、MT、TM、および内部ファジー(IF)データの詳細が含まれます。
-
-
ファイルタイプを選択すると、ダウンロードが開始されます。
これらのファイルは、ほとんどのプロジェクト管理ソフトウェアシステムにインポートできます。
ネットレートスキームを適用する
分析において、単語数/文字数/ページ数に対する割引を適用できます。割引後の翻訳ボリュームが即座に計算され、分析の行に直接表示されます。
分析からネットレートスキームを削除するには、ボタンの横にあるフィールドを空のままにします。
ネットレートスキームが分析に適用されると、分析結果をダウンロードしたファイルには、各一致カテゴリの加重単語数が表示されます。
分析をプロバイダーに割り当てるには、次の手順に従ってください。
-
リストから分析を選択し、編集をクリックします。
編集ページが開きます。
-
ドロップダウンリストからプロバイダーを選択します。
-
保存をクリックします。
分析は、割り当てられたプロバイダーがlinguistポータルで利用できるようになります。