ファイルインポートの設定

.XML - Extensible Markup Language (TMS)

本コンテンツはPhrase Language AIの機械翻訳により、英語から翻訳されています。

.XMLファイル形式は翻訳用に設計されておらず、正常にインポートするには追加の設定が必要です。

デフォルト設定にはアスタリスク(*)が付けられており、すべてのXML要素が翻訳用にインポートされます。インポートオプションを使用して、インポートの動作を変更できます。

AIサービスは、.XMLベースのファイルにおけるファイル形式の問題を特定するのに非常に効果的です。

ファイル形式

  • .XML

インポートオプション

標準インポートルール

  • タグ要素

    選択された要素(例:name、title、para)のみがインポートされます。アスタリスク(*)はすべての要素をインポートします。

  • タグ属性

    選択された属性(例:name、title、para)のみがインポートされます。アスタリスク(*)はすべての属性をインポートします。

  • 翻訳可能インライン要素

    インライン要素を自動的に識別オプションが選択されている場合、翻訳可能テキスト内のすべての要素が翻訳可能インライン要素としてインポートされます。

  • 翻訳不要インライン要素

    選択されたインライン要素name、title、paraはタグに変換され、コンテンツは翻訳可能になりません。

    注意

    タグに関する問題は、エクスポートエラー(例:ファイルが生成されませんでした)の一般的な原因であり、特にスプレッドシート(MS Excelベース)や.XMLなどのファイル形式で発生します。ファイルをエクスポートする前に、必ず品質管理チェックを実行して、タグと書式が正しいことを確認してください。

  • インライン要素を自動的に判別する

    テキストノードの隣接要素は、自動的にインラインタグに変換されます。

  • HTMLとして処理する要素

    選択された要素コードは.HTMLとして処理されます。.HTMLのインポート設定(空白を保持改行タグ(<br/>)で新しいセグメントを作成<4>など)をこれらの要素に使用できます。

    選択された要素値に.HTMLマークアップが含まれている場合は、このオプションを使用してください。特に指定がない限り、選択された要素の子要素には適用されません。

  • ロック済み要素

    選択された要素はロック済としてインポートされます。

  • ロック済み属性

    選択した属性は ロック済 としてインポートされます。

  • 文字実体へ変換

    文字参照の一覧(カンマ区切り)を出力ファイルに入力します。

    例:

    引用符("<1>)が必要な場合は &quot;<3> と表記され、文字Σは &#x3A3;<4> と表記されます。&quot;,&#x3A3;<5> を使用してください。&<6> および <<8> は、それぞれ常に &amp;<10> および &lt;<11> としてエクスポートされます。

  • Phrase TMSタグに変換する 

    正規表現を使用して、指定されたテキストをタグに変換。

  • Parse ICUメッセージ

    ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。

  • XMLエンティティをインポート

    DTD宣言<1>内のXMLエンティティは、翻訳用にインポートされます。

  • カスタム一般エンティティを拡張

  • コメントをインポート

    要素(HTMLとして処理)<1>オプションで指定されているように要素がHTMLとして処理される場合、コメントはインポートされません。

  • セグメンテーションからサブ要素を除外する

    XMLペアタグまたはサブ要素内でのセグメンテーション<1>を防ぐために選択します。これは、XMLにネストされた構造が含まれており、セグメンテーションによってテキストの論理的な意味が損なわれる場合に役立ちます。

  • XSLTプレビューファイルを作成

    .XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。

XPathを使用したXML設定

XPath<1>クエリ言語を使用すると、単純なインポートルールでは利用できない複雑なインポートルールの作成や、いくつかの追加機能が可能になります。

XPath式は、実際のテキストノードではなく、テキスト/値を翻訳する必要がある要素や属性を定義する必要があります。

使用する前にXPathに慣れておくことを推奨します。

コンテキストメモコンテキストキー、および最大訳文長は、10,000個を超えるXML要素を持つファイルでは処理されません。

  • コンテキストキー

    TMコンテキスト(101%一致)を構成します(該当する場合)。

    コンテキストキー<1>にXPath式が指定されていない場合、XMLフィルタはデフォルトでコンテキストキーを生成しません。セグメントの構造パスに基づいてコンテキストキーを生成するには、翻訳メモリ<4>のインポート設定で、セグメントコンテキスト<2>をセグメントキー<3>に設定します。

  • コンテキストメモ

    各要素の要素またはコンテキスト属性をインポートします。

  • 訳文の最大長さ

    要素または各要素の最大訳文文長をインポートします。各セグメントの文字数制限は、エディタ内のコンテキストメモビューに表示されます。制限を超えた文字は赤で強調表示されます。

  • 空白箇所を維持

    要素内の空白を保持するには、空欄のままにします。すべての要素内のすべての空白を保持するには xml:whitespace='preserve'. //*<1> を適用するか、任意のXPath式を使用します。

  • セグメンテーションから除外されたノード

    セグメント化しないXML要素または属性を指定します。除外するノードを特定するXPath式を入力します。これらのノードから抽出されたテキストは、より小さな単位に分割されるのではなく、単一のセグメントとして保持されます。

    //element[@attr='value']と入力して、属性attr=\"value\"を含むすべての<element>ノードをセグメンテーションから除外します。

XSLTスタイルシートを使用したHTMLプレビュー

XSLT言語(Extensible Stylesheet Language Transformations)を使用して、.XMLドキュメントをインコンテキストプレビュー目的で.HTMLファイル形式に変換できます。したがって、ドキュメントメニューの翻訳をプレビューからダウンロードされたプレビューファイルには、HTML拡張子が付きます。Phraseは現在XSLT 2.0をサポートしています。

プレビューに使用されるXSLTは、原文ではなく訳文に基づいている必要があります。

ファイルを選択をクリックしてスタイルシートをインポートします。

XSLTをダウンロードをクリックして、ファイルインポート後にスタイルシートをダウンロードします。

XMLファイルのCDATA

CDATAはCharacter Dataの略で、パーサーによって処理されず、マークアップとして認識されるテキストブロックとして定義されます。&lt;, &gt;&amp;などの定義済みエンティティは、入力が必要であり、マークアップ内では一般的に読み取りが困難です。そのような場合は、CDATAセクションを使用できます。

CDATAに埋め込み.HTMLが含まれている場合、対応するXML要素を要素(HTMLとして処理)の下にリストする必要があります。

原文ファイルにCDATAが含まれており、XMLをセグメント化が使用されている場合、完了したファイル内のすべてのセグメントにCDATAが追加されます。

CDATAは、句読点やスペースなど、セグメントの区切りが明確に示されている場合にのみセグメント化されます。

原文:

<text><![CDATA[Translatable text A. Translatable text B.]]></text>

訳文:

<text><![CDATA[Translatable text A.]]><![CDATA[ ]]><![CDATA[Translatable text B.]]></text>

完了したファイルは有効な.XMLであり、XMLビューアは翻訳可能テキスト A. 翻訳可能テキスト Bとしてテキストを正しく表示します。

アプリケーション固有の設定

Wordpress XML

Wordpress XMLの推奨設定:

  • XML

    XPath

  • 要素と属性

    //*[local-name()='encoded']|//description|//title

  • HTMLとして処理する要素

    //*[local-name()='encoded']|//description|//title

  • Phraseタグに変換する

    (\[[^\]]++\])++

HTML設定の下にある空白を保持を選択してください。

多言語XML

多言語ファイルは、インポート前に言語がマッピングされた複数のバイリンガルジョブとしてインポートされます。これらはジョブテーブル内でmultilingual_xml.pngと表示されます。複数の訳文言語にインポートされた場合、完了ファイルはすべての訳文言語で構成されます。

Phraseは、訳文が空欄であっても、すべての段落に対して原文要素と訳文要素の両方が存在するXMLファイルをサポートしています。原文のセグメンテーションと訳文のセグメンテーションが異なる場合、原文のセグメンテーションが決定要因となります。

個々の言語要素はすべて同じtrans-unit要素の子孫である必要があり、一方の言語をもう一方の言語に含めることはできません。原文のコンテンツと訳文のコンテンツを属性値に格納することはできません。trans-unit要素内の原文または訳文のXPathに一致する要素が複数ある場合、最初の要素のみが翻訳用にインポートされます。

  • ジョブを作成する際は、インポートオプションを適用する前に、ファイルタイプペインから多言語XMLを選択してください。指定がない場合、ファイルは標準の.XMLとしてインポートされます。

  • 原文.XMLファイルのタグコンテンツは、ツールメニューのタグを展開をクリックすることでエディタ内に表示でき、F2をクリックすることで編集できます。

例:

英語からドイツ語およびフランス語へ部分的に翻訳されたテキストのサンプル。すべての<tuv lang=\"en\"><tuv lang=\"de\">、および<tuv lang=\"fr\">は、同じ<tu>要素の子です。

<?xml version="1.0" encoding="utf-8"?>
<root>
翻訳不要テキスト。
<tu note="context note" key="ID 254" maxlen="16"> 
  <tuv lang="en">
    <seg>最初のセグメント。</seg>
  </tuv>
  <tuv lang="de">
    <seg>最初のセグメント</seg>
  </tuv>
  <tuv lang="fr">
    <seg></seg>
  </tuv>
</tu>
<tu note="another context note" key="ID 255" maxlen="18"> 
  <tuv lang="en">
    <seg>2番目のセグメント。</seg>
  </tuv>
  <tuv lang="de">
    <seg></seg>
  </tuv>
  <tuv lang="fr">
    <seg></seg>
  </tuv>
</tu>
</root>

インポートオプション

多言語.XMLファイルのインポートには、XPathクエリ言語を使用する必要があります。参考資料については、上記の例を参照してください。XPath式は、テキスト/値が翻訳されるべき要素を定義するものであり、実際のテキストノードを定義するものではありません。

  • 原文と訳文のサブ要素を含む要素

    //tu

  • 原文テキストを含む要素

    tuv[@lang='en']/seg(親要素//tuに関連して)

  • 翻訳不要インライン要素

    原文または訳文内のすべての要素は、ここで翻訳不要箇所として指定されない限り、翻訳可能インライン要素と見なされます。

  • コンテキストキー

    セグメントと共に翻訳メモリ<1>に保存され、一致コンテキストに使用されるコンテキストキーを指定します。

  • テキストの情報を表示

    各要素の要素またはコンテキスト属性をインポートします。

  • 訳文の最大長さ

    要素または各要素の最大訳文文長をインポートします

  • 文字実体へ変換

    文字参照の一覧(カンマ区切り)を出力ファイルに入力します。

    例:

    引用符("<1>)が必要な場合は &quot;<3> と表記され、文字Σは &#x3A3;<4> と表記されます。&quot;,&#x3A3;<5> を使用してください。&<6> および <<8> は、それぞれ常に &amp;<10> および &lt;<11> としてエクスポートされます。

  • Phrase TMSタグに変換する 

    正規表現を使用して、指定されたテキストをタグに変換。

  • Parse ICUメッセージ

    ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。

  • HTMLサブフィルターを使用する 

    ファイルに含まれる HTMLタグをインポートします。タグはHTMLファイルインポート設定で使用できます。段落タグ <p> は、セグメント 多言語 XML が選択されていない場合でも、新しいセグメントを作成します。

  • HTMLサブフィルターを使用する

    ファイルに含まれる HTMLタグをインポートします。タグはHTMLファイルインポート設定で使用できます。

  • セグメント多言語XML

    テキストは、セルごとに1つのセグメントではなく、一般的な セグメンテーション ルール によってセグメント化されます。

    注意

    訳文を含むファイルに セグメント 多言語 XML を適用すると、原文と訳文でセグメント数が異なる場合があります。

  • 空でないターゲットのセグメントステータスを設定する 

    デフォルトの確定ステータスと、確定済セグメントをTMに自動的に追加するかどうかを選択します。

  • XSLTプレビューファイルを作成

    .XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。

多言語 .XML に名前空間が含まれている場合、XPath は次のようになります:

  • 原文と訳文のサブ要素を含む要素

    //*[local-name()='trans-unit']

  • 原文テキストを含む要素

    *[local-name()='source']

  • 訳文テキストを含む要素

    *[local-name()='target']

この記事は役に立ちましたか?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.