.XMLファイル形式は翻訳用に設計されておらず、正常にインポートするには追加の設定が必要です。
デフォルト設定にはアスタリスク(*)が付けられており、すべてのXML要素が翻訳用にインポートされます。インポートオプションを使用して、インポートの動作を変更できます。
AIサービスは、.XMLベースのファイルにおけるファイル形式の問題を特定するのに非常に効果的です。
ファイル形式
-
.XML
インポートオプション
標準インポートルール
-
選択された要素(例:name、title、para)のみがインポートされます。アスタリスク()はすべての要素をインポートします。
-
選択された属性(例:name、title、para)のみがインポートされます。アスタリスク()はすべての属性をインポートします。
-
オプションが選択されている場合、翻訳可能テキスト内のすべての要素が翻訳可能インライン要素としてインポートされます。
-
選択されたインライン要素name、title、paraはタグに変換され、コンテンツは翻訳可能になりません。
-
テキストノードの隣接要素は、自動的にインラインタグに変換されます。
-
選択された要素コードは.HTMLとして処理されます。.HTMLのインポート設定(空白を保持や改行タグ(<br/>)で新しいセグメントを作成<4>など)をこれらの要素に使用できます。
選択された要素値に.HTMLマークアップが含まれている場合は、このオプションを使用してください。特に指定がない限り、選択された要素の子要素には適用されません。
-
選択された要素はロック済としてインポートされます。
-
選択した属性は ロック済 としてインポートされます。
-
文字参照の一覧(カンマ区切り)を出力ファイルに入力します。
例:
-
正規表現を使用して、指定されたテキストをタグに変換。
-
ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。
-
-
-
要素(HTMLとして処理)<1>オプションで指定されているように要素がHTMLとして処理される場合、コメントはインポートされません。
-
XMLペアタグまたはサブ要素内でのセグメンテーション<1>を防ぐために選択します。これは、XMLにネストされた構造が含まれており、セグメンテーションによってテキストの論理的な意味が損なわれる場合に役立ちます。
-
.XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。
XPathを使用したXML設定
XPath<1>クエリ言語を使用すると、単純なインポートルールでは利用できない複雑なインポートルールの作成や、いくつかの追加機能が可能になります。
XPath式は、実際のテキストノードではなく、テキスト/値を翻訳する必要がある要素や属性を定義する必要があります。
使用する前にXPathに慣れておくことを推奨します。
、、およびは、10,000個を超えるXML要素を持つファイルでは処理されません。
-
TMコンテキスト(101%一致)を構成します(該当する場合)。
-
各要素の要素またはコンテキスト属性をインポートします。
-
要素または各要素の最大訳文文長をインポートします。各セグメントの文字数制限は、エディタ内のビューに表示されます。制限を超えた文字は赤で強調表示されます。
-
要素内の空白を保持するには、空欄のままにします。すべての要素内のすべての空白を保持するには xml:whitespace='preserve'. //*<1> を適用するか、任意のXPath式を使用します。
-
セグメント化しないXML要素または属性を指定します。除外するノードを特定するXPath式を入力します。これらのノードから抽出されたテキストは、より小さな単位に分割されるのではなく、単一のセグメントとして保持されます。
//element[@attr='value']と入力して、属性
attr=\"value\"を含むすべての<element>ノードをセグメンテーションから除外します。
XSLTスタイルシートを使用したHTMLプレビュー
XSLT言語(Extensible Stylesheet Language Transformations)を使用して、.XMLドキュメントをインコンテキストプレビュー目的で.HTMLファイル形式に変換できます。したがって、ドキュメントメニューの翻訳をプレビューからダウンロードされたプレビューファイルには、HTML拡張子が付きます。Phraseは現在XSLT 2.0をサポートしています。
プレビューに使用されるXSLTは、原文ではなく訳文に基づいている必要があります。
ファイルを選択をクリックしてスタイルシートをインポートします。
XSLTをダウンロードをクリックして、ファイルインポート後にスタイルシートをダウンロードします。
XMLファイルのCDATA
CDATAはCharacter Dataの略で、パーサーによって処理されず、マークアップとして認識されるテキストブロックとして定義されます。<, >、&などの定義済みエンティティは、入力が必要であり、マークアップ内では一般的に読み取りが困難です。そのような場合は、CDATAセクションを使用できます。
CDATAに埋め込み.HTMLが含まれている場合、対応するXML要素をの下にリストする必要があります。
原文ファイルにCDATAが含まれており、が使用されている場合、完了したファイル内のすべてのセグメントにCDATAが追加されます。
CDATAは、句読点やスペースなど、セグメントの区切りが明確に示されている場合にのみセグメント化されます。
原文:
<text><![CDATA[Translatable text A. Translatable text B.]]></text>
訳文:
<text><![CDATA[Translatable text A.]]><![CDATA[ ]]><![CDATA[Translatable text B.]]></text>
完了したファイルは有効な.XMLであり、XMLビューアは翻訳可能テキスト A. 翻訳可能テキスト Bとしてテキストを正しく表示します。
多言語ファイルは、インポート前に言語がマッピングされた複数のバイリンガルジョブとしてインポートされます。これらはジョブテーブル内でと表示されます。複数の訳文言語にインポートされた場合、完了ファイルはすべての訳文言語で構成されます。
Phraseは、訳文が空欄であっても、すべての段落に対して原文要素と訳文要素の両方が存在するXMLファイルをサポートしています。原文のセグメンテーションと訳文のセグメンテーションが異なる場合、原文のセグメンテーションが決定要因となります。
個々の言語要素はすべて同じtrans-unit要素の子孫である必要があり、一方の言語をもう一方の言語に含めることはできません。原文のコンテンツと訳文のコンテンツを属性値に格納することはできません。trans-unit要素内の原文または訳文のXPathに一致する要素が複数ある場合、最初の要素のみが翻訳用にインポートされます。
-
ジョブを作成する際は、インポートオプションを適用する前に、ペインからを選択してください。指定がない場合、ファイルは標準の.XMLとしてインポートされます。
-
原文.XMLファイルのタグコンテンツは、メニューのタグを展開をクリックすることでエディタ内に表示でき、F2をクリックすることで編集できます。
例:
英語からドイツ語およびフランス語へ部分的に翻訳されたテキストのサンプル。すべての<tuv lang=\"en\">、<tuv lang=\"de\">、および<tuv lang=\"fr\">は、同じ<tu>要素の子です。
<?xml version="1.0" encoding="utf-8"?>
<root>
翻訳不要テキスト。
<tu note="context note" key="ID 254" maxlen="16">
<tuv lang="en">
<seg>最初のセグメント。</seg>
</tuv>
<tuv lang="de">
<seg>最初のセグメント</seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
<tu note="another context note" key="ID 255" maxlen="18">
<tuv lang="en">
<seg>2番目のセグメント。</seg>
</tuv>
<tuv lang="de">
<seg></seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
</root>
インポートオプション
多言語.XMLファイルのインポートには、XPathクエリ言語を使用する必要があります。参考資料については、上記の例を参照してください。XPath式は、テキスト/値が翻訳されるべき要素を定義するものであり、実際のテキストノードを定義するものではありません。
-
//tu -
tuv[@lang='en']/seg(親要素//tuに関連して) -
原文または訳文内のすべての要素は、ここで翻訳不要箇所として指定されない限り、翻訳可能インライン要素と見なされます。
-
-
各要素の要素またはコンテキスト属性をインポートします。
-
要素または各要素の最大訳文文長をインポートします
-
文字参照の一覧(カンマ区切り)を出力ファイルに入力します。
例:
-
正規表現を使用して、指定されたテキストをタグに変換。
-
ICUメッセージは自動的にtagsに変換されます。セグメントにインライン要素が含まれている場合、そのセグメントのICU解析はスキップされます。インライン要素を含まないセグメントは通常通り解析されます。
-
ファイルに含まれる HTMLタグをインポートします。タグはHTMLファイルインポート設定で使用できます。段落タグ
<p>は、 が選択されていない場合でも、新しいセグメントを作成します。 -
ファイルに含まれる HTMLタグをインポートします。タグはHTMLファイルインポート設定で使用できます。
-
テキストは、セルごとに1つのセグメントではなく、一般的な セグメンテーション ルール によってセグメント化されます。
注意
訳文を含むファイルに を適用すると、原文と訳文でセグメント数が異なる場合があります。
-
デフォルトの確定ステータスと、確定済セグメントをTMに自動的に追加するかどうかを選択します。
-
.XSLスタイルシートをアップロードして、それから読み取り可能なプレビューファイルを生成できます。
例: