Das .XML-Dateiformat ist nicht für die Übersetzung konzipiert und erfordert zusätzliche Einstellungen für einen erfolgreichen Import.
Standardeinstellungen sind mit einem Sternchen (*) gekennzeichnet und importieren alle XML-Elemente zur Übersetzung. Import-Optionen können verwendet werden, um das Import-Verhalten zu ändern.
KI-Dienste können sehr effektiv dabei sein, Formatprobleme in .XML-basierten Dateien zu identifizieren.
Dateitypen
-
.XML
Import-Optionen
Einfache Importregeln
-
Nur ausgewählte Elemente (d. h. name, title, para) werden importiert. Ein Sternchen () importiert alle Elemente.
-
Nur ausgewählte Attribute (d. h. name, title, para) werden importiert. Ein Sternchen () importiert alle Attribute.
-
Wenn die Option ausgewählt ist, werden alle Elemente im übersetzbaren Text als übersetzbare Inline-Elemente importiert.
-
Das ausgewählte Inline-Element name, title, para wird in Tags umgewandelt und der Content ist nicht übersetzbar.
Wichtig
Probleme mit Tags sind eine häufige Ursache für Exportfehler (z. B. ), insbesondere bei Dateitypen wie Tabellenkalkulationen (MS Excel-basiert) und .XML. Stellen Sie vor dem Exportieren von Dateien immer sicher, dass Tags und Formatierung korrekt sind, indem Sie Qualitätssicherung-Prüfungen durchführen.
-
Elemente, die Nachbarn von Textknoten sind, werden automatisch in Inline-Tags umgewandelt.
-
Der ausgewählte Elementcode wird als .HTML verarbeitet. .HTML-Import-Einstellungen wie Leerzeichen beibehalten oder Tag-Umbruch (<br/>) erzeugt neues Segment können für diese Elemente verwendet werden.
Verwenden Sie diese Option, wenn der Wert des ausgewählten Elements .HTML-Markup enthält. Dies gilt nicht für untergeordnete Elemente des ausgewählten Elements, sofern nicht anders angegeben.
-
Die ausgewählten Elemente werden als gesperrt importiert.
-
Die ausgewählten Attribute werden als gesperrt importiert.
-
Geben Sie eine Liste von Zeichenreferenzen (durch Kommas getrennt) in die Output-Datei ein.
Beispiel:
-
Wende reguläre Ausdrücke an, um bestimmten Text in Tags zu konvertieren.
-
ICU-Nachrichten werden automatisch in Tags konvertiert. Wenn ein Segment Inline-Elemente enthält, wird das ICU-Parsing für dieses Segment übersprungen. Segmente ohne Inline-Elemente werden normal geparst.
-
XML-Entitäten in DTD-Deklaration werden zur Übersetzung importiert.
-
-
Kommentare werden nicht importiert, wenn Elemente als HTML verarbeitet werden, wie in der Option Elemente (als HTML verarbeitet) angegeben.
-
Wählen Sie dies aus, um die Segmentierung innerhalb von XML-Paar-Tags oder Unterelementen zu verhindern. Dies ist nützlich, wenn das XML verschachtelte Strukturen enthält, bei denen eine Segmentierung die logische Bedeutung des Textes zerstören würde.
-
Ein .XSL-Stylesheet kann hochgeladen werden, um daraus eine lesbare Vorschau-Datei zu generieren.
XML-Einstellungen unter Verwendung von XPath
Die Verwendung der XPath-Query-Sprache ermöglicht die Erstellung komplexer Import-Regeln sowie einiger zusätzlicher Funktionen, die bei einfachen Import-Regeln nicht verfügbar sind.
Der XPath-Ausdruck sollte die Elemente und/oder Attribute definieren, deren Text/Wert übersetzt werden soll, und nicht den eigentlichen Textknoten.
Vertrautheit mit XPath wird vor der Verwendung empfohlen.
, und werden bei Dateien mit mehr als 10.000 XML-Elementen nicht verarbeitet.
-
Konstituiert gegebenenfalls TM-Kontext (101% Matches).
Wenn kein XPath-Ausdruck für angegeben ist, generiert der XML-Filter standardmäßig keinen Kontext-Key. Um einen Kontext-Key basierend auf dem strukturellen Pfad des Segments zu generieren, setzen Sie unter den -Import-Einstellungen auf Segment-Key.
-
Importieren Sie Elemente oder Kontext-Attribute für jedes Element.
-
Importiere Elemente oder die maximale Ziellänge für jedes Element. Das Zeichenlimit für jedes Segment wird im Bereich im Editor angezeigt. Jedes Zeichen, das das Limit überschreitet, wird rot hervorgehoben.
-
Lassen Sie dies leer, um Leerzeichen in Elementen zu erhalten. Verwenden Sie xml:whitespace='preserve'. //*, um alle Leerzeichen in allen Elementen zu erhalten, oder verwenden Sie einen beliebigen XPath-Ausdruck.
-
Geben Sie XML-Elemente oder -Attribute an, die nicht als Segment behandelt werden sollen. Geben Sie einen XPath-Ausdruck ein, der die auszuschließenden Knoten identifiziert. Jeder aus diesen Knoten extrahierte Text wird als einzelnes Segment beibehalten, anstatt in kleinere Einheiten aufgeteilt zu werden.
Geben Sie //element[@attr='value'] ein, um alle
<element>Knoten, die das Attributattr=\"value\"enthalten, von der Segmentierung auszuschließen.
HTML-Vorschau mit XSLT-Stylesheet
Die XSLT-Sprache (Extensible Stylesheet Language Transformations) kann verwendet werden, um .XML-Dokumente für Kontext-Vorschau-Zwecke in das .HTML-Format zu transformieren. Dementsprechend werden Vorschaudateien, die über Vorschau übersetzen im Menü Dokument heruntergeladen werden, mit der HTML-Erweiterung geliefert. Phrase unterstützt derzeit XSLT 2.0.
Das für die Vorschau verwendete XSLT muss auf der Zielsprache und nicht auf der Ausgangssprache basieren.
Klicken Sie auf Datei auswählen, um ein Stylesheet zu importieren.
Klicken Sie auf XSLT herunterladen, um das Stylesheet nach dem Dateiimport herunterzuladen.
CDATA in XML-Datei
CDATA steht für Character Data und ist als Textblock definiert, der nicht vom Parser verarbeitet, sondern als Markup erkannt wird. Vordefinierte Entitäten wie <, > und & erfordern eine Eingabe und sind im Markup im Allgemeinen schwer zu lesen. In solchen Fällen kann der CDATA-Abschnitt verwendet werden.
Wenn CDATA eingebettetes .HTML enthält, sollten die entsprechenden XML-Elemente unter aufgelistet werden.
Wenn die Ausgangssprache-Datei CDATA enthält und verwendet wird, wird CDATA zu jedem Segment in der fertigen Datei hinzugefügt.
CDATA wird nur dann als Segment behandelt, wenn ein klarer Hinweis auf einen Segmentumbruch vorliegt, wie z. B. Satzzeichen oder Leerzeichen.
Ausgangssprache:
<text><![CDATA[übersetzbar text A. übersetzbar text B.]]></text>
Zielsprache:
<text><![CDATA[Übersetzbarer Text A.]]><![CDATA[ ]]><![CDATA[Übersetzbarer Text B.]]></text>
Die abgeschlossene Datei ist ein gültiges .XML und der XML-Viewer zeigt den Text korrekt als Übersetzbarer Text A. Übersetzbarer Text B an.
Mehrsprachige Dateien werden als mehrere zweisprachige Jobs importiert, wobei die Sprachen vor dem Import zugeordnet werden. Sie werden mit in der Jobs-Tabelle dargestellt. Bei Import in mehrere Zielsprachen setzt sich die abgeschlossene Datei aus allen Zielsprachen zusammen.
Phrase unterstützt XML-Dateien, bei denen sowohl Ausgangssprache- als auch Zielsprache-Elemente für alle Absätze vorhanden sind, selbst wenn die Zielsprache leer ist. Wenn sich die Segmentierung der Ausgangssprache und der Zielsprache unterscheidet, ist die Segmentierung der Ausgangssprache maßgeblich.
Einzelne Sprachelemente müssen alle Nachfahren desselben trans-unit-Elements sein, und eine Sprache darf nicht in der anderen enthalten sein. Content der Ausgangssprache und Zielsprache kann nicht in Attributwerten gespeichert werden. Wenn mehrere Elemente den XPath für die Ausgangssprache oder Zielsprache innerhalb des trans-unit-Elements erfüllen, wird nur das erste für die Übersetzung importiert.
-
Wählen Sie beim Erstellen eines Jobs im Bereich aus, bevor Sie die Importoptionen anwenden. Falls nicht anders angegeben, wird die Datei als Standard-.XML importiert.
-
Der Tag-Content der Ausgangs-.XML-Datei kann im Editor visualisiert werden, indem Sie im Menü auf Tags erweitern klicken, und bearbeitet werden, indem Sie auf F2 klicken.
Beispiel:
Beispiel für teilweise übersetzten Text aus dem Englischen ins Deutsche und Französische. Alle <tuv lang=\"en\">, <tuv lang=\"de\"> und <tuv lang=\"fr\"> sind untergeordnete Elemente desselben <tu>-Elements.
<?xml version="1.0" encoding="utf-8"?>
<root>
Nicht übersetzbarer Text.
<tu note="context note" key="ID 254" maxlen="16">
<tuv lang="en">
<seg>Erstes Segment.</seg>
</tuv>
<tuv lang="de">
<seg>Erstes Segment</seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
<tu note=\"weiterer Kontexthinweis\" key=\"ID 255\" maxlen=\"18\">
<tuv lang="en">
<seg>Zweites Segment.</seg>
</tuv>
<tuv lang="de">
<seg></seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
</root>
Import-Optionen
Für den Import von mehrsprachigen .XML-Dateien muss die XPath-Query-Sprache verwendet werden. Siehe Beispiel oben als Referenz. Der XPath-Ausdruck definiert die Elemente, in denen der Text/Wert übersetzt werden soll, und nicht den tatsächlichen Textknoten.
-
//tu -
tuv[@lang='en']/seg(in Bezug auf das übergeordnete Element//tu) -
Alle Elemente in der Ausgangssprache oder Zielsprache gelten als übersetzbare Inline-Elemente, sofern sie hier nicht als nicht übersetzbare Inline-Elemente angegeben sind.
-
Geben Sie einen Kontext-Key an, der mit dem Segment im Translation Memory gespeichert und für den Match-Kontext verwendet wird.
-
Importieren Sie Elemente oder Kontext-Attribute für jedes Element.
-
Importiere Elemente oder die maximale Ziellänge für jedes Element
-
Geben Sie eine Liste von Zeichenreferenzen (durch Kommas getrennt) in die Output-Datei ein.
Beispiel:
-
Wende reguläre Ausdrücke an, um bestimmten Text in Tags zu konvertieren.
-
ICU-Nachrichten werden automatisch in Tags konvertiert. Wenn ein Segment Inline-Elemente enthält, wird das ICU-Parsing für dieses Segment übersprungen. Segmente ohne Inline-Elemente werden normal geparst.
-
Importiert die in der Datei enthaltenen HTML-Tags. Tags können dann mithilfe der HTML-Dateiimport-Einstellungen verwendet werden. Absatz-Tags
<p>erstellen neue Segmente, auch wenn nicht ausgewählt ist. -
Importiert die in der Datei enthaltenen HTML-Tags. Tags können dann mithilfe der HTML-Dateiimport-Einstellungen verwendet werden.
-
Text wird durch eine allgemeine Segmentierung unterteilt und nicht in ein Segment pro Zelle.
Vorsicht
Das Anwenden von auf eine Datei, die Text in der Zielsprache enthält, kann zu einer unterschiedlichen Anzahl von Segmenten in der Ausgangssprache als in der Zielsprache führen.
-
Wählen Sie den Standard-Bestätigungsstatus aus und ob bestätigte Segmente automatisch zur TM hinzugefügt werden.
-
Ein .XSL-Stylesheet kann hochgeladen werden, um daraus eine lesbare Vorschau-Datei zu generieren.
Beispiel: