Формат файла .XML не предназначен для перевода и требует дополнительных настроек для успешного импорта.
Настройки по умолчанию помечены звездочкой (*) и импортируют все XML элементы для перевода. Опции импорта можно использовать, чтобы изменить поведение импорта.
Сервисы искусственный интеллект (ИИ) могут быть очень эффективны при выявлении проблем с форматом в файлах на основе .XML.
Типы файлов
-
.XML
Параметры импорта
Простые правила импорта
-
Импортируются только выбранные элементы (например, name, title, para). Звездочка () импортирует все элементы.
-
Импортируются только выбранные атрибуты (например, name, title, para). Звездочка () импортирует все атрибуты.
-
Если выбрана опция , все элементы в переводимом контенте импортируются как Переводимый строковый элемент.
-
Выбранный строковый элемент name, title, para будет преобразован в теги, а контент не будет переводимым.
Важно
Проблемы с тегами являются частой причиной ошибок при экспорте (например, ), особенно для таких типов файлов, как электронные таблицы (на базе MS Excel) и .XML. Всегда проверяйте правильность тегов и форматирования перед экспортом файлов, запуская проверки контроль качества.
-
Элементы, являющиеся соседями текстовых узлов, будут автоматически преобразованы в строковые теги.
-
Код выбранного элемента обрабатывается как .HTML. Для этих элементов можно использовать настройки импорта .HTML, такие как Сохранять пробелы или Тег разрыва (<br/>) создает новый сегмент.
Используйте эту опцию, если значение выбранного элемента содержит разметку .HTML. Это не относится к дочерним элементам выбранного элемента, если не указано иное.
-
Выбранные элементы будут импортированы как заблокированный.
-
Выбранные атрибуты будут импортированы как заблокированный.
-
Введите список ссылок на символ (разделенных запятыми) в выходной файл.
Например:
-
Применить регулярные выражения, чтобы преобразовать указанный текст в теги.
-
Сообщения ICU автоматически конвертируются в теги. Когда сегмент содержит встроенные элементы, синтаксический анализ ICU для этого сегмента пропускается. Сегменты без встроенных элементов анализируются обычным образом.
-
XML-сущности в Объявление DTD будут импортированы для перевода.
-
-
Комментарии не импортируются, если элементы обрабатываются как HTML, как указано в параметре Элементы (обрабатываются как HTML).
-
Выберите, чтобы предотвратить сегментация внутри парных тегов XML или подэлементов. Это полезно, если XML содержит вложенные структуры, где сегментация нарушила бы логический смысл текста.
-
Можно загрузить таблицу стилей .XSL и создать на ее основе файл для предварительного просмотра.
Настройки XML с использованием XPath
Использование языка запросов XPath позволяет создавать сложные правила импорта и некоторые дополнительные функции, недоступные в обычных правилах импорта.
Выражение XPath должно определять элементы и/или атрибуты, текст/значение которых следует перевести, а не сам текстовый узел.
Перед использованием рекомендуется ознакомиться с XPath.
, и не будут обрабатываться для файлов, содержащих более 10 000 XML-элементов.
-
Составляет контекст памяти переводов (TM) (101% совпадения), если это применимо.
Если выражение XPath для не указано, XML-фильтр не создает контекстный ключ по умолчанию. Чтобы создать контекстный ключ на основе структурного пути сегмента, установите для значение Ключ сегмента в настройках импорта .
-
Импортировать элементы или контекстные атрибуты для каждого элемента.
-
Импортировать элементы или максимальную длину перевода для каждого элемента. Ограничение количества символов для каждого сегмента отображается на панели в редакторе. Любой символ, превышающий лимит, выделен красным цветом.
-
Оставьте пустым, чтобы сохранить пробелы в элементах. Примените xml:whitespace='preserve'. //*, чтобы сохранить все пробелы во всех элементах, или используйте произвольное выражение XPath.
-
Укажите XML-элементы или атрибуты, которые не следует подвергать сегментации. Введите XPath-выражение, которое определяет узлы, подлежащие Исключить. Любой текст, извлеченный из этих узлов, будет сохранен как единый сегмент, а не разделить на более мелкие единицы.
Введите //element[@attr='value'], чтобы Исключить все узлы
<element>, содержащие атрибутыattr=\"value\", из процесса сегментация.
HTML предварительный просмотр с таблицей стилей XSLT
Язык XSLT (Extensible Stylesheet Language Transformations) можно использовать для преобразования .XML-документов в формат .HTML для целей контекстный предварительный просмотр. Соответственно, файлы для предварительный просмотр, полученные через Предварительный просмотр перевод в меню Документ, имеют расширение HTML. Phrase в настоящее время поддерживает XSLT 2.0.
XSLT, используемый для предварительный просмотр, должен быть основан на перевод, а не на оригинал.
Нажмите Выбрать файл, чтобы импортировать таблицу стилей.
Нажмите Скачивание XSLT, чтобы выполнить скачивание таблицы стилей после импортировать файла.
CDATA в XML-файле
CDATA означает символьные данные (Character Data) и определяется как блоки текста, которые не обрабатываются парсером, но распознаются как разметка. Предопределенные сущности, такие как <, > и &, требуют ввода и, как правило, трудночитаемы в разметке. В таких случаях можно использовать раздел CDATA.
Если CDATA содержит встроенный .HTML, соответствующие XML-элементы должны быть перечислены в разделе .
Если исходный файл содержит CDATA и используется , то CDATA добавляется к каждому сегмент в завершенном файле.
CDATA будет подвергаться сегментации только при наличии четкого указания на разрыв сегмент, например, знака препинания или пробела.
Оригинал:
<text><![CDATA[Переводимый текст A. Переводимый текст B.]]></text>
Перевод:
<text><![CDATA[Переводимый текст A.]]><![CDATA[ ]]><![CDATA[Переводимый текст B.]]></text>
Завершенный файл является корректным .XML, и программа просмотра XML будет правильно отображать текст как Переводимый текст A. Переводимый текст B.
Многоязычные файлы импортируются как несколько двуязычных заданий с языками, сопоставленными перед импортом. Они представлены с помощью в таблице задания. При импорте на несколько языков перевода Завершенный файл состоит из всех языков перевода.
Phrase поддерживает XML-файлы, в которых присутствуют элементы оригинала и перевода для всех абзацев, даже если перевод пустой. Если сегментация оригинала и перевода различается, определяющей является сегментация оригинала.
Все отдельные языковые элементы должны быть потомками одного и того же элемента trans-unit, и один язык не может содержаться внутри другого. Контент оригинала и перевода не может храниться в значениях атрибутов. Если несколько элементов соответствуют XPath для оригинала или перевода внутри элемента trans-unit, для перевода импортируется только первый из них.
-
При создании задания выберите на панели перед применением настроек импорта. Если не указано иное, файл будет импортирован как стандартный .XML.
-
Контент тегов исходного .XML-файла можно визуализировать в редакторе, нажав Развернуть теги в меню , и отредактировать, нажав F2.
Например:
Образец частично переведенного текста с английского на немецкий и французский языки. Все <tuv lang=\"en\">, <tuv lang=\"de\"> и <tuv lang=\"fr\"> являются дочерними элементами одного и того же <tu> элемента.
<?xml version=\"1.0\" encoding=\"utf-8\"?>
<root>
Непереводимый текст.
<tu note=\"контекстное примечание\" key=\"Идентификатор 254\" maxlen=\"16\">
<tuv lang="en">
<seg>Первый сегмент.</seg>
</tuv>
<tuv lang="de">
<seg>Первый сегмент</seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
<tu note=\"другое контекстное примечание\" key=\"Идентификатор 255\" maxlen=\"18\">
<tuv lang="en">
<seg>Второй сегмент.</seg>
</tuv>
<tuv lang="de">
<seg></seg>
</tuv>
<tuv lang="fr">
<seg></seg>
</tuv>
</tu>
</root>
Параметры импорта
Для импорта многоязычных .XML-файлов необходимо использовать язык запросов XPath. См. пример выше для использования в качестве справочного файла. Выражение XPath определяет элементы, в которых текст/значение должны быть переведены, а не сам текстовый узел.
-
//tu -
tuv[@lang='en']/seg(по отношению к родительскому элементу//tu) -
Все элементы в оригинале или переводе считаются переводимыми встроенными элементами, если здесь не указано иное как непереводимые встроенные элементы.
-
Укажите контекстный ключ, который сохраняется вместе с сегментом в память переводов (TM) и используется для контекста совпадения.
-
Импортировать элементы или контекстные атрибуты для каждого элемента.
-
Импортировать элементы или максимальную длину перевода для каждого элемента
-
Введите список ссылок на символ (разделенных запятыми) в выходной файл.
Например:
-
Применить регулярные выражения, чтобы преобразовать указанный текст в теги.
-
Сообщения ICU автоматически конвертируются в теги. Когда сегмент содержит встроенные элементы, синтаксический анализ ICU для этого сегмента пропускается. Сегменты без встроенных элементов анализируются обычным образом.
-
Импортируются HTML теги, содержащиеся в файле. Далее теги можно использовать с настройками импорта файлов HTML. Теги абзацев
<p>будут создавать новые сегменты, даже если не выбран. -
Импортируются HTML теги, содержащиеся в файле. Далее теги можно использовать с настройками импорта файлов HTML.
-
Текст сегментируется по общему правилу сегментации, а не по одному сегменту на ячейку.
Осторожно
Применение к файлу, содержащему перевод, может привести к разному количеству сегментов в оригинале и в переводе.
-
Выберите статус подтверждения по умолчанию и укажите, должны ли подтвержденные сегменты автоматически добавляться в память переводов (TM).
-
Можно загрузить таблицу стилей .XSL и создать на ее основе файл для предварительного просмотра.
Пример: