파일 가져오기 설정

.XML - 확장성 언어(TMS)

컨텐츠는 영어 텍스트를 Phrase Language AI를 이용해 기계 번역한 것입니다.

.XML 파일 형식은 번역을 위해 설계되지 않았으므로 성공적인 가져오기를 위해 추가 설정이 필요합니다.

기본 설정은 별표(*)로 표시되며 모든 XML 요소를 번역을 위해 가져오기합니다. 가져오기 옵션을 사용하여 가져오기 동작을 변경할 수 있습니다.

AI 서비스는 .XML 기반 파일의 형식 문제를 식별하는 데 매우 효과적일 수 있습니다.

파일 유형

  • .XML

가져오기 옵션

일반 가져오기 규칙

  • 요소

    선택된 요소(예: name, title, para)만 가져오기됩니다. 별표(*)는 모든 요소를 가져오기합니다.

  • 속성

    선택된 속성(예: name, title, para)만 가져오기됩니다. 별표(*)는 모든 속성을 가져오기합니다.

  • 번역할 인라인 요소

    인라인 요소 자동 식별 옵션이 선택된 경우, 번역 가능 텍스트의 모든 요소는 번역 가능 인라인 요소로 가져오기됩니다.

  • 번역하지 않을 인라인 요소

    선택된 인라인 요소 name, title, para는 태그로 변환되며 콘텐츠는 번역 가능하지 않게 됩니다.

    중요 사항

    태그 관련 문제는 내보내기 오류(예: 파일을 생성할 수 없음)의 일반적인 원인이며, 특히 스프레드시트(MS Excel 기반) 및 .XML와 같은 파일 형식에서 자주 발생합니다. 파일을 내보내기 전에 항상 품질 보증 검사를 실행하여 태그와 형식이 올바른지 확인하십시오.

  • 인라인 요소를 자동으로 식별

    텍스트 노드와 인접한 요소는 자동으로 인라인 태그로 변환됩니다.

  • 요소(HTML로서 처리)

    선택된 요소 코드는 .HTML로 처리됩니다. .HTML 가져오기 설정(예: 공백 보존 또는 태그(<br/>) 줄바꿈으로 새 세그먼트 생성)을 이러한 요소에 사용할 수 있습니다.

    선택된 요소 값에 .HTML 마크업이 포함된 경우 이 옵션을 사용하십시오. 별도로 지정되지 않는 한, 선택된 요소의 하위 요소에는 적용되지 않습니다.

  • 잠긴 요소

    선택된 요소는 잠김 상태로 가져오기됩니다.

  • 잠긴 속성

    선택된 속성은 잠김 상태로 가져오기됩니다.

  • 문자 개체로 변환

    아웃풋 파일에 글자 참조 목록(쉼표로 구분)을 입력하십시오.

    예:

    따옴표(\")가 필요한 경우 &quot;<3>으로 표시되며, 글자 Σ는 &#x3A3;<4>로 표시됩니다. &quot;,&#x3A3;<5>를 사용하십시오. &<6> 및 <<8>은 항상 각각 &amp;<10> 및 &lt;<11>로 내보내집니다.

  • Phrase TMS 태그로 변환 

    지정된 텍스트를 태그로 변환하려면 정규식을 적용하십시오.

  • ICU 메시지 구문 분석

    ICU 메시지는 태그로 자동 변환됩니다. 세그먼트에 인라인 요소가 포함된 경우 해당 세그먼트에 대한 ICU 파싱은 건너뜁니다. 인라인 요소가 없는 세그먼트는 정상적으로 파싱됩니다.

  • XML 개체 가져오기

    DTD 선언<1>의 XML 엔티티는 번역을 위해 가져오기 됩니다.

  • 사용자 지정 일반 개체 확장

  • 주석 가져오기

    요소(HTML로 처리됨)<1> 옵션에 표시된 대로 요소가 HTML로 처리되는 경우 주석은 가져오기 되지 않습니다.

  • 세그먼트 분할에서 하위 요소 제외

    XML 쌍 태그 또는 하위 요소 내부의 세그먼트 분할<1>을 방지하려면 선택하십시오. 이는 XML에 세그먼트 분할이 텍스트의 논리적 의미를 깨뜨릴 수 있는 중첩 구조가 포함된 경우 유용합니다.

  • XSLT 미리 보기 파일 생성

    .XSL 스타일시트를 업로드하고 이를 통해 읽기 가능한 미리 보기 파일을 생성할 수 있습니다.

XPath를 사용하는 XML 설정

XPath 쿼리 언어를 사용하면 복잡한 가져오기 규칙을 생성할 수 있으며 일반 가져오기 규칙에서는 사용할 수 없는 몇 가지 추가 기능을 사용할 수 있습니다.

XPath 표현식은 실제 텍스트 노드가 아니라 텍스트/값이 번역되어야 하는 요소 및/또는 속성을 정의해야 합니다.

사용하기 전에 XPath에 익숙해지는 것을 권장합니다.

컨텍스트 메모, 컨텍스트 키최대 대상 길이<3>는 10,000개 이상의 XML 요소가 포함된 파일에 대해서는 처리되지 않습니다.

  • 컨텍스트 키

    해당 경우 TM 컨텍스트를 구성합니다(101% 일치).

    컨텍스트 키<1>에 대해 XPath 표현식이 지정되지 않은 경우, XML 필터는 기본적으로 컨텍스트 키를 생성하지 않습니다. 세그먼트의 구조적 경로를 기반으로 컨텍스트 키를 생성하려면 번역 메모리<4> 일치 가져오기 설정에서 세그먼트 컨텍스트<2>를 세그먼트 키<3>로 설정하십시오.

  • 컨텍스트 메모

    각 요소에 대한 요소 또는 컨텍스트 속성을 가져오십시오.

  • 최대 대상 길이

    요소 또는 각 요소의 최대 대상 길이를 가져오기. 각 세그먼트의 글자 수 제한은 편집기 내부의 컨텍스트 메모 창에 표시됩니다. 한도를 초과하는 글자 빨간색으로 강조 표시됩니다.

  • 공백 보존

    요소의 공백을 보존하려면 비어 있음으로 두십시오. xml:whitespace='preserve'. //*<1>을 적용하여 모든 요소의 모든 공백을 보존하거나 임의의 XPath 표현식을 사용하십시오.

  • 세그먼트 분할에서 제외된 노드

    세그먼트 분할을 하지 않아야 하는 XML 요소 또는 속성을 지정하십시오. 제외할 노드를 식별하는 XPath 표현식을 입력하십시오. 이 노드에서 추출된 모든 텍스트는 더 작은 단위로 분할되지 않고 단일 세그먼트로 유지됩니다.

    <element> 노드 중 attr=\"value\" 속성을 포함하는 모든 노드를 세그먼트 분할에서 제외하려면 //element[@attr='value']를 입력하십시오.

XSLT 스타일시트를 사용한 HTML 미리 보기

XSLT 언어(Extensible Stylesheet Language Transformations)를 사용하여 .XML 문서를 인컨텍스트 미리 보기 목적의 .HTML 형식으로 변환할 수 있습니다. 따라서 문서 메뉴의 미리 보기 번역을 통해 다운로드된 미리 보기 파일은 HTML 확장자로 제공됩니다. Phrase는 현재 XSLT 2.0을 지원합니다.

미리 보기에 사용되는 XSLT는 소스가 아닌 대상을 기반으로 해야 합니다.

스타일시트를 가져오려면 파일 선택을 클릭하십시오.

파일 가져오기 후 스타일시트를 다운로드하려면 다운로드 XSLT를 클릭하십시오.

XML 파일의 CDATA

CDATA는 글자 데이터를 의미하며, 파서에 의해 처리되지 않지만 마크업으로 인식되는 텍스트 블록으로 정의됩니다. &lt;, &gt;, &amp;와 같은 미리 정의된 엔티티는 입력을 필요로 하며 일반적으로 마크업에서 읽기가 어렵습니다. 이러한 경우 CDATA 섹션을 사용할 수 있습니다.

CDATA에 포함된 .HTML이 있는 경우, 해당 XML 요소는 요소 (HTML로 처리됨) 아래에 나열되어야 합니다.

소스 파일에 CDATA가 포함되어 있고 세그먼트 XML이 사용되는 경우, CDATA는 완료된 파일의 모든 세그먼트에 추가됩니다.

CDATA는 문장 부호나 공백과 같은 세그먼트 분할에 대한 명확한 표시가 있는 경우에만 세그먼트 분할됩니다.

소스:

<text><![CDATA[번역 가능 텍스트 A. 번역 가능 텍스트 B.]]></text>

대상:

<text><![CDATA[번역 가능 텍스트 A.]]><![CDATA[ ]]><![CDATA[번역 가능 텍스트 B.]]></text>

완료된 파일은 유효한 .XML이며 XML 뷰어는 번역 가능 텍스트 A. 번역 가능 텍스트 B로 텍스트를 올바르게 표시합니다.

애플리케이션별 설정

Wordpress XML

Wordpress XML에 대한 권장 설정:

  • XML

    XPath

  • 요소 및 속성

    //*[local-name()='encoded']|//description|//title

  • 요소(HTML로서 처리)

    //*[local-name()='encoded']|//description|//title

  • Phrase 태그로 변환

    (\[[^\]]++\])++

HTML 설정에서 공백 유지를 선택하십시오.

다국어 XML

다국어 파일은 가져오기 전에 언어가 매핑된 여러 다국어 작업으로 가져옵니다. 이 파일들은 작업<3> 테이블에서 multilingual_xml.png로 표시됩니다. 여러 대상 언어로 가져오는 경우, 완료됨 파일은 모든 대상 언어로 구성됩니다.

Phrase는 대상이 비어 있더라도 모든 단락에 대해 소스 및 대상 요소가 모두 존재하는 XML 파일을 지원합니다. 소스 및 대상 세그먼트 분할이 다른 경우, 소스 세그먼트 분할이 결정적입니다.

개별 언어 요소는 모두 동일한 trans-unit 요소의 하위 항목이어야 하며 한 언어가 다른 언어 내에 포함될 수 없습니다. 소스 및 대상 콘텐츠는 속성 값에 저장할 수 없습니다. trans-unit 요소 내의 소스 또는 대상에 대한 XPath와 일치하는 요소가 여러 개인 경우, 첫 번째 요소만 번역을 위해 가져옵니다.

  • 작업을 생성할 때, 가져오기 옵션을 적용하기 전에 파일 형식<3> 창에서 다국어 XML을 선택하십시오. 지정하지 않으면 파일은 표준 .XML로 가져옵니다.

  • 소스 .XML 파일의 태그 콘텐츠는 도구 메뉴 아래의 태그 확장을 클릭하여 편집자에서 시각화할 수 있으며 F2을 클릭하여 편집할 수 있습니다.

예:

영어에서 독일어 및 프랑스어로 부분적으로 번역된 텍스트 샘플입니다. 모든 <tuv lang=\"en\">, <tuv lang=\"de\"><tuv lang=\"fr\">은 동일한 <tu> 요소의 하위 항목입니다.

<?xml version="1.0" encoding="utf-8"?>
<root>
번역하지 않을 텍스트.
<tu note="context note" key="ID 254" maxlen="16"> 
  <tuv lang="en">
    <seg>첫 번째 세그먼트.</seg>
  </tuv>
  <tuv lang="de">
    <seg>첫 번째 세그먼트</seg>
  </tuv>
  <tuv lang="fr">
    <seg></seg>
  </tuv>
</tu>
<tu note="another context note" key="ID 255" maxlen="18"> 
  <tuv lang="en">
    <seg>두 번째 세그먼트.</seg>
  </tuv>
  <tuv lang="de">
    <seg></seg>
  </tuv>
  <tuv lang="fr">
    <seg></seg>
  </tuv>
</tu>
</root>

가져오기 옵션

다국어 .XML 파일을 가져오려면 XPath 문의 언어를 사용해야 합니다. 참조를 위해 위의 사례를 참조하십시오. XPath 표현식은 실제 텍스트 노드가 아니라 텍스트/값이 번역되어야 하는 요소를 정의합니다.

  • 소스 및 대상 하위 요소를 포함하는 요소

    //tu

  • 소스 텍스트를 포함하는 요소

    tuv[@lang='en']/seg (상위 요소 //tu와 관련됨)

  • 번역하지 않을 인라인 요소

    소스 또는 대상의 모든 요소는 여기에 번역하지 않을 부분 인라인 요소로 지정되지 않는 한 번역 가능 인라인 요소로 간주됩니다.

  • 컨텍스트 키

    세그먼트와 함께 번역 메모리에 저장되고 일치 항목 컨텍스트에 사용되는 컨텍스트 키를 지정하십시오.

  • 컨텍스트 메모

    각 요소에 대한 요소 또는 컨텍스트 속성을 가져오십시오.

  • 최대 대상 길이

    요소 또는 각 요소의 최대 대상 길이를 가져오기

  • 문자 개체로 변환

    아웃풋 파일에 글자 참조 목록(쉼표로 구분)을 입력하십시오.

    예:

    따옴표(\")가 필요한 경우 &quot;<3>으로 표시되며, 글자 Σ는 &#x3A3;<4>로 표시됩니다. &quot;,&#x3A3;<5>를 사용하십시오. &<6> 및 <<8>은 항상 각각 &amp;<10> 및 &lt;<11>로 내보내집니다.

  • Phrase TMS 태그로 변환 

    지정된 텍스트를 태그로 변환하려면 정규식을 적용하십시오.

  • ICU 메시지 구문 분석

    ICU 메시지는 태그로 자동 변환됩니다. 세그먼트에 인라인 요소가 포함된 경우 해당 세그먼트에 대한 ICU 파싱은 건너뜁니다. 인라인 요소가 없는 세그먼트는 정상적으로 파싱됩니다.

  • HTML 하위 필터 사용 

    파일에 포함된 HTML 태그를 가져옵니다. 그런 다음 HTML 파일 가져오기 설정에 태그를 사용할 수 있습니다. 다국어 XML 세그먼트가 선택되지 않은 경우에도 단락 태그 <p>는 새 세그먼트를 생성합니다.

  • HTML 하위 필터 사용

    파일에 포함된 HTML 태그를 가져옵니다. 그런 다음 HTML 파일 가져오기 설정에 태그를 사용할 수 있습니다.

  • 세그먼트 다국어 XML

    텍스트는 셀당 하나의 세그먼트가 아니라 일반적인 세그먼트 분할 규칙에 의해 세그먼트로 분할됩니다.

    주의

    대상 텍스트가 포함된 파일에 다국어 XML 세그먼트를 적용하면 소스의 세그먼트 수와 대상의 세그먼트 수가 다를 수 있습니다.

  • 비어 있지 않은 대상의 세그먼트 상태 설정 

    기본 확인 상태와 확인된 세그먼트가 TM에 자동으로 추가되는지 여부를 선택하십시오.

  • XSLT 미리 보기 파일 생성

    .XSL 스타일시트를 업로드하고 이를 통해 읽기 가능한 미리 보기 파일을 생성할 수 있습니다.

사례:

다국어 .XML에 네임스페이스가 포함된 경우 XPath는 다음과 같을 수 있습니다:

  • 소스 및 대상 하위 요소를 포함하는 요소

    //*[local-name()='trans-unit']

  • 소스 텍스트를 포함하는 요소

    *[local-name()='source']

  • 대상 텍스트를 포함하는 요소

    *[local-name()='target']

도움이 되었습니까?

Sorry about that! In what way was it not helpful?

The article didn’t address my problem.
I couldn’t understand the article.
The feature doesn’t do what I need.
Other reason.

Note that feedback is provided anonymously so we aren't able to reply to questions.
If you'd like to ask a question, submit a request to our Support team.
Thank you for your feedback.