분석은 선택한 파일의 글자 및 단어 수를 계산하고 다음을 식별합니다.
-
반복 (파일 간 반복 포함)
복제된 세그먼트의 첫 번째 발생만 별도로 계산되며, 일반 일치율 또는 내부 퍼지 버킷에 포함됩니다. 반복은 동일한 세그먼트의 후속 발생 횟수를 계산합니다. 예: 정확히 두 개의 동일한 세그먼트가 있는 작업은 2가 아니라 반복: 1 세그먼트으로 표시됩니다. 이는 계산 규칙을 반영합니다.
반복은 번역 메모리 일치 항목이 없거나 퍼지 일치 항목만 있는 복제 세그먼트의 후속 발생 횟수만 계산합니다. 100% 또는 101% 번역 메모리 일치 항목에 해당하는 세그먼트는 반복 버킷보다 우선순위가 높으며 반복이 아닌 번역 메모리 일치 항목 범주에서 계산됩니다.
-
번역하지 않을 부분
-
내부 퍼지 일치 항목
-
기계 번역 제안
분석은 검토자가 수행한 수정 횟수를 보여줄 수도 있습니다.
분석은 프로젝트 관리자나 관리자가 생성할 수 있습니다. 언어 전문가는 자신의 분석을 실행할 수 없습니다. 공급업체는 공유 작업/프로젝트에 대한 분석을 생성할 수 있습니다.
일부 CAT 도구에서는 분석을 통계라고 부릅니다.
조직 분석은 분석 대시보드에서 제공합니다.
국가마다 다른 청구 단위를 사용하므로 세 가지 계산 방법을 사용할 수 있습니다.
-
글자
공백을 제외합니다.
-
단어 수
중국어, 일본어, 태국어를 제외하고 단어 사이에 공백을 사용하는 언어의 경우.
-
페이지
공백 포함 1800 글자—파일의 실제 페이지 수와는 무관합니다.
언어마다 계산 방식이 다르기 때문에, 표시되는 단어 수는 다른 애플리케이션에서 생성된 단어 수와 다를 수 있습니다.
분석을 위한 단어 수는 MTU 계산과 다릅니다.
-
각 결합 태그는 하나의 공백으로 대체됩니다.
-
기타 태그는 제거됩니다.
단어 구분 시 공백을 사용하는 언어(예: 영어)의 경우:
-
+-,.을 포함하는 각 숫자 시퀀스는 한 글자로 대체됩니다(정규식 regex 표현식[+-]?[0-9]+([., -]?[0-9]++)*+사용). -
각 공백 시퀀스는 하나의 공백으로 대체됩니다.
-
세그먼트 시작과 끝의 공백은 제거됩니다.
-
공백과 다른 각 글자 시퀀스는 하나의 단어로 계산됩니다.
단어 구분 시 공백을 사용하지 않는 언어(예: 일본어)의 경우:
-
일부 문장 부호는 텍스트에서 제거됩니다(정규식 표현식
[\u2000-\u206F\u2E00-\u2E7F\u3000-\u3004\u3006-\u301F\p{P}]사용). -
세그먼트는 공백이 아닌(NWS) 한자, 히라가나, 가타카나, 태국어 스크립트에 속하는 글자 시퀀스와 해당 스크립트에 속하지 않는 글자 시퀀스(WS)로 분할됩니다.
-
총 단어 수 = (NWS의 단어 수) + (WS의 단어 수).
-
WS의 단어 수는 영어와 동일하게 계산됩니다.
-
NWS의 단어 수는 공백을 제외한 문자 수입니다.
-
태국어의 경우 단어 수는 공백을 제외한 문자 수를 2로 나눈 값입니다.
참고
CJK 언어의 문자는 문자와 단어로 모두 계산됩니다.
분석을 생성하려면 다음 단계를 따르십시오:
-
페이지에서 하나 이상의 을 선택하십시오.
-
분석을 클릭하십시오.
창이 열립니다.
-
드롭다운 목록에서 을 선택하십시오.
-
필요한 경우 이름을 입력하십시오.
-
분석 명명에 사용할 수 있는 매크로:
-
{projectName} -
{sourceLang}소스 언어를 추가합니다.
-
{targetLang}대상 언어를 추가합니다. 여러 언어를 분석하는 경우 언어가 비어 있게 됩니다.
-
{userName}할당된 Linguist 또는 Vendor의 사용자 이름을 추가합니다. 여러 Linguist가 할당된 경우 이름이 비어 있게 됩니다.
-
{workflow} -
{innerId} -
{fileName}분석에 더 많은 파일/작업이 사용되는 경우,
{fileName}은 비어 있게 됩니다.
-
-
-
분석 옵션을 선택합니다. 특히:
-
옵션을 적용하면 숫자가 단어 수로 계산되지 않으므로 단어 수에 영향을 미칩니다.
-
옵션은 분석된 작업의 세그먼트를 TM과 비교하는 대신 파일 내의 유사성을 비교합니다.
가 선택된 경우, 내부 퍼지 일치 항목은 새로 생성된 분석에서 별도의 범주로 표시됩니다. 예:
10개의 소스 단어가 포함된 번역 작업에는 다음과 같은 세그먼트가 있으며, 마지막 글자만 다릅니다:
-
저는 새 차를 샀습니다.
-
저는 새 차를 샀습니다!
TM에서 일치 항목을 찾을 수 없는 경우, 기본 분석이 다음과 같이 표시됩니다:
IF 옵션
TM 범주: 0%-49%
TM 범주: 95%-99%
IF 범주: 95%-99%
IF 포함 비활성화됨
단어 수: 10
IF 포함 활성화됨 + IF 분리 비활성화됨
단어 수: 5
단어 수: 5
IF 포함 + IF 분리 활성화됨
단어 수: 5
단어 수: 5
-
-
-
분석을 클릭하십시오.
분석은 목록에 추가됩니다.
-
목록에서 분석을 클릭하여 세부 정보 페이지에서 보거나 프로젝트 관리 애플리케이션에서 렌더링하기 위해 다운로드하십시오.
참고
분석 옵션은 분석을 생성할 때, 프로젝트 수준에서 또는 설정 에서 전역적으로 설정할 수 있습니다.
분석 결과는 각 언어 쌍에 대해 해당 언어의 자체 TM을 기준으로 독립적으로 계산됩니다. 프로젝트가 여러 대상 언어에 걸쳐 공유 TM을 사용하는 경우에도 각 언어 쌍은 고유한 번역 단위 집합을 유지합니다. 동일한 소스 세그먼트라도 각 언어에서 다르게 점수가 매겨질 수 있으며, 이로 인해 분석 설정이 동일하더라도 동일한 프로젝트의 각 대상 언어별로 일치율과 순 비율이 달라질 수 있습니다.
세 가지 분석 유형이 제공됩니다:
기본 분석은 소스 세그먼트의 번역 전 단계에서 실행되는 표준 분석입니다. 이 분석은 작업 번역에 소요된 노력을 평가하기 위해 사후 편집 분석과 함께 사용할 수 있는 작업의 기준 분석을 제공합니다. 이 기준은 고객을 위한 견적을 생성하는 기반으로도 사용됩니다.
TM 임계값은 사전 번역에서 설정되며 기본적으로 사용되지만, 필요한 경우 변경할 수 있습니다.
세그먼트/단어/문자 수의 분포가 산출되며, 프로젝트에서 사용되는 경우 TM 일치 항목이 번역 불가능 항목, 내부 퍼지 일치 항목 및 QPS(활성화된 경우)와 함께 식별됩니다.
중요 사항
번역 후 기본 분석을 실행하면 잘못된 분석이 산출됩니다.
분석 결과는 각 대상 언어에 대해 해당 언어의 번역 메모리를 기준으로 독립적으로 계산됩니다. 여러 대상 언어가 있는 프로젝트에서 동일한 소스 세그먼트는 각 언어 쌍이 고유한 번역 기록을 TM에 가지고 있기 때문에 각 언어 쌍에서 서로 다른 일치율을 받거나 일치 항목이 전혀 없을 수 있습니다. 결과적으로, 일치 범주별 단어 수 분포와 그에 따른 순 요율은 분석 설정이 동일하더라도 동일한 프로젝트 내의 각 대상 언어에 따라 달라질 수 있습니다.
사후 편집 분석은 대상 세그먼트에서 실행되며 편집 노력을 나타냅니다. 텍스트가 번역자나 교정자로부터 얼마나 많은 편집을 필요로 했는지를 보여줍니다. 사후 편집이 완료되면 실행됩니다.
번역자가 번역되지 않은 세그먼트를 클릭하면, 현재 가장 높은 번역 메모리 일치 항목, 기계 번역 제안 및/또는 비번역 항목이 해당 세그먼트에 저장되고 사후 편집 분석에 사용됩니다.
사후 편집 분석은 모든 워크플로 단계에서 시작할 수 있으며, 사용 가능한 소스(예: TM/MT)에서 삽입된 텍스트와 세그먼트 대상의 사후 편집된 결과 간의 차이로 계산됩니다.
사후 편집 분석은 기존의 번역 메모리 분석을 확장하여 기계 번역(MT) 및 비번역 항목(NT)을 포함합니다. 타사 MT 엔진도 지원됩니다.
중요 사항
및 을 비활성화해도 분석에서 TM/MT 일치 항목이 제외되지는 않습니다. 이 경우 분석은 사후 편집 노력 대신 더 높은 사용 가능한 일치 항목의 점수를 고려합니다.
사후 편집 분석에서 101% TM 결과가 반드시 해당 세그먼트가 TM에서 번역되었음을 의미하는 것은 아닙니다.
사례
이 비활성화되어 있고 세그먼트가 열렸을 때 101% TM 일치 항목을 사용할 수 있었던 경우, MT를 사용하여 번역된 작업도 101% TM으로 나타날 수 있습니다.
사후 분석 옵션
사후 편집 옵션은 번역 메모리(TM), 비번역 항목(NT), 기계 번역(MT)에서 일치 항목에 필요한 사후 편집 노력을 계산하는 데 사용됩니다.
사후 편집 TM 분석 활성화됨
-
번역자의 편집이 필요한 높은 비율의 일치 항목을 포함하는 저품질 TM을 위한 것입니다.
-
TM에 대한 사후 편집 노력을 나타냅니다.
-
분석에 100% 일치 항목만 포함합니다. TM의 문맥 내 101% 일치 항목은 계산에 영향을 미치지 않습니다.
사후 편집 TM 분석 비활성화됨
-
비용을 절감하기 위해 일치 항목을 가능한 한 적게 편집해야 하는 고품질 TM을 위한 것입니다.
-
101% 및 100%를 모두 나타냅니다.
-
세그먼트가 열릴 때 번역자에게 제공되는 TM 일치 항목을 나타냅니다(실제 번역자의 사후 편집 작업이 아님).
-
기계 번역 및 비번역 항목에 대한 사후 편집 노력을 나타냅니다.
NT/MT 사후 편집 분석 활성화
-
MT 또는 NT 제안이 추가 편집 없이 수락되면 분석에서 100% 일치 항목으로 표시됩니다.
-
번역자가 MT를 변경하면 일치율이 낮아집니다. 점수 산정 알고리즘은 번역 메모리 퍼지 일치 항목의 점수를 계산하는 데 사용되는 알고리즘과 동일합니다.
-
NT를 편집하면 해당 세그먼트는 0-49% NT로 표시됩니다.
NT/MT 사후 편집 분석 비활성화
-
예상 점수가 없는 MT/NT 항목은 TM 0%-49% 일치 항목으로 간주됩니다. MT가 고려되지 않은 상태에서 번역자가 번역한 것으로 표시됩니다.
-
QPS 및 Phrase Language AI 일치 항목 중 75%를 초과하는 항목은 각 일치 항목의 MT 열에 표시됩니다.
-
세그먼트가 열릴 때 번역자에게 제공되는 NT/MT 일치 항목을 나타냅니다(실제 번역자의 사후 편집 작업이 아님).
소스 업데이트 전에 사후 편집 분석을 자동으로 생성
-
분석이 생성됩니다.
-
각 업데이트된 작업에 대해.
-
각 개별 공급자별로 생성되며 해당 공급자에게 할당됩니다.
-
-
다음의 경우 분석이 생성되지 않습니다:
-
번역자나 공급자가 할당되지 않은 경우.
-
-
분석은 확인됨 및 번역된 세그먼트를 집계합니다.
-
분석은 다음 명명 규칙을 따릅니다.
-
소스 업데이트 #{innerID}{workflow}
-
-
분석은 단위 계산(소스), NT 사후 편집 분석, TM 사후 편집 분석 및 MT 사후 편집 분석을(를) 선택하여 생성됩니다.
단위 계산
-
분석에 표시할 단어 수를 선택하십시오. 대상 단어 수가 소스 단어 수보다 많을 수 있습니다.
일치 항목 점수에는 영향을 주지 않습니다.
비교 분석 기능은 워크플로 단계가 있는 프로젝트에서만 사용할 수 있습니다. 서로 다른 워크플로 단계에 있는 파일의 두 버전을 세그먼트 수준에서 비교하고 두 버전이 어떻게 다른지 분석합니다. 분석에 대한 프로젝트별 설정이 없는 경우 기본 설정이 사용되며 이로 인해 잘못된 보고서가 생성될 수 있습니다.
사례
분석은 여러 작업에서 실행할 수 있으며 두 가지 방식으로 그룹화할 수 있습니다.
-
공급자별 분석
-
번역자 또는 공급업체에 할당된 작업이 많은 프로젝트의 경우입니다. 사용 용도:
-
개별 번역자 또는 공급업체에 할당된 파일이 포함된 별도의 분석을 생성합니다.
-
분석을 공급자에게 할당하여 해당 번역자 또는 공급업체가 분석을 볼 수 있도록 합니다.
순 요율제이(가) 공급자에게 적용된 경우 옵션으로 미리 선택됩니다.
-
-
-
언어별 분석
분석을 위한 소스 파일이 업데이트되면 분석 표에 오래된 것으로 표시됩니다.
재계산은 원래 분석에 사용된 설정을 적용합니다.
공급업체는 구매자가 생성한 분석을 재계산할 수 없습니다.
새 소스 파일을 사용하여 재계산하려면 다음 단계를 따르십시오:
분석 보기 사용자 지정
, , , , 열을 분석 테이블에서 표시하거나 숨길 수 있습니다. 열은 사후 편집 분석에도 사용할 수 있으며, 세그먼트를 편집하는 데 소요된 시간을 초 단위로 나타냅니다.
분석 다운로드
분석을 다운로드하려면 다음 단계를 따르십시오:
-
다운로드를 클릭하여 드롭다운 메뉴를 표시하고 다음을 선택하십시오:
-
CSV (쉼표로 구분된 값): 문자 포함 여부에 관계없이 스프레드시트 애플리케이션에서 읽을 수 있습니다.
-
LOG (SDL Trados 형식과 유사하며, 대부분의 프로젝트 관리 애플리케이션에서 읽을 수 있습니다.)
-
JSON (JavaScript Object Notation), 경량 데이터 교환 형식입니다.
JSON 형식으로 다운로드된 분석에만 일치 유형별 NT, MT, TM 및 내부 퍼지(IF) 데이터의 세부 내역이 포함됩니다.
-
-
파일 형식을 선택하면 다운로드가 시작됩니다.
이 파일들은 대부분의 프로젝트 관리 소프트웨어 시스템으로 가져올 수 있습니다.
순 요율제를 적용하십시오.
분석에 단어/문자/페이지에 대한 할인을 적용할 수 있습니다. 할인된 번역 분량이 즉시 계산되어 분석의 행에 직접 표시됩니다.
분석에서 순 요율을 제거하려면 버튼 옆의 필드를 비워 두십시오.
분석에 순 요율이 적용되면, 다운로드된 분석 파일에 각 일치 항목 범주별 가중 단어 수가 표시됩니다.
분석을 공급자에게 할당하려면 다음 단계를 따르십시오.
-
목록에서 분석을 선택하고 편집을 클릭하십시오.
편집 페이지가 열립니다.
-
드롭다운 목록에서 공급자를 선택하십시오.
-
저장을 클릭합니다.
분석은 할당된 공급자가 linguist 포털에서 확인할 수 있습니다.