Анализ вычисляет количество символов и слов в выбранных файлах и определяет:
-
Повторы (включая повторы между файлами)
Только первое вхождение дублирующегося сегмента учитывается отдельно в обычном процентном соотношении совпадений или категории внутренних неточных совпадений. Повторы подсчитывает последующие вхождения того же сегмента. Пример: задание ровно с двумя идентичными сегментами показывает Повторы: 1 сегмент, а не 2. Это отражает правило подсчета.
-
Непереводимые элементы
-
Внутренние неточные совпадения
-
Предложения машинного перевода
Анализ также может показывать количество правок, внесенных редактором.
Анализ может быть создан руководителями проектов или администраторами. Лингвистам нельзя разрешать запускать собственный анализ. Поставщики могут создавать анализ для общих заданий/проектов.
Некоторые CAT-инструменты называют анализ статистикой.
Организационная аналитика предоставляется панелью управления аналитикой.
Поскольку в разных странах используются разные единицы биллинга, доступны три метода расчета:
-
Символы
Без пробелов.
-
Слова
Для языков, использующих пробелы между словами, за исключением китайского, японского и тайского.
-
Страницы
1800 символов с пробелами — не связано с фактическим количеством страниц в файле.
Из-за различий в методах подсчета в разных языках представленное количество слов может отличаться от количества слов, полученного в других приложениях.
Количество слов для анализа отличается от такового для расчета MTU.
-
Каждый тег объединения заменяется одним пробелом.
-
Остальные теги удаляются.
Для языков, использующих пробел для разделения слов (например, английского):
-
Каждая последовательность цифр, включая
+-,., заменяется одним символом (с использованием regex выражения[+-]?[0-9]+([., -]?[0-9]++)*+). -
Каждая последовательность пробелов заменяется одним пробелом.
-
Пробелы в начале и в конце сегмента удаляются.
-
Каждая последовательность символов, отличных от пробела, считается одним словом.
Для языков, не использующих пробелы для разделения слов (например, японского):
-
Некоторые знаки пунктуации удаляются из текста (с использованием regex выражения
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Сегмент разделяется на последовательности символов, относящихся к не содержащим пробелы (NWS) скриптам хань, хирагана, катакана и тайскому, и последовательности символов, не относящихся к этим скриптам (WS).
-
Общее количество слов = (количество слов из NWS) + (количество слов из WS).
-
Количество слов из WS вычисляется так же, как для английского языка.
-
Количество слов для NWS — это количество символов без пробелов.
-
Для тайского языка количество слов — это количество символов без пробелов, деленное на 2.
Примечание
Символы языков CJK учитываются и как символы, и как слова.
Чтобы создать анализ, выполните следующие действия:
-
На странице выберите одно или несколько .
-
Нажмите анализировать.
Откроется окно .
-
Выберите из выпадающего списка.
-
При необходимости укажите имя.
-
Доступные макросы для именования анализа:
-
{projectName} -
{sourceLang}Добавляет язык оригинала
-
{targetLang}Добавляет язык перевода. Если анализируется несколько языков, поле языка будет пустым.
-
{userName}Добавляет имя пользователя назначенного лингвиста или исполнителя. Если назначено несколько лингвистов, поле имени будет пустым.
-
{workflow} -
{innerId} -
{fileName}Если для анализа используется несколько файлов/заданий, поле
{fileName}будет пустым.
-
-
-
Выбрать параметры анализа. В частности:
-
Применение параметра повлияет на количество слов, так как числа не будут учитываться как слова.
-
Параметр сравнивает сегменты в анализируемом задании на предмет сходства внутри файла, в отличие от сравнения только с памятью переводов (TM).
Если выбран параметр , совпадения по внутренним нечетким соответствиям отображаются как отдельная категория в создаваемых анализах. Например:
Задание на перевод с 10 словами оригинала включает следующие сегменты, где отличается только последний символ:
-
Я купил новую машину.
-
Я купил новую машину!
Если в памяти переводов (TM) не найдено совпадений, будет отображен анализ по умолчанию:
Параметры внутренних нечетких совпадений
Категория памяти переводов (TM): 0%-49%
Категория памяти переводов (TM): 95%-99%
Категория внутренних нечетких совпадений: 95%-99%
Включить внутренние нечеткие совпадения<1> отключено
10 слов
Включить внутренние нечеткие совпадения<1> включено + Отдельные внутренние нечеткие совпадения<3> отключено
5 слов
5 слов
Включить внутренние нечеткие совпадения<1> + Отдельные внутренние нечеткие совпадения<3> включено
5 слов
5 слов
-
-
-
Нажмите анализировать.
Анализ или анализы добавляются в список.
-
Нажмите на анализ в списке, чтобы просмотреть его на странице сведений или скачать его для обработки в приложении для управления проектами.
Примечание
Параметры анализа можно задать при создании анализа, на уровне проекта или глобально в разделе Настройки .
Предусмотрено три типа анализа:
Анализ по умолчанию — это стандартный анализ, выполняемый для сегментов оригинала до<1> перевода. Он предоставляет базовый анализ задания, который можно использовать вместе с анализом постредактирования, чтобы определить, сколько усилий было затрачено на перевод этого задания. Эта база также используется в качестве основы для создания коммерческих предложений для клиентов.
Порог память переводов (TM), установленный при предварительном переводе, используется по умолчанию, но при необходимости его можно изменить.
Создается разбивка количества сегментов/слов/символов, и если она используется в проект, определяются совпадения память переводов (TM), а также непереводимые элементы, внутренние неточные совпадения и Оценка качества (QPS) (если включено).
Важно
Запуск анализа по умолчанию после перевода приводит к некорректным результатам анализа.
Анализ постредактирования выполняется для сегментов перевода и указывает на усилия по редактированию; сколько редактирования потребовал текст от лингвист или корректора. Он выполняется после того, как постредактирование завершено.
Когда лингвист нажимает на не переведено сегмент, текущее наивысшее совпадение память переводов, предложение машинный перевод и/или непереводимый элемент сохраняются для этого сегмента и используются в анализ постредактирования.
Анализ постредактирования можно запустить с любого этапа рабочего процесса; он рассчитывается как разница между текстом, вставленным из доступного оригинала (например, память переводов (TM)/машинный перевод (МТ)), и результатом постредактирования в переводе сегмента.
Анализ постредактирования расширяет традиционный анализ памяти переводов, включая машинный перевод (МТ) и непереводимые (NT) элементы. Сторонние системы машинного перевода (МТ) также поддерживаются.
Важно
Отключение и не исключает совпадения память переводов (TM)/машинный перевод (МТ) из анализа. В этом случае анализ учитывает оценку более высокого доступного совпадения вместо усилий по постредактированию.
Результат 101% память переводов (TM) в анализе постредактирования не обязательно означает, что сегмент был переведен из память переводов (TM).
Пример
Задание, переведенное с помощью машинный перевод (МТ), все равно может отображаться как 101% память переводов (TM), если отключено, а совпадение 101% память переводов (TM) было доступно при открытии сегмента.
Параметры после анализа
Параметры постредактирования используются для расчета усилий по постредактированию, необходимых для совпадений из память переводов (TM), непереводимых (NT) элементов и машинный перевод (МТ).
Анализировать постредактирование память переводов (TM) включено
-
Предназначено для низкокачественных память переводов (TM), которые содержат высокопроцентные совпадения, требующие редактирования лингвист.
-
Указывает на объем постредактирования для память переводов (TM).
-
Содержит только совпадения 100% в анализ. Контекстные совпадения 101% из память переводов (TM) не влияют на расчет.
Анализировать постредактирование память переводов (TM) отключено
-
Предназначено для высококачественной память переводов (TM), где совпадения должны редактироваться как можно меньше для снижения затрат.
-
Указывает как 101%, так и 100%.
-
Указывает на совпадения память переводов (TM), предлагаемые лингвист при открытии сегмент (а не фактический объем постредактирование лингвист).
-
Указывает на объем постредактирование для машинный перевод (МТ) и непереводимый.
Анализировать постредактирование непереводимый/машинный перевод (МТ) включено
-
Если предложение машинный перевод (МТ) или непереводимый было принято без дальнейшего редактирования, оно представляется как совпадение 100% в анализ.
-
Если лингвист изменяет машинный перевод (МТ), оценка совпадения будет ниже. Алгоритм подсчета оценка совпадает с тем, который используется для расчета оценка неточный совпадений память переводов.
-
Редактирование непереводимый приведет к тому, что сегмент будет представлен как непереводимый 0-49%.
Анализировать постредактирование непереводимый/машинный перевод (МТ) отключено
-
Записи из машинный перевод (МТ)/непереводимый без какой-либо оценочной оценка будут считаться совпадениями память переводов (TM) 0%-49%. Они будут указаны как переведенные лингвист без учета машинный перевод (МТ).
-
Оценка качества (QPS) и Phrase Language AI совпадения выше 75% будут находиться в столбце машинный перевод (МТ) в соответствующих совпадениях.
-
Указывает на непереводимый/машинный перевод (МТ) совпадения, предлагаемые лингвист при открытии сегмент (а не фактический объем постредактирование лингвист).
Автоматически создавать анализ постредактирование перед обновить оригинал
-
Анализ создан:
-
Для каждого обновленного задания.
-
Для каждого отдельного поставщика индивидуально и назначено соответствующему поставщику.
-
-
Анализ не создается, если:
-
Не назначен ни лингвист, ни исполнитель.
-
-
Анализ учитывает подтвержденные и переведенные сегменты.
-
Анализ следует правилам именования:
-
Обновить оригинал #{innerID}{рабочий процесс}
-
-
Анализ будет создан с выбранными параметрами Единицы подсчитаны (оригинал), Анализировать непереводимый (NT) постредактирование, Анализировать память переводов (TM) постредактирование и Анализировать машинный перевод (МТ) постредактирование.
Подсчитать единицы
-
Выберите, какое количество слов будет представлено в анализе. Количество слов в переводе может быть больше, чем количество слов в оригинале.
Не влияет на оценку совпадения.
-
планов: Team, Ultimate и Enterprise (устаревшая версия)
Свяжитесь с отделом продаж по вопросам лицензирования.
Функция сравнения анализа доступна только в проектах с этапами рабочего процесса. Она сравнивает две версии файла на разных этапах рабочего процесса на уровне сегментов и анализирует, чем отличаются эти две версии. Если для анализа нет настроек, специфичных для проекта, используются настройки по умолчанию, что может привести к некорректным отчетам.
Пример
Анализ можно запустить для нескольких заданий, и его можно сгруппировать двумя способами:
-
Анализировать по поставщику
-
Для проекта с множеством заданий, назначенных различным лингвистам или поставщикам. Используется для:
-
Создать отдельные анализы, содержащие файлы, назначенные отдельным лингвистам или поставщикам.
-
Назначить анализы поставщику, делая анализы видимыми для их лингвистов/поставщиков.
Схема расчета чистой ставки<1> будет выбрана по умолчанию, если она применена к поставщику.
-
-
-
Анализировать язык
-
Если проект содержит несколько переводов, анализы всех файлов можно запустить пакетом, создав отдельный анализ для каждого отдельного языка.
Чтобы анализировать язык, выполните следующие действия:
-
На странице проект выберите все файлы .
-
Нажмите анализировать.
Откроется окно .
-
Сохраните настройки по умолчанию и выберите .
-
Нажмите анализировать.
Анализ задания подготавливается по языку.
Примечание
Снимите выбор с этого параметра, чтобы создать один общий анализ для многоязычного проекта.
-
-
Когда оригинал файла для анализа обновляется, он помечается как устаревший в таблице анализа.
Пересчет применяет настройки, использованные для исходного анализа.
Поставщикам не разрешается пересчитывать анализы, созданные покупателями.
Чтобы выполнить пересчет с использованием нового оригинала файла, выполните следующие действия:
Настроить вид анализ
Столбцы , , , и можно отобразить/скрыть в таблице анализ. Столбец также доступен для постредактирование анализ и указывает, сколько секунд было потрачено на редактирование сегмент.
Скачать анализ
Чтобы выполнить скачивание анализ, выполните следующие действия:
-
Нажмите Скачать, чтобы открыть выпадающее меню и Выбрать:
-
CSV (значения, разделенные запятыми) с символами или без них, читается приложениями для работы с электронными таблицами.
-
LOG (похож на формат SDL Trados) и читается большинством приложений для управления проект.
-
JSON (JavaScript Object Notation), легкий формат обмена данными.
Только анализ, скачанный в формат JSON, будет включать разбивку данных по непереводимый (NT), машинный перевод (МТ), память переводов (TM) и внутренним нечетким совпадениям (IF) для каждого тип совпадение.
-
-
Выбор тип файла запускает скачивание.
Эти файлы можно импортировать в большинство систем управления проект.
Применить схема расчета чистой ставки
Скидка к словам/символам/страницам может быть применена в анализ. Объем перевода со скидкой немедленно рассчитывается и отображается непосредственно в анализ в строке .
Чтобы удалить схема расчета чистой ставки из анализ, оставьте поле рядом с кнопка пустой.
Когда схема расчета чистой ставки применяется к анализ, скачанный файл с анализ показывает взвешенное количество слов в каждой категория совпадение.
Чтобы назначить анализ поставщику, выполните следующие действия:
-
Выберите анализ из списка и нажмите редактировать.
Откроется страница редактирования.
-
Выберите поставщика из раскрывающегося списка.
-
Нажмите «Сохранить».
Анализ будет доступен назначенному поставщику на портале лингвист.