Анализ вычисляет количество символов и слов в выбранных файлах и определяет:
-
Повторы (включая повторы между файлами)
Только первое вхождение дублирующегося сегмента учитывается отдельно в обычном процентном соотношении совпадений или в категории внутренних нечетких совпадений. Повторы учитывают последующие вхождения того же сегмента. Например: В задании с двумя идентичными сегментами отображается Повторы: 1 сегмент, а не 2. Это отражает правило подсчета.
«Повторы» учитывают только последующие вхождения дублирующихся сегментов, для которых нет совпадений в памяти переводов или есть только нечеткое совпадение. Сегменты, соответствующие 100% или 101% совпадению в памяти переводов, имеют приоритет перед категорией «Повторы» и учитываются в категории совпадений TM, а не в «Повторах».
-
Непереводимые элементы
-
Внутренние нечеткие совпадения
-
Предложения машинного перевода
Анализы также могут показывать количество правок, внесенных рецензентом.
Анализы могут создаваться руководителями проектов или администраторами. Лингвистам не разрешается запускать собственные анализы. Поставщики могут создавать анализы для общих заданий/проектов.
Некоторые CAT-инструменты называют анализ статистикой.
Организационная аналитика предоставляется через панель аналитики.
Поскольку в разных странах используются разные единицы тарификации, доступны три метода расчета:
-
симв.
Без пробелов.
-
Слова
Для языков, в которых используются пробелы между словами — за исключением китайского, японского и тайского.
-
Страницы
1800 знаков с пробелами — не связано с фактическим количеством страниц в файле.
Количество слов
Из-за различий в методах подсчета в разных языках представленное количество слов может отличаться от количества слов, полученного в других приложениях.
Количество слов для анализа отличается от расчета MTU и от количества слов, обработанных в TMS, используемого для выставления счетов по подписке.
-
Каждый тег объединения заменяется одним пробелом.
-
Остальные теги удаляются.
В языках, использующих пробел для разделения слов (например, английский):
-
Каждая последовательность цифр, включая
+-,., заменяется одним символом (с использованием regex выражения[+-]?[0-9]+([., -]?[0-9]++)*+). -
Каждая последовательность пробелов заменяется одним пробелом.
-
Пробелы в начале и в конце сегмента удаляются.
-
Каждая последовательность символов, отличных от пробела, считается одним словом.
В языках, не использующих пробелы для разделения слов (например, японский):
-
Некоторые знаки пунктуации удаляются из текста (с использованием регулярного выражения
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Сегмент разбивается на последовательности символов, относящихся к иероглифическим (Han), хирагана, катакана и тайским системам письма, не использующим пробелы для разделения слов (NWS), и последовательности символов, не относящихся к этим системам (WS).
-
Общее количество слов = (количество слов из NWS) + (количество слов из WS).
-
Количество слов из WS вычисляется так же, как для английского языка.
-
Количество слов для NWS — это количество символов без пробелов.
-
Для тайского языка количество слов — это количество символов без пробелов, деленное на 2.
Примечание
Символы языков CJK считаются одновременно и символами, и словами.
Чтобы создать анализ, выполните следующие действия:
-
На странице выберите одну или несколько .
-
Нажмите Анализ.
Откроется окно .
-
Выберите из раскрывающегося списка.
-
При необходимости укажите имя.
-
Доступные макросы для именования анализа:
-
{projectName} -
{sourceLang}Добавляет исходный язык.
-
{targetLang}Добавляет целевой язык. Если анализируется несколько языков, язык будет пустым.
-
Имя пользователяДобавляет имя пользователя назначенного лингвиста или поставщика. Если назначено несколько лингвистов, имя будет пустым.
-
Рабочий процесс
-
"innerId": "1",
-
Имя файла
Если для анализа используется несколько файлов/задач, поле
{fileName}будет пустым.
-
-
-
Выберите параметры анализа. В частности:
-
Применение параметра повлияет на подсчет слов, так как числа не будут учитываться как слова.
-
Параметр сравнивает сегменты анализируемой задачи на предмет схожести внутри файла, а не только с ТМ.
Если флажок установлен, внутренние нечеткие совпадения отображаются как отдельная категория в созданных анализах. Например:
Задача по переводу из 10 исходных слов включает следующие сегменты, в которых отличается только последний символ:
-
Я купил новый автомобиль.
-
Я купил новый автомобиль!
Если в TM не найдено совпадений, будет отображен анализ по умолчанию:
Параметры IF
Категория TM: 0 * * 49
Категория TM: 95 * * 99
Категория IF: 95 * * 99
Включить IF отключено
Слова
Включить IF включено + Отделить IF отключено
Слова
Слова
Включить IF включено + Отделить IF включено
Слова
Слова
-
-
-
Нажмите Анализ.
Анализ или анализы добавляются в список.
-
Нажмите на анализ в списке, чтобы просмотреть его на странице сведений или загрузить для отображения в приложении для управления проектами.
Примечание
Параметры анализа можно задать при создании анализа, на уровне проекта или глобально в разделе Настройки .
Результаты анализа рассчитываются независимо для каждой языковой пары относительно собственной памяти переводов (TM) этого языка. Даже если в проекте используется общая TM для нескольких целевых языков, для каждой языковой пары поддерживается собственный набор единиц перевода. Один и тот же исходный сегмент может иметь разную оценку для каждого языка, что приводит к разным процентам совпадений и чистым ставкам для разных целевых языков в рамках одного проекта, даже если параметры анализа идентичны.
Предусмотрено три типа анализа:
Анализ по умолчанию — это стандартный анализ, выполняемый для исходных сегментов до перевода. Он обеспечивает базовый анализ задачи, который можно использовать вместе с анализом постредактирования для определения объема усилий, затраченных на перевод этой задачи. Эта база также используется в качестве основы для формирования коммерческих предложений для клиентов.
порог памяти переводов, установленный в предварительном переводе, используется по умолчанию, но при необходимости его можно изменить.
Формируется сводная таблица подсчета сегментов, слов и символов, а если анализ проводится в проекте, дополнительно определяются совпадения памяти переводов, непереводимые элементы, внутренние нечеткие совпадения и QPS (если функция включена).
Важно
Запуск анализа по умолчанию после перевода приводит к некорректным результатам.
Результаты анализа рассчитываются независимо для каждого целевого языка по отношению к собственной памяти переводов этого языка. В проекте с несколькими целевыми языками один и тот же исходный сегмент может получать разные проценты совпадений или не получать их вовсе в каждой языковой паре, поскольку каждая языковая пара имеет свою собственную историю переводов в TM. В результате распределение количества слов по категориям совпадений и итоговая чистая ставка могут различаться для разных целевых языков в рамках одного проекта, даже если параметры анализа идентичны.
Анализ после редактирования
Анализ постредактирования выполняется для целевых сегментов и демонстрирует усилия, затраченные на редактирование текста лингвистом или корректором. Он выполняется после завершения постредактирования.
Когда лингвист нажимает на непереведённый сегмент, текущее наилучшее совпадение из памяти переводов, предложение машинного перевода и/или непереводимый элемент сохраняются для этого сегмента и используются при анализе постредактирования.
Анализ постредактирования можно запустить на любом этапе рабочего процесса; он рассчитывается как разница между текстом, вставленным из доступных источников (например, ПП/МП), и результатом постредактирования в целевом сегменте.
Анализ постредактирования расширяет традиционный анализ памяти переводов, включая машинный перевод (МП) и непереводимые элементы (НЭ). Сторонние системы машинного перевода также поддерживаются.
Важно
Отключение и не исключает совпадения ПП/МП из анализа. В этом случае анализ учитывает оценку более высокого доступного совпадения вместо усилий по постредактированию.
Результат ПП 101% в анализе постредактирования не обязательно означает, что сегмент был переведён из ПП.
Пример
Задание, переведённое с использованием МП, всё равно может отображаться как 101% ПП, если отключён, а совпадение ПП 101% было доступно в момент открытия сегмента.
Параметры постредактирования
Параметры постредактирования используются для расчёта усилий по постредактированию, необходимых для совпадений из памяти переводов (ПП), непереводимых элементов (НЭ) и машинного перевода (МП).
Анализ постредактирования ПП включён
-
Предназначено для низкокачественных ПП, содержащих высокопроцентные совпадения, требующих редактирования лингвистом.
-
Указывает на объём постредактирования для памяти переводов (ПП).
-
Содержит только 100% совпадения в анализе. Контекстные 101% совпадения из памяти переводов не влияют на расчёт.
Анализ постредактирования ПП отключён
-
Предназначено для высококачественной памяти переводов, где совпадения должны редактироваться как можно меньше для снижения затрат.
-
Указывает как на 101%, так и на 100%.
-
Указывает на совпадения TM, предлагаемые лингвисту при открытии сегмента (а не фактический объем постредактирования лингвиста).
-
Указывает на объем постредактирования для машинного перевода (МП) и непереводимых элементов (НЭ).
Анализ постредактирования NT/MT включен
-
Если предложение машинного перевода (MT) или непереводимого сегмента (NT) было принято без дальнейшего редактирования, оно представляется в анализе как 100% совпадение.
-
Если лингвист вносит изменения в машинный перевод, процент совпадения будет ниже. Алгоритм подсчета баллов такой же, как и тот, что используется для расчета баллов нечетких совпадений памяти переводов.
-
Редактирование непереводимого сегмента (НЭ) приведет к тому, что сегмент будет представлен как НЭ с совпадением 0–49%.
Анализ постредактирования NT/MT отключен
-
Записи из машинного перевода (МП) и непереводимых элементов (НЭ) без какой-либо оценочной балльной оценки будут считаться совпадениями памяти переводов 0%–49%. Они будут указаны как переведенные лингвистом без учета машинного перевода.
-
Совпадения QPS и Phrase Language AI выше 75% будут находиться в столбце МП в соответствующих совпадениях.
-
Указывает на совпадения непереводимых элементов (НЭ) и машинного перевода (МП), предлагаемые лингвисту при открытии сегмента (а не фактический объем постредактирования лингвиста).
Автоматически создавать анализ постредактирования перед обновлением исходного текста
-
Анализ создается:
-
Для каждого обновленного задания.
-
Для каждого отдельного поставщика индивидуально и назначено соответствующему поставщику.
-
-
Анализ не создается, если:
-
Не назначен ни один лингвист или поставщик.
-
-
Анализ подсчитывает подтвержденные и переведенные сегменты.
-
Анализ следует соглашению об именовании:
-
Обновить исходный файл #{innerID}{workflow}
-
-
Анализ будет создан с выбранными параметрами Подсчет единиц (исходный текст), Анализ постредактирования NT, Анализ постредактирования ТМ и Анализ постредактирования МП.
Единицы подсчета
-
Исходник/перевод
Выберите, какой подсчет слов будет представлен в анализе. Количество слов в переводе может быть больше, чем количество слов в исходном тексте.
Не влияет на оценку совпадений.
Сравнительный анализ
-
планов: Team, Ultimate и Enterprise (устаревшая версия)
Свяжитесь с отделом продаж по вопросам лицензирования.
Функция сравнения анализа доступна только в проектах с этапами рабочего процесса. Она сравнивает две версии файла на разных этапах рабочего процесса на уровне сегментов и анализирует различия между ними. Если для анализа нет настроек, специфичных для проекта, используются настройки по умолчанию, что может привести к некорректным отчетам.
Пример
Анализ можно запустить для нескольких заданий, и его можно сгруппировать двумя способами:
-
Анализ по поставщику
-
Для проекта с множеством заданий, назначенных различным лингвистам или поставщикам. Используется для:
-
Создать отдельные анализы, содержащие файлы, назначенные отдельным лингвистам или поставщикам.
-
Назначить анализы поставщику, чтобы сделать их доступными для лингвистов и поставщиков.
Схема чистых ставок будет выбрана по умолчанию в качестве опции, если она применяется к поставщику.
-
-
-
Анализ по языкам
-
Если проект содержит несколько целевых языков, анализ всех файлов можно запустить пакетно, создав отдельный анализ для каждого отдельного языка.
Чтобы выполнить анализ по языку, выполните следующие действия:
-
На странице проекта выберите все файлы .
-
Нажмите Анализ.
Откроется окно .
-
Сохраните настройки по умолчанию и выберите .
-
Нажмите Анализ.
Анализ задания подготавливается по языку.
Примечание
Снимите этот флажок, чтобы создать один общий анализ для многоязычного проекта.
-
-
Когда исходный файл для анализа обновляется, он помечается как устаревший в таблице анализа.
При пересчете применяются настройки, использованные для исходного анализа.
Поставщикам не разрешается пересчитывать анализы, созданные заказчиками.
Чтобы выполнить пересчет с использованием нового исходного файла, выполните следующие действия:
Настройка представления анализа
Столбцы , , , и можно отобразить или скрыть в таблице анализа. Столбец также доступен для анализа постредактирования и показывает, сколько секунд было потрачено на редактирование сегмента.
Скачать анализ
Чтобы скачать анализ, выполните следующие действия:
-
Нажмите Скачать, чтобы открыть выпадающее меню, и выберите:
-
CSV (значения, разделённые запятыми) с символами или без них и читаемые приложениями для работы с электронными таблицами.
-
LOG (похожий на формат SDL Trados) и читаемый большинством приложений для управления проектами.
-
JSON (JavaScript Object Notation, формат объектной нотации JavaScript) — легкий формат обмена данными.
Только анализ, скачанный в формате JSON, будет включать детализацию данных непереводимых элементов (НЭ), машинного перевода (МП), памяти переводов (ПП) и внутренних нечетких совпадений (IF) для каждого типа совпадения.
-
-
Выбор типа файла начинает загрузку.
Эти файлы можно импортировать в большинство систем управления проектами.
Применить схему чистой ставки
В анализе можно применить скидку к словам/символам/страницам. Объем перевода со скидкой немедленно рассчитывается и отображается непосредственно в анализе в строке .
Чтобы удалить схему чистой ставки из анализа, оставьте поле рядом с кнопкой пустым.
Когда к анализу применяется схема чистой ставки, в скачанном файле с анализом отображается взвешенное количество слов в каждой категории совпадений.
Чтобы назначить анализ поставщику услуг, выполните следующие действия:
-
Выберите анализ из списка и нажмите Изменить.
Откроется страница редактирования.
-
Выберите поставщика услуг из выпадающего списка.
-
Нажмите «Сохранить».
Анализ будет доступен назначенному поставщику на портале лингвиста.