Analytics dashboards предоставляют готовые дашборды для стандартных метрик, включая использование МТ, стоимость, объем, рычаги, экономию, время, качество, расценки и порог ТМ, каждая из которых имеет свои фильтры. Используйте Advanced Analytics для создания диаграммы по метрике, разбивке или комбинации, которые не охватываются ни одним из предопределённых дашбордов.
Доступ к Analytics dashboards осуществляется с помощью кнопки Phrase Analytics на навигационной панели.
В соответствии с нашей внутренней политикой хранения данных, любой введённый пользователем текст (например, названия проектов, имена файлов, домены) из безвозвратно удалённого контента не отображается в аналитике (Analytics). Безвозвратно удаленный контент заменяется на Удалено. Все числовые значения, даты, метки времени, логические типы данных из безвозвратно удаленного контента остаются доступными. Это гарантирует, что исторические KPI, тренды и агрегированные показатели прогнозирования остаются неизменными со временем.
-
Диаграммы, отображающие по поставщику, включают как лингвистов, так и поставщиков.
-
Языковые пары отображаются как объединение исходного и целевого языков.
-
Диаграммы, отображающие по проекту, показывают только первые 10 000 проектов, в то время как полный список проектов доступен при скачивании.
-
Дашборды отображают данные в часовом поясе UTC.
-
Дашборды обновляются дважды в день:
-
12:00 и 24:00 UTC для ЕС
-
07:00 и 19:00 UTC для США
На каждом дашборде отображается время последнего завершения обновления данных. Важно отметить, что отображаемая метка времени может не включать данные, созданные за последние 3 часа. Это связано с тем, что транзакции могут не успеть попасть в отчет при запуске процесса обновления данных.
-
-
Отчеты по данным доступны за последние 12 полных месяцев, что позволяет пользователям иметь данные за полный год в любой момент времени.
Видеообзор дашбордов:
| ] |
Примечание
Из-за постоянных доработок пользовательский интерфейс может быть не совсем таким, как представлено в видео.
Администратор устанавливает уровень доступа к Analytics для каждого менеджера проектов в настройках пользователя. Доступны три уровня:
-
Просмотр всех данных организации.
-
Просмотр только данных по проектам, владельцем которых является менеджер проектов.
-
Нет доступа к дашборду.
Каждый дашборд поддерживает различные фильтры для отображения выбранных данных на диаграммах. В частности, фильтр Состояние задания учитывает следующие состояния задания:
-
.
-
.
Когда задание или проект удаляется, задание помечается этим состоянием, пока оно находится в корзине.
-
.
Задание, удаленное вручную или автоматически путем очистки корзины.
-
.
Примечание
Когда задание архивируется, его состояние меняется на архивированное. При архивации проекта состояние задания не меняется.
Рекомендуется не применять фильтр по дате для периодов, превышающих один год, поскольку это может привести к снижению производительности и ухудшению качества диаграммы.
Каждую диаграмму можно загрузить в форматах файлов .csv, .xlsx, .json и .png. Нажмите кнопку с тремя точками в правом верхнем углу диаграммы и выберите Загрузить результаты:
-
Чтобы загрузить отформатированные результаты, включая разделитель запятыми в больших числах, выберите нужный формат файла в окне .
-
Чтобы загрузить неотформатированные результаты, удерживайте клавишу Shift (Windows) или Option (Mac) и выберите нужный формат файла в окне .
Данные из общего контента поддерживаются на всех панелях мониторинга.
Нет гарантии, что удаленный общий контент останется видимым для любой организации, кроме владельца контента.
Несколько панелей мониторинга включают фильтры владения, помогающие различать данные, принадлежащие организации, и данные, которыми обмениваются между организациями:
-
Фильтр определяет, является ли организация создателем задания или нет.
-
Задания, созданные организацией (которые могут быть общими или нет).
-
Задания, которыми делится организация или которые ей передают, независимо от того, кто их создал.
-
-
Фильтр определяет, является ли организация создателем оценки LQA.
Провайдер проверки считается владельцем, поэтому в представлении организации оценка будет отображаться как . Пользователи из других организаций (таких как провайдер перевода, заказчик проекта или поставщик) увидят ту же оценку в списке .
Если провайдер из вашей организации, отображаются его имя пользователя и полное имя. Если провайдер из другой организации, отображаются его идентификатор пользователя и название организации, как показано в оценочной ведомости.
-
Фильтр определяет, является ли организация создателем расценки.
-
Фильтр определяет, является ли организация создателем анализа.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
На диаграммах отображаются фактические расходы организации, рассчитанные на основе метрики ценообразования (например, количества слов, количества символов, страниц или часов) и умноженные на прайс-лист.
Панель мониторинга затрат основана на:
-
Расценки для всех этапов рабочего процесса в проекте.
Примечание
Создание новой расценки для того же этапа рабочего процесса перезаписывает данные для ранее созданной расценки.
-
Все почасовые расценки для проекта и последняя из стандартных расценок для каждого задания.
В общих проектах (или расценках с назначенным поставщиком) расценка видна всем пользователям, но последняя расценка может отличаться для каждого пользователя.
При назначении поставщика на работу учитывайте следующее:
-
Если поставщик назначается во время создания работы, его прайс-лист перезаписывает прайс-лист проекта.
-
Если поставщик назначен позже, стоимость не пересчитывается автоматически.
Создайте новую расценку для назначенного пользователя, чтобы обновить данные соответствующим образом.
-
Если к части задания назначено несколько поставщиков, используются данные первого указанного поставщика.
Создайте новую расценку, чтобы использовать ценовую информацию любого другого пользователя.
Вкладка содержит информацию о единицах машинного перевода (МТ) и использовании переведенных символов в Phrase TMS и Strings, Phrase Portal и Phrase Language AI через интерфейс приложений API. Она предоставляет обзор потребления во времени, по парам языков, системам машинного перевода (МТ) и профилям машинного перевода (МТ), а также по проектам и этапам рабочего процесса.
При доступе по умолчанию отображается Phrase TMS, но пользователи также могут просматривать потребление по всем или конкретным продуктам Phrase, настроив фильтр панели мониторинга «Продукт Phrase».
Фильтр источника МТ в TMS показывает распределение единиц МТ в Phrase TMS:
-
Предварительный перевод в TMS
-
Анализ в TMS
-
CAT editor в TMS
На диаграммах показано, как память переводов (TM), машинный перевод (MT), повторы и непереводимые элементы (NT) используются в заданиях.
Использование рассчитывается как разница между количеством слов в конкретной категории совпадений до применения какой-либо схемы чистых ставок и количеством слов в той же категории совпадений после применения схемы чистых ставок.
Панель мониторинга основана на:
-
Данные из анализа по умолчанию.
-
Данные последнего выполненного анализа для любого задания.
Данные создаются только в том случае, если схема чистых ставок добавлена в проект или поставщику, назначенному на задание, до создания анализа. Если схема чистых ставок изменена в проекте или анализе, на панели анализа отображается актуальная информация.
На диаграммах не отображаются данные в следующих сценариях:
-
Проекты и задания без схемы чистых ставок.
-
Анализы с нулевым покрытием (например, для проектов, языковых пар и т. д.).
-
Анализы с внутренними нечеткими совпадениями.
-
Удаленные анализы
В расчеты на панели мониторинга включаются только анализы, созданные пользователем, принадлежащим к организации зрителя. Поэтому, когда покупатель делится заданием с поставщиком и поставщик создает анализы:
-
Покупатель не видит данные, относящиеся к анализам, на панели мониторинга.
-
Поскольку поставщик является создателем анализов, он может видеть соответствующие данные на панели мониторинга.
-
Планы Team, Professional, Business, Enterprise и Software UI/UX
Свяжитесь с отделом продаж по вопросам лицензирования.
Оценка качества машинного перевода (QPS) позволяет оценить качество машинного перевода на уровне сегмента, чтобы определить, какие сегменты достаточно хороши для автоматического подтверждения. QPS создается автоматически с помощью Language AI и отличается от оценок Language Quality Assessment (LQA), которые отражают оценки, выставленные человеком, и отслеживаются отдельно на Quality Dashboard.
Предварительно переведенные сегменты могут быть автоматически подтверждены на основе пороговых значений QPS, установленных в настройках предварительного перевода. QPS доступен только для сегментов машинного перевода, переведенных с помощью Language AI.
Для получения данных о качестве машинного перевода используйте QPS Insights Dashboard. Для получения оценок экспертной проверки используйте Quality Dashboard.
Панель мониторинга помогает найти оптимальный пороговый уровень QPS для баланса между экономией затрат и рисками качества.
Фильтры на панели мониторинга помогают найти лучшие значения для различных категорий контента, поскольку технические, юридические и маркетинговые тексты могут иметь различные требования к качеству.
Эти аналитические данные основаны на метриках уровня сегмента. Пользовательские аналитические данные можно получить с помощью Phrase Data Premium, который предоставляет доступ к необработанным данным на уровне сегмента.
Включенные данные
-
Последние 6 месяцев, начиная с 1 января 2025 г. (когда началось отслеживание)
-
Только Language AI, поскольку QPS доступен только для переводов машинного перевода, переведенных с помощью Language AI.
-
Все сегменты Language AI, независимо от источника (предварительный перевод или предложения редактора)
-
Оценки QPS — это исходные оценки, выставленные после перевода через Language AI, а не после редактирования лингвистом.
-
Заказчики (а не поставщики) видят данные по общим проектам
Фильтрация длительного времени редактирования
Иногда сегменты имеют необычно долгое время редактирования. Это может быть связано с отвлечением внимания (например, проверка телефона или перерыв). Для поддержания точности данных среднее время редактирования составляет ~20 секунд. Применяется 50% буфер, исключающий сегменты с временем редактирования более 30 секунд.
Хотя некоторые длительные правки могут быть обоснованными, большинство из них являются выбросами и создают шум.
Влияние фильтрации:
-
На больших наборах данных фильтрация этих длинных сегментов оказывает минимальное влияние.
-
На меньших наборах данных эффект более выражен, так как одна затянувшаяся правка может непропорционально повлиять на общее время редактирования.
Эта фильтрация обеспечивает более точные и надежные данные отслеживания времени.
Описание диаграмм
-
Диаграмма 1:
Отображает распределение объемов сегментов на основе их оценки QPS в выбранном временном диапазоне.
-
Диаграмма 2:
Показывает процент сегментов, которые были отредактированы лингвистами. Ожидается, что при более высоких показателях QPS будет меньше правок.
-
Диаграмма 3:
Показывает, сколько времени лингвисты тратят на редактирование сегментов.
-
Диаграмма 4:
Включает как отредактированные, так и неотредактированные сегменты (сегменты с нулевым временем редактирования). Это дает более четкое представление об общих усилиях, затраченных на все обработанные сегменты, объединяя данные из двух предыдущих диаграмм.
-
Диаграмма 5:
Оценивает количество автоматически одобренных слов, которые не потребуют проверки человеком при снижении порогового значения QPS. Например, если пороговое значение QPS снизится с 95 до 90, среднее количество автоматически одобренных слов может увеличиться с 950 до 1750.
-
Диаграмма 6:
Показывает, сколько времени на редактирование можно сэкономить при снижении порогового значения QPS.
-
Диаграмма 7:
Отслеживает сокращение количества отредактированных сегментов с течением времени путем сравнения процента автоматизированных сегментов (автоматически подтвержденных или автоматически заблокированных) с процентом отредактированных сегментов машинного перевода. Показывает, как автоматизация повышает эффективность за счет сокращения количества сегментов, требующих ручного редактирования.
-
Ultimate и Enterprise планы (устаревшие)
Свяжитесь с отделом продаж по вопросам лицензирования.
Панель мониторинга фокусируется на функциях LQA и включает результаты завершенных оценок, представленные в отдельной строке. Результат оценки может включать или не включать проблемы, а диаграммы основаны на дате создания задания.
Панель мониторинга предоставляет аналитическую информацию о:
-
Средний показатель качества в организации и количество ошибок с течением времени.
-
Какие категории имеют самые серьезные ошибки LQA.
-
Какие провайдеры поддерживают высокий показатель качества.
-
Количество ошибок по степени серьезности для каждого проекта.
-
Как меняется показатель качества в зависимости от языковой пары и клиента с течением времени.
Подсчет ошибок LQA включает повторяющиеся проблемы. Повторяющиеся и неповторяющиеся проблемы отображаются отдельно в таблицах по проектам и по провайдерам.
Существует переключатель между аналитикой LQA и Auto LQA.
«Средний балл LQA», отображаемый на панели мониторинга, рассчитывается как простое среднее арифметическое баллов LQA по всем включенным оценкам: сумма баллов отдельных оценок, деленная на количество оценок. При расчете не применяется какое-либо взвешивание на основе количества слов, количества сегментов или любого другого фактора. Оценки без баллов исключаются из расчета. Все завершенные оценки с баллом включаются в среднее значение, независимо от того, прошла оценка или не прошла.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
На панели мониторинга отображается информация о коммерческих предложениях поставщиков для оплаты заданий, включая все коммерческие предложения со статусами «новое», «утверждено», «на утверждении» и «отклонено».
Коммерческие предложения по удаленным проектам исключаются из панели мониторинга.
-
— это минимальная цена, установленная для всех заданий в рамках коммерческого предложения.
-
— это цена, понесенная за каждое задание в рамках коммерческого предложения.
-
показывает фактическую оплаченную стоимость, разделенную поровну между всеми этапами рабочего процесса задания, языковыми парами и т. д.
Включено в панель мониторинга (и таблицу коммерческих предложений):
-
Коммерческие предложения для заданий, разделенных поровну между всеми этапами рабочего процесса. Это включает коммерческие предложения для разделенных заданий только с одним этапом рабочего процесса.
-
Коммерческие предложения, созданные до разделения.
Не включено в панель мониторинга (и таблицу коммерческих предложений):
-
Коммерческие предложения для заданий, неравномерно распределённых по всем этапам рабочего процесса.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
Эта панель мониторинга сравнивает исходную и чистую цену из коммерческого предложения для расчета соответствующей экономии.
Если минимальная цена выше рассчитанной цены, в коммерческом предложении используется минимальная цена. В этом случае экономия равна нулю, так как схема чистых ставок не применяется к минимальной цене.
Если существует плата за минимальный заказ, расчет количества слов больше не применяется.
Примечание
На устаревшей панели мониторинга , когда минимальная цена равна 0, экономия считается как разница между исходной и чистой ценой.
Эта панель мониторинга фокусируется на своевременной или просроченной сдаче заданий на основе даты создания задания и срока выполнения задания. Панель мониторинга включает все своевременные и просроченные задания, у которых есть срок выполнения и чей последний статус не является отменено, отклонено или отклонено лингвистом.
Если задание еще не помечено как выполненное, то срок выполнения задания сравнивается с текущей датой.
Для визуализации данных на этой панели мониторинга существуют два предварительных условия:
-
Для заданий требуется срок выполнения.
-
За исключением диаграммы , задания должны следовать правильному порядку статусов: новые, отправленные по электронной почте, принятые и выполненные:
-
Дата/время отправки задания по электронной почте меньше или равно дате/времени принятия задания поставщиком.
-
Дата/время принятия задания поставщиком меньше или равно дате/времени сдачи задания или выполнения задания поставщиком.
-
Поскольку задание может проходить через один и тот же статус несколько раз, расчет основан на первом случае назначения и последнем случае принятия и выполнения.
Примечание
Все этапы рабочего процесса задания учитываются на диаграмме . Например, если в задании есть этап перевод и этап редактирование, каждый из них учитывается со своим отдельным статусом (который может отличаться или не отличаться).
Панель мониторинга предоставляет информацию о:
-
Количество выполненных вовремя и просроченных заданий с течением времени.
-
Отслеживание сдачи заданий на основе метаданных – т. е. клиентов и доменов.
-
О том, какие проекты идут по графику, а какие нет.
-
Какие клиенты и поставщики, как правило, показывают хорошие результаты.
-
Среднее время, затрачиваемое на назначение, принятие и выполнение заданий, разделённое по языковым парам. Это позволяет понять, для каких языков обычно требуется больше или меньше времени на каждом этапе.
-
Среднее время редактирования на каждом этапе рабочего процесса.
При использовании Phrase Data названия статусов отличаются и соотносятся следующим образом:
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
-
планов: Team, Ultimate и Enterprise (устаревшая версия)
Свяжитесь с отделом продаж по вопросам лицензирования.
К данным применяются следующие критерии:
-
Включаются сегменты, предварительно переведенные с помощью TM или MT. Сегменты, предварительно переведенные с помощью TM, должны быть подтверждены.
-
Сегмент с несколькими частями задания рассматривается и учитывается как один сегмент. Сумма времени редактирования берется из сегментов по всем частям задания и учитывает время на обдумывание.
-
Сегменты с временем редактирования более 30 секунд не включаются в средние показатели времени редактирования, но включаются в подсчет на диаграмме предварительно переведенных сегментов.
-
Включаются сегменты из заданий, где все части задания были в какой-то момент или .
-
Включаются сегменты, созданные за предыдущие 6 календарных месяцев и в текущем месяце.
На графиках выделено:
-
На этом графике показано среднее время редактирования предварительно переведенного сегмента. Для сегментов, предварительно переведенных с помощью TM, отображается время редактирования по категории оценки совпадения TM. Для сегментов, предварительно переведенных с помощью MT, горизонтальная линия показывает среднее время редактирования сегментов MT. Это должно помочь определить оптимальное значение для установки порогового уровня.
-
Сегменты, которые не редактировались, включаются с нулевым временем редактирования.
-
Оценки совпадения TM сгруппированы по категориям (0-69%, 70-74%,..., 95-99%, 100-101%) для более наглядного представления данных.
-
-
На этом графике показано общее среднее время редактирования предварительно переведенного сегмента из всех источников. Это можно использовать для проверки того, влияют ли изменения порогового значения. Регулировка порогового значения должна привести к сокращению времени редактирования.
-
На этой диаграмме показано, сколько сегментов проходит предварительный перевод, и оценка категории совпадений, возвращенная TM.
Фильтры включают:
-
Дата — это дата создания сегмента.
-
По умолчанию установлено значение 6 месяцев, чтобы соответствовать критериям, используемым для рекомендации значения порогового значения Phrase TM.
-
-
Шаблон проекта
-
Домен (метаданные проекта)
-
Поддомен (метаданные проекта)
-
Целевая локаль (метаданные проекта)
Эти диаграммы предоставляют данные Analytics, помогающие минимизировать лингвистические усилия за счет определения оптимального порогового значения TM, и должны служить отправной точкой для использования преимуществ автоматизации. Установка нескольких комбинаций фильтров может привести к отображению небольшой подгруппы сегментов, которая может не содержать достаточного количества данных для получения убедительных выводов.
Количество слов учитывает все исходные слова, обработанные (загруженные) в TMS, например, при отправке задания, создании задания или при выполнении непрерывной локализации и обновлении исходного текста. Настройте фильтр панели мониторинга, чтобы включить удаленные задания. Для непрерывных заданий расчет основан на всех исходных словах в последней версии.
Панель мониторинга предоставляет информацию об обработанном количестве слов:
-
Слова, использованные в течение подписки.
-
Помесячное потребление слов.
-
Как слова распределяются между поставщиками.
-
Какие языковые пары занимают наибольший объем слов.
-
Объем слов, разделенный по метаданным, таким как клиенты и домены.
Количество слов по создателям проектов или создателям заданий можно отобразить с помощью настраиваемых диаграмм, доступных в Advanced Analytics.
При необходимости можно просматривать диаграммы на основе количества символов или вместо количества слов. Выберите нужную метрику с помощью переключателя , чтобы отобразить соответствующие данные на диаграммах.
Количество слов
Из-за различий в методах подсчета в разных языках представленное количество слов может отличаться от количества слов, полученного в других приложениях.
Количество слов для анализа отличается от количества символов, используемого для расчета MT, и от количества слов, обработанных в TMS, используемого для выставления счетов по подписке.
-
Каждый тег объединения заменяется одним пробелом.
-
Остальные теги удаляются.
В языках, использующих пробел для разделения слов (например, английский):
-
Каждая последовательность цифр, включая
+-,., заменяется на один символ (с использованием regex выражения[+-]?[0-9]+([., -]?[0-9]++)*+). -
Каждая последовательность пробелов заменяется на один пробел.
-
Пробелы в начале и в конце сегмента удаляются.
-
Каждая последовательность символов, отличных от пробела, считается одним словом.
В языках, не использующих пробел для разделения слов (например, японский):
-
Некоторые знаки препинания удаляются из текста (с использованием regex выражения
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Сегмент разбивается на последовательности символов, относящихся к скриптам хань, хирагана, катакана и тайскому, в которых слова не разделяются пробелами (NWS), и на последовательности символов, не относящихся к этим скриптам (WS).
-
Общее количество слов = (количество слов из NWS) + (количество слов из WS).
-
Количество слов из WS вычисляется так же, как для английского языка.
-
Количество слов для NWS — это количество символов без пробелов.
-
Для тайского языка количество слов — это количество символов без пробелов, деленное на 2.
Если требуются другие критерии для панели мониторинга, мы приветствуем запрос на добавление функции.