Дашборды Analytics предоставляют готовые панели для стандартных метрик, включая использование МТ, стоимость, объем, коэффициент использования, экономию, время, качество, расценки и порог ТМ, каждая из которых имеет свои собственные фильтры. Используйте Advanced Analytics, чтобы создать диаграмму для метрики, разбивки или комбинации, которые не охватываются ни одним из предопределённых дашбордов.
Доступ к дашбордам Analytics осуществляется с помощью кнопки Phrase Analytics на навигационной панели.
В соответствии с нашей внутренней политикой хранения данных, любой текст, введённый клиентом (например, названия проектов, имена файлов, домены) из безвозвратно удалённого контента не отображается в Phrase Analytics. Безвозвратно удаленный контент заменяется на Удалено. Все числовые значения, даты, метки времени и логические типы данных из безвозвратно удаленного контента остаются доступными. Это гарантирует, что исторические KPI, тенденции и агрегированные прогнозы остаются согласованными с течением времени.
-
Диаграммы с разбивкой по поставщикам включают как лингвистов, так и вендоров.
-
Языковые пары отображаются как комбинация исходного и целевого языков.
-
На диаграммах с разбивкой по проектам отображаются только первые 10 000 проектов, однако при скачивании включается полный список проектов.
-
Дашборды отображают данные в часовом поясе UTC.
-
Дашборды обновляются дважды в день:
-
12:00 и 24:00 UTC для ЕС
-
07:00 и 19:00 UTC для США
На каждом дашборде отображается время последнего завершения обновления данных. Важно отметить, что отображаемая метка времени может не включать данные, созданные за последние 3 часа. Это связано с тем, что транзакции могут не успеть попасть в систему к моменту запуска процесса обновления данных.
-
-
Отчеты по данным доступны за последние 12 полных месяцев, что позволяет пользователям иметь данные за полный год в любой момент времени.
Видеообзор дашбордов:
Примечание
Из-за постоянных доработок пользовательский интерфейс может быть не совсем таким, как представлено в видео.
Администратор устанавливает уровень доступа к аналитике для каждого менеджера проекта в настройках пользователя. Доступны три уровня:
-
Просмотр всех данных организации.
-
Просмотр только данных из проектов, владельцем которых является руководитель проекта.
-
Нет доступа к дашбордам.
Каждый дашборд поддерживает различные фильтры для отображения выбранных данных на диаграммах. В частности, фильтр Состояние задания учитывает следующие состояния задания:
-
.
-
.
Когда задание или проект удаляются, задание помечается этим состоянием на всё время, пока оно находится в корзине.
-
.
Задание, удалённое вручную или автоматически при очистке корзины удалённых объектов.
-
.
Примечание
Когда задание архивируется, его состояние меняется на архивировано. Когда проект архивируется, состояние задания не меняется.
Рекомендуется не использовать фильтр по дате для периода более одного года, так как производительность может снизиться, а диаграмма может перестать сохранять определение.
Каждую диаграмму можно загрузить в форматах .csv, .xlsx, .json и .png. Нажмите на кнопку с тремя точками в правом верхнем углу диаграммы и выберите Загрузить результаты:
-
Чтобы загрузить отформатированные результаты, включая разделитель запятыми в больших числах, выберите нужный формат файла в окне .
-
Чтобы загрузить неотформатированные результаты, удерживайте клавишу Shift (Windows) или Option (Mac) и выберите нужный формат файла в окне .
Данные из общего контента поддерживаются во всех информационных панелях.
Нет гарантии, что общий контент, который был удалён, останется видимым для любой организации, кроме владельца контента.
Некоторые дашборды включают фильтры владения, помогающие различать данные, принадлежащие организации, и данные, которыми обмениваются между организациями:
-
Фильтр определяет, является ли организация создателем задания.
-
Задания, созданные организацией (которые могут быть как общими, так и приватными).
-
Задания, которыми делится организация или которые ей передаются, независимо от их создателя.
-
-
Фильтр определяет, является ли организация создателем оценки LQA.
Поставщик услуг по проверке считается владельцем, поэтому в представлении организации эта оценка будет отображаться как . Пользователи из других организаций (например, поставщик услуг перевода, заказчик проекта или поставщик) увидят ту же оценку в разделе .
Если поставщик услуг принадлежит к вашей организации, отображаются его имя пользователя и полное имя. Если поставщик услуг принадлежит к другой организации, отображаются его идентификатор пользователя и название организации, как показано в сводной таблице.
-
Фильтр определяет, является ли организация создателем ценового предложения.
-
Фильтр определяет, является ли организация создателем анализа.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
На диаграммах показаны фактические расходы организации, рассчитанные на основе метрики ценообразования (например, количества слов, символов, страниц или часов) и умноженные на ценовой список.
Информационная панель затрат основана на:
-
Ценовые предложения для всех этапов рабочего процесса в проекте.
Примечание
Создание нового ценового предложения для того же этапа рабочего процесса перезаписывает данные для ранее созданного ценового предложения.
-
Все почасовые расценки для проекта, а также последняя из стандартных расценок для каждого задания.
В общих проектах (или расценках с назначенным поставщиком) расценка видна всем пользователям, но последняя расценка может отличаться для каждого пользователя.
При назначении поставщика на задание учитывайте следующее:
-
Если поставщик назначается во время создания задания, его прайс-лист заменяет прайс-лист проекта.
-
Если поставщик назначается позже, стоимость не пересчитывается автоматически.
Создайте расценку для назначенного пользователя, чтобы обновить данные соответствующим образом.
-
Если к части задания назначено несколько поставщиков, используются данные первого указанного поставщика.
Создайте новую расценку, чтобы использовать ценовую информацию любого другого пользователя.
Вкладка содержит информацию о единицах машинного перевода (MT) и использовании переведённых символов в Phrase TMS и Strings, Phrase Portal и Phrase Language AI через API. Он предоставляет обзор потребления во времени, по языковым парам, системам машинного перевода (МТ) и их профилям, а также по проектам и этапам рабочего процесса.
При доступе по умолчанию отображаются данные Phrase TMS, но пользователи также могут просматривать потребление по всем или отдельным продуктам Phrase, изменив фильтр дашборда «Продукт Phrase».
Фильтр источника МТ в TMS показывает распределение единиц МТ в Phrase TMS:
-
Предварительный перевод в TMS
-
Анализ в TMS
-
CAT-редактор в TMS
На диаграммах отображается, как используются память переводов (TM), машинный перевод (MT), повторы и непереводимые элементы (NT) в заданиях.
Leverage рассчитывается как разница между количеством слов в конкретной категории совпадений до применения любой схемы чистых ставок и количеством слов в той же категории после её применения.
Дашборд основан на:
-
Данные из анализа по умолчанию.
-
Данные из анализа последнего запуска для любого заданного задания.
Данные создаются только в том случае, если схема чистых ставок добавлена в проект или поставщику, назначенному на задание, до создания анализа. Если схема чистых ставок изменена в проекте или анализе, анализ отображает актуальную информацию.
Диаграммы не отображают данные в следующих сценариях:
-
Проекты и задания без схемы чистых ставок.
-
Анализы с нулевым использованием (например, для проектов, языковых пар и т. д.).
-
Анализы с внутренними нечеткими совпадениями.
-
Удаленные анализы
В расчёт дашборда включаются только анализы, созданные пользователем, принадлежащим к организации зрителя. Поэтому, когда заказчик делится заданием с поставщиком, а поставщик создает анализы:
-
Заказчик не видит данные, относящиеся к этим анализам, на информационной панели.
-
Поскольку поставщик является создателем анализов, он может видеть соответствующие данные на информационной панели.
-
Планы Team, Professional, Business, Enterprise и Software UI/UX
Свяжитесь с отделом продаж по вопросам лицензирования.
Показатель качества перевода (QPS) оценивает качество машинного перевода на уровне сегментов, чтобы определить, какие сегменты соответствуют требованиям для автоматического подтверждения. QPS создается автоматически с помощью Language AI и отличается от баллов Language Quality Assessment (LQA), которые отражают человеческие оценки и отслеживаются отдельно на панели мониторинга качества.
Предварительно переведенные сегменты могут быть автоматически подтверждены на основе пороговых значений QPS, установленных в настройках предварительного перевода. QPS доступен только для сегментов машинного перевода, переведенных с помощью Language AI.
Для получения данных о качестве машинного перевода используйте информационную панель QPS Insights. Для оценки проверки человеком воспользуйтесь панелью мониторинга качества.
Информационная панель помогает определить оптимальный порог QPS, обеспечивающий баланс между экономией затрат и рисками для качества.
Фильтры на панели мониторинга помогают определить оптимальные значения для различных категорий контента, поскольку технические, юридические и маркетинговые тексты могут иметь разные требования к качеству.
Эти аналитические данные основаны на метриках на уровне сегментов. Пользовательские аналитические данные можно разблокировать с помощью Phrase Data Premium, которая предоставляет доступ к необработанным данным на уровне сегментов.
Включенные данные
-
Последние 6 месяцев, начиная с 1 января 2025 года (когда началось отслеживание)
-
Только Language AI, поскольку QPS доступен только для машинного перевода, обработанного через Language AI
-
Все сегменты Language AI, независимо от источника (предварительный перевод или предложения редактора)
-
Оценки QPS — это исходные оценки, выставленные после перевода через Language AI, а не после редактирования лингвистом.
-
Заказчики (а не поставщики) видят данные по общим проектам
Фильтрация длительного времени редактирования
Иногда редактирование сегментов занимает непривычно много времени. Это может быть связано с отвлечением внимания (например, проверкой телефона или перерывом). Для поддержания точности данных среднее время редактирования составляет ~20 секунд. Применяется 50%-й буфер, который исключает сегменты с временем редактирования, превышающим 30 секунд.
Хотя некоторые длительные правки могут быть обоснованными, большинство из них являются выбросами и вносят шум в данные.
Влияние фильтрации:
-
На больших наборах данных фильтрация таких длинных сегментов оказывает минимальное влияние.
-
На меньших наборах данных эффект заметнее, поскольку одна продолжительная правка может непропорционально повлиять на общее время редактирования.
Эта фильтрация обеспечивает более точные и надежные данные отслеживания времени.
Описание диаграмм
-
Диаграмма 1:
Отображает распределение объемов сегментов на основе их оценки QPS в пределах выбранного периода времени.
-
Диаграмма 2:
Показывает процент сегментов, которые были отредактированы лингвистами. Ожидается, что при более высоких оценках QPS правок будет меньше.
-
Диаграмма 3:
Показывает, сколько времени лингвисты тратят на редактирование сегментов.
-
Диаграмма 4:
Включает как отредактированные, так и неотредактированные сегменты (сегменты с нулевым временем редактирования). Это дает более ясное представление о совокупных усилиях, затраченных на все обработанные сегменты, объединяя данные двух предыдущих диаграмм.
-
Диаграмма 5:
Оценивает количество автоматически одобренных слов, которые не потребуют проверки человеком при снижении порога QPS. Например, если порог QPS снизится с 95 до 90, среднее количество автоматически одобренных слов может увеличиться с 950 до 1750.
-
Диаграмма 6:
Показывает, сколько времени на редактирование можно сэкономить, если снизить пороговое значение QPS.
-
Диаграмма 7:
Отслеживает сокращение количества отредактированных сегментов с течением времени путем сравнения процента автоматизированных сегментов (автоматически подтвержденных или автоматически заблокированных) с процентом отредактированных сегментов МП. Она показывает, как автоматизация повышает эффективность за счет сокращения количества сегментов, требующих ручного редактирования.
-
Ultimate и Enterprise планы (устаревшие)
Свяжитесь с отделом продаж по вопросам лицензирования.
Панель мониторинга ориентирована на функции LQA и включает результаты завершенных оценок, представленные в отдельной строке. Результат оценки может включать или не включать проблемы, а диаграммы основаны на дате создания задания.
Панель мониторинга предоставляет аналитическую информацию о:
-
Средний показатель качества в организации и количество ошибок с течением времени.
-
Категории, в которых наблюдается самый высокий уровень серьезных ошибок LQA.
-
Поставщики, поддерживающие высокий показатель качества.
-
Количество ошибок по степени серьезности для каждого проекта.
-
Как изменяется показатель качества в зависимости от языковой пары и клиента с течением времени.
Подсчет ошибок LQA включает повторяющиеся проблемы. Повторяющиеся и неповторяющиеся проблемы отображаются отдельно в таблицах по проектам и по поставщикам.
Предусмотрено переключение между аналитическими данными LQA и Auto LQA.
«Средний показатель LQA», отображаемый на панели мониторинга, рассчитывается как простое среднее арифметическое показателя LQA по всем включенным оценкам: сумма баллов отдельных оценок, деленная на количество оценок. При расчете не применяется какое-либо взвешивание на основе количества слов, количества сегментов или любого другого фактора. Оценки без баллов исключаются из расчета. Все завершенные оценки с баллами включаются в среднее значение, независимо от того, пройдена оценка или нет.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
На панели мониторинга отображается информация о расценках поставщика для оплаты заданий, и она включает все расценки со статусом «новые», «утвержденные», «на утверждении» и «отклоненные».
Расценки удаленных проектов исключаются из панели мониторинга.
-
— это минимальная цена, установленная для всех заданий в рамках расценки.
-
— это цена, понесенная за каждое задание в рамках расценки.
-
показывает фактическую стоимость, разделённую поровну между всеми этапами рабочего процесса задания, языковыми парами и т. д.
Включено в панель мониторинга (и таблицу расценок):
-
Расценки для заданий, разделенных поровну между всеми этапами рабочего процесса. Сюда входят расценки для разделенных заданий только с одним этапом рабочего процесса.
-
Расценки, созданные до разделения.
Не включено в панель мониторинга (и таблицу расценок):
-
Расценки для заданий, разделенных неравномерно между всеми этапами рабочего процесса.
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
Эта панель мониторинга сравнивает исходную и чистую цену из расценки для расчета соответствующей экономии.
Если минимальная цена выше рассчитанной цены, в расценке используется минимальная цена. В этом случае экономия равна нулю, так как схема чистых ставок не применима к минимальной цене.
Если существует плата за минимальный заказ, расчет количества слов больше не применяется.
Примечание
На устаревшей панели при минимальной цене 0 экономия считается как разница между исходной и чистой ценой.
Эта панель мониторинга фокусируется на своевременной доставке заданий по сравнению с просроченной, основываясь на дате создания задания и сроке выполнения задания. Панель мониторинга включает все выполненные вовремя и просроченные задания, у которых есть срок выполнения и чей последний статус не является cancelled, declined или rejected by linguist.
Если задание еще не помечено как завершенное, то срок выполнения задания сравнивается с текущей датой.
Существует два предварительных условия для визуализации данных на этой панели мониторинга:
-
Для заданий требуется срок выполнения.
-
За исключением диаграммы , задания должны следовать правильному порядку статусов — новые, отправленные по электронной почте, принятые и завершенные:
-
Дата/время отправки задания по электронной почте меньше или равно дате/времени принятия задания поставщиком.
-
Дата/время принятия задания поставщиком меньше или равно дате/времени сдачи или завершения задания поставщиком.
-
Поскольку задание может проходить через один и тот же статус несколько раз, расчет основан на первом случае назначения и последнем случае принятия и завершения.
Примечание
Все этапы рабочего процесса задания учитываются на диаграмме . Например, если задание имеет этап translation и этап revision, каждый из них учитывается со своим отдельным статусом (который может отличаться или не отличаться).
Панель мониторинга предоставляет информацию о:
-
Количество заданий, выполненных вовремя, и просроченных с течением времени.
-
Отслеживание сдачи заданий на основе метаданных (например, клиентов и доменов).
-
Какие проекты выполняются по графику, а какие нет.
-
Какие клиенты и поставщики, как правило, работают эффективно.
-
Среднее время, затрачиваемое на назначение, принятие и завершение заданий с разбивкой по языковым парам. Это позволяет определить, какие языковые пары обычно требуют больше или меньше времени на каждом этапе.
-
Среднее время редактирования на один этап рабочего процесса.
При использовании Phrase Data названия статусов отличаются и соотносятся следующим образом:
-
планов: Team, Professional, Business- и Enterprise
Свяжитесь с отделом продаж по вопросам лицензирования.
-
планов: Team, Ultimate и Enterprise (устаревшая версия)
Свяжитесь с отделом продаж по вопросам лицензирования.
К данным применяются следующие критерии:
-
Сегменты, предварительно переведенные с помощью TM или MT, включены. Сегменты, предварительно переведенные с помощью TM, должны быть подтверждены.
-
Сегмент с несколькими частями задания рассматривается и учитывается как один сегмент. Сумма времени редактирования берется из сегментов по всем частям задания и учитывает время на обдумывание.
-
Сегменты с временем редактирования более 30 секунд не включаются в средние показатели времени редактирования, но включаются в подсчет диаграммы предварительно переведенных сегментов.
-
Включаются сегменты из заданий, где все части задания были в какой-то момент или .
-
Включаются сегменты, созданные за предыдущие 6 календарных месяцев и в текущем месяце.
На диаграммах выделено:
-
Эта диаграмма показывает среднее время редактирования предварительно переведенного сегмента. Для сегментов, предварительно переведенных с помощью TM, она показывает время редактирования по баллу категории совпадения TM. Для сегментов, предварительно переведенных с помощью MT, горизонтальная линия показывает среднее время редактирования сегментов MT. Это должно помочь определить оптимальное значение для установки порогового уровня.
-
Сегменты, которые не редактируются, включаются с 0 временем редактирования.
-
Оценки совпадений TM сгруппированы по категориям (0-69%, 70-74%,..., 95-99%, 100-101%) для более наглядного представления данных.
-
-
На этой диаграмме показано общее среднее время редактирования предварительно переведенного сегмента из всех источников. Это можно использовать для проверки того, влияют ли изменения порогового значения. Корректировка порогового значения должна привести к сокращению времени редактирования.
-
На этой диаграмме показано, сколько сегментов проходят предварительный перевод, и оценка категории совпадения, возвращенная TM.
Фильтры включают:
-
Дата — это дата создания сегмента.
-
По умолчанию установлено значение 6 месяцев, чтобы соответствовать критериям, используемым для рекомендации значения Phrase TM threshold.
-
-
Шаблон проекта
-
Домен (метаданные проекта)
-
Поддомен (метаданные проекта)
-
Целевая локаль (метаданные проекта)
Эти диаграммы предоставляют аналитические данные, помогающие минимизировать лингвистические усилия за счет определения оптимального порога TM, и служат отправной точкой для использования возможностей автоматизации. Установка нескольких комбинаций фильтров может привести к отображению небольшой подвыборки сегментов, которая может не содержать достаточного количества данных для получения убедительных выводов.
Количество слов учитывает все исходные слова, обработанные (загруженные) в TMS, например, когда была сделана отправка, создано задание или когда были выполнены непрерывная локализация и обновление исходного текста. Настройте фильтр панели мониторинга таким образом, чтобы включить задания, перемещенные в корзину или удаленные. Для непрерывных заданий расчет основан на всех исходных словах в последней версии.
На панели мониторинга представлены сведения об объеме обработанных слов:
-
Слова, использованные в течение срока действия подписки.
-
Потребление слов по месяцам.
-
Как слова распределяются между поставщиками.
-
Какие языковые пары занимают наибольший объем слов.
-
Объем слов, разделенный по метаданным, таким как клиенты и домены.
Количество слов по создателям проектов или создателям заданий можно отобразить с помощью настраиваемых диаграмм, доступных в Advanced Analytics.
При необходимости можно просматривать диаграммы на основе количества символов или вместо количества слов. Выберите нужную метрику с помощью переключателя , чтобы отобразить соответствующие данные на диаграммах.
Количество слов
Из-за различий в методах подсчета в разных языках представленное количество слов может отличаться от количества слов, полученного в других приложениях.
Количество слов для анализа отличается от расчёта MTU и от числа TMS-обработанных слов, используемых для выставления счетов по подписке.
-
Каждый тег join заменяется одним пробелом.
-
Остальные теги удаляются.
В языках, использующих whitespace для разделения слов (например, английский):
-
Каждая последовательность цифр, включая
+-,., заменяется одним символом (с использованием regex выражения[+-]?[0-9]+([., -]?[0-9]++)*+). -
Каждая последовательность пробелов заменяется одним пробелом.
-
Пробелы в начале и в конце сегмента удаляются.
-
Каждая последовательность символов, отличных от пробела, считается одним словом.
В языках, не использующих whitespace для разделения слов (например, японский):
-
Некоторые знаки препинания удаляются из текста (с использованием regex выражения
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Сегмент разбивается на последовательности символов, относящиеся к непробельным (NWS) письменам, таким как хань, хирагана, катакана и тайский, а также на последовательности символов, не относящиеся к этим системам (WS).
-
Общее количество слов = (количество слов из NWS) + (количество слов из WS).
-
Количество слов из WS вычисляется так же, как для английского языка.
-
Количество слов для NWS — это количество символов без пробелов.
-
Для тайского языка количество слов — это количество символов без пробелов, деленное на 2.
Если требуются другие критерии для панели мониторинга, приветствуется запрос на добавление функции.