Phrase Next GenMT — это разработанный компанией Phrase движок машинного перевода на базе генеративного ИИ, который использует новейшие большие языковые модели для автоматизированного перевода. Кроме того, он поддерживает использование глоссариев MT, обработку тегов и динамическую настройку в режиме реального времени с помощью генерации с дополнением поиска (RAG).
Phrase Next GenMT доступен в качестве встроенного движка MT через Phrase Language AI и расходует MTUs в рамках тарифных планов с оплатой по объему или кредиты в рамках тарифных планов с оплатой по кредитам. Для работы с этой функцией пользователям не требуются собственные учетные данные LLM.
Основываясь на современных технологиях генеративного ИИ, Phrase Next GenMT обеспечивает плавность перевода и легко справляется с терминологией, даже если не был приложен в качестве справочного материала.
Основные функции
-
Технология генеративного ИИ
В отличие от традиционных решений на базе нейронного машинного перевода (NMT), Phrase Next GenMT использует технологию генеративного ИИ, чтобы обеспечить клиентам повышенную беглость и точность перевода в более широком спектре предметных областей.
-
Многосегментный перевод
Phrase Next GenMT обрабатывает целые текстовые блоки вместо отдельных сегментов в рамках одного запроса, что обеспечивает более точный и связный перевод. Это позволяет устранить ошибки, возникающие при сегментной обработке, такие как несоответствие тональности, неправильное использование местоимений и терминологические расхождения.
Благодаря сохранению контекста многосегментный перевод позволяет повысить качество перевода и сократить объем постредактирования.
-
Расширенная поддержка глоссариев MT
Если прикреплен глоссарий MT, реализация Phrase Next GenMT поддерживает морфологическое изменение слов вместо простого слепого поиска и замены, что обеспечивает точное использование терминологии.
-
Автоматическая расстановка тегов
Поддерживает как теги форматирования, так и теги-заполнители tags, что позволяет Phrase Next GenMT беспрепятственно работать со сложными последовательностями.
-
Региональные варианты языка
Phrase Next GenMT обеспечивает качественный перевод между региональными вариантами языков, такими как британский английский (en-GB), канадский французский (fr-CA), бразильский португальский (pt-BR), мексиканский испанский (es-MX) и другими.
-
Управление формальностью речи
Phrase Next GenMT позволяет пользователям определять уровень формальности для переведенного текста. Для движка в соответствующем профиле МТ можно настроить следующие параметры:
-
-
-
(настройка по умолчанию): Соответствует формальности исходного текста.
Формальность влияет на лексику и местоимения, но ее воздействие выходит за рамки грамматики. Она определяет общий регистр переведенного контента: воспринимается ли он как профессиональный или как фамильярный.
**Examples**
-
Английский — Немецкий
Нейтральный английский исходный текст «How can I help you?» переводится по-разному в зависимости от настройки формальности:
-
Формально «Wie kann ich Ihnen behilflich sein?»
-
Неформально «Wie kann ich dir helfen?»
Местоимение меняется с Ihnen на dir, и глагольная конструкция меняется соответствующим образом. Behilflich sein («оказывать помощь») — это формальная конструкция, которая звучит вычурно в повседневном общении, где естественным выбором является helfen («помогать»). Английский исходный текст полностью нейтрален, однако два немецких перевода относятся к двум разным социальным регистрам.
-
-
Английский — Японский
Для японского языка настройка формальности переключается между вежливым и простым тоном:
-
Простой тон (常体, jōtai): предложения заканчиваются на da или dearu. Используется в повседневном общении, а также в официальных письменных контекстах, таких как научные статьи и новостные заметки.
-
Вежливый тон (敬体, keitai): предложения заканчиваются на desu или masu. Используется в деловой переписке и в разговорах с начальством, коллегами или людьми, с которыми вы не близки.
Нейтральный английский исходный текст «The meeting starts at 10.» переводится как:
-
Простой (常体, jōtai): «会議は10時に始まる。»" (Kaigi wa jūji ni hajimaru.)"
-
Вежливая форма (敬体, keitai): «会議は10時に始まります.»" (Kaigi wa jūji ni hajimarimasu.)"
Значение идентично; меняется только окончание глагола. Hajimaru — это простая форма; hajimarimasu добавляет окончание masu, которое указывает на уважение к читателю.
-
Доступные языки
Настройки формальности доступны для всех языков, поддерживаемых Phrase Next GenMT.
Примечание
Настройка формальности применяется к сегментам, которые переводятся заново с помощью Phrase Next GenMT. Однако полные совпадения (1:1) из памяти переводов (TM) будут игнорировать настройку формальности. Это может привести к несоответствиям в формальности в рамках одного задания, если в памяти переводов содержатся переводы с другим тоном.
-
-
Поддержка терминологических баз (в настоящее время поддерживается только для Phrase TMS)
Когда поддержка терминологических баз включена, Phrase Next GenMT учитывает:
-
Запрещенные термины
-
Предпочтительные термины
-
Капитализация
Чтобы включить поддержку терминологических баз, перейдите в настройки движка Phrase Next GenMT и нажмите Migrate to term bases. Это однократное необратимое действие. Поддержка терминологических баз включается для каждого профиля машинного перевода. После включения Phrase Next GenMT начнет использовать терминологические базы, уже привязанные к TMS-проекту профиля, вместо глоссариев машинного перевода.
-
Настройка в режиме реального времени через RAG
Включает настройку переводов в режиме реального времени с использованием памяти переводов (TM). Few-shot prompting используется вместе с релевантными совпадениями из памяти переводов (TM) для немедленной адаптации поведения модели и обеспечения согласованности с голосом бренда, стилем и терминологией.
Как работает RAG:
-
RAG идентифицирует и извлекает набор нечетких совпадений из памяти переводов (TM), назначенной проекту.
-
Извлеченные сегменты TM используются в качестве примеров (шотов) для модели. Метод few-shot prompting позволяет направлять результат перевода в соответствии со специфическими требованиями клиента.
В отличие от других систем машинного перевода, Phrase Next GenMT переводит с учетом контекста. Система обрабатывает несколько сегментов вместе, что позволяет ей переводить текст согласованно. Многосегментный, контекстно-зависимый перевод уменьшает количество ошибок в местоимениях, глагольных формах и уровне формальности.
Варианты использования
-
Менеджеры по локализации, которым требуются высококачественные переводы без необходимости дообучения модели.
-
Динамические рабочие процессы, в которых голос бренда, стиль и терминология часто меняются.
-
Контент, требующий быстрой адаптации для различных областей и аудиторий.
-
Локализация или адаптация контента из одного варианта локали (например, en-US, pt-BR) в другой (например, en-GB, pt-PT).
Поддержка языков
Учитывая многоязычную природу больших языковых моделей, Phrase Next GenMT — это многоязычное решение, которое охватывает множество вариантов использования и языковых потребностей, способное переводить широкий спектр языков. Хотя решение поддерживает множество языковых комбинаций, следующие рекомендуемые языковые пары соответствуют высоким стандартам качества Phrase (в обоих направлениях перевода):
-
Английский — чешский
-
Английский — испанский
-
Английский — французский
-
Английский — русский
-
Английский — немецкий
-
Английский — итальянский
-
Английский — нидерландский
-
Английский — китайский (упрощённый)
-
Английский — шведский
-
Английский — японский
-
Английский — португальский
-
Английский — корейский
-
Английский — польский
-
Английский — датский
-
Английский — греческий
-
Английский — норвежский (букмол)
-
Английский — индонезийский
-
Английский — венгерский
-
Английский — арабский
-
Английский — турецкий
-
Английский — тайский