Phrase Next GenMT je nástroj pro strojový překlad založený na generativní umělé inteligenci vyvinutý společností Phrase, který využívá nejnovější velké jazykové modely pro automatizovaný překlad. Dále podporuje použití slovníku MT, práci s tagy a dynamické přizpůsobení v reálném čase prostřednictvím generování s rozšířenou referencí (RAG).
Phrase Next GenMT je k dispozici jako nativní nástroj MT prostřednictvím Phrase Language AI a spotřebovává MTUs. Zákazníci nepotřebují vlastní přihlašovací údaje k LLM, aby ji mohli začít používat.
Phrase Next GenMT, postavený na nejmodernější technologii generativní umělé inteligence, optimalizuje plynulost a snadno zvládá terminologii, a to i v případech, kdy není jako reference připojen slovník MT.
Hlavní funkce
-
Technologie generativní umělé inteligence
Na rozdíl od tradičních řešení neuronového strojového překladu (NMT) využívá Phrase Next GenMT technologii generativní umělé inteligence, aby zákazníkům přinesl vyšší plynulost a přesnost překladu napříč širším výběrem domén.
-
Vícesegmentový překlad
Phrase Next GenMT zpracovává celé bloky textu namísto jednotlivých segmentů v rámci jednoho požadavku, což vede k přesnějším a koherentnějším překladům. Tím se eliminují chyby způsobené zpracováním na úrovni segmentů, jako je nekonzistentní tón, nesprávná zájmena a neshody v terminologii.
Díky zachování kontextu může vícesegmentový překlad zlepšit kvalitu překladu a snížit potřebu post-editace.
-
Pokročilá podpora pro slovník MT
Pokud je připojen slovník MT, implementace Phrase Next GenMT namísto slepého vyhledávání a nahrazování podporuje morfologické ohýbání, čímž zajišťuje přesné používání terminologie.
-
Automatizované umisťování tagů
Podporuje formátovací tagy i tagy pro zástupné znaky tags, což umožňuje Phrase Next GenMT bezproblémově pracovat se složitými sekvencemi.
-
Jazykové varianty
Phrase Next GenMT plynule překládá mezi jazykovými variantami, jako je britská angličtina (en-GB), kanadská francouzština (fr-CA), brazilská portugalština (pt-BR), mexická španělština (es-MX) a další.
-
Řízení formálnosti
Phrase Next GenMT umožňuje uživatelům definovat úroveň formálnosti pro přeložený výstup. Pro nástroj lze v příslušném MT profilu nakonfigurovat následující možnosti:
-
-
-
(výchozí nastavení): Odpovídá formálnosti zdrojového textu.
Formálnost ovlivňuje slovní zásobu a zájmena, ale její dopad přesahuje rámec gramatiky. Určuje celkový tón přeloženého obsahu: zda je text psán formálně nebo neformálně.
Příklady:
-
Angličtina do němčiny
Neutrální anglický zdroj „How can I help you?“ se překládá různě v závislosti na nastavení formálnosti:
-
Formální: „Jak Vám mohu pomoci?“
-
Neformální: „Jak ti mohu pomoci?“
Zájmeno se mění z Vám na ti, a slovesná vazba se podle toho mění. Být nápomocen („to be of assistance“) je formální konstrukce, která v neformálních kontextech zní strojeně, kde je přirozenou volbou pomoci („to help“). Anglický zdroj je zcela neutrální, přesto dva německé překlady patří do dvou odlišných sociálních registrů.
-
-
Angličtina do japonštiny
U japonštiny se nastavení formálnosti přepíná mezi zdvořilým a prostým tónem:
-
Prostý tón (常体, jōtai): věty končí da nebo dearu. Používá se v běžné konverzaci, ale také ve formálních písemných kontextech, jako jsou akademické práce a novinové články.
-
Zdvořilý tón (敬体, keitai): věty končí desu nebo masu. Používá se v business e-mailech a v konverzacích s nadřízenými, kolegy nebo lidmi, se kterými si nejste blízcí.
Neutrální anglický zdroj „The meeting starts at 10.” se překládá jako:
-
Plain (常体, jōtai): "会議は10時に始まる。" (Kaigi wa jūji ni hajimaru.)"
-
Polite (敬体, keitai): "会議は10時に始まります。" (Kaigi wa jūji ni hajimarimasu.)"
Význam je totožný; mění se pouze koncovka slovesa. Hajimaru je prostý tvar; hajimarimasu přidává koncovku masu, která signalizuje respekt ke čtenáři.
-
Dostupné jazyky
Nastavení formálnosti jsou k dispozici pro všechny jazyky podporované Phrase Next GenMT.
Poznámka
Nastavení formálnosti se aplikuje na segmenty, které jsou nově přeloženy pomocí Phrase Next GenMT. Nicméně 1:1 shody z překladové paměti (TM) obejdou nastavení formálnosti. To může vést k nekonzistencím ve formálnosti v rámci úlohy, pokud TM obsahuje překlady s jiným tónem.
-
Přizpůsobení v reálném čase pomocí RAG
Umožňuje přizpůsobení překladů v reálném čase pomocí překladových pamětí (TM). Few-shot prompting se používá s relevantními shodami z TM k okamžitému přizpůsobení chování modelu a zajištění konzistence s hlasem značky, stylem a terminologií.
Jak RAG funguje:
-
RAG identifikuje a vyhledá sadu částečných shod z TM přiřazené projektu.
-
Získané segmenty z TM se používají jako příklady (shots) pro model. Prostřednictvím few-shot prompting tyto příklady vedou výstup překladu, aby zajistily soulad s požadavky zákazníka.
Na rozdíl od jiných MT nástrojů překládá Phrase Next GenMT s kontextem. Nástroj zpracovává více segmentů společně, což mu umožňuje překládat text konzistentně. Vícesegmentový překlad s ohledem na kontext snižuje chyby v zájmenech, slovesných tvarech a úrovni formálnosti.
Příklady použití
-
Manažeři lokalizace, kteří hledají vysoce kvalitní překlady bez nutnosti ladění modelu.
-
Dynamické pracovní postupy, kde se hlas značky, styl a terminologie často vyvíjejí.
-
Obsah vyžadující rychlé přizpůsobení pro různé domény a publika.
-
Lokalizace nebo adaptace obsahu z jedné jazykové varianty (např. en-US, pt-BR) do jiné (např. en-GB, pt-PT).
Podpora více jazyků
Vzhledem k masivně vícejazyčné povaze velkých jazykových modelů je Phrase Next GenMT vícejazyčné řešení, které řeší různé případy použití a jazykové potřeby a je schopno překládat širokou škálu jazyků. Ačkoli řešení podporuje mnoho jazykových kombinací, vybrali jsme sadu doporučených jazykových párů, které splňují vysoké standardy kvality Phrase (v obou směrech překladu):
-
Angličtina – čeština
-
Angličtina – španělština
-
Angličtina – francouzština
-
Angličtina – ruština
-
Angličtina – němčina
-
Angličtina – italština
-
Angličtina – nizozemština
-
Angličtina – čínština (zjednodušená)
-
Angličtina – švédština
-
Angličtina – japonština
-
Angličtina – portugalština
-
Angličtina – korejština
-
Angličtina – polština
-
Angličtina – dánština
-
Angličtina – řečtina
-
Angličtina – norština (bokmål)
-
Angličtina – indonéština
-
Angličtina – maďarština
-
Angličtina – arabština
-
Angličtina – turečtina
-
Angličtina – thajština