Analýza vypočítá počet znaků a slov ve vybraných souborech a identifikuje:
-
Opakování (včetně opakování napříč soubory)
Pouze první výskyt duplicitního segmentu se počítá samostatně, v rámci běžného procenta shody nebo v rámci částečné shody. Opakování počítá následné výskyty téhož segmentu. Příklad: Zakázka se dvěma přesně stejnými segmenty zobrazí Opakování: 1 segment, nikoli 2. To odráží pravidlo počítání.
-
Nepřekládaný text
-
Interní částečné shody
-
Návrhy strojového překladu
Analýzy mohou také zobrazit počet revizí provedených korektorem.
Analýzy mohou vytvářet projektoví manažeři nebo administrátoři. Lingvistům nelze povolit spouštění vlastních analýz. Dodavatelé mohou vytvářet analýzy pro sdílené zakázky/projekty.
Některé CAT nástroje označují analýzu jako statistiku.
Organizační Analytics poskytuje hlavní panel Analytics.
Protože se v různých zemích používají různé fakturační jednotky, jsou k dispozici tři metody výpočtu:
-
Znaky
Bez mezer.
-
Slova
Pro jazyky, které používají mezi slovy Space—kromě čínštiny, japonštiny a thajštiny.
-
Stran
1800 znaků se Space—nesouvisí se skutečným počtem stran v souboru.
Vzhledem k různým metodám počítání v různých jazycích nemusí být zobrazený počet slov stejný jako počet slov vytvořený jinými aplikacemi.
Počet slov pro analýza se liší od výpočtu MTU.
-
Každý tag sloučit je nahrazen jedním Space.
-
Ostatní tag jsou odstraněny.
V jazycích používajících Space pro oddělování slov (např. angličtina):
-
Každá číselná sekvence včetně
+-,.je nahrazena jedním znakem (pomocí regex výrazu[+-]?[0-9]+([., -]?[0-9]++)*+). -
Každá sekvence Space je nahrazena jedním Space.
-
Space na začátku a na konci segment jsou odstraněny.
-
Každá sekvence znaků odlišných od Space se počítá jako jedno slovo.
V jazycích, které nepoužívají Space pro oddělování slov (např. japonština):
-
Některá interpunkční znaménka jsou z textu odstraněna (pomocí regex výrazu
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Segment je rozdělen na sekvence znaků patřících do skriptů bez Space (NWS) Han, Hiragana, Katakana a thajského písma a sekvence znaků, které do těchto skriptů nepatří (WS).
-
Celkový počet slov = (počet slov z NWS) + (počet slov z WS).
-
Počet slov z WS se vypočítá stejně jako pro angličtinu.
-
Počet slov pro NWS je počet znaků bez Space.
-
Pro thajštinu je počet slov počet znaků bez Space dělený 2.
Poznámka
Znaky z jazyků CJK se počítají jako znaky i jako slova.
Chcete-li vytvořit analýzu, postupujte takto:
-
Na stránce vyberte jednu nebo více .
-
Klikněte na analyzovat.
Otevře se okno .
-
Vyberte z rozevíracího seznamu.
-
V případě potřeby zadejte název.
-
Dostupná makra pro pojmenování analýzy:
-
{projectName} -
{sourceLang}Přidá zdrojový jazyk
-
{targetLang}Přidá cílový jazyk. Pokud je analyzováno více jazyků, bude jazyk prázdný.
-
{userName}Přidá uživatelské jméno přiřazeného překladatele nebo dodavatele. Pokud je přiřazeno více překladatelů, bude jméno prázdné.
-
{pracovní postup} -
{innerId} -
{fileName}Pokud je pro analýzu použito více souborů/zakázek, bude
{fileName}prázdný.
-
-
-
Vybrat možnosti analýzy. Zejména:
-
Použití možnosti ovlivní počet slov, protože čísla nebudou započítána jako slova.
-
Možnost porovnává segmenty v analyzované zakázce z hlediska podobnosti v rámci souboru, na rozdíl od porovnávání pouze proti TM.
Pokud je zaškrtnuto , zobrazují se shody interních fuzzy shod v nově vytvořených analýzách jako samostatná kategorie. Například:
Překladová zakázka s 10 zdrojovými slovy obsahuje následující segmenty, kde se liší pouze poslední znak:
-
Koupil jsem si nové auto.
-
Koupil jsem si nové auto!
V případě, že v TM nejsou nalezeny žádné shody, výchozí analýza zobrazí:
Možnosti IF
Kategorie TM: 0%-49%
Kategorie TM: 95%-99%
Kategorie IF: 95%-99%
Zahrnout IF zakázáno
10 slov
Zahrnout IF povoleno + Oddělit IF zakázáno
5 slov
5 slov
Zahrnout IF + Oddělit IF povoleno
5 slov
5 slov
-
-
-
Klikněte na analyzovat.
Analýza nebo analýzy jsou přidány do seznamu.
-
Kliknutím na analýzu v seznamu ji zobrazíte na stránce detailu nebo ji stáhnete pro vykreslení v aplikaci pro správu projektů.
Poznámka
Možnosti analýzy lze nastavit při vytváření analýzy, na úrovni projektu nebo globálně v nastavení .
Výsledky analýzy se počítají nezávisle pro každý jazykový pár vůči vlastní TM daného jazyka. I když projekt používá sdílenou TM pro více cílových jazyků, každý jazykový pár si udržuje vlastní sadu překladových jednotek. Stejný zdrojový segment může mít v každém jazyce jiné skóre, což vede k různým procentům shody a čistým sazbám napříč cílovými jazyky v rámci stejného projektu, i když jsou nastavení analýzy identická.
Jsou poskytovány tři typy analýzy:
Výchozí analýza je standardní analýza spuštěná na zdrojových segmentech před překladem. Poskytuje základní analýzu zakázky, kterou lze použít spolu s analýzou post-editace k určení, kolik úsilí bylo vynaloženo na překlad dané zakázky. Tento základ se také používá jako podklad pro generování cenových nabídek pro klienty.
Práh TM nastavený v předpřekladu se používá jako výchozí, ale v případě potřeby jej lze změnit.
Vytvoří se rozpis počtů segmentů/slov/znaků a pokud se použije v projektu, identifikují se shody TM spolu s nepřekládaným textem, interními částečnými shodami a QPS (pokud je povoleno).
Důležité
Spuštění výchozí analýzy po překladu vytvoří nesprávné analýzy.
Výsledky analýzy se vypočítávají nezávisle pro každý cílový jazyk vůči překladové paměti daného jazyka. V projektu s více cílovými jazyky může stejný zdrojový segment získat v každém jazykovém páru jiná procenta shody, nebo žádnou shodu, protože každý jazykový pár má v TM svou vlastní historii překladů. V důsledku toho se rozdělení počtu slov podle kategorií shody a výsledná čistá sazba mohou v rámci stejného projektu lišit napříč cílovými jazyky, i když je nastavení analýzy identické.
Analýza post-editace se spouští na cílových segmentech a indikuje úsilí při editaci; kolik editace text vyžadoval od překladatele nebo korektora. Spouští se po dokončení post-editace.
Když překladatel klikne na nepřeložený segment, uloží se pro tento segment aktuálně nejvyšší shoda z překladové paměti, návrh ze strojového překladu a/nebo nepřekládaný text, což se následně použije v analýze post-editace.
Analýzu post-editace lze spustit z jakékoli fáze pracovního postupu a vypočítává se jako rozdíl mezi textem vloženým z dostupného zdroje (např. TM/MT) a post-editovaným výsledkem v cíli segmentu.
Analýza post-editace rozšiřuje tradiční analýzu překladové paměti o strojový překlad (MT) a nepřekládaný text (NT). Podporovány jsou také MT enginy třetích stran.
Důležité
Zakázání a nevyloučí shody TM/MT z analýzy. V tomto případě analýza zohledňuje skóre vyšší dostupné shody namísto úsilí při post-editaci.
Výsledek 101% TM v analýze post-editace nutně neznamená, že segment byl přeložen z TM.
Příklad
Zakázka přeložená pomocí MT se stále může jevit jako 101% TM, pokud je zakázáno a 101% shoda TM byla k dispozici v okamžiku otevření segmentu.
Možnosti po analýze
Možnosti post-editace se používají pro výpočet úsilí při post-editaci potřebného pro shody z překladové paměti (TM), nepřekládaného textu (NT) a strojového překladu (MT).
Analyzovat post-editaci TM povoleno
-
Určeno pro nekvalitní TM, které obsahují shody s vysokým procentem, jež vyžadují editaci překladatelem.
-
Indikuje úsilí při post-editaci pro TM.
-
Obsahuje v analýze pouze 100% shody. Kontextové 101% shody z TM nemají na výpočet žádný vliv.
Analyzovat post-editaci TM zakázáno
-
Určeno pro vysoce kvalitní TM, kde by shody měly být editovány co nejméně, aby se snížily náklady.
-
Indikuje 101% i 100% shodu.
-
Indikuje shody TM nabízené překladateli při otevření segmentu (nikoli skutečné úsilí překladatele při post-editaci).
-
Indikuje úsilí při post-editaci pro strojový překlad a nepřekládaný text (NT).
Analyzovat post-editaci NT/MT povoleno
-
Pokud byl návrh MT nebo NT přijat bez další editace, je v analýze prezentován jako 100% shoda.
-
Pokud překladatel změní MT, bude míra shody nižší. Algoritmus pro počítání skóre je stejný jako ten, který se používá k výpočtu skóre částečné shody překladové paměti.
-
Editace NT způsobí, že segment bude prezentován jako 0–49% NT.
Analyzovat post-editaci NT/MT zakázáno
-
Položky z MT/nepřekládaný text (NT) bez jakéhokoli odhadovaného skóre budou považovány za shody TM 0–49 %. Budou označeny jako přeložené překladatelem, přičemž MT nebude brána v úvahu.
-
Shody QPS a Phrase Language AI vyšší než 75 % budou ve sloupci MT v rámci příslušných shod.
-
Indikuje shody nepřekládaný text (NT)/MT nabízené překladateli při otevření segmentu (nikoli skutečné úsilí překladatele při post-editaci).
Automaticky generovat analýzu post-editace před aktualizací zdroje
-
Analýza je vytvořena:
-
Pro každou aktualizovanou zakázku.
-
Pro každého jednotlivého poskytovatele zvlášť a přiřazena danému poskytovateli.
-
-
Analýza není vytvořena, pokud:
-
Není přiřazen žádný překladatel ani dodavatel.
-
-
Analýza započítává potvrzené a přeložené segmenty.
-
Analýza se řídí konvencí pojmenování:
-
UpdateSource #{innerID}{workflow}
-
-
Analýza bude vytvořena s vybranými možnostmi Počet jednotek (zdroj), Analyzovat post-editaci nepřekládaný text (NT), Analyzovat post-editaci TM a Analyzovat post-editaci MT.
Počet jednotek
-
Vyberte, který počet slov bude v analýze zobrazen. Cílový počet slov může být vyšší než zdrojový počet slov.
Neovlivňuje skórování shody.
-
edice Team, Ultimate a Enterprise (starší)
S dotazy ohledně licencí se obraťte na prodejní oddělení.
Funkce Porovnat analýzu je dostupná pouze v projektech s fázemi pracovního postupu. Porovnává dvě verze souboru v různých fázích pracovního postupu na úrovni segment a analyzuje, jak se tyto dvě verze liší. Pokud pro analýza neexistují žádná nastavení specifická pro projekt, použijí se výchozí nastavení, což může vést k nesprávným přehledům.
Příklad
Analýza lze spustit pro více zakázka a lze je seskupit dvěma způsoby:
-
Analyzovat podle poskytovatel
-
Pro projekt s mnoha zakázka přiřazenými různým lingvistům nebo dodavatelům. Používá se k:
-
Vytvořit samostatné analýza obsahující soubory přiřazené jednotlivým lingvistům nebo dodavatelům.
-
Přiřadit analýzy poskytovateli, čímž se analýzy zpřístupní jeho lingvistům/dodavatelům.
Schéma pro sazbu netto bude předem vybráno jako možnost, pokud je u poskytovatele použito.
-
-
-
Analyzovat podle jazyka
-
Pokud projekt obsahuje více cílových jazyků, lze analýzy všech souborů spustit v dávce, čímž se vytvoří samostatná analýza pro každý jednotlivý jazyk.
Chcete-li analyzovat podle jazyka, postupujte podle těchto kroků:
-
Na stránce Projekt vyberte všechny soubory .
-
Klikněte na analyzovat.
Otevře se okno .
-
Ponechte výchozí nastavení a vyberte .
-
Klikněte na analyzovat.
Analýza zakázka je připravena podle jazyka.
Poznámka
Zrušte výběr této možnosti, chcete-li vytvořit jednu společnou analýzu pro vícejazyčný projekt.
-
-
Když je zdrojový soubor pro analýzu aktualizován, je v tabulce analýz označen jako zastaralý .
Přepočítání použije nastavení použitá pro původní analýzu.
Dodavatelé nesmějí přepočítávat analýzy vytvořené odběrateli.
Chcete-li provést přepočet pomocí nového zdrojového souboru, postupujte podle těchto kroků:
Přizpůsobit zobrazení analýzy
Sloupce , , , a lze v tabulce analýz zobrazit/skrýt. Sloupec je k dispozici také pro analýzu post-editace a udává, kolik sekund bylo stráveno editací segmentu.
Stáhnout analýzu
Chcete-li stáhnout analýzu, postupujte podle těchto kroků:
-
Klikněte na Stáhnout pro zobrazení rozbalovací nabídky a vyberte:
-
CSV (hodnoty oddělené čárkou) se znaky nebo bez nich, čitelné v tabulkových aplikacích.
-
LOG (podobný formátu SDL Trados), čitelný ve většině aplikací pro správu projektů.
-
JSON (JavaScript Object Notation), odlehčený formát pro výměnu dat.
Pouze analýza stažená ve formátu JSON bude obsahovat rozpis dat NT, MT, TM a interních fuzzy shod (IF) podle typu shody.
-
-
Výběr typu souboru spustí stahování.
Tyto soubory lze importovat do většiny softwarových systémů pro správu projektů.
Použít schéma pro sazbu netto
Slevu na slova/znaky/stránky lze v analýze uplatnit. Zlevněný objem překladu se okamžitě vypočítá a zobrazí přímo v analýze v řádku .
Chcete-li schéma pro sazbu netto z analýzy odebrat, ponechte pole vedle tlačítka prázdné.
Když je na analýzu aplikováno schéma pro sazbu netto, stažený soubor s analýzou zobrazuje vážený počet slov v každé kategorii shoda.
Chcete-li přiřadit analýzu poskytovateli, postupujte podle těchto kroků:
-
Vyberte analýzu ze seznamu a klikněte na upravit.
Otevře se stránka pro úpravu.
-
Vyberte poskytovatele z rozevíracího seznamu.
-
Klikněte na Uložit.
Analýza bude přiřazenému poskytovateli dostupná na portálu překladatel.