Analýza vypočítá počet znaků a slov ve vybraných souborech a identifikuje:
-
Opakování (včetně opakování napříč soubory)
Pouze první výskyt duplicitního segmentu se počítá samostatně, v rámci běžného procenta shody nebo v rámci částečné shody. Opakování počítá následné výskyty téhož segmentu. Příklad: Zakázka s přesně dvěma identickými segmenty zobrazuje Opakování: 1 segment, nikoli 2. To odráží pravidlo počítání.
-
Nepřekládaný text
-
Interní částečné shody
-
Návrhy strojového překladu
Analýzy mohou také zobrazit počet revizí provedených korektorem.
Analýzy mohou vytvářet projektoví manažeři nebo administrátoři. Lingvistům nelze povolit spouštění vlastních analýz. Dodavatelé mohou vytvářet analýzy pro sdílené zakázky/projekty.
Některé CAT nástroje označují analýzu jako statistiku.
Organizační analytika je poskytována prostřednictvím hlavního panelu analytiky.
Protože se v různých zemích používají různé fakturační jednotky, jsou k dispozici tři metody výpočtu:
-
Znaky
Bez mezer.
-
Slova
Pro jazyky, které používají mezi slovy Space—kromě čínštiny, japonštiny a thajštiny.
-
Stran
1800 znaků se Space—nesouvisí se skutečným počtem stran v souboru.
Vzhledem k různým metodám počítání v různých jazycích nemusí být zobrazený počet slov stejný jako počet slov vytvořený jinými aplikacemi.
Počet slov pro analýza se liší od výpočtu MTU.
-
Každý tag sloučit je nahrazen jedním Space.
-
Ostatní tag jsou odstraněny.
V jazycích používajících Space pro oddělování slov (např. angličtina):
-
Každá číselná sekvence včetně
+-,.je nahrazena jedním znakem (pomocí regex výrazu[+-]?[0-9]+([., -]?[0-9]++)*+). -
Každá sekvence Space je nahrazena jedním Space.
-
Space na začátku a na konci segment jsou odstraněny.
-
Každá sekvence znaků odlišných od Space se počítá jako jedno slovo.
V jazycích, které nepoužívají Space pro oddělování slov (např. japonština):
-
Některá interpunkční znaménka jsou z textu odstraněna (pomocí regex výrazu
[\\u2000-\\u206F\\u2E00-\\u2E7F\\u3000-\\u3004\\u3006-\\u301F\\\\p{P}]). -
Segment je rozdělen na sekvence znaků patřících do skriptů bez Space (NWS) Han, Hiragana, Katakana a thajského písma a sekvence znaků, které do těchto skriptů nepatří (WS).
-
Celkový počet slov = (počet slov z NWS) + (počet slov z WS).
-
Počet slov z WS se vypočítá stejně jako pro angličtinu.
-
Počet slov pro NWS je počet znaků bez Space.
-
Pro thajštinu je počet slov počet znaků bez Space dělený 2.
Poznámka
Znaky z jazyků CJK se počítají jako znaky i jako slova.
Chcete-li vytvořit analýzu, postupujte takto:
-
Na stránce vyberte jednu nebo více .
-
Klikněte na analyzovat.
Otevře se okno .
-
Vyberte z rozevíracího seznamu.
-
V případě potřeby zadejte název.
-
Dostupná makra pro pojmenování analýzy:
-
{projectName} -
{sourceLang}Přidá zdrojový jazyk
-
{targetLang}Přidá cílový jazyk. Pokud je analyzováno více jazyků, bude jazyk prázdný.
-
{userName}Přidá uživatelské jméno přiřazeného překladatele nebo dodavatele. Pokud je přiřazeno více překladatelů, bude jméno prázdné.
-
{pracovní postup} -
{innerId} -
{fileName}Pokud je pro analýzu použito více souborů/zakázek, bude
{fileName}prázdný.
-
-
-
Vybrat možnosti analýzy. Zejména:
-
Použití možnosti ovlivní počet slov, protože čísla nebudou započítána jako slova.
-
Možnost porovnává segmenty v analyzované zakázce z hlediska podobnosti v rámci souboru, na rozdíl od porovnávání pouze proti TM.
Pokud je zaškrtnuto , shody interních fuzzy shod se v nově vytvořených analýzách zobrazují jako samostatná kategorie. Například:
Překladová zakázka s 10 zdrojovými slovy obsahuje následující segmenty, kde se liší pouze poslední znak:
-
Koupil jsem si nové auto.
-
Koupil jsem si nové auto!
V případě, že v TM nejsou nalezeny žádné shody, zobrazí se výchozí analýza:
Možnosti IF
Kategorie TM: 0%-49%
Kategorie TM: 95%-99%
Kategorie IF: 95%-99%
Zahrnout IF zakázáno
10 slov
Zahrnout IF povoleno + Oddělit IF zakázáno
5 slov
5 slov
Zahrnout IF + Oddělit IF povoleno
5 slov
5 slov
-
-
-
Klikněte na analyzovat.
Analýza nebo analýzy jsou přidány do seznamu.
-
Kliknutím na analýzu v seznamu ji zobrazíte na stránce detailu nebo ji stáhnete pro vykreslení v aplikaci pro správu projektů.
Poznámka
Možnosti analýzy lze nastavit při vytváření analýzy, na úrovni projektu nebo globálně v části nastavení .
Jsou poskytovány tři typy analýzy:
Výchozí analýza je standardní analýza spuštěná na zdrojových segmentech před překladem. Poskytuje základní analýzu zakázky, kterou lze použít spolu s analýzou post-editace k určení toho, kolik úsilí bylo vynaloženo na překlad dané zakázky. Tento základ se také používá jako podklad pro generování cenových nabídek pro klienty.
Práh TM nastavený v předpřekladu se používá jako výchozí, ale v případě potřeby jej lze změnit.
Vytvoří se rozpis počtu segmentů/slov/znaků a pokud je použit v projektu, identifikují se shody TM spolu s nepřekládaným textem, interními částečnými shodami a QPS (pokud je povoleno).
Důležité
Spuštění výchozí analýzy po překladu vytvoří nesprávné analýzy.
Analýza post-editace se spouští na cílových segmentech a indikuje úsilí při úpravách; kolik úprav text vyžadoval od překladatele nebo korektora. Spouští se po dokončení post-editace.
Když překladatel klikne na nepřeložený segment, aktuálně nejvyšší shoda překladové paměti, návrh strojového překladu a/nebo nepřekládaný text se pro daný segment uloží a použije v analýze post-editace.
Analýzu post-editace lze spustit z jakékoli fáze pracovního postupu a vypočítává se jako rozdíl mezi textem vloženým z dostupného zdroje (např. TM/MT) a výsledkem post-editace v cíli segmentu.
Analýza post-editace rozšiřuje tradiční analýzu překladové paměti o strojový překlad (MT) a nepřekládaný text (NT). Podporovány jsou také motory strojového překladu třetích stran.
Důležité
Zakázání a nevyloučí shody TM/MT z analýzy. V tomto případě analýza zohledňuje skóre vyšší dostupné shody namísto úsilí při post-editaci.
Výsledek 101% shody TM v analýze post-editace nutně neznamená, že segment byl přeložen z TM.
Příklad
Zakázka přeložená pomocí MT se stále může jevit jako 101% shoda TM, pokud je zakázáno a v době otevření segmentu byla k dispozici 101% shoda TM.
Možnosti analýzy po překladu
Možnosti post-editace se používají pro výpočet úsilí při post-editaci potřebného pro shody z překladové paměti (TM), nepřekládaný text (NT) a strojový překlad (MT).
Analyzovat post-editaci TM povoleno
-
Určeno pro nekvalitní TM, které obsahují shody s vysokým procentem, jež vyžadují úpravy od překladatele.
-
Indikuje úsilí o post-editaci pro TM.
-
Obsahuje pouze 100% shody v analýze. Kontextové 101% shody z TM nemají na výpočet žádný vliv.
Analyzovat post-editaci TM zakázáno
-
Určeno pro vysoce kvalitní TM, kde by shody měly být upravovány co nejméně, aby se snížily náklady.
-
Indikuje 101% i 100%.
-
Indikuje shody TM nabízené překladateli při otevření segmentu (nikoli skutečné úsilí překladatele o post-editaci).
-
Indikuje úsilí o post-editaci pro strojový překlad a nepřekládaný text (NT).
Analyzovat post-editaci NT/MT povoleno
-
Pokud byl návrh MT nebo nepřekládaného textu (NT) přijat bez dalších úprav, je v analýze prezentován jako shoda 100 %.
-
Pokud překladatel změní MT, bude míra shody nižší. Algoritmus pro počítání skóre je stejný jako ten, který se používá k výpočtu skóre částečné shody překladové paměti.
-
Úprava nepřekládaného textu (NT) způsobí, že segment bude prezentován jako 0–49% NT.
Analyzovat post-editaci NT/MT zakázáno
-
Záznamy z MT/NT bez jakéhokoli odhadovaného skóre budou považovány za shody TM 0–49 %. Budou označeny jako přeložené překladatelem, přičemž MT nebude brán v úvahu.
-
Shody QPS a Phrase Language AI vyšší než 75 % budou ve sloupci MT v rámci příslušných shod.
-
Indikuje shody NT/MT nabízené překladateli při otevření segmentu (nikoli skutečné úsilí překladatele o post-editaci).
Automaticky generovat analýzu post-editace před aktualizací zdroje
-
Analýza je vytvořena:
-
Pro každou aktualizovanou zakázku.
-
Pro každého jednotlivého poskytovatele zvlášť a přiřazeno danému poskytovateli.
-
-
Analýza se nevytvoří, pokud:
-
Není přiřazen žádný překladatel ani dodavatel.
-
-
Analýza započítává potvrzené a přeložené segmenty.
-
Analýza se řídí konvencí pojmenování:
-
UpdateSource #{innerID}{workflow}
-
-
Analýza bude vytvořena s vybranými možnostmi Jednotky započítány (zdroj), Analyzovat NT post-editace, Analyzovat TM post-editace a Analyzovat MT post-editace.
Počet jednotek
-
Vyberte, který počet slov bude v analýze zobrazen. Cílový počet slov může být vyšší než zdrojový počet slov.
Neovlivňuje skórování shody.
-
edice Team, Ultimate a Enterprise (starší)
S dotazy ohledně licencí se obraťte na prodejní oddělení.
Funkce Porovnat analýzu je dostupná pouze v projektech s fázemi pracovního postupu. Porovnává dvě verze souboru v různých fázích pracovního postupu na úrovni segmentů a analyzuje, jak se tyto dvě verze liší. Pokud pro analýzu neexistuje žádné nastavení specifické pro projekt, použije se výchozí nastavení, což může vést k nesprávným přehledům.
Příklad
Analýzu lze spustit pro více zakázek a lze ji seskupit dvěma způsoby:
-
Analyzovat podle poskytovatele
-
Pro projekt s mnoha zakázkami přiřazenými různým lingvistům nebo poskytovatelům. Používá se k:
-
Vytvořit samostatné analýzy obsahující soubory přiřazené jednotlivým lingvistům nebo poskytovatelům.
-
Přiřadit analýzy poskytovateli, čímž se analýzy zpřístupní jejich lingvistům/poskytovatelům.
Schéma pro sazbu netto bude předem vybráno jako možnost, pokud je u poskytovatele použito.
-
-
-
Analyzovat jazyk
-
Pokud projekt obsahuje více cílových jazyků, lze analýzy všech souborů spustit v dávce, čímž se vytvoří samostatná analýza pro každý jednotlivý jazyk.
Chcete-li analyzovat jazyk, postupujte takto:
-
Na stránce projekt vyberte všechny soubory .
-
Klikněte na analyzovat.
Otevře se okno .
-
Ponechte výchozí nastavení a vyberte .
-
Klikněte na analyzovat.
Analýza zakázky je připravena podle jazyka.
Poznámka
Zrušte výběr této možnosti, chcete-li vytvořit jednu analýzu pro vícejazyčný projekt.
-
-
Když je zdrojový soubor pro analýzu aktualizován, je v tabulce analýzy označen jako zastaralý .
Přepočítání použije nastavení použitá pro původní analýzu.
Poskytovatelé nesmějí přepočítávat analýzy vytvořené kupujícími.
Chcete-li provést přepočet pomocí nového zdrojového souboru, postupujte takto:
Přizpůsobit zobrazení analýza
Sloupce , , , a lze v tabulce analýza zobrazit/skrýt. Sloupec je také k dispozici pro post-editace analýza a udává, kolik sekund bylo stráveno úpravou segment.
Stáhnout analýza
Chcete-li stáhnout analýza, postupujte podle těchto kroků:
-
Klikněte na Stáhnout pro zobrazení rozbalovací nabídky a Vybrat:
-
CSV (hodnoty oddělené čárkami) se znaky nebo bez nich a čitelný tabulkovými aplikacemi.
-
LOG (podobný formátu SDL Trados) a čitelný většinou aplikací pro správu projektů.
-
JSON (JavaScript Object Notation), odlehčený formát pro výměnu dat.
Pouze analýza stažená ve formátu JSON bude obsahovat rozpis dat NT, MT, TM a interních fuzzy shod (IF) podle typu shoda.
-
-
Výběr typu souboru spustí stáhnout.
Tyto soubory lze importovat do většiny softwarových systémů pro správu projektů.
Použít schéma pro sazbu netto
V analýze lze uplatnit slevu na slova/znaky/stránky. Zlevněný objem překladu je okamžitě vypočítán a zobrazen přímo v analýze v řádku .
Chcete-li odebrat schéma pro sazbu netto z analýzy, ponechte pole vedle tlačítko prázdný.
Když je na analýzu aplikováno schéma pro sazbu netto, stažený soubor s analýzou zobrazuje vážený počet slov v každé kategorii shoda.
Chcete-li přiřadit analýzu poskytovateli, postupujte podle těchto kroků:
-
Vyberte analýzu ze seznamu a klikněte na upravit.
Otevře se stránka pro úpravu.
-
Vyberte poskytovatele z rozevíracího seznamu.
-
Klikněte na Uložit.
Analýza bude dostupná přiřazenému poskytovateli na portálu překladatel.