Analýza vypočítá počet znaků a slov ve vybraných souborech a identifikuje:
-
Opakování (včetně opakování napříč soubory)
Pouze první výskyt duplicitního segmentu se počítá samostatně, ve skupině procentuální shody nebo interní fuzzy shody. Opakování počítá následné výskyty téhož segmentu. Příklad: Úloha se dvěma přesně stejnými segmenty zobrazí Opakování: 1 segment, nikoli 2. To odráží pravidlo počítání.
Opakování počítá pouze následné výskyty duplicitních segmentů, které nemají žádnou shodu v překladové paměti nebo mají pouze fuzzy shodu. Segmenty, které splňují podmínky pro 100% nebo 101% shodu z překladové paměti, mají přednost před kategorií Opakování a jsou započítány do kategorie shody z překladové paměti namísto do Opakování.
-
Nepřekládaný text
-
Interní fuzzy shody
-
Návrhy strojového překladu
Analýzy mohou také zobrazit počet revizí provedených revizorem.
Analýzy mohou vytvářet projektoví manažeři nebo administrátoři. Lingvistům nelze povolit spouštění vlastních analýz. Dodavatelé mohou vytvářet analýzy pro sdílené úlohy/projekty.
Některé CAT nástroje označují analýzu jako statistiku.
Organizační analytiku poskytuje analytický panel.
Protože se v různých zemích používají různé fakturační jednotky, jsou k dispozici tři metody výpočtu:
-
znaků
Bez mezer.
-
Slova
Pro jazyky, které používají mezery mezi slovy – s výjimkou čínštiny, japonštiny a thajštiny.
-
Stran
1800 znaků včetně mezer – nesouvisí se skutečným počtem stran v souboru.
Počet slov
Vzhledem k různým metodám počítání v různých jazycích nemusí být zobrazený počet slov stejný jako počet slov vytvořený jinými aplikacemi.
Počet slov pro analýzu se liší od výpočtu MTU a od počtu slov zpracovaných systémem TMS použitých pro fakturaci předplatného.
-
Každá spojovací značka je nahrazena jednou mezerou.
-
Ostatní značky jsou odstraněny.
V jazycích používajících mezeru k oddělování slov (např. angličtina):
-
Každá číselná sekvence včetně
+-,.je nahrazena jedním znakem (pomocí regex výrazu[+-]?[0-9]+([., -]?[0-9]++)*+). -
Každá sekvence mezer je nahrazena jednou mezerou.
-
Mezery na začátku a na konci segmentu jsou odstraněny.
-
Každá sekvence znaků odlišných od mezery se počítá jako jedno slovo.
V jazycích, které k oddělování slov nepoužívají mezery (např. japonština):
-
Některá interpunkční znaménka jsou z textu odstraněna (pomocí regulárního výrazu
[\u2000-\u206F\u2E00-\u2E7F\u3000-\u3004\u3006-\u301F\\p{P}]). -
Segment je rozdělen na sekvence znaků patřících do písem Han, Hiragana, Katakana a thajského písma, které nejsou odděleny mezerami (NWS), a na sekvence znaků, které do těchto písem nepatří (WS).
-
Celkový počet slov = (počet slov z NWS) + (počet slov z WS).
-
Počet slov z WS se vypočítá stejně jako u angličtiny.
-
Počet slov pro NWS je počet znaků bez mezer.
-
U thajštiny je počet slov roven počtu znaků bez mezer dělenému 2.
Poznámka
Znaky z jazyků CJK se počítají jako znaky i jako slova.
Chcete-li vytvořit analýzu, postupujte podle těchto kroků:
-
Ze stránky vyberte jednu nebo více .
-
Klikněte na Analyzovat.
Otevře se okno .
-
Vyberte z rozevíracího seznamu.
-
V případě potřeby zadejte název.
-
Dostupná makra pro pojmenování analýzy:
-
{projectName} -
{sourceLang}Přidá zdrojový jazyk
-
{targetLang}Přidá cílový jazyk. Pokud je analyzováno více jazyků, bude jazyk prázdný.
-
Uživatelské jménoPřidá uživatelské jméno přiřazeného lingvisty nebo dodavatele. Pokud je přiřazeno více lingvistů, bude jméno prázdné.
-
Pracovní postup
-
"innerId": "1",
-
Název souboru
Pokud je pro analýzu použito více souborů/úloh, bude
{fileName}prázdný.
-
-
-
Vyberte možnosti analýzy. Zejména:
-
Použití možnosti ovlivní počet slov, protože čísla nebudou započítána jako slova.
-
Možnost porovnává segmenty v analyzované úloze z hlediska podobnosti v rámci souboru, na rozdíl od porovnávání pouze proti TM.
Pokud je zaškrtnuto , zobrazí se interní fuzzy shody jako samostatná kategorie v nově vytvořených analýzách. Například:
Překladatelská zakázka s 10 zdrojovými slovy obsahuje následující segmenty, kde se liší pouze poslední znak:
-
Koupil jsem si nové auto.
-
Koupil jsem si nové auto!
V případě, že v TM nejsou nalezeny žádné shody, zobrazí se výchozí analýza:
Možnosti IF
Kategorie TM: 0–49:
Kategorie TM: 95–99:
Kategorie IF: 95–99:
Zahrnout IF zakázáno
Slova
Zahrnout IF povoleno + Oddělit IF zakázáno
Slova
Slova
Zahrnout IF + Oddělit IF povoleno
Slova
Slova
-
-
-
Klikněte na Analyzovat.
Analýza nebo analýzy jsou přidány do seznamu.
-
Kliknutím na analýzu v seznamu ji zobrazíte na stránce detailu nebo si ji stáhnete pro vykreslení v aplikaci pro správu projektů.
Poznámka
Možnosti analýzy lze nastavit při vytváření analýzy, na úrovni projektu, nebo globálně v části Nastavení .
Výsledky analýzy se vypočítávají nezávisle pro každý jazykový pár vůči vlastní TM daného jazyka. I když projekt používá sdílenou TM pro více cílových jazyků, každý jazykový pár si udržuje vlastní sadu překladových jednotek. Stejný zdrojový segment může mít v každém jazyce jiné skóre, což vede k různým procentům shody a čistým sazbám napříč cílovými jazyky v rámci stejného projektu, i když jsou nastavení analýzy identická.
Jsou poskytovány tři typy analýzy:
Výchozí analýza je standardní analýza, která se provádí na zdrojových segmentech před překladem. Poskytuje základní analýzu zakázky, kterou lze použít s analýzou po úpravách k určení toho, kolik úsilí bylo vynaloženo na překlad dané zakázky. Tento základ se také používá jako podklad pro generování cenových nabídek pro klienty.
Práh TM nastavený v předpřekladu se používá jako výchozí, ale v případě potřeby jej lze změnit.
Vytvoří se rozpis počtu segmentů/slov/znaků a pokud je použit v projektu, identifikují se shody TM spolu s nepřeložitelnými položkami, interními fuzzy shodami a QPS (pokud je povoleno).
Důležité
Spuštění výchozí analýzy po překladu vede k nesprávným analýzám.
Výsledky analýzy se vypočítávají nezávisle pro každý cílový jazyk vůči vlastní překladové paměti daného jazyka. V projektu s více cílovými jazyky může stejný zdrojový segment získat v každém jazykovém páru různá procenta shody, nebo žádnou shodu, protože každý jazykový pár má v TM svou vlastní historii překladů. V důsledku toho se rozdělení počtu slov napříč kategoriemi shod a výsledná čistá sazba mohou v rámci stejného projektu lišit napříč cílovými jazyky, i když jsou nastavení analýzy identická.
Analýza post-editace
Analýza post-editace se spouští na cílových segmentech a indikuje úsilí při úpravách; kolik úprav text vyžadoval od lingvisty nebo korektora. Spouští se po dokončení post-editace.
Když lingvista klikne na nepřeložený segment, aktuálně nejvyšší shoda z překladové paměti, návrh strojového překladu a/nebo nepřeložitelná položka se pro daný segment uloží a použije v analýze post-editace.
Analýzu post-editace lze spustit z jakéhokoli kroku pracovního postupu a vypočítává se jako rozdíl mezi textem vloženým z dostupného zdroje (např. TM/MT) a výsledkem post-editace v cílovém segmentu.
Analýza post-editace rozšiřuje tradiční analýzu překladové paměti o strojový překlad (MT) a nepřeložitelné položky (NT). MT enginy třetích stran jsou také podporovány.
Důležité
Zakázání a nevylučuje shody TM/MT z analýzy. V tomto případě analýza zohledňuje skóre vyšší dostupné shody namísto úsilí při post-editaci.
Výsledek 101% TM v analýze post-editace nutně neznamená, že segment byl přeložen z TM.
Příklad
Zakázka přeložená pomocí MT se stále může jevit jako 101% TM, pokud je zakázána a v době otevření segmentu byla k dispozici shoda 101% TM.
Možnosti po analýze
Možnosti post-editace se používají pro výpočet úsilí při post-editaci potřebného pro shody z překladové paměti (TM), nepřeložitelné položky (NT) a strojový překlad (MT).
Analýza post-editace TM povolena
-
Určeno pro nekvalitní TM, které obsahují shody s vysokým procentem, jež vyžadují úpravu lingvistou.
-
Indikuje úsilí potřebné pro post-editaci TM.
-
Obsahuje pouze 100% shody v analýze. Kontextové 101% shody z TM nemají na výpočet žádný vliv.
Analýza post-editace TM zakázána
-
Určeno pro vysoce kvalitní TM, kde by shody měly být upravovány co nejméně, aby se snížily náklady.
-
Indikuje 101% i 100% shody.
-
Indikuje shody TM nabízené lingvistovi při otevření segmentu (nikoli skutečné úsilí lingvisty při post-editaci).
-
Indikuje úsilí potřebné pro post-editaci strojového překladu a nepřeložitelných položek.
Analýza post-editace NT/MT povolena
-
Pokud byl návrh MT nebo NT přijat bez dalších úprav, je v analýze prezentován jako 100% shoda.
-
Pokud lingvista změní MT, bude míra shody nižší. Algoritmus pro výpočet skóre je stejný jako ten, který se používá pro výpočet skóre fuzzy shod překladové paměti.
-
Úprava NT způsobí, že segment bude prezentován jako 0–49% NT.
Analýza post-editace NT/MT zakázána
-
Záznamy z MT/NT bez jakéhokoli odhadovaného skóre budou považovány za shody TM 0–49 %. Budou označeny jako přeložené lingvistou, přičemž MT nebude brán v úvahu.
-
QPS a Phrase Language AI shody vyšší než 75 % budou ve sloupci MT v rámci příslušných shod.
-
Indikuje shody NT/MT nabízené lingvistovi při otevření segmentu (nikoli skutečné úsilí lingvisty při post-editaci).
Automaticky generovat analýzu post-editace před aktualizací zdroje
-
Analýza je vytvořena:
-
Pro každou aktualizovanou úlohu.
-
Pro každého jednotlivého poskytovatele zvlášť a přiřazeno danému poskytovateli.
-
-
Analýza se nevytvoří, pokud:
-
Není přiřazen ani lingvista, ani dodavatel.
-
-
Analýza počítá potvrzené a přeložené segmenty.
-
Analýza se řídí konvencí pojmenování:
-
Aktualizovat zdroj #{innerID}{workflow}
-
-
Analýza bude vytvořena s vybranými možnostmi Počet jednotek (zdroj), Analyzovat post-editaci NT, Analyzovat post-editaci TM a Analyzovat post-editaci MT.
Počítat jednotky
-
Zdroj/cíl
Vyberte, který počet slov se má v analýze zobrazit. Počet slov v cílovém jazyce může být vyšší než počet slov ve zdrojovém jazyce.
Neovlivňuje hodnocení shody.
Srovnávací analýza
-
edice Team, Ultimate a Enterprise (starší)
S dotazy ohledně licencí se obraťte na prodejní oddělení.
Funkce Porovnat analýzu je dostupná pouze v projektech s kroky workflow. Porovnává dvě verze souboru v různých krocích workflow na úrovni segmentů a analyzuje, jak se tyto dvě verze liší. Pokud pro analýzu neexistují žádná nastavení specifická pro projekt, použijí se výchozí nastavení, což může vést k nesprávným přehledům.
Příklad
Analýzu lze spustit pro více úloh a lze ji seskupit dvěma způsoby:
-
Analýza podle poskytovatelů
-
Pro projekt s mnoha úlohami přiřazenými různým lingvistům nebo dodavatelům. Používá se k:
-
Vytvoření samostatných analýz obsahujících soubory přiřazené jednotlivým lingvistům nebo dodavatelům.
-
Přiřazení analýz poskytovateli, čímž se analýzy zpřístupní jeho lingvistům/dodavatelům.
Schéma čisté sazby bude předvybráno jako možnost, pokud je u poskytovatele použito.
-
-
-
Analýza podle jazyků
-
Pokud projekt obsahuje více cílových jazyků, lze analýzy všech souborů spustit dávkově, čímž se vytvoří samostatná analýza pro každý jednotlivý jazyk.
Chcete-li provést analýzu podle jazyka, postupujte takto:
-
Na stránce projektu vyberte všechny soubory .
-
Klikněte na Analyzovat.
Otevře se okno .
-
Ponechte výchozí nastavení a vyberte .
-
Klikněte na Analyzovat.
Analýza úlohy je připravena podle jazyka.
Poznámka
Zrušte výběr této možnosti, chcete-li vytvořit jednu společnou analýzu pro vícejazyčný projekt.
-
-
Když je zdrojový soubor pro analýzu aktualizován, je v tabulce analýzy označen jako zastaralý .
Přepočítání použije nastavení použitá pro původní analýzu.
Dodavatelé nesmějí přepočítávat analýzy vytvořené odběrateli.
Chcete-li provést přepočet pomocí nového zdrojového souboru, postupujte takto:
Přizpůsobení zobrazení Analýza
Sloupce , , , a lze v tabulce Analýza zobrazit/skrýt. Sloupec je k dispozici také pro analýzu po úpravách a udává, kolik sekund bylo stráveno úpravou segmentu.
Stáhnout analýzu
Chcete-li stáhnout analýzu, postupujte podle těchto kroků:
-
Kliknutím na Stáhnout zobrazíte rozevírací nabídku a vyberte:
-
CSV (hodnoty oddělené čárkou) se znaky nebo bez nich, čitelné v tabulkových aplikacích.
-
LOG (podobný formátu SDL Trados), čitelný ve většině aplikací pro správu projektů.
-
JSON (JavaScript Object Notation), odlehčený formát pro výměnu dat.
Pouze analýza stažená ve formátu JSON bude obsahovat rozpis dat NT, MT, TM a interních fuzzy shod (IF) podle typu shody.
-
-
Výběr typu souboru spustí stahování.
Tyto soubory lze importovat do většiny softwarových systémů pro správu projektů.
Aplikujte net rate scheme
V analýze lze uplatnit slevu na slova/znaky/stránky. Zlevněný objem překladu se okamžitě vypočítá a zobrazí přímo v analýze v řádku .
Chcete-li z analýzy odebrat schéma čistých sazeb, ponechte pole vedle tlačítka prázdné.
Pokud je na analýzu aplikováno schéma čistých sazeb, stažený soubor s analýzou zobrazuje vážený počet slov v každé kategorii shody.
Chcete-li přiřadit analýzu poskytovateli, postupujte podle těchto kroků:
-
Vyberte analýzu ze seznamu a klikněte na Edit.
Otevře se stránka pro úpravu.
-
Vyberte poskytovatele z rozevíracího seznamu.
-
Klikněte na Uložit.
Analýza bude přiřazenému poskytovateli k dispozici na portálu linguist.