A análise calcula a contagem de caracteres e palavras nos arquivos selecionados e identifica:
-
Repetições (incluindo repetições entre arquivos)
Apenas a primeira ocorrência de um segmento duplicado é contada separadamente, no grupo de porcentagem de correspondência regular ou fuzzy interno. Repetições conta as ocorrências subsequentes desse mesmo segmento. Exemplo: Um trabalho com exatamente dois segmentos idênticos mostra Repetições: 1 segmento, não 2. Isso reflete a regra de contagem.
Repetições conta apenas as ocorrências subsequentes de segmentos duplicados que não possuem correspondência de memória de tradução ou que possuem apenas uma correspondência fuzzy. Segmentos que se qualificam para uma correspondência de memória de tradução de 100% ou 101% têm prioridade sobre o grupo de Repetições e são contados na categoria de correspondência de TM em vez de em Repetições.
-
Não traduzíveis
-
Correspondências fuzzy internas
-
Sugestões de tradução automática
As análises também podem mostrar o número de revisões feitas por um revisor.
As análises podem ser criadas por gerentes de projeto ou administradores. Não é permitido que os linguistas executem suas próprias análises. Fornecedores podem criar análises para trabalhos/projetos compartilhados.
Algumas ferramentas CAT referem-se à análise como estatísticas.
As análises organizacionais são fornecidas pelo painel de análise.
Como diferentes unidades de faturamento são usadas em diferentes países, três métodos de cálculo estão disponíveis:
-
caracteres
Sem espaços.
-
Palavras
Para idiomas que usam espaços entre palavras — excluindo chinês, japonês e tailandês.
-
Páginas
1800 caracteres com espaços — não relacionados ao número real de páginas em um arquivo.
Contagem de palavras
Devido a diferentes métodos de contagem entre diferentes idiomas, a contagem de palavras apresentada pode não ser a mesma que as contagens de palavras produzidas por outros aplicativos.
A contagem de palavras para análise é diferente daquela do cálculo de MTU e do número de palavras processadas pelo TMS usadas para cobrança de assinatura.
-
Cada tag de junção é substituída por um espaço.
-
Outras tags são removidas.
Em idiomas que usam um espaço em branco para separar palavras (por exemplo, inglês):
-
Cada sequência numérica, incluindo
+-,., é substituída por um caractere (usando a expressão regex[+-]?[0-9]+([., -]?[0-9]++)*+). -
Cada sequência de espaços em branco é substituída por um espaço.
-
Espaços em branco no início e no fim do segmento são removidos.
-
Cada sequência de caracteres diferente de espaço é contada como uma palavra.
Em idiomas que não usam espaços em branco para separar palavras (por exemplo, japonês):
-
Alguns sinais de pontuação são removidos do texto (usando a expressão regex
[\u2000-\u206F\u2E00-\u2E7F\u3000-\u3004\u3006-\u301F\\p{P}]). -
O segmento é dividido em sequências de caracteres pertencentes aos scripts Han, Hiragana, Katakana e tailandês (NWS, não espaços em branco), e em sequências de caracteres que não pertencem a esses scripts (WS).
-
Número total de palavras = (número de palavras de NWS) + (número de palavras de WS).
-
O número de palavras de WS é calculado como para o inglês.
-
O número de palavras para NWS é o número de caracteres sem espaços em branco.
-
Para o tailandês, o número de palavras é o número de caracteres sem espaços em branco dividido por 2.
Nota
Caracteres de idiomas CJK são contados tanto como caracteres quanto como palavras.
Para criar uma análise, siga estas etapas:
-
A partir de uma página de , selecione um ou mais .
-
Clique em Analisar.
A janela é aberta.
-
Selecione um na lista suspensa.
-
Forneça um nome, se necessário.
-
Macros disponíveis para nomeação da Análise:
-
{projectName} -
{sourceLang}Adiciona o idioma do texto original
-
{targetLang}Adiciona o idioma de destino. Se vários idiomas forem analisados, o idioma ficará vazio.
-
Nome de usuárioAdiciona o nome de usuário do Linguista ou Fornecedor atribuído. Se vários Linguistas forem atribuídos, o nome ficará vazio.
-
Fluxo de trabalho
-
{innerId} -
Nome do arquivo
Se mais arquivos/trabalhos forem usados para análise, o
{fileName}ficará vazio.
-
-
-
Selecione as opções de análise. Em particular:
-
A aplicação da opção afetará a contagem de palavras, pois os números não serão calculados como palavras.
-
A opção compara segmentos no trabalho analisado em busca de semelhanças dentro do arquivo, em vez de compará-los apenas com uma TM.
Se estiver marcado, as correspondências de fuzzies internos serão exibidas como uma categoria separada em análises recém-criadas. Por exemplo:
Um trabalho de tradução com 10 palavras de origem inclui os seguintes segmentos, onde apenas o último caractere difere:
-
Eu comprei um carro novo.
-
Eu comprei um carro novo!
Caso nenhuma correspondência seja encontrada na TM, uma análise padrão exibirá:
Opções de IF
Categoria da TM: 0–49:
Categoria da TM: 95–99:
Categoria de IF: 95–99:
Incluir IF desativado
Palavras
Incluir IF ativado + Separar IF desativado
Palavras
Palavras
Incluir IF + Separar IF ativado
Palavras
Palavras
-
-
-
Clique em Analisar.
A análise, ou análises, são adicionadas à lista.
-
Clique em uma análise na lista para visualizá-la na página de detalhes ou faça o download para renderização em um aplicativo de gerenciamento de projetos.
Nota
As opções de análise podem ser definidas ao criar uma análise, no nível do projeto em , ou globalmente em Configurações .
Os resultados da análise são calculados independentemente para cada par de idiomas em relação à TM desse idioma. Mesmo quando um projeto usa uma TM compartilhada entre vários idiomas de destino, cada par de idiomas mantém seu próprio conjunto de unidades de tradução. O mesmo segmento de origem pode ter pontuações diferentes em cada idioma, resultando em diferentes porcentagens de correspondência e taxas líquidas entre os idiomas de destino dentro do mesmo projeto, mesmo quando as configurações de análise são idênticas.
Três tipos de análise são fornecidos:
A análise padrão é aquela executada em segmentos de origem antes da tradução. Ela fornece a análise básica de um trabalho, que pode ser utilizada juntamente com a análise de pós-edição para determinar o esforço empregado na tradução do trabalho. Esta linha de base também é usada como base para gerar orçamentos para clientes.
O limite de TM do , definido na , é utilizado por padrão, mas pode ser alterado, se necessário.
Um detalhamento das contagens de segmentos/palavras/caracteres é produzido e, se usado em um projeto, as correspondências de TM são identificadas juntamente com os não traduzíveis, correspondências fuzzy internas e QPS (se habilitado).
Importante
Executar uma análise padrão após a tradução produz análises incorretas.
Os resultados da análise são calculados independentemente para cada idioma de destino em relação à sua própria memória de tradução. Em um projeto com vários idiomas de destino, o mesmo segmento de origem pode receber diferentes porcentagens de correspondência, ou nenhuma correspondência, em cada par de idiomas, já que cada par de idiomas tem seu próprio histórico de tradução na TM. Como resultado, a distribuição da contagem de palavras entre as categorias de correspondência, e a taxa líquida resultante, podem diferir entre os idiomas de destino dentro do mesmo projeto, mesmo quando as configurações de análise são idênticas.
Análise de pós-edição
A análise de pós-edição é executada em segmentos de destino e indica o esforço de edição; quanto de edição o texto exigiu de um linguista ou revisor. Ela é executada após a conclusão da pós-edição.
Quando um linguista clica em um segmento não traduzido, a correspondência de memória de tradução mais alta atual, a sugestão de tradução automática e/ou o não traduzível é salvo para aquele segmento e usado na análise de pós-edição.
A análise de pós-edição pode ser iniciada a partir de qualquer etapa do fluxo de trabalho e é calculada como a diferença entre o texto inserido da fonte disponível (por exemplo, MT/TM) e o resultado pós-editado no destino do segmento.
A análise de pós-edição estende a análise tradicional de memória de tradução para incluir tradução automática (MT) e não traduzíveis (NT). Motores de MT de terceiros também são suportados.
Importante
Desabilitar e não exclui as correspondências de TM/MT da análise. Nesse caso, a análise considera a pontuação da correspondência disponível mais alta em vez do esforço de pós-edição.
Um resultado de 101% de TM em uma análise de pós-edição não significa necessariamente que o segmento foi traduzido a partir da TM.
Exemplo
Um trabalho traduzido usando MT ainda pode aparecer como 101% de TM se estiver desabilitado e uma correspondência de 101% de TM estiver disponível quando o segmento for aberto.
Opções de pós-análise
As opções de pós-edição são usadas para calcular o esforço de pós-edição necessário para correspondências da memória de tradução (TM), não traduzíveis (NT) e tradução automática (MT).
Análise de pós-edição de TM habilitada
-
Destinado a TMs de baixa qualidade que contêm correspondências de alta porcentagem que exigem edição do linguista.
-
Indica o esforço de pós-edição para a TM.
-
Contém apenas correspondências de 100% na análise. As correspondências 101% em contexto da TM não têm efeito no cálculo.
Análise de pós-edição de TM desativada
-
Destinado a TM de alta qualidade, onde as correspondências devem ser editadas o mínimo possível para reduzir custos.
-
Indica tanto 101% quanto 100%.
-
Indica correspondências de TM oferecidas ao linguista quando o segmento é aberto (não o esforço real de pós-edição do linguista).
-
Indica o esforço de pós-edição para tradução automática e não traduzíveis.
Análise de pós-edição de NT/MT habilitada
-
Se a sugestão de MT ou NT for aceita sem edição adicional, ela será apresentada como uma correspondência de 100% na análise.
-
Se o linguista alterar a MT, a taxa de correspondência será menor. O algoritmo de contagem de pontuação é o mesmo utilizado para calcular a pontuação das correspondências fuzzy da memória de tradução.
-
A edição de uma NT fará com que o segmento seja apresentado como NT de 0-49%.
Análise de pós-edição de NT/MT desativada
-
Entradas de MT/NT sem qualquer pontuação estimada serão consideradas correspondências de TM de 0%-49%. Elas serão indicadas como traduzidas pelo linguista, sem considerar a MT.
-
Correspondências de QPS e Phrase Language AI superiores a 75% estarão na coluna de MT em suas respectivas correspondências.
-
Indica correspondências de NT/MT oferecidas ao linguista quando o segmento é aberto (não o esforço real de pós-edição do linguista).
Gerar automaticamente a análise de pós-edição antes de uma atualização de origem
-
A análise é criada:
-
Para cada trabalho atualizado.
-
Para cada provedor individualmente e atribuído a esse respectivo provedor.
-
-
A análise não é criada se:
-
Nenhum linguista ou fornecedor estiver atribuído.
-
-
A análise conta segmentos confirmados e traduzidos.
-
A análise segue a convenção de nomenclatura:
-
UpdateSource #{innerID}{workflow}
-
-
A análise será criada com Units counted (source), Analyze NT post-editing, Analyze TM post-editing e Analyze MT post-editing selecionados.
Contar unidades do(a)
-
Original/tradução
Selecione qual contagem de palavras será apresentada na análise. Uma contagem de palavras de destino pode ser maior do que uma contagem de palavras de origem.
Não afeta a pontuação de correspondência.
Análise comparativa
-
Planos Team, Ultimate e Enterprise (legado)
Entre em contato com o departamento de Vendas para perguntas sobre o licenciamento.
O recurso de análise de comparação está disponível apenas em projetos com etapas de fluxo de trabalho. Ele compara duas versões de um arquivo em diferentes etapas do fluxo de trabalho em um nível de segmento e analisa como as duas versões diferem. Se não houver configurações específicas do projeto para a análise, as configurações padrão serão usadas e poderão resultar em relatórios incorretos.
Exemplo
A análise pode ser executada em vários trabalhos e pode ser agrupada de duas maneiras:
-
Analisar por responsável
-
Para um projeto com muitos trabalhos atribuídos a vários linguistas ou fornecedores. Usado para:
-
Criar análises separadas contendo arquivos atribuídos a linguistas ou fornecedores individuais.
-
Atribua análises a um provedor, tornando as análises visíveis para seus linguistas/fornecedores.
Esquema de tarifa líquida será pré-selecionado como opção se um for aplicado ao provedor.
-
-
-
Analisar por idioma
-
Se um projeto contiver vários idiomas de destino, as análises de todos os arquivos podem ser executadas em lote, criando uma análise separada para cada idioma individual.
Para analisar por idioma, siga estas etapas:
-
Em uma página de Projeto, selecione todos os arquivos de .
-
Clique em Analisar.
A janela abre.
-
Mantenha as configurações padrão e selecione .
-
Clique em Analisar.
A análise do trabalho é preparada por idioma.
Nota
Desmarque esta opção para criar uma única análise para um projeto multilíngue.
-
-
Quando o arquivo de origem de uma análise é atualizado, ele é marcado como desatualizado na tabela de análise.
O recálculo aplica as configurações usadas para a análise original.
Fornecedores não têm permissão para recalcular análises criadas por compradores.
Para recalcular usando um novo arquivo de origem, siga estas etapas:
Personalize a visualização da análise
As colunas , , , e podem ser exibidas/ocultadas na tabela de análise. A coluna também está disponível para análise de pós-edição e indica quantos segundos foram gastos editando um segmento.
Baixar uma análise
Para baixar uma análise, siga estas etapas:
-
Clique em Baixar para apresentar o menu suspenso e selecione:
-
CSV (Valores Separados por Vírgula) com ou sem caracteres e legível com aplicativos de planilha.
-
LOG (Semelhante ao formato do SDL Trados) e legível com a maioria dos aplicativos de gerenciamento de projetos.
-
JSON (JavaScript Object Notation), um formato leve de intercâmbio de dados.
Somente a análise baixada no formato JSON incluirá um detalhamento dos dados de NT, MT, TM e correspondências parciais internas (IF) por tipo de correspondência.
-
-
Selecionar um tipo de arquivo inicia o download.
Esses arquivos podem ser importados na maioria dos sistemas de software de gerenciamento de projetos.
Aplicar um esquema de tarifa líquida
Um desconto para palavras/caracteres/páginas pode ser aplicado em uma análise. Um volume de tradução com desconto é calculado imediatamente e exibido diretamente na análise na linha .
Para remover o esquema de tarifa líquida da análise, deixe o campo ao lado do botão vazio.
Quando um esquema de tarifa líquida é aplicado à análise, o arquivo baixado com a análise mostra contagens de palavras ponderadas em cada categoria de correspondência.
Para atribuir uma análise a um fornecedor, siga estas etapas:
-
Selecione uma análise na lista e clique em Editar.
A página de edição é aberta.
-
Selecione um fornecedor na lista suspensa.
-
Clique em Gravar.
A análise estará disponível para o fornecedor atribuído no portal do linguista.