Glossário de tradução e localização: os termos que realmente surgem no dia a dia
Memória de tradução, fuzzy match, MTPE, XLIFF, TMX, leverage, transcriação. Definições em linguagem simples para todos os termos que você encontrará em orçamentos, ferramentas CAT ou conversas com fornecedores, e como eles se relacionam entre si.

Nesta página
A tradução tem um problema de vocabulário. Metade das palavras são siglas, várias significam quase a mesma coisa e algumas mudam de sentido dependendo de quem fala. Quando um orçamento promete "80% de leverage com limite de 85% de fuzzy", nem sempre é óbvio se isso é uma boa notícia.
Este é um glossário prático: os termos que você encontra em orçamentos, ferramentas CAT ou conversas com fornecedores, definidos na ordem em que costumam aparecer, em vez de ordem alfabética. Quando um termo tem um significado específico para o Transept, ele é sinalizado como tal.
Qual é a diferença entre um glossário, uma term base e uma memória de tradução?
Esses três termos são usados como sinônimos em conversas, mas significam coisas diferentes dentro de uma ferramenta.
Glossário
Uma lista de termos com suas traduções aprovadas, além de observações sobre quando cada um se aplica. Nomes de produtos, nomes de personagens, vocabulário jurídico, as palavras das quais o cliente não abre mão. Um glossário responde a uma pergunta: quando este termo aparece, como ele deve ser traduzido?
No Transept, os glossários são fixados no prompt em cada execução e verificados novamente depois, para que um termo definido na página 1 continue valendo na página 500.
Term base (TB)
É o nome que as ferramentas CAT dão ao glossário, geralmente com mais metadados por entrada: classe gramatical, domínio, uma lista de variantes proibidas e, às vezes, uma definição. Se alguém disser term base e você entender glossário, você terá compreendido perfeitamente.
Memória de tradução (TM)
Um repositório de segmentos que você já traduziu — pares de origem e destino — reutilizados quando um texto semelhante aparece novamente. Enquanto um glossário atua no nível do termo, a memória atua no nível da frase completa.
As memórias clássicas buscam correspondências textuais. A memória de tradução do Transept também identifica semelhanças de significado e preserva o raciocínio por trás de cada decisão (as alternativas rejeitadas, os comentários de revisão). É isso que permite que ela ajude mesmo em frases com redações diferentes, mas que resolvem o mesmo problema. Escrevemos sobre o que mudou com essa abordagem.
Fuzzy match
Uma correspondência na memória que é próxima, mas não idêntica, representada por uma porcentagem. 85% é um limite comum: acima desse valor, a tradução armazenada serve como ponto de partida; abaixo dele, o segmento é tratado como novo. Esse número indica a semelhança textual, e não se a tradução antiga tinha qualidade.
Exact match, 100% e 101%
Uma exact match ou correspondência de 100% significa que o segmento de origem é idêntico a um que já está na memória. Uma correspondência de 101% (também chamada de in-context exact match, ou ICE) significa que o segmento é idêntico e os segmentos ao redor também coincidem; como o contexto é o mesmo, é muito mais provável que a tradução armazenada ainda sirva.
Leverage
É a porcentagem de um novo trabalho que a memória já cobre. O leverage dita os custos: as agências dão descontos para palavras com alto índice de leverage porque uma correspondência de 100% exige apenas uma revisão, em vez de uma tradução completa. Quando um orçamento cita o leverage, ele informa quanto trabalho se espera economizar.
O que significam as siglas de tradução automática?
Tradução automática (MT)
Qualquer tradução automática, independentemente da tecnologia utilizada. É o termo genérico.
Tradução automática neural (NMT)
Tradução automática por redes neurais treinadas especificamente para tradução. Esta é a geração de motores que inclui o DeepL e o Google Tradutor. A NMT é boa em produzir frases fluentes, mas não tem como seguir instruções: não há como pedir que ela seja mais formal no meio do caminho.
Tradução por LLM
Tradução realizada por um modelo de linguagem de grande porte (LLM) de uso geral. A diferença prática em relação à NMT é que você pode interagir com o modelo: é possível fornecer um glossário, um guia de estilo, o contexto do documento ou instruções sobre o tom. O Transept utiliza LLMs de ponta e trata o modelo como um backend intercambiável.
MTPE (pós-edição de tradução automática)
Um humano editando o resultado da máquina para transformá-lo em uma tradução finalizada. Às vezes abreviado como PEMT. É o modelo de trabalho predominante no setor e o que mais mudou com as LLMs: a MT antiga era visivelmente rudimentar, por isso os erros saltavam aos olhos; já o texto das LLMs pode soar impecável e, ainda assim, ter omitido uma oração inteira.
Nosso guia de MTPE explica como conduzir esse processo para que o critério humano entre em cena antes do rascunho, e não depois.
Pós-edição leve e completa
Dois níveis de serviço. A pós-edição leve foca em precisão e clareza, aceitando um fraseado mais simples. A pós-edição completa busca qualidade para publicação, tornando o resultado indistinguível de uma tradução feita do zero. Esses termos fazem diferença na fatura: eles representam tempos de dedicação humana muito diferentes.
Como uma ferramenta de tradução divide um documento?
Segmento
A unidade em que a ferramenta divide o texto, quase sempre uma frase. A memória é armazenada por segmento, as correspondências são pontuadas por segmento e a contagem de palavras é calculada por segmento.
Origem e destino
A origem é o idioma de onde você traduz; o destino, o idioma para o qual você traduz. Juntos, um segmento de origem e seu respectivo segmento de destino formam uma entrada na memória. O total de "palavras de origem" costuma ser a base para a definição de preços, inclusive nos nossos.
Bloco
A unidade do Transept, propositalmente maior que um segmento: um parágrafo, título, item de lista ou célula de tabela. O bloco mantém cada frase junto das demais, para que o modelo perceba que um pronome três frases adiante se refere a algo no início. O controle em nível de frase ainda existe dentro do bloco.
Alinhamento
O processo de emparelhar uma tradução existente com seu texto de origem, segmento por segmento, para que o trabalho realizado antes do uso de uma ferramenta possa ser convertido em memória dentro dela. O alinhamento também é a verificação feita ao importar traduções prontas: se os dois lados não baterem perfeitamente, algo foi adicionado ou deixado de fora.
Quais formatos de arquivo são trocados entre ferramentas?
XLIFF
XML Localization Interchange File Format. O contêiner padrão para transferir conteúdo traduzível entre sistemas: cada unidade traz sua origem, seu destino, um status e, muitas vezes, uma observação para o tradutor. Se um cliente lhe enviar um arquivo bilíngue, provavelmente será um XLIFF. Disponibilizamos um conversor de XLIFF gratuito para leitura em planilhas.
TMX
Translation Memory eXchange. O formato portátil para memórias de tradução, que permite transferir uma memória criada em uma ferramenta para outra. É o TMX que garante que a memória seja um ativo de sua propriedade, e não algo que fica sob o controle do fornecedor.
TBX
TermBase eXchange. Segue a mesma lógica para glossários e bases de termos. É menos difundido que o TMX, já que glossários costumam ser pequenos o suficiente para serem enviados por planilha via e-mail.
PO e gettext
O formato de strings utilizado por grande parte dos softwares de código aberto, pelo WordPress e por projetos em Python e PHP. Um arquivo .po vincula cada string de origem à sua tradução e contém comentários do tradutor; o .pot é o modelo vazio.
SRT e VTT
Formatos de legenda: sincronização e texto, uma entrada por vez. Traduzi-los exige respeitar a velocidade de leitura e o comprimento das linhas, além do sentido, pois uma legenda fiel, mas longa demais, torna-se ilegível na tela.
Arquivos de recursos
Os contêineres específicos de cada plataforma onde um aplicativo armazena suas strings de interface: .strings em plataformas Apple, .resx no .NET, .arb para Flutter e JSON ou YAML simples em quase todo o resto. Traduzir software significa traduzir esses arquivos em vez de documentos, e é por isso que os fluxos de trabalho com tabelas de strings são diferentes dos de documentos.
O que significam os termos de qualidade e processo?
Localidade
Um idioma, uma região e as convenções que os acompanham: ordem de data, separador decimal, moeda, formato de endereço e, às vezes, um sistema de escrita diferente. pt-BR e pt-PT são ambos português, mas não são intercambiáveis em um produto. Optar por uma localidade em vez de apenas um idioma é o que evita que um leitor brasileiro se depare com construções europeias.
i18n e l10n
Numerônimos: a contagem das letras entre a primeira e a última. Internacionalização (i18n) é o trabalho de engenharia para viabilizar a tradução de um produto: nada de texto embutido em imagens, nada de frases montadas a partir de fragmentos e espaço no layout para o alemão. Localização (l10n) é a adaptação para uma localidade específica. A i18n ocorre uma única vez; a l10n, para cada idioma.
Guia de estilo
As regras que não tratam de terminologia: formalidade, tom, como se dirigir ao leitor, convenções de pontuação e citação, e como lidar com números e unidades. Os guias de estilo são o que garantem que a tradução soe como uma só voz, mesmo quando várias pessoas e diversas etapas contribuíram para ela.
LQA (garantia de qualidade linguística)
Revisão estruturada: um revisor avalia uma amostra segundo categorias de erro (precisão, terminologia, estilo, convenções de localidade), atribuindo uma gravidade a cada falha. O resultado é um índice numérico, e não apenas uma impressão, servindo de base para aceitar ou rejeitar entregas e para comparar fornecedores.
Transcriação
Reescrever para causar impacto, em vez de apenas traduzir o sentido. Um slogan com trocadilhos em inglês não funcionará em japonês; por isso, o briefing passa a ser "faça a ideia colar" em vez de "seja fiel ao original". A cobrança é feita por hora ou por conceito, nunca por palavra.
Retrotradução
Traduzir o texto de destino de volta para o idioma de origem, com um tradutor diferente que não tenha visto o original, para verificar se o sentido foi preservado. É a prática padrão em ensaios clínicos e materiais regulamentados, onde erros custam caro. Testa-se o sentido, nunca o estilo.
Perguntas frequentes
Quais destes termos eu realmente preciso conhecer desde o primeiro dia?
Quatro: glossário, memória de tradução, segmento e localidade. Eles descrevem como o trabalho é armazenado e dividido, e bastam para você entender um orçamento. As siglas servem basicamente para a comunicação com fornecedores e ferramentas; você pode consultá-las conforme surgirem.
Posso importar uma memória de tradução de outra ferramenta para o Transept?
Você pode trazer as traduções em si, e a importação é gratuita: não há cobrança por execuções de modelo nem por palavras, pois o trabalho já foi feito. O caminho é a importação de tabelas de strings descrita em Traga suas traduções existentes, ou o carregamento de um documento já traduzido. Atualmente, arquivos .tmx brutos não são importados diretamente. Nosso TMX Cleaner gratuito converte o arquivo para Excel ou CSV no seu navegador (nada é enviado para o servidor), o que costuma ser a forma mais rápida de deixar uma memória antiga pronta para uso.
Glossários e memórias de tradução entram em conflito?
Eles desempenham funções diferentes e são usados em conjunto. O glossário fixa como um termo individual deve ser traduzido; a memória recupera como um segmento inteiro foi resolvido da última vez. Uma ferramenta que utiliza ambos aplica o glossário aos termos e a memória ao texto ao redor, garantindo que as frases recuperadas ainda utilizem a sua terminologia atual.
A pós-edição ainda é necessária com os modelos modernos?
Sim, e o motivo mudou. A tradução automática de antigamente falhava de forma óbvia, o que tornava os erros fáceis de identificar e corrigir. Já os modelos modernos produzem textos fluentes, mas que ainda podem omitir orações, nivelar o registro ou escolher o sentido errado de uma palavra. Editar tornou-se menos uma questão de consertar a gramática e mais de garantir que o sentido e a voz original foram, de fato, preservados.
Qual é a diferença entre tradução e localização?
A tradução foca no texto. A localização é todo o resto que precisa ser adaptado para que um produto funcione em outro mercado: datas e moedas, formatos de nome e endereço, escolha de imagens e cores, avisos legais e os ajustes de layout necessários quando uma frase fica 30% mais longa. Um produto traduzido ainda pode parecer estrangeiro; um localizado, não.
O autor

Cofundadora do Transept. Três diplomas em Língua e Literatura Inglesa — Kyiv, Ostrava e um ano em Salzburg — e uma nativa ucraniana que vive a maior parte de sua vida de escritora em inglês. Entrou na IA como engenheira de prompt, passando depois para marketing de produto e ciclo de vida. Ela escreve histórias semificcionais sobre pessoas reais e continua rondando a questão do que se perde entre os idiomas.