Glosario de traducción y localización: los términos que realmente se utilizan
Memoria de traducción, coincidencia parcial (*fuzzy match*), MTPE, XLIFF, TMX, *leverage*, transcreación. Una definición clara de cada término que encontrará en un presupuesto, en una herramienta TAO o en una conversación con un proveedor, y cómo se relacionan entre sí.

En esta página
La traducción tiene un problema de vocabulario. La mitad de las palabras son siglas, varias significan casi lo mismo y unas cuantas cambian de sentido según quién hable. De pronto le llega un presupuesto que promete un «80 % de leverage con un umbral fuzzy del 85 %» y no resulta nada obvio si eso es una buena noticia.
Este es un glosario práctico: los términos que verá en presupuestos, herramientas TAO o conversaciones con proveedores, definidos en el orden en que suelen aparecer y no por orden alfabético. Cuando un término tenga un significado específico para Transept, se indicará como tal.
¿Cuál es la diferencia entre un glosario, una base terminológica y una memoria de traducción?
Estos tres términos suelen usarse indistintamente al hablar, pero en una herramienta significan cosas distintas.
Glosario
Una lista de términos con sus traducciones aprobadas y notas sobre cuándo se aplica cada una. Nombres de productos, nombres de personajes, vocabulario jurídico o términos en los que el cliente insiste. Un glosario responde a una sola pregunta: cuando aparece este término, ¿en qué debe convertirse?
En Transept, los glosarios se anclan al prompt en cada ejecución y se vuelven a verificar después; así, un término definido en la página 1 se mantiene igual en la página 500.
Base terminológica (TB)
Es el nombre que las herramientas TAO dan a los glosarios; suelen incluir más metadatos por entrada: categoría gramatical, dominio, una lista de variantes prohibidas y, a veces, una definición. Si alguien dice «base terminológica» y usted entiende «glosario», habrá captado perfectamente la idea.
Memoria de traducción (TM)
Un almacén de segmentos ya traducidos —el original emparejado con su traducción— que se reutilizan cuando vuelve a aparecer un texto similar. Un glosario trabaja a nivel de término; la memoria, a nivel de oración completa.
La memoria clásica busca coincidencias de texto. La memoria de traducción de Transept también busca coincidencias por significado y conserva el razonamiento tras cada decisión (las alternativas descartadas, los comentarios de revisión), lo que le permite ser útil incluso en oraciones redactadas de forma distinta pero que resuelven el mismo problema. Hemos detallado qué ha supuesto este cambio.
Coincidencia parcial (fuzzy match)
Una coincidencia en la memoria que se aproxima al original sin ser idéntica, expresada como un porcentaje. El 85 % es un umbral habitual: por encima de este, la traducción guardada se ofrece como punto de partida; por debajo, el segmento se trata como nuevo. Esta cifra describe la similitud textual, no si la traducción anterior era realmente buena.
Coincidencia exacta, 100 % y 101 %
Una coincidencia exacta o del 100 % significa que el segmento original es idéntico a uno que ya existe en la memoria. Una coincidencia del 101 % (también llamada coincidencia exacta en contexto o ICE) significa que el segmento es idéntico y que los segmentos que lo rodean también coinciden; al ser el mismo contexto, es mucho más probable que la traducción guardada siga siendo válida.
Leverage
Es el porcentaje de un nuevo proyecto que la memoria ya cubre. El leverage es lo que mueve el dinero: las agencias aplican descuentos a las palabras con un alto grado de leverage porque una coincidencia del 100 % supone una revisión en lugar de una traducción. Cuando un presupuesto especifica el leverage, le está indicando qué parte del trabajo se espera ahorrar.
¿Qué significan las siglas de la traducción automática?
Traducción automática (MT)
Cualquier traducción automática, independientemente de la tecnología subyacente. Es el término genérico.
Traducción automática neuronal (NMT)
Traducción automática mediante redes neuronales entrenadas específicamente para traducir. Es la generación de motores a la que pertenecen DeepL y Google Translate. La NMT destaca por generar oraciones fluidas, pero no admite instrucciones: no es posible pedirle que use un tono más formal a mitad del texto.
Traducción mediante LLM
Traducción realizada por un modelo de lenguaje de gran tamaño de propósito general. La diferencia práctica respecto a la NMT es que se puede interactuar con el modelo: se le puede proporcionar un glosario, una guía de estilo, el contexto del documento o instrucciones sobre el tono. Transept funciona con los LLM de vanguardia y trata al modelo como un backend intercambiable.
MTPE (posedición de traducción automática)
Consiste en la edición humana del resultado de una máquina hasta convertirlo en una traducción finalizada. A veces se abrevia como PEMT. Es el modelo de trabajo predominante en el sector y el que más han transformado los LLM: la MT antigua era obviamente tosca y los errores se delataban por sí solos, mientras que el resultado de un LLM puede leerse de maravilla y, aun así, haber omitido una cláusula.
Nuestra guía de MTPE explica cómo implementarla para que el criterio humano intervenga antes del borrador y no después.
Posedición ligera y completa
Existen dos niveles de servicio. La posedición ligera busca precisión y claridad, y tolera una redacción algo plana. La posedición completa aspira a una calidad apta para publicación, indistinguible de una traducción hecha desde cero. Estos términos importan en una factura: marcan la diferencia entre dos niveles de dedicación humana muy distintos.
¿Cómo divide un documento una herramienta de traducción?
Segmento
La unidad en la que una herramienta divide el texto, casi siempre una oración. La memoria se almacena por segmento, las coincidencias se puntúan por segmento y el recuento de palabras se calcula por segmento.
Origen y destino
El origen es el idioma del que se traduce; el destino, aquel al que se traduce. Un segmento de origen y su segmento de destino conforman una entrada en la memoria. Las «palabras de origen» suelen ser la base para fijar los precios, incluidos los nuestros.
Bloque
La unidad de Transept, deliberadamente más amplia que un segmento: un párrafo, un encabezado, un elemento de lista o una celda de tabla. El bloque mantiene cada oración junto a aquellas con las que guarda relación; de este modo, el modelo puede identificar que un pronombre tres frases más abajo se refiere a algo mencionado al principio. El control a nivel de oración se mantiene incluso dentro del bloque.
Alineación
Consiste en vincular una traducción existente con su original, segmento a segmento, para que el trabajo realizado antes de adoptar una herramienta pueda integrarse en su memoria. La alineación es también el proceso de verificación que se realiza al importar traducciones terminadas: si ambas partes no coinciden exactamente, significa que se ha añadido o se ha omitido algo.
¿Qué formatos de archivo se intercambian entre herramientas?
XLIFF
XML Localization Interchange File Format. Es el contenedor estándar para transferir contenido traducible entre sistemas: cada unidad incluye su origen, su destino, un estado y, a menudo, una nota para el traductor. Si un cliente le envía un archivo bilingüe, lo más probable es que sea un XLIFF. Ofrecemos un conversor de XLIFF gratuito para poder leerlo en una hoja de cálculo.
TMX
Translation Memory eXchange. Es el formato portátil de las memorias de traducción que permite moverlas de una herramienta a otra. Gracias al TMX, la memoria es un activo de su propiedad y no algo que queda en manos de un proveedor.
TBX
TermBase eXchange. El mismo concepto aplicado a glosarios y bases terminológicas. Se utiliza menos que el TMX, ya que un glosario es lo bastante pequeño como para enviarse simplemente por correo en una hoja de cálculo.
PO y gettext
Es el formato de cadenas que utiliza gran parte del software de código abierto, WordPress y los proyectos de Python y PHP. Un archivo .po vincula cada cadena de origen con su traducción e incluye comentarios para el traductor; el .pot es la plantilla vacía.
SRT y VTT
Formatos de subtítulos: marcas de tiempo y texto, entrada por entrada. Traducirlos exige respetar la velocidad de lectura y la longitud de las líneas tanto como el sentido, ya que un subtítulo fiel pero demasiado extenso resulta ilegible en pantalla.
Archivos de recursos
Los contenedores específicos de cada plataforma donde una aplicación guarda las cadenas de su interfaz: .strings en plataformas de Apple, .resx en .NET, .arb para Flutter y archivos JSON o YAML convencionales en casi todo lo demás. Traducir software implica traducir estos archivos en lugar de documentos; por eso los flujos de trabajo con tablas de cadenas son distintos a los de los documentos.
¿Qué significan los términos sobre calidad y procesos?
Configuración regional (locale)
Es la combinación de un idioma, una región y las convenciones asociadas: el orden de las fechas, el separador decimal, la moneda, el formato de las direcciones y, en ocasiones, un sistema de escritura distinto. Tanto el pt-BR como el pt-PT son portugués, pero no son intercambiables en un producto. Seleccionar una configuración regional en lugar de simplemente un idioma es lo que evita que un lector brasileño se encuentre con giros lingüísticos europeos.
i18n y l10n
Son numerónimos que cuentan las letras entre la primera y la última. La internacionalización (i18n) es la labor de ingeniería necesaria para que un producto sea siquiera traducible: evitar el texto incrustado en imágenes, no formar oraciones a partir de fragmentos y dejar espacio en el diseño para el alemán. La localización (l10n) consiste en adaptarlo a una configuración regional. La i18n se hace una sola vez; la l10n se realiza para cada idioma.
Guía de estilo
Son las normas ajenas a la terminología: el nivel de formalidad, el tono, la forma de dirigirse al lector, las convenciones de puntuación y de comillas, y el tratamiento de números y unidades. Las guías de estilo son las que consiguen que una traducción mantenga una voz coherente, incluso cuando han intervenido diversas personas y se ha realizado en varias etapas.
LQA (control de calidad lingüística)
Es una revisión estructurada: un revisor califica una muestra basándose en categorías de error (precisión, terminología, estilo y convenciones regionales) y asigna un nivel de gravedad a cada fallo, lo que genera una puntuación numérica en lugar de una valoración subjetiva. Se utiliza para aceptar o rechazar entregas y para comparar proveedores.
Transcreación
Consiste en reescribir para lograr un efecto en lugar de traducir el significado. Un eslogan con un juego de palabras en inglés no funcionará en japonés, por lo que el encargo pasa a ser «haz que esto cale» en lugar de «haz que sea exacto». Se presupuesta por horas o por concepto, nunca por palabra.
Retrotraducción
Consiste en traducir el texto de destino de vuelta al idioma de origen mediante un traductor distinto que no haya visto el original, con el fin de verificar que el significado se ha preservado. Es la práctica habitual en ensayos clínicos y materiales regulados, donde un error puede salir muy caro. Evalúa el significado, nunca el estilo.
Preguntas frecuentes
¿Cuáles de estos términos necesito realmente desde el primer día?
Cuatro: glosario, memoria de traducción, segmento y configuración regional (locale). Estos términos describen cómo se almacena y se divide el trabajo; con ellos basta para entender un presupuesto. Las siglas son básicamente vocabulario para comunicarse con proveedores y herramientas; puede consultarlas a medida que aparezcan.
¿Puedo importar una memoria de traducción de otra herramienta a Transept?
Puede importar las traducciones en sí y su carga es gratuita: no se facturan palabras ni ejecuciones del modelo, puesto que el trabajo ya está hecho. El procedimiento consiste en utilizar la importación de tablas de cadenas descrita en Importar traducciones existentes o en cargar un documento que ya esté traducido. Actualmente, no es posible procesar directamente archivos .tmx en bruto. Nuestra herramienta gratuita TMX Cleaner los convierte a Excel o CSV desde el navegador (sin subir nada), lo que suele ser la forma más rápida de adaptar una memoria antigua a un formato con el que pueda trabajar.
¿Entran en conflicto los glosarios y la memoria de traducción?
Cumplen funciones distintas y se utilizan de forma conjunta. El glosario fija cómo debe traducirse un término concreto; la memoria recuerda cómo se resolvió un segmento completo la última vez. Las herramientas que emplean ambos recursos aplican el glosario a los términos y la memoria a la redacción que los rodea, de modo que las oraciones recuperadas siempre incorporan la terminología actual.
¿Sigue siendo necesaria la posedición con los modelos actuales?
Sí, pero el motivo ha cambiado. Antes, la traducción automática fallaba de forma evidente, por lo que los errores eran fáciles de detectar y corregir. Un modelo actual genera un texto fluido que, aun así, puede omitir una cláusula, aplanar el registro o elegir el sentido incorrecto de una palabra. La edición ya no consiste tanto en reparar la gramática, sino en comprobar que el significado y la voz realmente se hayan preservado.
¿Cuál es la diferencia entre traducción y localización?
La traducción es el texto. La localización es todo lo demás que debe cambiar para que un producto funcione en otro mercado: fechas y monedas, formatos de nombre y dirección, la elección de imágenes y colores, los avisos legales y los ajustes de diseño necesarios cuando una misma oración se alarga un 30 %. Un producto traducido puede seguir resultando ajeno; uno localizado, no.
El autor

Cofundadora de Transept. Tres títulos en Lengua y Literatura Inglesa —Kyiv, Ostrava y un año en Salzburg— y nativa ucraniana que vive la mayor parte de su vida literaria en inglés. Llegó a la IA como ingeniera de prompts, y luego pasó al marketing de producto y ciclo de vida. Escribe historias de semificción sobre personas reales y sigue dándole vueltas a la pregunta de qué se pierde entre los idiomas.