Transept
Безкоштовний інструмент

Очистьте та конвертуйте свій TMX-файл

Упорядковуйте пам'ять перекладів без повноцінної CAT-програми: видаляйте дублікати й порожні записи, очищуйте файл від пошкоджених тегів або переносьте весь TMX у таблицю для перевірки. Безкоштовно, без реєстрації, обробка прямо у вашому браузері.

Ваші файли ніколи не залишають браузера.

Покрокова інструкція

Як очистити TMX-файл

Усього чотири кроки, і файл ніколи не залишає вашого браузера.

  1. Завантажте свій TMX

    Перетягніть .tmx-файл у вікно інструмента. Він відкриється прямо у браузері, і жодні дані не надсилатимуться на сервер.

  2. Перегляньте вміст пам'яті

    Ви побачите мовну пару, кількість сегментів у пам'яті, скільки з них є дублікатами та скільки все ще містять теги форматування.

  3. Виберіть, що видалити

    Позначте дублікати та порожні записи, які потрібно видалити. Ви також можете прибрати теги форматування, щоб залишити чистий текст. Біля кожної опції вказано кількість записів, яких це торкнеться.

  4. Завантажте очищений файл

    Завантажте очищений TMX із застосованими налаштуваннями або експортуйте пам'ять в Excel чи CSV, щоб відредагувати записи та згодом відновити TMX-файл.

Що таке TMX-файл?

TMX (Translation Memory eXchange) — це стандартний формат для обміну пам'яттю перекладів між різними програмами. Пам'ять перекладів зберігає кожне речення разом із його перекладом, що дозволяє CAT-програмам, як-от Trados, MemoQ або OmegaT, повторно використовувати ваші напрацювання в нових проєктах. Саме завдяки TMX пам'ять переноситься з одного інструмента до іншого.

За роки роботи в пам'яті накопичується чимало зайвого: дублікати сегментів, записи без перекладу та пошкоджені теги форматування, що залишилися після імпорту. Це «сміття» збільшує розмір файлу та псує якість збігів під час повторного використання пам'яті. Наш інструмент видаляє ці дані, а якщо вам зручніше працювати в таблицях — перетворює пам'ять на редаговану сітку, яку можна перекласти та знову зібрати у файл.

FAQ

  • Очищення видаляє записи, що роздувають файл і знижують надійність пам'яті: точні дублікати сегментів, записи без оригіналу чи перекладу та пошкоджені теги форматування. У результаті ви отримуєте компактніший TMX, який забезпечує якісніші збіги під час повторного використання.
  • Сегмент вважається дублікатом, якщо і його оригінал, і переклад повністю збігаються з попереднім записом. Перший такий сегмент зберігається, а наступні копії видаляються. Якщо ви також вирішите прибрати теги форматування, записи, що відрізнялися лише тегами, зливаються в один.
  • Видалення тегів — це додаткова опція, яка за замовчуванням вимкнена. Якщо її активувати, внутрішньотекстові теги (як-от bpt та ph) будуть видалені, а текст усередині них залишиться. Це саме те, що потрібно для створення глосарія у форматі простого тексту або «чистого» повторного імпорту. Якщо ці теги потрібні для вашої роботи, залиште цю опцію непозначеною.
  • Ні. Інструмент повністю працює у браузері, тому ваша пам'ять перекладів ніколи не залишає пристрою, а дані не зберігаються на сервері.
  • Він підтримує стандарт TMX 1.4, експортований із таких програм, як Trados, MemoQ, OmegaT, Wordfast та Smartcat, зокрема й багатомовні бази. Найкраще він працює з двомовними файлами — це найпоширеніший випадок.
  • Так. Експортуйте пам'ять у таблицю Excel або CSV, де кожному сегменту відповідає один рядок: ID, оригінал, переклад і примітки. Усі вибрані параметри очищення також будуть застосовані до таблиці.
  • Експортуйте дані в таблицю, відредагуйте колонку з перекладом в Excel або будь-якому іншому редакторі, а потім перейдіть на вкладку «З таблиці в TMX». Додайте оригінальний файл і відредаговану таблицю та завантажте новий TMX-файл із внесеними змінами. Оригінал слугує шаблоном, тому все інше залишиться незмінним.

Бажаєте створити пам'ять перекладів, якій можна довіряти?

Transept — це редактор перекладів із пам'яттю, яка фіксує кожне ваше рішення. Завдяки цьому термінологія та стиль залишаються однаковими в усіх проєктах без необхідності подальшого очищення бази.