TMXファイルをクリーンアップ&変換
本格的なCATツールがなくても、翻訳メモリを整理できます。重複や空のエントリの削除、破損したフォーマットタグの除去のほか、TMX全体をスプレッドシートに書き出して確認することもできます。無料・登録不要で、処理はすべてブラウザー内で完結します。
ファイルがブラウザー外へ送信されることはありません。
TMXファイルをクリーンアップする方法
わずか4ステップ。ファイルがブラウザー外へ送信されることはありません。
TMXをアップロード
ツールに.tmxファイルをドロップします。ファイルはブラウザー内で読み込まれ、サーバーには送信されません。
メモリの内容を確認
言語ペア、総セグメント数、重複セグメント数、フォーマットタグを含むセグメント数を確認できます。
削除する項目を選択
重複、空のエントリ、またはその両方を削除するかを選択します。フォーマットタグを除去してプレーンテキストにすることもできます。各オプションには対象となるエントリ数が表示されます。
クリーンアップしたファイルをダウンロード
設定を適用したクリーンなTMXをダウンロードするか、メモリをExcelやCSVにエクスポートしてエントリを編集し、後からTMXを再構築できます。
TMXファイルとは?
TMX(Translation Memory eXchange)は、ツール間で翻訳メモリを受け渡すための標準形式です。翻訳メモリには過去に翻訳した文と訳文がペアで保存されており、Trados、MemoQ、OmegaTなどのCATツールで新しいプロジェクトにその翻訳を再利用できます。
長年使っている翻訳メモリには、二重に保存された同一セグメント、訳文のないエントリ、インポート時に残った破損インラインタグなど、不要なデータが蓄積していきます。そうした不要データはファイルサイズを肥大化させ、メモリ再利用時の一致精度を低下させます。本ツールはこれらを除去できるほか、スプレッドシートで作業したい場合は表形式でエクスポートして編集し、TMXとして再構築することもできます。
FAQ
- ファイルサイズを肥大化させ信頼性を下げる原因となる、完全重複セグメント、原文または訳文のないエントリ、破損したフォーマットタグを除去します。これによりTMXが軽量化され、再利用時の一致精度が向上します。
- 原文と訳文の両方が先行するエントリと完全に一致するセグメントが重複とみなされます。最初のエントリのみが保持され、それ以降の重複は削除されます。フォーマットタグの除去を有効にした場合、タグの違いしかなかったエントリも1つに統合されます。
- タグの除去は任意で、初期設定ではオフになっています。オンにすると、bptやphなどのインラインタグが除去され、タグで囲まれていた語句はそのまま残ります。プレーンテキストの用語集を作成したい場合や、クリーンな状態で再インポートしたい場合に便利です。ワークフローでタグが必要な場合は、チェックを入れないでください。
- いいえ、ありません。ツールはすべてブラウザー内で動作するため、翻訳メモリがお使いのデバイス外へ送信されることはなく、サーバーに保存されることもありません。
- Trados、MemoQ、OmegaT、Wordfast、Smartcatなどのツールからエクスポートされた標準的なTMX 1.4を読み込めます。多言語メモリにも対応していますが、2言語のメモリが最も一般的であり、最適に動作します。
- はい、変換できます。ID、原文、訳文、メモがセグメントごとに1行ずつ配置されたExcelまたはCSVシートにメモリをエクスポートできます。選択したクリーンアップ設定はスプレッドシートにも適用されます。
- メモリをスプレッドシートにエクスポートし、Excelなどのエディターで訳文列を編集します。その後「スプレッドシートからTMXへ」に切り替え、元のファイルと編集したシートを追加すると、変更内容が反映された新しいTMXをダウンロードできます。元のファイルに直接書き込むため、それ以外のデータは変更されずにそのまま保持されます。
信頼できる翻訳メモリを構築しませんか?
Transeptは翻訳メモリを備えた翻訳エディターです。すべての判断を記憶して再利用するため、後からクリーンアップしなくても、プロジェクトをまたいで用語や言い回しの一貫性を保てます。