ヘルプセンターを見る

翻訳メモリ

管理担当:Vitalii Vlasiuk共同創業者

翻訳メモリは、翻訳済みのセグメントを記録し、同じ文を2度翻訳する手間を省きます。

また、過去の訳文が参考情報としてモデルへと渡されるため、AIが新しい言い回しを作り出すことなく、これまでに定着した表現を再利用します。

目次

翻訳メモリにはどのように蓄積されますか?

初期設定は不要です。個人で作業した場合もチームで作業した場合も、訳文を承認した(有効なバージョンとなった)ブロックは、すべて自動的に翻訳メモリへと追加されます。

インポートした翻訳メモリも同様に活用できます。TMXまたはXLIFFファイルを取り込めば、そのセグメントはその日からすぐに検索できます。

選択したブロックの一致結果。最上位の一致では、1が原文の行、2が過去の訳文、3が参照元ドキュメントを示しています。

翻訳メモリの一致はどこで確認できますか?

エディターのサイドバーでメモリパネルを開くと、選択中のブロックが自動的に検索されます。テキストの一致だけでなく意味の一致も検出され、完全一致やあいまい一致(ファジーマッチ)にセマンティック検索を組み合わせることで、新しい文の言い回しが異なっていても過去の訳文が表示されます。

各結果には原文、過去の訳文、一致率(テキストの類似度)が表示されます。結果の精度を高めるを使うと、AIが結果を関連度順に並べ替えます。訳文をコピーしたり、ブロックにそのまま挿入したりできます。

訳文以外も検索できるモードが4つあります。

  • ブロック:過去の作業で承認された原文と訳文のペア。
  • コメント:未解決または解決済みとしてタグ付けされた過去のディスカッションスレッド。
  • チャット:コラボレーションチャットやアシスタントとの会話。
  • ドキュメント:類似する作業がどこにあるかを見つけるため、ドキュメント全体を関連度順にランク付けします。

AIは翻訳メモリをどのように活用しますか?

翻訳、校正、「ブロックを検索」の実行時に、一致した訳文が参考情報としてモデルへ渡されます。これにより、機械翻訳が毎回推測で新しい言い回しを作るのではなく、定着した表現を一貫して再利用します。

用語集が個々の「用語」の一貫性を保つのに対し、翻訳メモリは「文」全体の一貫性を保ちます。しかもそれをAIの出力の中で実現します。

エディター内では、メモリがデフォルトでオンになっています。TMをスキップ(ブロックツールバーのメモリボタン、または一括処理ダイアログ内)を押さない限り、毎回の実行でメモリが活用されます。

Fastモードは例外で、メモリを使うにはStandardモードかProモードが必要です。

一括処理の実行とワークフローステップは、それぞれ設定された翻訳メモリ設定に従います。デフォルト設定は以下で指定してください。

翻訳にどのメモリが使用されたか確認するには?

プロンプトにメモリの一致を含めて翻訳が生成された場合、ブロックのヘッダーに件数付きの小さなメモリチップが表示されます。これを押すと、AIに渡された情報(一致率付きの過去の表現、参照元ドキュメント、そのセグメントに対して以前に却下された表現、背景にあるレビュアーのディスカッション)を確認できます。これにより、その表現が採用された理由がわかります。

各項目には2つのラベルのいずれかが付きます。再利用は、出力がその過去の表現を明確に取り入れたことを示します。参照は、モデルに参考情報として提示されたものの、出力ではその表現が再利用されなかったことを示します。

選択中のブロックについては、同じ一覧がこの翻訳に使用として「メモリ」パネルの上部にも固定表示されます。

チップが表示されない場合、そのバージョンはメモリなしで生成されています。実行時にメモリがオフになっていた、使用したモードがメモリを使わない、一致がなかった、のいずれかです。

本機能が導入される前に翻訳されたバージョンにも、チップは表示されません。

翻訳メモリを検索するには?

これらの操作を実行する場所(ブロックツールバーのメモリボタン、一括処理ダイアログ、各ワークフローステップ)では、設定項目が2つのグループに分かれています。

エディター内では、「メモリ」パネルの折りたたみ可能な検索とフィルターセクションに配置されています。一致結果の表示スペースを確保するためデフォルトでは閉じていますが、検索で返す結果を変えたいときに開いてください。

検索では、どの一致結果を返すかを決めます。対象範囲は、デフォルトでは現在のドキュメントの翻訳元の言語 → 翻訳先の言語のペアで、アクセスできるすべてを検索します。対象をプロジェクト、チーム、このドキュメントのみに絞り込むこともできます。最後のオプションでは、そのドキュメント自体の承認済みセグメントだけが呼び出されるため、アプリのUI文字列のようなコーパスを他の作業と切り離しておけます。範囲のほかに、このドキュメントを除外、検索対象を広げる他の言語ペアを含める、上位の一致を関連度順に並べ直すAIで並び替えもあります。

AIコンテキストでは、一致結果と一緒にモデルへ渡す内容を決めます。ディスカッションを含める(過去のコメントスレッドを一致として含めます)、別の候補を含める(セグメントの以前の候補を最大2件含めます)、コンテキスト(各一致の前後のブロックをプロンプトに添付し、その表現がどう使われたかをモデルに見せます)の3つです。

翻訳メモリは、Freeプランを含むすべてのプランで無料です。メモリの蓄積や再利用でクレジットが消費されることはありません。クレジットが消費されるのは、AIがテキストを処理するときだけです。

翻訳メモリのデフォルト設定を変更するには?

ライブラリメニューの翻訳メモリページ(エディターの「メモリ」パネルにある翻訳メモリ設定を管理リンクからも開けます)で、ドキュメント独自の上書き設定がない限りすべてのドキュメントに継承されるデフォルト値を設定できます。

設定できるのは、エディターでメモリを最初からオンにするかどうか、上記の検索とAIコンテキストの各オプション、検索結果の表示対象です。

最後の設定項目では、検索対象とするドキュメントのステータスや、除外するプロジェクトを指定します。デフォルトでは承認済みの作業(納品済み、または支払い済み)のみが検索対象となりますが、対象範囲を広げることもできます。

ここには結果に関する設定がもう1つあります。デフォルトでオンになっているステータス未設定のドキュメントを含めるです。ステータスフィルターは許可したステータスだけを通すため、ステータスが未設定のドキュメント(ステータスを持たない一括インポートやAPIインポートのコンテンツが大半です)は本来除外されます。このスイッチがオンなら、それらのドキュメントもメモリに残ります。ステータス管理されている作業のみにメモリを厳密に限定したい場合は、これをオフにしてください。

  • デフォルト設定はドキュメント単位で上書きできます。エディターの「メモリ」パネルで設定した変更内容は、そのドキュメントに直接適用されます。
  • 各ワークフローステップにはメモリ設定があり、ドキュメントのデフォルト設定を使用オプションを選ぶと、ドキュメント(またはそのチーム)に適用される設定が継承されます。

チームで翻訳メモリポリシーを強制適用するには?

チームのオーナーは、チームの翻訳メモリポリシーを設定し、強制適用できます。

チーム所有のドキュメントでは、メンバーに許可される操作がメモリのオン/オフの切り替えのみになり、検索やAIコンテキストの設定、検索結果フィルターにはチームポリシーが適用されます。個人用ドキュメントには、常にご自分で設定したデフォルト設定が適用されます。

ドキュメントのオーナーは、特定のドキュメントに対してこのポリシーを上書きできます(詳細は後述)。

特定のドキュメントに対して強制適用されたポリシーを上書きできますか?

はい、そのドキュメントのオーナーであればできます。チームポリシーが強制適用されている場合でも、ドキュメントの管理者(チーム所有ドキュメントの場合はチームオーナー、個人用ドキュメントの場合はご自身)であれば、「メモリ」パネルから該当するドキュメントの検索とAIコンテキストの設定を変更できます。

この変更はドキュメント単位の上書きとなり、該当するドキュメントに限り強制ポリシーより優先されます。そのため、チームの他のドキュメントにはチームポリシーを適用したまま、特定のドキュメントだけをこのドキュメントのみに切り替えられます。

他のメンバーにはこれらの設定項目が読み取り専用で表示され、メモリのオン/オフの切り替えだけができます。詳しくは役割と権限をご覧ください。

「メモリ」パネルに一致する項目が表示されないのはなぜですか?

「メモリ」パネルに何も表示されない場合、通常は3つの原因のいずれかが考えられます。

ドキュメントのステータスフィルター(最も一般的な原因)。デフォルトでは、完了した作業、つまり納品済みまたは支払い済みとマークしたドキュメントのみが翻訳メモリの対象となります。それ以前のステータス(見積済み、進行中、レビュー中)にとどまっている作業は除外されます。

なお、ステータスが一切設定されていないドキュメント(一括インポートやAPIインポートによるコンテンツ、またはボードに追加していない作業)は、ステータス未設定のドキュメントを含めるがデフォルトで有効になっているため対象に含まれます。

対処するには、エディターヘッダーのステータスチップまたはダッシュボードの⋯メニューからドキュメントのステータスを設定します。**また、翻訳メモリ設定ページの検索結果の表示対象で対象とするステータスを広げたり、ステータス未設定のドキュメントを含める**をオフにしてステータス管理されている作業のみにメモリを限定したりすることもできます。

インポートしたコンテンツについては、既存の翻訳を取り込むをご覧ください。

言語ペア。パネルは現在のドキュメントの翻訳元の言語 → 翻訳先の言語ペアを検索するため、この言語からこの言語へ翻訳した過去の作業データがない場合、一致する項目は見つかりません。ドキュメントの言語設定が正しいことを確認し、他の言語ペアを横断して検索するにはパネル内の他の言語ペアを含めるをオンにしてください。

インポート直後の翻訳メモリ。インポートしたばかりのTMXやXLIFFは、テキスト検索ならすぐに利用できますが、意味に基づく一致のインデックスはバックグラウンドで構築されます。少し時間を置いてからもう一度検索してください。インデックスの作成が完了すると、検索語とは言い回しが異なるセグメントも表示されるようになります。

よくある質問✦

TradosやmemoQへ翻訳メモリをエクスポートできますか?

はい、できます。ドキュメントのエクスポートメニューにある翻訳データから、TranseptはTMX(原文と訳文のセグメントペアを収めたメモリ)、XLIFF(対訳形式の作業ファイル)、CSV(原文の列と翻訳先の言語ごとに1列)形式で書き出せます。

これらはTrados、memoQ、Phraseなどのツールに対応した標準的な交換形式です。複数言語のドキュメントの場合、いずれの形式でもすべての言語が1つのファイルにまとめてエクスポートされます。詳細はエクスポートをご覧ください。

AIは各ブロックに対して翻訳メモリの一致結果を何件取得しますか?

使用するモードによって異なります。Standardモードでは1ブロックにつき最大5件、Proモードでは最大10件の一致結果が渡されます。ブロックを検索ステップでは、どのモードでも最大20件まで使えます。

Fastモードは翻訳メモリをまったく使いません。そのため、実行に翻訳メモリが反映されない場合は、まずモードをご確認ください。

ブロックに対して一致率が30%以上のものだけが対象になります。フィクション作品などでそこまで近いものがない場合でも、最も近い2つのテキストが関連コンテキストとして組み込まれます。このとき、メモリチップには一致率なしで一覧表示されます。

同じTMXファイルを再度インポートすると、翻訳メモリが重複しますか?

いいえ、重複しません。一度取り込んだファイルを再度インポートしても、すでに存在する対訳ペアは二重に追加されずスキップされます。

エディターの「メモリ」パネルにあるインポートボタンからTMXまたはXLIFFをインポートします。対訳ペアはすぐにテキスト検索できるようになり、意味に基づくインデックスもバックグラウンドで間もなく構築が完了します。

Literessがアクセスできるドキュメントは、翻訳メモリ設定で許可されたものだけですか?

いいえ。Literessによるドキュメントや過去のチャットの検索は、アクセス権を持つすべてのデータを対象とします。翻訳メモリの検索範囲、フィルター、ステータスルールによって制限されることはありません。

それらの設定は、「メモリ」パネルに表示される結果と、モデルに参考情報として渡される内容を決めるものです。

機能を見る✦

解決しない場合は、アプリ内のLiteressに質問するか、[email protected]までご連絡ください。