TXT翻訳ツール
プレーンテキストには保護すべきマークアップや従うべきスキーマがないため、最も簡単に翻訳でき、静かに台無しにされやすいものです。原稿、メモ、成績証明書、またはエクスポートをアップロードし、文字エンコーディング、改行、インデントをそのままにして返却します。
翻訳するドキュメントをアップロードまたはドロップしてください
最大ファイルサイズ 1 GB
拡張機能はほとんど何も約束しない
他のすべてのドキュメント形式には、それ自体の説明が含まれています。ワードプロセッサのドキュメントはフォント名を指定し、文字セットを宣言します。マークアップのページは、各部分が何であるかを伝えるタグでコンテンツをラップします。プレーンテキストはそれらのいずれも宣言しません。それはバイトの連続であり、誰かがそれらを文字として読み取るという合意がありますが、その合意全体は書かれていません。
したがって、3つのことが読み取るのではなく、把握する必要があります。バイトがどの文字エンコーディングに属するか、作者が改行に使用したシーケンス、そして改行が意味があるのか、それとも単に誰かのエディタウィンドウの幅によるものなのか。ソフトウェアは、そのようなドキュメントを開くたびにこれら3つすべてを推測し、通常は正しく機能しますが、それが失敗が驚くべき理由です。
利点は本物です。スタイルを保持する必要はなく、レイアウトエンジンと戦う必要もなく、埋め込みオブジェクトを失うこともありません。エンコーディングと行構造が維持されれば、すべてが維持されます。このページの残りは、それら2つのことについてです。
人々が実際にプレーンテキストで保持しているもの
拡張機能は、まったくプロフェッショナルではないものに添付され、それぞれに異なる種類の注意が必要です。あなたが何を持っているかを知ることで、作業に1分かかるか、準備が必要かが決まります。
- 連続した散文。 原稿、メモ、記事の下書き、インタビューのトランスクリプト、スクレイピングされた記事本文。これは簡単なケースであり、注意すべきことは、段落が空行で区切られているか、まったく区切られていないかだけです。
- 字幕とキャプション。 番号付きのキュー、タイミング行、および1〜2行のダイアログ。タイミングは座標であり、正確に再現する必要があります。一方、ダイアログ行は、速度で読み取れるように十分に短く保つ必要があります。これは、翻訳された行が元の行よりも長くなることが多いため重要です。
- 設定とプロパティリスト。 各行にキー、セパレーター、値があります。左側のキーはソフトウェアが名前で検索する識別子です。それをタッチすると、設定が無効になります。右側の値のみ、そしてその値がパスやスイッチではなくメッセージである場合にのみ、言語です。
- ログとマシンの出力。 タイムスタンプ、重大度ワード、識別子、スタックトレース。重大度ワードを翻訳すると、それをgrepするフィルターが壊れ、スタックトレースはどの言語でもプロフェッショナルではありません。
- 偽装された表形式のエクスポート。 タブで区切られた値が、間違った拡張子で保存されています。コンテンツが実際にグリッドである場合は、代わりにCSV翻訳を使用してください。これはレコードと列を理解します。
- 読み取り専用メモとライセンステキスト。 大文字で偽装された見出しとダッシュ行、番号付きの句、ハードラップされた段落。偽装された構造が壊れる部分です。
結果を決定する3つの不可視のプロパティ
これらのいずれも、画面上でコンテンツを見るときには表示されず、それぞれが良い翻訳を使い物にならないものに変える可能性があります。
バイトが属するエンコーディング
Unicodeがデフォルトになる前は、各言語地域には独自のシングルバイトまたはマルチバイトスキームがありました。キリル文字用、西ヨーロッパのアクセント用、ギリシャ語用、日本語用、簡体字および繁体字中国語用、韓国語用など、それぞれ別々でした。これらのスキームで書かれたドキュメントはまだ流通していますが、どれが適用されるかを示すものは何もありません。間違った仮定で開くと、アクセント付きの文字は無意味な文字列に変わり、プレーンな文字は問題なく表示されるため、一見しただけでは損傷を見逃しやすいです。エンコーディングを明示的に選択できるエディタで確認し、アクセント付き文字とラテン文字以外の文字が正しく読めるまで再オープンしてください。
行の終わり方
Windowsツールは行を2つの制御文字で終了し、Unixから派生したものはすべて1つを使用し、非常に古いMacintoshドキュメントはそれ自体で別のものを使用しました。ほとんどの最新のエディタは3つすべてを受け入れますが、多くの処理スクリプトはそうではなく、1つのドキュメント内で規約を混在させると、各行の末尾に余分なマークが表示されたり、単一の連続した段落として表示されるドキュメントになったりします。1つの規約を全体にわたって維持し、結果を消費するシステムが期待するものに優先してください。
改行が意味を持つかどうか
固定幅で手動で折り返されたテキストは、各行の終わりに改行があり、その改行は書き込みの一部ではなく、幅の人工物です。段落は通常、ブロック間の空行でマークされます。折り返された各行を単位として扱うと、文が断片に分割され、文脈から外れて翻訳されるため、どの言語でも読みにくくなります。段落を単位として保持することが正しく、出力が元のものとは異なる点で再折り返しされることを意味します。これは欠陥ではなく、予期されることです。
スペースで揃えられたものはすべて、揃えられずに表示されます
列がずれる理由
スタイル設定なしで、何かを揃える唯一の方法は文字数を数えることです。パイプとダッシュで描かれた表、等号の行で下線が引かれた見出し、スペースで埋められた元帳、インデントされたアウトライン、線画文字で作成されたボックスはすべて、各エントリが以前と同じ幅を占めることに依存しています。
翻訳により、ほぼすべてのものの幅が変わります。ドイツ語とロシア語は通常、英語よりも5分の1から3分の1長くなります。中国語と日本語は文字数が少なくなりますが、固定幅表示では各文字が2列を占めます。どちらの場合も配置が移動します。手描きの表は後で再パディングする必要があることを想定し、コンテンツが代わりに実際の表計算ソフトを必要とするかどうかを検討してください。
先頭の空白はコンテンツです
設定ドキュメント、コードスニペット、アウトラインでは、行頭のスペースが意味を持ちます。ネストを示したり、ブロックをリテラルとしてマークしたりします。タブとスペースの連続は画面上では同じように見え、異なるバイトであるため、一方を他方に正規化するツールは、表示されずにドキュメントを変更します。
同じことが、バックスラッシュと文字で書かれた小さなエスケープシーケンスにも当てはまります。これは、設定エントリの単一行内の改行またはタブを表します。これらは2つの通常の文字であり、後でプログラムが解釈するため、反対側で変更されずに到着する必要があります。
プレーンテキストジョブのコスト
ドキュメント内の単語数に基づいて課金されるため、メッセージが少ない長いログでも、サイズから示唆されるよりもはるかに安価になります。
Free
登録にカードは不要です
- $0.005/単語 AI翻訳
- スキャンおよび画像PDFは1ページあたり1ドル
- 120以上の言語
- 最大20MB、20ページまでのファイル
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG、CSV
- 24時間ファイルストレージのみ
- PDFエディターおよびPDFからDOCXへのコンバーター
- いつでもキャンセル可能
- 含まれていません: メールサポート
- 含まれていません: チームアクセス
- 含まれていません: 無制限の無料PDFプレビュー
- 含まれていません: 用語集
Storage
または年間149ドル
- $0.005/単語 AI翻訳
- スキャンおよび画像PDFは1ページあたり1ドル
- 120以上の言語
- 最大100MB、100ページまでのファイル
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG、CSV
- 無制限のファイルストレージ
- PDFエディターおよびPDFからDOCXへのコンバーター
- メールサポート
- いつでもキャンセル可能
- 含まれていません: チームアクセス
- 含まれていません: 無制限の無料PDFプレビュー
- 含まれていません: 用語集
Pro
または年間499ドル
- AI翻訳は1ワードあたり0.004ドル
- スキャンおよび画像PDFは1ページあたり0.80ドル
- 120以上の言語
- 最大1,000MB、5,000ページまでのファイル
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG、CSV
- 無制限のファイルストレージ
- PDFエディターおよびPDFからDOCXへのコンバーター
- メールサポート
- 最大5名までのチームアクセス
- 無制限の無料PDFプレビュー
- 用語集
- いつでもキャンセル可能
エンタープライズ
月額149.99ドル(リクエストに応じて)。AI翻訳は1ワードあたり0.003ドル(1ページあたり0.60ドル)、ファイルは最大1,000MB、5,000ページ、無制限のファイルストレージ、最大15名までのチームアクセス。
サンプルドキュメント、並べて表示
サムネイルをクリックすると全画面表示が開きます。ペアを横に読むと、次のようになります。
- 段落の区切りと空行の間隔は、以前と同じ場所に配置されます。
- アクセント付き文字と非ラテン文字は、記号に劣化するのではなく、レンダリングされます。
- インデントと番号付きシーケンスは、ネストを維持します。
- 結果は、テキストの画像ではなく、編集可能なテキストとして開かれます。




各ペアは、後で手動で修正することなく、単一のアップロードから生成されました。
すべての翻訳例を見る →5分間の準備、その後アップロード
プレーンテキスト翻訳に関するほぼすべての苦情は、アップロード前にドキュメントにすでに存在していた何かに起因します。これらのチェックですべてをキャッチします。
- 1
エンコーディングが正しく読み取れることを確認する
エンコーディングを表示および変更できるエディタでドキュメントを開きます。アクセント付き文字または非ラテン文字が関連性のない記号のシーケンスのように見える場合は、間違ったスキームで読み取っています。まずそれを修正し、Unicodeコピーを保存してください。なぜなら、すでに誤って読み取られた文字は、どの翻訳でも回復できないからです。
- 2
何がプローズで何がそうでないかを決定する
コンテンツが設定、ログ、または字幕である場合、変更されないようにする必要がある部分を特定します。区切り文字の左側のキー、重大度を示す単語、キュー番号、タイミング行などです。ドキュメントの大部分が少量のプローズを含むマシンコンテンツである場合、プローズを最初に抽出する方が、結果を修正するよりも高速です。
- 3
アカウントを作成してアップロードする
メールアドレスでサインアップし、ドキュメントを送信してください。単一のアップロードは最大1 GBまで対応しており、原稿、トランスクリプトアーカイブ、ログエクスポートなどを分割せずに処理できます。
- 4
両方の言語を設定して翻訳する
ソースの名前付けは、フォーマットされたドキュメントの場合よりもここで重要になります。なぜなら、システムが推測するためのマークアップやメタデータがないからです。次にターゲットを選択し、ジョブを開始します。
- 5
結果を再度開き、同じ3つのことを確認する
エンコーディング、行末、および手動で揃えられたものが再パディングを必要とするかどうか。ドキュメントがビルドパイプラインまたはメディアプレーヤーに入る場合は、依存する前に一度そのパイプラインに通してください。
プレーンテキストに関するよくある質問
私の文書には、アクセント付き文字の代わりに奇妙な記号がたくさん入って返ってきました。なぜですか?
それはエンコーディングの不一致であり、翻訳よりもはるかに前の問題です。古い地域スキームで書き込まれたバイトが、Unicodeであるかのように読み取られると、まさにそのパターンが発生します。通常の文字は正しく表示されますが、アクセント付き文字やラテン文字以外の文字は、無関係な記号の羅列に変わります。元のファイルを、エンコーディングを選択できるエディタで開き、正しく表示されるものを特定し、Unicodeコピーを保存して、そこから始めてください。
改行は同じ場所に残りますか?
段落の区切りは残ります。ただし、個々の折り返し行は、翻訳された語句が占める文字数が異なるため、残すことはできませんし、残すこともできません。元の文書が固定の文字幅で手動で折り返されていた場合、結果は異なる場所で改行されます。文書の送信先で特定の幅が重要な場合は、翻訳後にその文書を使用するツールで再折り返しを行ってください。
字幕ファイルもこのように翻訳できますか?
はい、そして2つの点に注意が必要です。キュー番号とタイミング行は単語ではなく座標であり、そのまま残す必要があります。また、翻訳されたセリフは元のセリフよりも長くなることが多く、視聴者が利用可能な時間内に読める量を超えてしまう可能性があります。最も長いセリフをタイミングと照らし合わせて確認し、キューが密集しすぎている場合は短縮してください。
設定やプロパティのドキュメントはどうですか?
言語は右側の一部のみです。区切り文字前のキーはソフトウェアが名前で検索する識別子であるため、それを翻訳すると設定がサイレントに無効になります。ファイルパス、スイッチ、数値、または他のキーへの参照である値も、プロセではありません。キーが多く、メッセージが少ないドキュメントの場合は、ドキュメント全体を確認するよりも、まずメッセージを抽出する方が迅速です。
手書きの表が配置ずれしました。回避できますか?
プレーンテキストではできません。テキストのアラインメントはスペースの数で決まりますが、翻訳によってフレーズが占める文字数が変わるためです。ドイツ語やロシア語は通常拡張され、中国語や日本語は文字数では収縮しますが、各文字は2つの表示列を占めます。後で再パディングするのが解決策です。真に表形式のデータの場合は、スプレッドシートまたはカンマ区切りエクスポートの方が適しています。
ドキュメントのサイズに制限はありますか?
ProおよびEnterpriseプランでは、1つのアップロードで最大1 GBまたは5,000ページ相当のコンテンツに対応できるため、長編の原稿、トランスクリプトコレクション、長いエクスポートも一度に処理できます。チャンクではなく全体を送信することで、最初のページから最後のページまで、繰り返し使用される用語の一貫性も保たれます。
結果は編集可能ですか、それとも画像ですか?
編集可能です。返されるのは、どのエディタでも開いて作業を続けられるテキストドキュメントで、元の文書と同じ文字コンテンツと構造を持っています。何もラスター化されず、何もロックされません。
長い文書の料金はいくらですか?
価格設定はバイト数ではなく単語数に基づいています。すべてのドキュメントは個別に請求され、FreeおよびStorageでは1単語あたり0.005ドル、Proでは0.004ドル、Enterpriseでは0.003ドルで、最低0.99ドルです。サブスクリプションではストレージと上限が追加されますが、翻訳は含まれません。そのため、原稿は開始前に単語数から直接見積もることができます。
ドキュメントを送信して構造を維持
エンコーディングを確認し、アップロードして言語を選択すると、段落、インデント、非ラテン文字が適切な場所にある編集可能なテキストが返されます。
提携企業
関連翻訳サービス
ファイル形式
PDFツール
