PDFファイルをオンラインで圧縮
重いPDFを、添付ファイルの制限やファイルポータルをクリアできるサイズにまで軽量化します。ただし、まだ読む必要がある詳細は失われません。
翻訳するドキュメントをアップロードまたはドロップしてください
最大ファイルサイズ 1 GB
- スキャンや写真のOCR機能
- 108言語に対応
- 元のレイアウトを保持

ほとんどのサイズは少数のオブジェクトにあります。
PDFの重さは、ページ全体に均等に分散されることは決してありません。テキストは非常に小さいです。1ページの文章は、文字と位置のリストとして保存されるため、数キロバイトしかかかりません。ファイルが重くなる主な原因は、常に短いリストのいずれかであり、どの原因であるかを知ることが、どの圧縮が効果的かを決定します。
- 写真がカメラのフル解像度で配置され、ページ上で縮小されたもの。ファイルには元の全体が含まれていますが、その詳細のほんの一部しかそのサイズでは表示されません。
- スキャンされたページ。各シートが1つの大きな画像になっています。スキャンは、圧倒的に最も重い種類のPDFであり、そのサイズはスキャナーの設定解像度に応じてスケーリングされます。
- サブセットではなく、フォント全体が埋め込まれている場合。ファミリー内のすべてのグリフを運ぶフォントは、ドキュメントが実際に使用する数百の文字しか運ばないフォントよりもはるかにコストがかかります。
- 増分保存からの残り物。PDFを繰り返し編集および保存すると、ファイルを書き換える代わりに各改訂が追加される可能性があるため、既に削除したページの古いバージョンがまだ内部に残っている場合があります。
- ロゴやレターヘッドの画像が、ドキュメントごとではなくページごとに一度だけ保存されます。
アップロード前に推測する簡単な方法:ファイルサイズをページ数で割ります。テキストドキュメントは1ページあたり数十キロバイトです。1ページあたり数メガバイトのものは画像であり、そこから削減が行われます。
1つのボタンの背後にある2つの非常に異なる操作
圧縮ツールは2種類の作業をまとめてバンドルします。1つは結果に影響がなく、もう1つは永続的です。ファイル間で結果がこれほど大きく異なる理由は、異なるドキュメントがそれぞれ利用可能な量の違いを持っているためです。
ロスレス:何も破棄されません
ファイル内のストリームは、より効率的なエンコーダーで再パックされ、埋め込みフォントは実際に使用されている文字に削減され、もはや参照されていないオブジェクトは削除され、複数回保存された同一の画像は1つにまとめられ、以前の保存からの置き換えられたリビジョンはドロップされます。
出力のすべてのピクセルとすべての文字は入力と同じです。何度も編集されたテキストが多いドキュメントでは、これだけでも大幅な節約になります。クリーンで新しくエクスポートされたファイルでは、削除する無駄がないため、ほとんど何も節約できない場合があります。
ロッシー:サイズのために詳細が失われます
画像はより低い解像度に縮小され、選択された品質設定で再エンコードされます。この段階で破棄された情報は、そのコピーから永久に失われ、結果を再度圧縮しても、有用な方法で小さくなるのではなく、さらに悪化します。
ここから劇的な削減が行われ、またドキュメントを損傷する可能性のある唯一の段階でもあります。ほとんどがテキストのファイルには、ロッシーによる節約の余地はほとんどありません。スキャンされたページのファイルはほとんどすべて画像であるため、強く反応します。これはスキャンに最も注意が必要な理由です。

読まなければならないスキャンに対する重い圧縮の代償
文字認識は文字形状のマッチングによって機能するため、エッジの鮮明さに依存します。ロッシー画像圧縮は、まさにそのエッジを攻撃します。ブロック単位で動作し、明るい暗いの間のシャープな遷移の周りにわずかなリップルを残します。写真では目立ちません。小さな文字のページでは、すべての文字が明るい暗いの間のシャープな遷移であるため、単語が正しく読めるか、別のものとして読まれるかの違いになります。
解像度も同様に重要です。ボディテキストの信頼性の高い認識には、通常300ドット/インチが推奨される最小値であり、小さな文字、脚注、スタンプされた詳細には、それ以上が望ましいです。サイズ制限に合わせて300 dpiのスキャンをダウンサンプリングすることは、画面上の人間には許容範囲に見える一方で、ソフトウェアで読み取れなくなる最も一般的な方法です。
操作の順序が解決策です。ページがまだフルクオリティの間にテキストを認識し、単語がファイルにテキストとして保存されるようにします。その後圧縮します。検索可能で翻訳可能なコンテンツがそれらに依存しなくなるため、画像はハードに圧縮できます。DocTranslatorはスキャンされたドキュメントや画像ファイル内のテキストを読み取るため、圧縮されたコピーではなく良好なコピーをアップロードすると、明らかに良い結果が得られます。
PDFがあまり小さくならない場合
すでに圧縮されている
最新のソフトウェアからエクスポートされたファイルは、通常、画像がすでに効率的にエンコードされ、フォントがすでにサブセット化された状態で到着します。取り込む余裕がないため、2回目のパスではほぼ同じサイズのファイル、または同じサイズの少し見栄えの悪いファイルが返されます。
ほとんどがテキストである
写真のない長い契約書やマニュアルは、最初から小さいです。テキストドキュメントが予想外に重い場合、原因は通常、埋め込みフォントまたは蓄積された保存履歴であり、ページコンテンツではありません。ロスレスパスが役立つ部分です。
ベクターアートワークである
エンジニアリング図面、地図、詳細なチャートには、数万もの個々の線や形状が含まれる場合があります。それはピクセルではなくデータなので、ダウンサンプリングするものはありません。それを縮小することは、描画を単純化することであり、それは表示されるものを変更します。
暗号化または署名されている
パスワードで保護されたファイルは、コンテンツを書き換える前にロックを解除する必要があります。デジタル署名されたファイルは圧縮できますが、書き換えによって署名がカバーするバイトが変更されるため、署名はもはや検証されません。署名後に圧縮するのではなく、署名前に圧縮してください。

クリアしようとしている制限によって、どれだけ強くプッシュするかが決まります
誰も自分のためにファイルを圧縮しません。常に反対側に数字があります:メールサーバーのアタッチメントキャップ、政府または裁判所のポータルのアップロードフィールド、設定サイズを超えるものを拒否するサプライヤーシステム、ストレージクォータ。開始する前にその数字を見つけてください。なぜなら、ロスレスパスで十分なのか、それとも画像品質を犠牲にする必要があるのかを教えてくれるからです。
ターゲットが1回の圧縮パスで到達できるものをはるかに下回る場合は、品質を下げるのをやめて、代わりにジョブの形状を変更してください。PDF分割でドキュメントをパーツに分割して個別に送信すると、すべてのページが読み取り可能になりますが、積極的な制限の下で1つのファイルを強制するとそうはなりません。
アップロードサイズが制約になることはほとんどありません。DocTranslatorは、ProおよびBusinessプランで最大1GBまたは5,000ページのファイルをサポートしているため、通常、ドキュメントは翻訳のためではなく、次の宛先に合わせて圧縮する必要があるだけです。

良好なコピーから翻訳し、小さい方を送信する
ドキュメントが翻訳され、サイズ制限のある場所に送信される場合、元のドキュメントから翻訳してください。ソースの品質は、認識ステップが処理する必要があるものであり、すでに画像が削減されたファイルは、処理するものが少なくなります。
翻訳された出力は、元のスキャンよりも軽量になる傾向があります。なぜなら、元のピクセルだった単語が結果ではテキストになるからです。スキャンされたページにはすべての文字の画像が含まれますが、翻訳されたページには文字自体が含まれます。これだけで計算が変わります。
未加工のオリジナルはどこかに保管しておいてください。圧縮されたコピーは以前の品質に復元することはできません。証明書や署名されたページのクリーンなバージョンを要求された日は、コピーを保持していたかどうかを確認する日です。

最小の文字をチェックする
圧縮されたファイルを、最初のページではなく、その中の最も難しいもので判断してください。脚注、スタンプ、手書きの署名、または数値の表にズームインしてください。それらがまだ判読可能であれば、圧縮は安全でした。数字がぼやけている場合は、品質設定で一歩戻ってください。画面に合わせたページではなく、読者が実際に使用するズームレベルでレビューすることが、違いを教えてくれることです。
PDFを適切に圧縮する方法
ターゲットサイズを把握する
まず、メールの添付ファイルの制限やポータルのアップロードフィールドなど、クリアしなければならない制限を確認してください。これにより、安全でロスレスな処理で十分か、画質を犠牲にする必要があるかが決まります。
何かを縮小する前に、まずテキストを認識してください
ページがスキャンされたものである場合、画像がまだフルクオリティであるうちに、ピクセルから単語を抽出してください。テキストがテキストとして保存されれば、必要なものを何も犠牲にすることなく、画像をハードに圧縮できます。
アップロードして、ファイルを書き換えてください
無料アカウントを作成してドキュメントをアップロードしてください。未使用のオブジェクト、重複した画像、および大きすぎるフォントセットが最初に削除されます。これは、編集されたファイルではしばしばそれだけで十分です。
最も難しいページを検査し、元のファイルを保持してください
脚注、スタンプ、または数字の列にズームインして、結果がまだ判読可能であることを確認し、非圧縮のソースをアーカイブしてください。ロッシー処理で失われた詳細は、後で回復することはできません。
PDFの圧縮:よくある質問
ファイルがほとんど小さくならなかったのはなぜですか?
削除するものがほとんどなかったためです。テキストの保存にはほとんどコストがかからないため、写真を含まないドキュメントはすでにその下限に近い状態であり、最新のソフトウェアでエクスポートされたファイルは通常、画像が効率的にエンコードされ、フォントがすでに削減されています。大きな削減は画像データから来ます。つまり、スキャンと写真です。
圧縮するとドキュメントが破損しますか?
可逆圧縮は、無駄を削除し、すべてのピクセルを同じままにするだけなので、破損しません。非可逆圧縮は、画像の解像度と品質を永久に低下させます。その重要性は、画像が何であるかによって異なります。写真はそれを簡単に許容しますが、小さな文字のページはそうではありません。
OCRを実行する前にスキャンを圧縮する必要がありますか?
いいえ、逆に行ってください。認識は文字の形に一致しますが、非可逆圧縮は、それに依存するシャープなエッジをぼかし、ダウンサンプリングは小さな文字に必要な詳細を削除します。最初にフルクオリティでテキストを認識してから圧縮してください。その時点では、単語はテキストとして保存されており、画像に依存しなくなります。
スキャンされたページの解像度はどのくらいであるべきですか?
本文のテキストを確実に読み取るための通常の推奨最小値は約300ドット/インチであり、小さな文字、脚注、またはスタンプの詳細が含まれるものはそれ以上が良いでしょう。サイズ制限を満たすためにそれ以下に下げることは、画面上の人間には読み取れるがソフトウェアには読み取れないファイルになる最も一般的な方法です。
同じファイルを2回圧縮して、さらに小さくできますか?
めったに効果がなく、しばしば悪化します。可逆的な節約は最初のパスで既に完了しているため、2回目の実行は、既に詳細が失われた画像を再エンコードするだけで、意味のある削減なしにそれらをさらに劣化させます。1回のパスで目標に到達しなかった場合は、再度圧縮するのではなく、ドキュメントを分割してください。
数ページしかないのに、PDFが巨大なのはなぜですか?
サイズをページ数で割ります。ページあたりのメガバイトは画像データを意味します。カメラのフル解像度で保持されているが小さく表示されている写真、または高設定でキャプチャされたスキャンされたページ。テキストページは数十キロバイトの範囲にあるため、重いテキストドキュメントは通常、完全に埋め込まれたフォントまたは繰り返し保存からの残りのリビジョンを示します。
翻訳のためにアップロードする前に圧縮する必要がありますか?
通常はありません。Basicプランは最大100 MBおよび300ページ、ProおよびBusinessプランは最大1 GBおよび5,000ページまで対応しているため、サイズが制約となることはめったにありません。また、高品質なソースファイルは、画像からページを読み取る場合に、より良い結果をもたらします。Freeプランは20 MBおよび20ページで停止しますが、これは重いスキャンを最初に圧縮することで役立つ場合があります。ただし、圧縮は翻訳自体には影響しません。それ以外の場合は、翻訳後ではなく、ドキュメントの送信先に応じて圧縮してください。
署名済みまたはパスワードで保護されたPDFはどうなりますか?
保護されたファイルは、その内容を書き換える前にロックを解除する必要があります。署名されたファイルは圧縮できますが、書き換えると署名が適用されたバイトが変更されるため、署名は検証されなくなります。ドキュメントが両方を必要とする場合は、最初に圧縮してから、小さい方のバージョンに署名してください。
PDFを制限内に収める
重いファイルから無駄なものを削除し、小さな文字を判読可能に保ち、ファイルサイズが適切な大きさになったら、ドキュメントを120以上の言語に翻訳してください。
