PDFの中身を覗く

PDFツールはどれもページを編集しますが、PDFが「何であるか」を見せるものはほぼありません。PDFエンジニアが読む形でオブジェクトグラフ全体をたどれます。生成コードのデバッグ、公開前の監査、フォーマットの学習に。

ツールを読み込み中…

使い方

  1. PDFをドロップします。qpdfがブラウザ内でオブジェクトグラフ全体を解析します。
  2. 型で絞るか辞書全体を検索し、オブジェクトをクリックして整形表示を確認します。
  3. 概要を確認します:バージョン、ページ数、暗号化、そして保存された世代数。

アップロードが不要な理由

このページの処理はすべて、ブラウザのタブ内で動くコードが行います。ファイルはディスクからタブのメモリに読み込まれ、その場で変換され、ダウンロードとして書き出されます。当社にも第三者にも送信されません。

ご自身で確認する方法

  1. ブラウザの開発者ツール(F12)を開き、「ネットワーク」タブを選びます。
  2. ファイルを読み込んでツールを実行します。
  3. 表示されるのは、ツール自身のコードの読み込みと、一部の重いツールでは公開CDNからのエンジン取得、それに loreatec.jp への小さなアクセス集計(ページのアドレスとタイトルだけ)です。あなたのファイルを運ぶ通信は1つもありません。

外部送信ゼロの確認方法 →

よくある質問

「保存された世代」とは何ですか?なぜ警告されるのですか?

PDFは増分保存ができます。新しい版がファイル末尾に追記され、古いバイト列はそのまま残ります。世代が2つ以上あるということは、より前の %%EOF でファイルを切れば以前の内容が復元できる場合があるということです。共有前に「修正」された文書では、これが重要になります。

実際には何に使いますか?

自分のコードが生成するPDFのデバッグ(なぜフォントが埋め込まれない?メタデータはどこへ?)、公開前のファイル監査(本当は何が入っている?)、そして200KBのPDFが一瞬で開くのに別のファイルが重い理由の解明。ページ単位のツールには問うことすらできない質問に、オブジェクトグラフは答えます。

ストリームの中身は見えますか?

各ストリームの辞書 — 長さ、フィルタ、型 — は表示しますが、このバージョンではデコード済みの中身の抽出は行いません。ページ内の画像は画像抽出ツール、テキストはテキスト抽出ツールの担当です。

PDFはアップロードされますか?

されません。標準的なオープンソースのPDFライブラリをWebAssemblyにコンパイルし、このタブ内で解析します。未公開・機密文書を検査する人が使うツールにとって、端末内処理は唯一許される設計です。