In een PDF kijken

Elke PDF-tool bewerkt pagina’s; bijna geen enkele laat zien wat een PDF eigenlijk ís. Dit doorloopt de volledige objectgraaf zoals een PDF-engineer die leest — nuttig om generators te debuggen, te controleren wat een bestand met zich meedraagt, en om het formaat te leren kennen.

De tool wordt geladen…

Hoe het werkt

  1. Sleep de PDF erin — qpdf ontleedt de volledige objectgraaf in je browser.
  2. Filter op objecttype of zoek door alle dictionaries; klik op een object om het opgemaakt te zien.
  3. Bekijk het overzicht: versie, aantal pagina’s, versleuteling, en hoeveel bewaarde generaties het bestand met zich meedraagt.

Waarom er niets wordt geüpload

Alles wat deze pagina doet, doet code die in je browsertabblad draait, met dezelfde engine die ook webpagina’s tekent. Je bestand wordt van schijf naar het geheugen van dat tabblad gelezen, daar bewerkt en weer weggeschreven als download. Het wordt nergens naartoe gestuurd — niet naar ons, en niet naar een derde partij.

Controleer het zelf

  1. Open de ontwikkelaarstools van je browser (F12) en kies het tabblad Netwerk.
  2. Laad je bestand en start de tool.
  3. De enige verzoeken die je ziet, halen de code van de tool zelf op — en bij een paar zware tools hun opensource-engine van een openbare CDN — plus één kleine bezoekmelding aan loreatec.jp (adres en titel van de pagina, meer niet). In geen van die verzoeken zit jouw bestand.

Bewijs dat het lokaal blijft →

Veelgestelde vragen

Wat zijn “bewaarde generaties” en waarom worden ze gemarkeerd?

PDF’s kunnen incrementeel worden opgeslagen: de nieuwe versie wordt toegevoegd en de oude bytes blijven in het bestand staan. Meer dan één generatie betekent dat eerdere inhoud mogelijk terug te halen is door het bestand bij een eerdere %%EOF af te knippen — en dat telt wanneer een document werd “gecorrigeerd” voordat het werd gedeeld.

Waar zou ik dit nu echt voor gebruiken?

Een PDF debuggen die je eigen code genereert (waarom is het lettertype niet ingesloten? waar is de metadata gebleven?), een bestand controleren voor publicatie (wat zit er nu echt in?), en begrijpen waarom de ene PDF van 200 KB meteen opent en de andere traag is. De objectgraaf beantwoordt vragen die tools op paginaniveau niet eens kunnen stellen.

Toont hij de inhoud van streams?

Hij toont het dictionary van elke stream — lengte, filters, type — maar haalt in deze versie de gedecodeerde inhoud niet eruit. Voor afbeeldingen op een pagina is er de tool om afbeeldingen te extraheren; voor tekst zijn er de tools voor tekstextractie.

Wordt de PDF geüpload?

Nee. Een gangbare opensource PDF-bibliotheek, gecompileerd naar WebAssembly, ontleedt het bestand in dit tabblad. Voor een tool waarvan het publiek ongepubliceerde en vertrouwelijke documenten inspecteert, is lokaal het enige aanvaardbare ontwerp.