Deutsch

PDF-Komprimierung erklärt

Das ToolAcre PDF Toolkit komprimiert keine PDFs. Das ist eine bewusste Auslassung, kein fehlendes Feature: Die einem Browser zur Verfügung stehende Technik rastert jede Seite, wodurch auswählbarer Text zerstört wird und ein Textdokument häufig eher größer als kleiner wird.

Fast die gesamte überschüssige Größe in einer PDF-Datei besteht aus eingebetteten Bildern. Wenn Sie diese reduzieren, bevor das PDF erstellt wird, oder das Dokument aus einer kleineren Quelle neu erstellen, können Sie echte Einsparungen erzielen, ohne die Datei zu beschädigen. Auf dieser Seite erfahren Sie, wie Sie das Gewicht ermitteln und was tatsächlich hilft.

Was macht ein PDF groß?

Ein PDF ist ein Container. Der Text wird in Form von Anweisungen und eingebetteten Schriftarten-Untergruppen gespeichert und ist bemerkenswert kompakt – hundert Seiten Prosa kosten oft deutlich weniger als ein Megabyte. Seine Bilder werden als codierte Streams gespeichert und sind fast immer dort, wo die Größe ist.

Der übliche Schuldige ist ein Scan oder ein eingefügtes Foto mit voller Kameraauflösung. Ein Telefonfoto kann viertausend Pixel breit sein; Wenn es auf eine A4-Seite gedruckt wird, wird es mit einem Bruchteil davon angezeigt, und die zusätzlichen Pixel werden für immer in der Datei gespeichert, ohne dass sie etwas bewirken.

An den Rändern sind eingebettete Schriftarten wichtig. Ein Dokument, das mehrere vollständige Schriftfamilien anstelle von Teilsätzen einbettet, kann mehrere hundert Kilobyte Schriftart enthalten. Ärgerlich, selten entscheidend.

Die drei Dinge, die „PDF komprimieren“ bedeuten kann

Rasterisieren ist das, was viele browserbasierte „PDF-Kompressoren“ tun, da ein Browser bereits eine Seite auf einer Leinwand rendern und Bilder in ein neues Dokument schreiben kann. Es erstellt zuverlässig eine kleinere Datei für ein gescanntes Dokument. Bei einem Textdokument wird die Textebene zerstört – keine Auswahl, keine Suche, kein Bildschirmlesezugriff – und die resultierenden Seitenbilder sind oft größer als die Vektoranweisungen, die sie ersetzt haben.

Ein Tool, das Ihren durchsuchbaren Vertrag stillschweigend gegen einen Stapel Bilder austauscht, hat Ihnen etwas weggenommen, dessen Verlust Sie nicht eingewilligt haben. Anstatt dies hinter einer benutzerfreundlichen Schaltfläche „Komprimieren“ zu verbergen, bietet dieses Toolkit es nicht an und sagt nicht, warum.

  • Downsampling von Bildern: Neukodierung eingebetteter Bilder mit einer niedrigeren Auflösung oder Qualität. Hier entstehen fast alle ehrlichen Einsparungen, und das ist für die Bilder verlustbehaftet, für den Text jedoch harmlos.
  • Stream-Komprimierung: Anwenden oder Verbessern der Deflate-Komprimierung auf Content-Streams. Die meisten Autoren tun dies bereits, sodass die Ersparnis normalerweise gering ist.
  • Rastern: Jede Seite in ein Bild rendern und das PDF aus diesen Bildern neu erstellen. Dies ist die Technik, die in einem Browser leicht verfügbar ist, und sie ist die destruktive.

Was stattdessen zu tun ist

Finden Sie heraus, wo das Gewicht liegt, bevor Sie etwas unternehmen. Wenn die Seitenzahl hoch ist und die Datei pro Seite klein ist, gibt es nichts zu gewinnen. Wenn ein zehnseitiges Dokument 40 MB ist, enthält es Bilder, und diese Bilder sind das ganze Problem.

Verkleinern Sie die Bilder, bevor das PDF existiert. Wenn Sie das Dokument aus Fotos oder Scans erstellen, ändern Sie zunächst deren Größe und kodieren Sie sie neu – ein 1600 Pixel breites JPEG mit Qualität 80 reicht für ein Bild in voller Breite auf einer A4-Seite aus und ist nur ein kleiner Bruchteil der ursprünglichen Kameradatei. Stellen Sie daraus dann das PDF zusammen.

Wenn die PDF-Datei bereits vorhanden ist und Sie nicht über die Quellen verfügen, lautet die ehrliche Antwort: Sie benötigen ein Tool, das Bildströme direkt umschreiben kann – einen Desktop-PDF-Editor oder ein Befehlszeilentool wie Ghostscript oder qpdf. Das liegt außerhalb dessen, was ein Browser ohne Rasterung leisten kann, daher weist diese Website Sie darauf hin, anstatt es vorzutäuschen.

Es lohnt sich, zuerst zwei günstige Gewinne zu prüfen. Exportieren Sie erneut aus der Originalanwendung mit der Voreinstellung „Kleinere Dateigröße“ oder „Web“, die Bilder normalerweise ordnungsgemäß herunterskaliert. Und wenn es sich bei dem Dokument um einen Scan handelt, den Sie nur lesen müssen, ist die einmalige Konvertierung in einer vernünftigen Auflösung besser als jede Post-hoc-Komprimierung.

Ausgearbeitetes Beispiel: eine 46 MB „Broschüre“, die 3 MB sein sollte

Eine sechsseitige Broschüre wird unter 46 MB exportiert. Sechs Seiten Layout können das nicht erklären, daher liegt das Gewicht bei den Bildern. Die Quelldatei enthält sechs Fotos in voller Auflösung mit jeweils etwa 4000 x 3000 Pixeln direkt von einer Kamera.

Auf einer A4-Seite ist ein vollrandiges Foto etwa 8,3 Zoll breit. Bei 150 dpi – ausreichend für alles, was kein Kunstdruck ist – sind das ungefähr 1250 Pixel. Die Fotos haben eine mehr als dreifache lineare Auflösung, die auf der Seite angezeigt werden kann, was etwa dem Zehnfachen der Pixelzahl entspricht.

  1. Passen Sie die Größe jedes Fotos an der langen Kante auf 1500 Pixel an.
  2. Exportieren Sie jeweils als JPEG mit Qualität 80.
  3. Erstellen Sie die Broschüre anhand der verkleinerten Bilder neu.

Ergebnis: Sechs Bilder mit jeweils etwa 300-450 KB statt jeweils 6-9 MB und ein PDF im niedrigen einstelligen Megabyte-Bereich. Die Textebene bleibt unberührt und weiterhin auswählbar, da nichts gerastert wurde.

Öffnen Sie das Tool

Verkleinern Sie die Bilder, bevor Sie das PDF erstellen

Der Bildkonverter ändert die Größe und kodiert JPEG, PNG und WebP in Ihrem Browser neu. PDF-Dateien werden nicht geöffnet.

Was dies nicht abdeckt

  • Auf dieser Seite wird das Problem erläutert. Das ToolAcre PDF Toolkit verfügt über keine Komprimierungsfunktion und erhält diese auch nicht durch Rasterung.
  • Der ToolAcre Image Converter kann die Bilder, die Sie in eine PDF-Datei eingeben, verkleinern, er kann jedoch nicht in eine vorhandene PDF-Datei hineingreifen, um sie zu ersetzen.
  • Ghostscript und qpdf werden hier als genaue Antworten und nicht als Produkte dieser Site genannt. Niemand hier pflegt sie und es besteht keine Beziehung.
  • In diesem Toolkit gibt es keine OCR-Funktion, sodass eine gescannte Seite nicht wieder in durchsuchbaren Text umgewandelt werden kann.