Guide

Macht PDF-Komprimierung den Text nicht mehr durchsuchbar?

Die meisten PDF-Komprimierer wandeln Seiten in Bilder um und entfernen dabei unbemerkt den durchsuchbaren Text. So erkennen Sie, welche Methode verwendet wird und wann sie die richtige Wahl ist.

LuraPDF Team
LuraPDF Team

Redaktionelles & technisches Team · 21. September 2026 · 6 min Lesezeit

Ja — meistens. Wenn ein Komprimierungsprogramm Ihre PDF-Datei drastisch verkleinert hat, hat es höchstwahrscheinlich jede Seite in ein Bild umgewandelt, und der Text darin ist kein Text mehr.

Das merkt man meist erst später, im denkbar ungünstigsten Moment: Man sucht in einem Vertrag nach einer Klausel und findet nichts, oder man versucht einen Absatz zu kopieren und bekommt leere Hände. Dieser Leitfaden erklärt, warum das passiert, wie man es erkennt und wie man eine Datei komprimiert, ohne dass es dazu kommt.

Ein Wort für zwei völlig verschiedene Vorgänge

„Komprimieren" bezeichnet zwei Dinge, die auf entgegengesetzte Weise funktionieren. Die wenigsten Tools verraten, welches Verfahren sie anwenden.

Verlustfrei: Die Datei neu aufbauen

Die Dokumentstruktur wird effizienter neu geschrieben. Doppelte Ressourcen werden zusammengeführt, nicht verwendete Objekte entfernt und die internen Datenströme neu gepackt. Der Seiteninhalt bleibt unberührt.

Text bleibt Text. Schriften bleiben eingebettet. Links, Formularfelder und Anmerkungen bleiben erhalten. Der Haken liegt bei der erzielbaren Größenreduzierung: typischerweise 20–30 %, und bei einer bereits gut optimierten Datei manchmal kaum spürbar.

Verlustbehaftet: Die Seiten fotografieren

Jede Seite wird in ein Bild gerendert, dieses Bild wird komprimiert, und aus den Bildern wird eine neue PDF-Datei aufgebaut — eine Seite, ein Bild.

Das ist außerordentlich effektiv — bei gescannten Dokumenten sind 60–80 % normal —, weil dabei der Unterschied zwischen einem Buchstaben und den Pixeln, die ihn darstellen, aufgegeben wird. Und genau darin liegt das Problem. Danach ist die Seite ein Foto Ihres Dokuments. Es gibt keinen Text darin, der gefunden werden könnte.

Erkennen, welches Verfahren angewendet wurde

Öffnen Sie die Ausgabedatei und versuchen Sie, mit dem Cursor eine Zeile des Fließtexts zu markieren.

  • Ein Textcursor erscheint, und Sie können einzelne Wörter hervorheben — der Text ist erhalten geblieben.
  • Es erscheint ein Auswahlrahmen über der ganzen Seite, oder es passiert gar nichts — die Seite ist ein Bild.

Zwei weitere schnelle Tests: Drücken Sie Strg+F (Cmd+F auf dem Mac) und suchen Sie nach einem Wort, das Sie auf der Seite deutlich sehen können. Zoomen Sie außerdem auf 400 %. Echter Text bleibt bei jedem Zoomfaktor scharf, weil er aus Schriftumrissen gezeichnet wird; ein Bild wird weich und dann pixelig.

Warum das wichtiger ist, als es klingt

Den durchsuchbaren Text zu verlieren ist nicht nur ein Komfortproblem.

Suchen und Extrahieren sind nicht mehr möglich. Jeder Arbeitsablauf, der Daten aus dem Dokument ausliest, funktioniert nicht mehr — Spesenerfassungssysteme, Vertragsprüfung, Dokumentenmanagement-Indizierung.

Screenreader können den Inhalt nicht vorlesen. Das ist das eigentlich schwerwiegende Problem. Eine Seite, die ein Bild ist, ist für alle, die Hilfstechnologien verwenden, vollständig unzugänglich. Wenn Sie ein Dokument veröffentlichen, das die Öffentlichkeit lesen soll, oder wenn Sie in einem Bereich mit Barrierefreiheitspflichten arbeiten, ist ein reines Bild-PDF keine akzeptable Ausgabe.

Suchmaschinen können die Datei nicht indizieren. Eine auf einer Website veröffentlichte PDF-Datei ohne Textebene leistet keinen Beitrag zur Suche.

Die Qualität ist dauerhaft beeinträchtigt. Den Text lässt sich später nicht mehr zurückgewinnen, es sei denn durch OCR — dabei wird er durch Auswertung der Pixel rekonstruiert, was meist genau, aber nie perfekt und nie mit der ursprünglichen Formatierung funktioniert.

Bewusst wählen

Unser Tool PDF komprimieren bietet beide Verfahren an und zeigt an, welche Einstellung welches Verfahren verwendet.

Text behalten ist der verlustfreie Pfad. Verwenden Sie ihn immer dann, wenn das Dokument durchsucht, mit Hilfstechnologien gelesen, automatisch verarbeitet oder als Ablage aufbewahrt wird. Erwarten Sie eine bescheidene Reduzierung.

Kleinste Größe ist der verlustbehaftete Pfad, in drei Stärken — ungefähr 144, 108 und 72 DPI. Verwenden Sie ihn, wenn die Datei ein hartes Limit einhalten muss und eine Person sie schlicht anschauen wird. Das Tool weist klar darauf hin, dass in keinem dieser Modi der Text selektierbar bleibt.

Es gibt auch einen Zielgröße-Modus für Fälle, in denen ein Portal eine bestimmte Dateigröße vorschreibt. Dabei handelt es sich um einen verlustbehafteten Modus, sodass derselbe Kompromiss gilt.

Der Fall, in dem es keinen Unterschied macht

Wenn Ihre PDF ein Scan ist, gab es darin nie Text, der verloren gehen könnte. Ein Foto einer Seite enthält keine Zeichen, nur Pixel — egal welches Tool es erstellt hat.

Bei Scans kostet verlustbehaftete Komprimierung nichts in Bezug auf die Durchsuchbarkeit — denn diese war von Anfang an nicht vorhanden. Deshalb lassen sich Scans auch so gut komprimieren: Sie bestehen aus reinen Bilddaten, und genau dafür ist verlustbehaftete Komprimierung ausgelegt.

Wenn ein Scan durchsuchbar sein soll, ist das ein separater Vorgang: OCR liest die Pixel und fügt darunter eine Textebene ein. Am besten bevor Sie komprimieren, denn aggressive Komprimierung erschwert die Zeichenerkennung und verringert die OCR-Genauigkeit.

Eine Regel, die funktioniert

Stellen Sie sich eine Frage: Wird nach dem Versand dieser Datei irgendetwas anderes als ein Paar menschlicher Augen sie lesen müssen?

  • Nein — ein Kollege wird einen kurzen Blick darauf werfen, ein Portalgutachter wird sie freigeben, sie geht per E-Mail raus. Verlustbehaftet ist in Ordnung. Nehmen Sie die 70 %.
  • Ja — sie wird durchsucht, indiziert, archiviert, vorgelesen oder verarbeitet. Bleiben Sie verlustfrei, akzeptieren Sie die geringere Einsparung und schaffen Sie den Platz anderweitig.

„Anderweitig" sind meistens Seiten. Das Entfernen von Seiten, die niemand angefordert hat, schlägt jede Komprimierungseinstellung und kostet nichts in Qualität. Mit PDF-Seiten extrahieren holen Sie nur die heraus, die Sie benötigen.

Wenn der Text bereits verloren ist

Wenn Sie eine Datei in Bilder komprimiert haben und das Original nicht mehr besitzen, lässt sich der Text nicht in seiner ursprünglichen Form wiederherstellen. Ihre Möglichkeiten sind, zum Quelldokument zurückzugehen und erneut zu exportieren, oder OCR auf die komprimierte Version anzuwenden, um eine neue Textebene zu erzeugen.

OCR an einer bereits stark komprimierten Datei ist die schwächste dieser Optionen, weil die Komprimierung genau die Buchstabenformen beschädigt hat, auf die die Erkennung angewiesen ist. Das ist das stärkste Argument dafür, das Original von allem aufzubewahren, was von Bedeutung ist.

Häufig gestellte Fragen

Kann ich erkennen, ob eine PDF echten Text enthält, ohne sie in einem Leseprogramm zu öffnen? Der schnellste Test ist, sie zu öffnen und zu versuchen, eine Zeile zu markieren. Wenn Sie sicher gehen möchten, suchen Sie nach einem Wort, das Sie auf der Seite deutlich sehen — findet die Suche nichts, gibt es keine Textebene.

Kann Komprimierung Text aus einer nicht gescannten PDF entfernen? Ja. Verlustbehaftete Komprimierung rendert jede Seite zu einem Bild, unabhängig davon, was sich auf ihr befand. Eine aus Word exportierte PDF mit einwandfreiem Text verliert diesen Text, wenn sie im Modus „Kleinste Größe" komprimiert wird.

Ist eine kleinere Datei immer schlechter in der Qualität? Nein. Verlustfreie Komprimierung macht eine Datei kleiner, ohne die Qualität zu beeinträchtigen — sie entfernt Überflüssiges statt Details. Sie kann nur nicht die drastischen Reduzierungen erzielen, die viele erwarten.

Meine komprimierte PDF sieht identisch aus. Hat sie den Text behalten? Nicht unbedingt. Bei normalem Zoomfaktor sieht ein gut komprimiertes Bild einer Seite dem Original sehr ähnlich. Text zu selektieren ist der einzige zuverlässige Test.

Kann ich den Text nach der Komprimierung wieder hinzufügen? Nur durch OCR, das eine neue Textebene erstellt, indem es die Pixel erkennt. Das ist in der Regel genau, aber nie garantiert, und es stellt die ursprüngliche Formatierung nicht wieder her.

Über die Autorin

LuraPDF Team
LuraPDF Team

Redaktionelles & technisches Team · 21. September 2026 · 6 min Lesezeit

Das LuraPDF-Team besteht aus Experten für Dokumentverarbeitung, Softwareentwicklern und technischen Redakteuren, die sich dafür einsetzen, professionelle PDF-Bearbeitung kostenlos, privat und zugänglich zu machen.