OCR PDF kostenlos online — PDF durchsuchbar machen ohne Upload
Gescannte PDFs in durchsuchbare PDFs umwandeln — kein Upload, kein Konto, kein Adobe-Abo.
Laden Sie ein gescanntes oder nur aus Bildern bestehendes PDF hoch — wir führen die Texterkennung (OCR) auf jeder Seite im Browser durch, indem wir Tesseract.js (die Open-Source-OCR-Engine) verwenden, und betten den erkannten Text unsichtbar hinter dem ursprünglichen Seitenbild ein. Das Ergebnis sieht identisch mit dem Quell-PDF aus, aber Strg+F findet jetzt Wörter, Sie können Text markieren und kopieren, und jedes PDF-zu-Word/Excel/Text-Tool kann Daten extrahieren. PDF durchsuchbar machen gelingt mit 30+ Sprachpaketen — Deutsch, Englisch, Arabisch, Hindî, Japanisch und mehr.
Gescanntes PDF hier ablegen
oder
Kein Upload erforderlich. Alles läuft 100 % lokal in Ihrem Browser.
Was ist OCR bei PDFs?
OCR stands for Optical Character Recognition. In a PDF context, OCR turns image-based pages — scans, faxes, photos, rasterized exports — into pages with a real text layer underneath the picture. The visible content stays exactly the same. The difference is that Ctrl+F finds words across the document, you can select and copy text, screen readers can read it, and any PDF→Word / PDF→Excel / PDF→Text tool can extract data from it.
Zwei Arten von PDFs in der Praxis
Native Text-PDFs
Keine OCR erforderlichErstellt aus Word, Excel, Google Docs, Browsern und den meisten modernen Anwendungen. Der Text ist real, markierbar und durchsuchbar, sobald die Datei erstellt wird. Die meisten PDFs, die Sie per E-Mail erhalten, fallen in diese Kategorie.
Nur-Bild- / gescannte PDFs
OCR erforderlichErstellt durch Scanner, Handy-Kamera-Scans, Faxe oder Rasterisierungs-Tools (einschließlich einiger Word-zu-PDF- und PowerPoint-zu-PDF-Konverter). Der Text sind nur Pixel in einem Bild — Sie können ihn nicht markieren, kopieren oder durchsuchen, bis OCR eine echte Textebene hinzufügt.
So führen Sie OCR an einem PDF durch — Schritt für Schritt
-
OCR-Tool öffnen
Visit
pdfedit.com/ocr-pdfin any modern browser. No install, no signup, no extension required — the page works offline once it's loaded. -
Gescanntes PDF ablegen
Drag any PDF onto the dropzone above, or click PDF auswählen to browse. The file loads into your browser memory only — there is no server upload step at any point in the workflow.
-
Dokumentsprache auswählen
Wählen Sie die Sprache, die Tesseract erkennen soll: Deutsch, Englisch, Spanisch, Französisch, Italienisch, Portugiesisch, Russisch, Arabisch, Chinesisch, Japanisch, Koreanisch, Hindî und 20+ weitere. Bei mehrsprachigen Dokumenten wählen Sie die dominante Sprache — Tesseract verarbeitet kleine Mengen anderer Schriften ausreichend gut.
-
OCR starten klicken
Jede Seite wird mit hohem DPI gerendert, von Tesseract erkannt und zu einem durchsuchbaren PDF mit unsichtbarer Textebene zusammengesetzt. Die Ausgabe sieht identisch mit der Quelle aus — gleiches Seitenbild, gleiches Layout, gleiche Unterschriften und Stempel. Der einzige Unterschied ist der darunter liegende, markierbare und kopierbare Text.
-
Herunterladen und prüfen
The searchable PDF saves to your device. Open it in any PDF reader and try Ctrl+F on a word from the document — it should jump straight to the right page. Job done.
Warum dieses OCR-Tool verwenden?
100 % Lokal — Ihr Scan verlässt nie Ihr Gerät
OCR ist der heikelste Datenschutzvorgang in der PDF-Welt. Gescannte Dokumente sind meist Ausweise, unterzeichnete Verträge, Patientenakten, Steuerformulare — Dinge, die Sie absolut nicht auf einem fremden Server haben möchten. Adobe, iLovePDF, PDF24 und maxai.co laden alle hoch. Wir verwenden Tesseract.js + pdf.js + pdf-lib in Ihrem Browser. Es gibt keine serverseitige Kopie, weil wir keinen Server für Ihre Dateien haben.
Keine Adobe-Paywall
Adobe Acrobat verlangt 19,99 $/Monat für die OCR-Funktion. Smallpdf sperrt es hinter seinem kostenpflichtigen Tarif. iLovePDF begrenzt die Seitenanzahl für kostenlose Nutzer. Unsere Lösung ist kostenlos ohne Tageskontingent, ohne Seitenbegrenzung, ohne Wasserzeichen, ohne Anmeldung.
Dieselbe Engine wie unser Editor
The OCR runs on the same v2/js/ocr/OcrRegionService.js module our main editor uses for in-app text recognition. One source of truth — bug fixes and accuracy improvements ship to both surfaces simultaneously.
30+ Sprachen, kombinierbar
Tesseract unterstützt 100+ Sprachpakete. Wir bieten die 30 meistgewünschten im Dropdown an: Deutsch, Englisch, Spanisch, Französisch, Italienisch, Portugiesisch, Niederländisch, Russisch, Polnisch, Türkisch, Arabisch, Hebräisch, Japanisch, Koreanisch, Chinesisch (Vereinfacht + Traditionell), Hindî, Ukrainisch, Tschechisch, Schwedisch, Norwegisch, Dänisch, Finnisch, Ungarisch, Griechisch, Rumänisch, Bulgarisch, Kroatisch, Serbisch, Slowakisch, Thai, Vietnamesisch, Indonesisch. Kombinieren Sie mehrere Pakete für mehrsprachige Dokumente.
Open-Source-Engine — prüfbar
Tesseract.js ist der JavaScript-Port von Googles Tesseract-OCR-Engine, lizenziert unter Apache 2.0. Dieselbe Engine, die OCRmyPDF verwendet. Sie können den Quellcode lesen, das Modell prüfen, es für immer offline ausführen. Wir liefern keine Blackbox.
Visuelle Treue erhalten
Das ausgegebene PDF ist ein durchsuchbares Bild — die sichtbare Seite ist der Originalscan, die Textebene ist unsichtbar. Unterschriften, Stempel, Layout und exakter Pixelinhalt bleiben identisch mit der Quelle. Die sichere Wahl für rechtliche, vertragliche und archivarische Dokumente.
OCR PDF vs. Adobe, iLovePDF, PDF24, OCRmyPDF
| Merkmal | PDF Edit | Adobe Acrobat | iLovePDF | PDF24 | OCRmyPDF (CLI) |
|---|---|---|---|---|---|
| PDF auf Server hochgeladen? | Nein — 100 % lokal | Ja (Cloud) / Nein (Desktop) | Ja | Ja | Nein (lokale CLI) |
| Kosten | Kostenlos | 19,99 $/Monat | Kostenloses Kontingent begrenzt | Kostenloses Kontingent eingeschränkt | Kostenlos (Open Source) |
| Konto erforderlich? | Niemals | Ja | Kostenloses Kontingent eingeschränkt | Kostenloses Kontingent eingeschränkt | Keine — nur Installation |
| Installation erforderlich? | Nein | Ja (Desktop) oder Web-Konto | Nein | Nein | Ja (Python + Tesseract) |
| OCR-Engine | Tesseract.js (Open Source) | Proprietor Adobe | Proprietär | Tesseract | Tesseract |
| Sprachpakete | 30+ in der Oberfläche, 100+ verfügbar | 40+ | ~25 | ~40 | 100+ |
| Seitenzahl-Limit? | Keine | Keine (kostenpflichtig) | Kostenloses Kontingent begrenzt | Kostenloses Kontingent begrenzt | Keine |
| Tägliches Limit? | Keine | Keine (kostenpflichtig) | 2 Aufgaben/Stunde kostenlos | Stufenbasiert | Keine |
| Visuelle Treue (Durchsuchbares Bild-Modus) | Identisch mit Quelle | Identisch mit Quelle | Identisch mit Quelle | Identisch mit Quelle | Identisch mit Quelle |
| Offline verwendbar nach dem Laden? | Ja | Desktop ja / Web nein | Nein | Nein | Ja (lokale CLI) |
Adobe ist der Goldstandard für Genauigkeit bei schwierigen Fällen (schlechte Scans, gemischte Schriften, exotische Zeichensätze), kostet aber 20 $/Monat und lädt die Datei in der Web-Version hoch. OCRmyPDF ist der Open-Source-Standard für Batch-Automatisierung, erfordert aber eine Python-Installation. Für eine einmalige OCR eines sensiblen Scans ist die browserbasierte lokale Variante die einzige Lösung, die weder Geld kostet noch Ihre Datei kopiert.
Durchsuchbares Bild vs. Bearbeitbarer Text — Was soll ich wählen?
Adobe Acrobat (und einige andere OCR-Tools) bieten zwei Ausgabemodi. Wir verwenden standardmäßig das durchsuchbare Bild, da es für die meisten Dokumente die sicherere Wahl ist. Hier ist der Unterschied:
| Aspekt | 📄 Durchsuchbares Bild (dieses Tool) | 📝 Bearbeitbarer Text (kostenpflichtiger Adobe-Modus) |
|---|---|---|
| Visueller Inhalt | Originalscan, pixelidentisch | Neu generiert mit OCR-geschätzten Schriftarten |
| Unterschriften + Stempel | Exakt erhalten | Durch gerenderten Text ersetzt |
| Suche + Kopieren funktioniert? | Ja | Ja |
| In Acrobat bearbeitbar? | Nein (Text ist unsichtbare Überlagerung) | Ja (Text sind echte Glyphen) |
| Layout-Treue | 100 % | ~95 % — kleine Schrift-/Abstandsabweichungen |
| OCR-Fehler sichtbar? | Versteckt (beeinflussen nur die Suche) | Im gerenderten Text sichtbar |
| Geeignet für | Rechtlich, Verträge, Archivierung — alles, wo der sichtbare Inhalt unverändert bleiben muss | Dokumente, die nach der OCR weiter bearbeitet werden |
Für 95 % der OCR-Anwendungsfälle — einen gescannten Beleg durchsuchbar machen, einen Stapel Verträge indizieren, Text aus einem Fax extrahieren — ist das durchsuchbare Bild die richtige Wahl. Wenn Sie den erkannten Text bearbeiten möchten, führen Sie hier die OCR durch und öffnen Sie das Ergebnis dann im PDF-Edit-Editor, um die gewünschten Bereiche mit „Text bearbeiten“ zu korrigieren.
Wer nutzt OCR für PDFs?
Rechtsanwälte + Rechtsanwaltsgehilfen
Offenlegungsproduktion aus älteren Dokumenten = Kisten gescannter PDFs. OCR macht sie in Fallmanagement-Tools (Relativity, Everlaw, iManage) durchsuchbar. Die lokale Verarbeitung hält privilegierte Inhalte von Drittservern fern.
Buchhalter + Rechnungsprüfer
Belegscans, Lieferantenrechnungen als PDFs, ältere Kontoauszüge — alle benötigen OCR, bevor sie abgeglichen oder in QuickBooks / Xero eingegeben werden können.
Gesundheitsverwaltung
Patientenakten, Laborergebnisse, Aufnahmeformulare für den EHR-Upload. HIPAA-geschützte Daten erfordern lokale Verarbeitung.
Forscher + Bibliothekare
Digitalisierte Archive, Bibliotheken mit Abschlussarbeiten, Mikrofilm-Scans, umgewandelt in durchsuchbare PDFs zur Indexierung.
HR + Recruiting
Als Bild-PDFs eingereichte Lebensläufe, Ausweise, unterzeichnete Angebotsschreiben — OCR macht sie in ATS/HRIS-Systemen durchsuchbar.
Genealogen + Historiker
Alte Volkszzählungsunterlagen, Einwanderungsdokumente, Militärakten — Tesseract verarbeitet gedruckten Text aus dem 19. und 20. Jahrhundert gut, besonders mit dem entsprechenden Sprachpaket.
Tipps für bessere OCR-Genauigkeit
- 1. Scannen Sie mit 300 DPI oder höher.
Tesseract wurde mit 300-DPI-Scans trainiert. Niedrigere Auflösungen verlieren Zeichendetails, und die Genauigkeit sinkt bei unter 200 DPI stark. Die meisten Verbraucherscanner sind standardmäßig auf 300 DPI eingestellt; Handy-Scan-Apps passen sich normalerweise automatisch an.
- 2. Stellen Sie sicher, dass die Seiten gerade sind.
Verzerrte Seiten (mehr als ca. 5° schief) verwirren den Zeilenerkennungsalgorithmus. Die meisten modernen Scan-Apps korrigieren die Ausrichtung automatisch; wenn Ihre das nicht tut, drehen Sie vor der OCR.
- 3. Wählen Sie das richtige Sprachpaket.
"English" and "Spanish" are different models — using the wrong one for a French document will produce gibberish. For genuinely mixed-language documents, combine packs (the language picker accepts e.g.
eng+spa). - 4. Saubere Scans schlagen gute Scans.
Schwarzer Text auf sauberem weißen Hintergrund wird mit fast 99 % Genauigkeit erkannt. Vergilbtes Papier, körnige Fotos oder Text auf farbigen Hintergründen verschlechtert die Genauigkeit. Wenn möglich, scannen Sie in Graustufen oder reinem Schwarzweiß statt in Farbe.
- 5. Verwenden Sie höhere Render-Skalierung (3× / 288 DPI) für kleinen Druck.
Wenn Ihre Quelle kleinen Text enthält — Quittungen, Fußnoten, dichter juristischer Druck — erhöhen Sie die Render-Skalierung auf 3× vor der OCR. Pro Seite langsamer, aber erfasst Details, die Tesseract sonst übersieht.
- 6. Handschrift benötigt ein anderes Tool.
Tesseract ist auf gedruckten Text ausgerichtet und bei Handschriften unzuverlässig. Für handgeschriebene OCR sind Google Cloud Vision Handwriting und Microsoft Read die führenden Optionen (beide kostenpflichtig).
Häufig gestellte Fragen
Was ist OCR bei PDFs?
OCR (Optische Zeichenerkennung) liest die Pixel einer bildbasierten PDF-Seite und schreibt darunter eine echte Textebene, sodass die sichtbare Seite gleich bleibt, aber Strg+F Wörter findet und Text markiert und kopiert werden kann.
Wie führe ich OCR an einem PDF durch?
Laden Sie das gescannte PDF oben hoch, wählen Sie die Dokumentsprache und klicken Sie auf OCR starten. Das durchsuchbare PDF wird auf Ihr Gerät heruntergeladen.
Wie kann ich gescannte Verträge OCR durchsuchbar machen, kostenlos und ohne Upload?
Ja — PDF Edit ermöglicht es, gescannte Verträge OCR durchsuchbar machen kostenlos, ohne Anmeldung und ohne Datei-Upload. Laden Sie den gescannten Vertrag oder das Rechtsdokument hoch, wählen Sie Deutsch als Sprache und klicken Sie auf OCR starten. Tesseract.js läuft 100 % in Ihrem Browser — vertrauliche Vertragsinhalte werden niemals an einen Server übertragen. Das durchsuchbare PDF wird direkt auf Ihr Gerät heruntergeladen.
Kann man ein PDF per OCR verarbeiten?
Ja. Laden Sie das PDF hier hoch und klicken Sie auf OCR starten. Funktioniert für gescannte Dokumente, Faxe, Handy-Scans, rasterisierte Exporte — jedes nur aus Bildern bestehende PDF.
Wird mein gescannter Vertrag beim OCR auf einen Server hochgeladen?
Nein. Die Verarbeitung läuft vollständig in Ihrem Browser-Tab — keine Datei verlässt Ihr Gerät. Das ist besonders wichtig für vertrauliche Rechtsdokumente: gescannte Verträge, Notariatsakte und Compliance-Unterlagen bleiben 100 % lokal. Adobe, iLovePDF, PDF24 und maxai.co laden alle hoch; PDF Edit tut das nicht. Für datenschutzbewusste Nutzer in der Rechts- und Compliance-Branche ist das der entscheidende Unterschied.
Ist dieses OCR-PDF-Tool kostenlos?
Ja. 100 % für immer kostenlos, keine Gebühr pro Datei, kein Tägliches Limit. Adobe Acrobat verlangt 20 $/Monat für dieselbe Funktion.
Wie genau ist die OCR?
Tesseract ist der Open-Source-Standard. Saubere 300-DPI-Scans von gedrucktem Text erreichen eine Genauigkeit von ca. 99 %. Handyfotos bei schlechtem Licht kommen auf etwa 90 %. Handschrift ist von Fall zu Fall verschieden.
Verändert sich der sichtbare Inhalt?
Nein. Die Ausgabe ist ein durchsuchbares Bild — die sichtbare Seite ist der Originalscan, die Textebene ist unsichtbar darunter. Unterschriften, Stempel und Layout bleiben zu 100 % erhalten.
Welche Sprachen werden unterstützt?
30+ im Dropdown: Deutsch, Englisch, Spanisch, Französisch, Italienisch, Portugiesisch, Niederländisch, Russisch, Polnisch, Türkisch, Arabisch, Hebräisch, Japanisch, Koreanisch, Chinesisch (Vereinfacht + Traditionell), Hindî, Ukrainisch, Tschechisch, Schwedisch, Norwegisch, Dänisch, Finnisch, Ungarisch, Griechisch, Rumänisch, Bulgarisch, Kroatisch, Serbisch, Slowakisch, Thai, Vietnamesisch, Indonesisch. Tesseract unterstützt 100+ gesamt — teilen Sie uns mit, wenn Ihre Sprache fehlt.
Gibt es ein Seitenzahl- oder Dateigrößen-Limit?
Kein künstliches Limit. OCR ist jedoch CPU-intensiv — typische gescannte PDFs benötigen auf einem modernen Laptop 5–15 Sekunden pro Seite. Ein 50-seitiges Dokument dauert etwa 5–12 Minuten.
Funktioniert das auf dem Smartphone?
Ja. iPhone Safari, iPad, Android Chrome — aber langsamer als auf dem Desktop, da OCR sehr CPU-intensiv ist. Lange Scans sollten auf einem Laptop verarbeitet werden.
Funktioniert das offline?
Ja, sobald die Seite geladen wurde. Tesseract.js und das verwendete Sprachpaket werden im Browser zwischengespeichert.
Hat die Ausgabe ein Wasserzeichen?
Nein. Saubere Ausgabe, jedes Mal.
Was ist mit handgeschriebenem Text?
Tesseract ist für gedruckten Text ausgelegt. Handschrift ist unzuverlässig; Kursivschrift funktioniert fast nie. Für Handschriften empfehlen sich Google Cloud Vision Handwriting oder Microsoft Read (beide kostenpflichtig).
Wie schneidet dieses Tool gegenüber Adobe Acrobat OCR ab?
Adobe kostet 19,99 $/Monat und lädt die Datei in der Web-Version hoch. Unsere Lösung ist kostenlos und läuft lokal. Adobe ist bei Grenzfällen marginal genauer; bei sauberen Dokumenten sind wir gleichwertig.
Wie schneidet dieses Tool gegenüber OCRmyPDF ab?
Beide nutzen dieselbe Tesseract-Engine. OCRmyPDF läuft serverseitig oder als lokale CLI nach der Installation; unsere Lösung läuft in jedem Browser ohne Installation. Für Batch-Automatisierung gewinnt OCRmyPDF; für Einzeldokumente im Browser gewinnt diese Lösung.
Was ist das beste kostenlose Tool, um gescannte Verträge OCR durchsuchbar machen zu können?
Um gescannte Verträge OCR durchsuchbar machen zu können, ist PDF Edit die beste kostenlose Wahl: kein Upload, keine Anmeldung, kein Tageslimit. Ideal für Rechtsanwälte, Compliance-Teams und alle, die vertrauliche Dokumente lokal verarbeiten müssen. Für serverseitige Batch-Automatisierung ist OCRmyPDF + Tesseract der Open-Source-Standard. Für höchste Genauigkeit bei schwierigen Scans ist Adobe Acrobat der kostenpflichtige Goldstandard.
v2/js/ocr/OcrRegionService.js our editor uses for in-app text recognition — one source of truth, no duplicate code, accuracy improvements land on both surfaces at once.
Last updated: