SKSolveKit

Dateien verlassen dieses Gerät nicht

Texterkennung

Mach aus gescannten Seiten durchsuchbaren Text.

Erkenne den Text gescannter Seiten direkt im Browser — auf Englisch oder Spanisch — und lade ihn als reinen Text oder als durchsuchbare Kopie des PDFs herunter. Nichts wird hochgeladen.

Dateien werden gelesen …

Was es löst

Durchsuch- und kopierbarer Text aus Seiten, die nur Bilder waren.

Dieses Werkzeug erkennt Text auf gescannten Seiten mit Tesseract-Modellen, die von dieser Website ausgeliefert werden und im Browser laufen — verfügbar sind derzeit Englisch und Spanisch. Wähle Sprache und Seiten, verfolge den Fortschritt live Seite für Seite mit der Möglichkeit abzubrechen, und lade dann den reinen Text als TXT-Datei oder ein durchsuchbares PDF herunter, das unsichtbaren Text über die Originalseiten legt.

Die Erkennungsqualität hängt von der Scanqualität ab: Saubere, gerade Scans mit hoher Auflösung werden gut gelesen, blasse oder schiefe senken die Zuverlässigkeit pro Seite. Jeder Durchlauf ist auf 20 Seiten begrenzt, damit der Speicher dieses Geräts nicht erschöpft wird.

Typische Anwendungsfälle

01

Eine Vertragsrevision prüfen

Vergleiche den verschickten Entwurf mit der zurückgekommenen Version und sieh vor der Unterschrift genau, welche Seiten angefasst wurden.

02

Ein Scan-Archiv nutzbar machen

Erkenne den Text englischer oder spanischer Scans und exportiere durchsuchbare Kopien, die du zitieren und durchsuchen kannst.

03

Eine Veröffentlichung vorprüfen

Lass die vier Barrierefreiheits-Checks über einen Bericht laufen, bevor er zur Fachprüfung geht, und behebe die offensichtlichen Blocker zuerst.

Kurzanleitung

Vom geschlossenen Dokument zu klaren Antworten.

  1. 01Öffne das PDF, das du verstehen willst; für einen Vergleich fügst du beide Versionen hinzu.
  2. 02Wähle, was laufen soll: den Textvergleich, Sprache und Seiten der Erkennung oder die vier Barrierefreiheits-Checks.
  3. 03Starte die Analyse und verfolge den Fortschritt Seite für Seite, direkt auf den Seiten.
  4. 04Lies das Ergebnis am Bildschirm und lade bei Bedarf den Text oder den Bericht als Datei herunter.

Grenzen, die man kennen sollte

Ehrlich darüber, was die Analyse sehen kann.

  • 01

    Der Vergleich liest extrahierbaren Text: Gescannte Seiten ohne Textebene lassen sich nicht vergleichen, und rein visuelle Änderungen wie Bilder oder Layout werden nicht erkannt. Erkenne Scans vorher mit OCR.

  • 02

    Die Texterkennung bietet derzeit Englisch und Spanisch, bis zu 20 Seiten pro Durchlauf — eine bewusste Grenze, damit der Speicher des Geräts nicht erschöpft wird — und ihre Qualität hängt von der Scanqualität ab.

  • 03

    Das Barrierefreiheits-Ergebnis ist eine praktische Vorprüfung, keine PDF/UA- oder WCAG-Zertifizierung; eine konforme Veröffentlichung braucht weiterhin eine Fachvalidierung.

  • 04

    Alles läuft auf diesem Gerät: Sehr große Dokumente sind durch den Speicher des Browsers begrenzt, und jedes Ergebnis ist ein neuer Download, der das Original nie überschreibt.

Häufige Fragen

OCR für PDFs — FAQ.

01Lädt dieses Werkzeug mein PDF hoch?

Nein. Die Analyse läuft im Browser, und die Erkennungsmodelle werden von dieser Website selbst ausgeliefert. Die Dokumentbytes verlassen das Gerät nicht und erreichen keinen Server.

02Warum findet es auf gescannten Seiten nichts?

Ein Scan ist ein Foto der Seite: Es gibt keine Textebene, die gelesen werden könnte. Führe zuerst OCR aus, um eine hinzuzufügen, und vergleiche oder prüfe dann die erkannte Kopie.

03Wie zuverlässig ist der erkannte Text?

Das hängt vom Scan ab: Saubere, gerade Seiten mit guter Auflösung werden gut gelesen, während blasse oder schiefe die angezeigte Zuverlässigkeit pro Seite senken. Prüfe das Ergebnis, bevor du dich darauf verlässt.

04Ist das Barrierefreiheits-Ergebnis eine offizielle Zertifizierung?

Nein. Geprüft werden vier praktische Voraussetzungen — Tags, Sprache, Titel und reine Scan-Seiten. Volle PDF/UA- oder WCAG-Konformität erfordert Fachvalidierung und manuelle Prüfung.

Verwandte Werkzeuge

Weiter am Dokument arbeiten.

Alle PDF-Werkzeuge