toolsmith

Kein Upload · alles läuft im Browser

Bild und PDF zu Text (OCR)

Liest die Wörter aus einem Bild oder einem gescannten PDF und gibt Ihnen reinen Text zum Kopieren. Die Erkennung läuft auf Ihrem Gerät.

Bild oder PDF hier ablegen

PNG · JPG · WebP · PDF — eines nach dem anderen

Wohin gehen meine Dateien?

Nirgendwohin. Das Bild wird in diesem Browser-Tab gelesen und nie hochgeladen. Unterwegs ist allein die Erkennungs-Engine, die von einem öffentlichen CDN zu Ihnen herunterkommt — die Richtung ist also umgekehrt.

Warum werden vorher ein paar Megabyte geladen?

Weil OCR eine echte Engine und ein für die gewählte Sprache trainiertes Modell braucht. Zusammen sind das rund 4 bis 6MB. Wir holen sie in dem Moment, in dem Sie den Knopf drücken, und nicht früher; Ihr Browser behält sie danach, sodass das zweite Dokument sofort startet.

Warum ist der Text nicht perfekt?

Wir nutzen die kompakten Modelle, die fünf- bis zehnmal kleiner sind als die genauen (Englisch: 2MB gegen 11MB, Japanisch: 1,5MB gegen 16MB). Bei einem sauberen Scan ist der Unterschied klein, bei einem verwackelten Handyfoto zeigt er sich. Wir wollten Ihnen dafür keine 16MB zumuten. Legen Sie die Seite gerade hin und sorgen Sie für Licht — das hilft deutlich.

Kann es ein PDF lesen?

Ja, bis zu 30 Seiten auf einmal. Jede Seite wird zuerst als Bild gezeichnet und dann gelesen. Wenn im PDF bereits echter Text steckt, ist Kopieren aus einem beliebigen Reader schneller und exakt — OCR ist für die PDFs, die nur Bilder von Papier sind.

Bleibt das Layout erhalten?

Nein. Sie bekommen die Wörter in Lesereihenfolge, keine Spalten, Tabellen oder Überschriften. Wenn das Layout wichtiger ist als die Wörter, ist dies das falsche Werkzeug.

Weitere Werkzeuge

Lesenswert