Werkzeuge

OCR: Bild zu Text

Holt Text aus Screenshots, Scans und Fotos auf Chinesisch, Englisch, Japanisch, Koreanisch, Deutsch oder Französisch – ohne Upload.

Läuft im BrowserKI-Entwicklertools38.705
Kostenlos
Dateien hierher ziehen

Oder Dateien auswählen. Sie werden in diesem Tab verarbeitet und nie auf einen Server hochgeladen.

Text aus einem Screenshot, einem gescannten Vertrag oder dem Foto einer Folie herauszukopieren, ist genau die Art Aufgabe, für die man das Bild nicht auf den Server eines anderen schicken sollte. Dieses Tool führt Tesseract über naptha/tesseract.js, die WebAssembly-Portierung der Engine, direkt im Tab aus: Sprache wählen, ein oder mehrere Bilder ablegen und den Text samt dem eigenen Konfidenzwert der Engine erhalten. Voreingestellt ist vereinfachtes Chinesisch plus Englisch, weil chinesische Screenshots so oft englische Begriffe enthalten.

So arbeitet es

  • Beim ersten Durchlauf werden der tesseract.js-Worker, der WASM-Kern und das Sprachmodell vom jsDelivr-CDN geladen; der Browser speichert sie im Cache, und das Bild selbst verlässt den Tab nie.
  • Mehrere Bilder werden nacheinander mit einem einzigen Worker erkannt, und jedes Ergebnis wird mit seinem Dateinamen beschriftet.
  • Tesseract setzt Leerzeichen zwischen chinesische und japanische Zeichen; sie werden entfernt, wo beide Nachbarn CJK-Zeichen sind, sodass gemischter Text wie GPU 显存 seine Lücke behält.

Wohin Ihre Daten gehen

Nirgendwohin. Dieses Werkzeug läuft vollständig in Ihrem Browser: Der eingefügte Text wird von der Seite verarbeitet und weder an einen Server übertragen noch protokolliert.

Dieses Tool ist kostenlos und braucht kein Konto. Die Ergebnisse existieren nur in Ihrer geöffneten Seite und werden nirgends gespeichert.

Was es kostet

Dieses Werkzeug ist kostenlos, ohne Anmeldung und ohne Punkte.

Häufige Fragen

Wie erhalte ich bessere Ergebnisse?
Tesseract arbeitet am besten mit sauberem, gedrucktem, waagerechtem Text, dessen Zeichen mindestens etwa 20 Pixel hoch sind. Schneiden Sie auf den Text zu, verwenden Sie einen Screenshot statt eines Fotos vom Bildschirm und wählen Sie die exakte Sprache – traditionelles Chinesisch, als vereinfachtes erkannt, führt zu Verwechslungen. Handschrift und stark stilisierte Schriften liegen außerhalb dessen, was diese Engine gut kann.
Was bedeutet der Konfidenzwert?
Er ist Tesseracts mittlere Wortkonfidenz für die Seite, von 0 bis 100. Oberhalb von etwa 90 stimmt der Text meist; im Bereich von 60 bis 79 ist mit falschen Zeichen zu rechnen, besonders bei ähnlich aussehenden chinesischen Zeichen. Der Wert misst die Sicherheit der Engine, nicht die Genauigkeit – lesen Sie also alles Wichtige immer Korrektur.
Warum ist der erste Durchlauf langsam?
Engine und Sprachdaten werden bei der ersten Nutzung heruntergeladen, für Chinesisch mehrere Megabyte, und danach zwischengespeichert. Ist jsDelivr in Ihrem Netz langsam oder gesperrt, bleibt der Download hängen und das Tool kann nicht starten; nach einem erfolgreichen Durchlauf funktioniert es wieder aus dem Cache.

Das Open Source dahinter

Dieses Werkzeug läuft auf naptha/tesseract.js, veröffentlicht unter Apache-2.0. Wer dasselbe Verhalten im eigenen Programm braucht, greift zu dieser Bibliothek.

naptha/tesseract.js

Auch bekannt als

  • bild zu text
  • ocr online kostenlos
  • text aus bild extrahieren
  • screenshot zu text
  • texterkennung online
  • tesseract online