CLI-Tool
scribeocr/scribe.js avatar
scribeocr/scribe.js

Scribe.js: dokumentierte Funktionen und Grenzen

JavaScript OCR und Textextraktion für Bilder und PDFs. Projekte Scribe OCR: offiziell unterstütztes GUI-Frontend für Scribe.js. Website unter scribeocr.com, Repo unter github.com/scribeocr/scribeocr. Wenn Sie ein Projekt oder Beispiel-Repo haben, das Scribe.js verwendet, können Sie es gerne mithilfe einer Pull-Anfrage zu dieser Liste hinzufügen.

320 Sterne24 ForksJavaScriptAGPL-3.0
GitHub

Auf einen Blick

Was ist das?
Scribe.js im deutschen Faktencheck: Zweck, Einstieg, technische Bausteine und Grenzen der veröffentlichten README.
Für wen ist es gedacht?
Geeignet für Anwender, deren konkreter Bedarf zum README-Umfang von Scribe.js passt. Ungeeignet als Ersatz für fehlende Betriebsannahmen.
Darf ich es kommerziell nutzen?
Ja, unter strengen Bedingungen. AGPL-3.0 ist eine Lizenz mit Netzwerk-Copyleft: Wenn andere eine veränderte Version über ein Netzwerk nutzen, etwa als gehosteten Dienst, müssen Sie ihnen den Quellcode unter derselben Lizenz anbieten.
Wird es noch gepflegt?
Ja. Die letzten Commits kamen vor 3 Tagen.
In welcher Sprache ist es geschrieben?
Hauptsächlich JavaScript, laut der Sprachstatistik von GitHub.

Die Antworten beruhen auf den GitHub-Daten des Projekts (zuletzt abgeglichen am 14. September 2026) und auf unserer Analyse. Sie sind keine Rechtsberatung.

TIEFGEHENDE OPEN-SOURCE-ANALYSE

Wofür Scribe.js gedacht ist

Die README stellt Scribe.js als JavaScript-Bibliothek vor, die OCR durchführt und Text aus Bildern und PDFs extrahiert. Es werden drei häufige Anwendungsfälle aufgeführt: Texterkennung aus Bildern, Textextraktion aus benutzerhochgeladenen PDFs (bei textbasierten PDFs wird vorhandener Text extrahiert, bei bildbasierten PDFs läuft OCR) und das Schreiben von PDFs mit einer hochwertigen unsichtbaren Textebene. Im letzten Fall können Sie Text in ein vorhandenes PDF einfügen und es durchsuchbar machen. Die Bibliothek richtet sich an Entwickler; Endbenutzer, die Dokumente scannen möchten, werden an die offiziell unterstützte GUI unter scribeocr.com verwiesen, deren Repository verlinkt ist. Scribe.js wird im README als JavaScript OCR and text extraction for images and PDFs. Projects Scribe OCR: officially supported GUI front-end for Scribe.js Site at scribeocr.com, repo at github.com/scribeocr/scribeocr If you have a project or example repo that uses Scribe.js, feel free to add it to this list using a pull request. beschrieben. Für diesen konkreten Eintrag sind npm install scribe.js, OCR, PDF, Tesseract, browser die relevanten Anker. Die Quelle beschreibt damit den vorgesehenen Umfang, macht aber keine pauschale Zusage für andere Betriebssysteme, Versionen oder Datenmengen. Scribe.js wird im README als JavaScript OCR and text extraction for images and PDFs. Projects Scribe OCR: officially supported GUI front-end for Scribe.js Site at scribeocr.com, repo at github.com/scribeocr/scribeocr If you have a project or example repo that uses Scribe.js, feel free to add it to this list using a pull request. beschrieben. Für diesen konkreten Eintrag sind npm install scribe.js, OCR, PDF, Tesseract, browser die relevanten Anker. Die Quelle beschreibt damit den vorgesehenen Umfang, macht aber keine pauschale Zusage für andere Betriebssysteme, Versionen oder Datenmengen.

Die dokumentierten Bausteine von Scribe.js

Installieren Sie Scribe.js von npm mit dem Befehl `npm i scribe.js-ocr`. Das Paket ist in JavaScript mit ESM geschrieben, sodass Sie es direkt aus Browser- oder Node.js-Code ohne Build-Schritt importieren können. Die README zeigt zwei Importstile: einen für Node.js oder Browser mit Bundler mit `import scribe from 'scribe.js-ocr'` und einen für den Browser ohne Bundler, mit Import-Map oder relativem Pfad zu `node_modules/scribe.js-ocr/scribe.js`. Diese zweite Form erfordert ausdrücklich, dass alle Dateien von derselben Herkunft wie die importierende Datei bereitgestellt werden; die README warnt, dass Import von einer CDN nicht funktioniert und keine UMD-Version existiert. Der Paketname auf npm ist `scribe.js-ocr`, was nicht identisch mit dem Repository-Namen ist , ein Detail, das man beim Installieren beachten sollte.

Erster Einstieg mit npm install scribe.js

Für neue Benutzer nimmt die Funktion `scribe.extractText` ein Array von Quellen und gibt Text mit angemessenen Standardeinstellungen zurück. Die README weist darauf hin, dass dies für die Produktion nicht ideal ist. Für volle Kontrolle erstellen Sie ein Dokumentobjekt mit `openDocument` und rufen dann Methoden wie `recognize({ langs: ['eng'] })` auf, um OCR auszuführen, und `download('pdf', 'receipt.pdf')`, um ein durchsuchbares PDF zu schreiben. Beide Beispiele rufen nach der Erkennung `await scribe.terminate()` auf, damit der Node-Prozess beendet werden kann. Das Dokumentobjekt kann ein Bild, ein PDF oder vorhandene OCR-Dateien akzeptieren, aber die README erläutert nicht, welche OCR-Dateiformate unterstützt werden. Das Beispiel verwendet `['receipt.png']` als Eingabe, was darauf hindeutet, dass Bilder direkt akzeptiert werden.

Betrieb und Konfiguration bei Scribe.js

Die README ist bezüglich des Browserverhaltens eindeutig: Alle Dateien müssen von derselben Herkunft wie die Datei bereitgestellt werden, die Scribe.js importiert. Das bedeutet, dass der Import von einer CDN nicht funktioniert und keine UMD-Version vorhanden ist. Die Bibliothek ist nur ESM, daher ist im Browser ein Bundler oder eine Import-Map erforderlich. Diese Einschränkungen werden ohne Erklärung aufgelistet, daher sollten Entwickler die genaue Serverkonfiguration verifizieren, bevor sie sich darauf verlassen. Die README erwähnt über diese Herkunftsregel hinaus keine Browserkompatibilitätsdetails, sodass ältere Browser je nach ESM-Unterstützung funktionieren oder nicht.

Grenzen der README-Aussagen · scribeocr scribe js

Die README verlinkt auf vier Vorlagen-Repositories, die Scribe.js in verschiedenen Umgebungen zeigen: Browser mit ESM ohne Build-Schritt, Browser mit Next.js, Browser mit Webpack 5 und Browser mit Vue.js v2. Sie verweist auch auf ein examples-Verzeichnis im Repository und listet ein Projekt auf: Scribe OCR, das offizielle GUI-Frontend, gehostet auf scribeocr.com, mit Quellcode unter github.com/scribeocr/scribeocr. Mitwirkende werden eingeladen, über Pull-Requests eigene Beispiel-Repositories oder Projekte hinzuzufügen, mit der Bedingung, dass Beispiele gut dokumentiert sind und Projekte funktional und aktiv gepflegt werden. Die README sagt nicht, ob diese Vorlagen mit jedem Release aktuell gehalten werden.

Lizenz, Pflege und konkrete Prüfung · scribeocr scribe js

Das Repository enthält einen Leitfaden, eine API-Referenz, eine CLI-Referenz und einen examples-Ordner, die alle von der README verlinkt werden. Ein eigener Artikel vergleicht Scribe.js mit Tesseract.js, aber die README fasst die Schlussfolgerungen dieses Artikels nicht zusammen. Die offizielle GUI wird als Endbenutzeranwendung zum Scannen von Dokumenten beschrieben, getrennt von der Entwicklerbibliothek. Die README gibt nicht an, welche Funktionen der Bibliothek die GUI freigibt, oder ob der Vergleichsartikel eine Bibliothek der anderen vorzieht. Das Dokumentationsverzeichnis wird als `./docs/` referenziert, mit Dateien wie `guide.md` und `API.md`, aber die README bietet kein Inhaltsverzeichnis oder Lesereihenfolge. Als erster projektbezogener Check dient bei Scribe.js der dokumentierte Einstieg npm install scribe.js. Beobachte dabei die von Scribe.js erzeugte Ausgabe und prüfe die zugehörige README-Stelle OCR. Erst diese konkrete Beobachtung zeigt, ob die angenommene Umgebung zu Scribe.js passt; allgemeine Leistungsversprechen lassen sich aus dem Material nicht ableiten.

Redaktionelles Fazit

Geeignet für Anwender, deren konkreter Bedarf zum README-Umfang von Scribe.js passt. Ungeeignet als Ersatz für fehlende Betriebsannahmen. Prüfe zuerst npm install scribe.js, OCR und die dabei entstehende Ausgabe oder Konfiguration, bevor du Scribe.js verbindlich einführst.

Offizielle Quellen

  1. Official README
  2. Project repository
  3. Release notes
Community-Notizen

Community-Notizen