ツール

OCR 画像文字起こし

スクリーンショット、スキャン、写真から、中国語・英語・日本語・韓国語・ドイツ語・フランス語のテキストをアップロードせずに取り出します。

ブラウザ内で実行AI 開発ツール3.9万
無料
ここにファイルをドロップ

またはファイルを選択してください。ファイルはこのタブの中で処理され、どのサーバーにもアップロードされません。

スクリーンショット、スキャンした契約書、スライドを撮った写真からテキストを書き写すような作業に、画像を他人のサーバーへ送る必要はないはずです。このツールは、エンジンの WebAssembly 移植版である naptha/tesseract.js を通じて、Tesseract をタブの中で実行します。言語を選び、画像を 1 枚または複数ドロップすれば、エンジン自身の信頼度スコア付きでテキストが得られます。中国語のスクリーンショットには英語の用語が混ざっていることが多いため、既定は簡体字中国語+英語です。

動作のしくみ

  • 初回実行時に tesseract.js のワーカー、WASM コア、言語モデルを jsDelivr CDN からダウンロードします。これらはブラウザにキャッシュされ、画像そのものはタブの外に出ません。
  • 複数の画像は 1 つのワーカーで順番に認識し、それぞれの結果にファイル名のラベルを付けます。
  • Tesseract は中国語や日本語の文字の間に空白を入れてしまいます。両隣が CJK 文字の場合だけ空白を取り除くので、GPU 显存 のような混在テキストの区切りは残ります。

データの行き先

どこにも行きません。このツールは完全にブラウザ内で動作します。貼り付けたテキストはページが処理し、サーバーに送信されることも、ログに記録されることもありません。

このツールは無料で登録不要です。結果は開いているページの中にだけあり、どこにも保存されません。

必要なポイント

このツールは無料です。ログインもポイントも必要ありません。

よくある質問

認識精度を上げるにはどうすればよいですか?
Tesseract が最も得意なのは、きれいに印刷された横書きのテキストで、文字の高さがおよそ 20 ピクセル以上ある場合です。テキスト部分だけを切り抜き、画面を撮影した写真ではなくスクリーンショットを使い、言語を正確に選んでください。繁体字中国語を簡体字として認識させると、別の字に置き換わってしまいます。手書き文字や装飾の強いフォントは、このエンジンの得意分野ではありません。
信頼度の数値は何を意味しますか?
ページ全体における Tesseract の単語ごとの信頼度の平均で、0 から 100 の値です。おおむね 90 を超えていればテキストは正しいことが多く、60〜70 台では誤った文字、特に形の似た漢字の誤りを覚悟してください。これは正確さではなくエンジンの確信度を測ったものなので、重要な内容は必ず見直してください。
初回の実行が遅いのはなぜですか?
エンジンと言語データは初回使用時にダウンロードされ(中国語では数 MB)、その後はキャッシュされます。お使いのネットワークで jsDelivr が遅い、またはブロックされている場合は、ダウンロードが止まってツールを実行できません。一度でも実行に成功すれば、以降はキャッシュから動作します。

背後にあるオープンソース

このツールは naptha/tesseract.js(Apache-2.0)の上で動作しています。同じ処理を自分のプログラムに組み込みたい場合は、そのライブラリを使ってください。

naptha/tesseract.js

別の呼び方

  • 画像 文字起こし
  • OCR オンライン
  • 画像 テキスト 抽出
  • スクショ 文字 読み取り
  • 日本語 OCR 無料
  • tesseract オンライン