實用工具
把檔案拖到這裡
或點選選擇檔案。檔案只在目前分頁裡處理,不會上傳到任何伺服器。
從螢幕截圖、掃描的合約或拍下來的投影片裡複製文字,本來就不該需要把圖片交給別人的伺服器。這個工具透過 naptha/tesseract.js(Tesseract 引擎的 WebAssembly 移植版)在目前的分頁裡完成辨識:選好語言,拖進一張或多張圖片,就能取得文字以及引擎本身給出的信賴度。預設是簡體中文加英文,因為中文截圖裡十之八九夾雜著英文術語;辨識繁體中文時,記得把語言切換成繁體中文。
它是怎麼運作的
- 第一次執行會從 jsDelivr CDN 下載 tesseract.js 的 worker、WASM 核心和語言模型,之後由瀏覽器快取;圖片本身始終不會離開這個分頁。
- 多張圖片由同一個 worker 依序辨識,每段結果前面都標有對應的檔名。
- Tesseract 會在中文、日文字元之間插入空格,工具只刪除兩側都是 CJK 字元的空格,所以 GPU 显存 這種中英混排會保留原本的間隔。
你的資料去了哪裡
哪也沒去。本工具完全在你的瀏覽器裡執行:你貼上的文字由頁面處理,不會傳輸到任何伺服器,也不會寫進任何紀錄。
本工具免費且免登入,執行結果只存在於你目前的頁面裡,不會被儲存到任何地方。
它要花多少
本工具完全免費,不需要登入,也不消耗點數。
常見問題
- 怎樣提高辨識準確率?
- Tesseract 最擅長清晰、印刷體、橫式排列的文字,字高最好在 20 像素左右以上。先把圖片裁到只剩文字,用螢幕截圖而不是對著螢幕拍照,語言也要選對——繁體中文以簡體辨識會出現大量錯字。手寫字和花俏的藝術字超出了這個引擎的能力範圍。
- 信賴度這個數字代表什麼?
- 它是 Tesseract 對整頁各個詞的平均信賴度,範圍 0 到 100。90 以上通常大致正確;六、七十分就要預期會有錯字,尤其是字形相近的漢字。它衡量的是引擎有多確定,而不是實際準確率,重要的內容務必親自校對一遍。
- 為什麼第一次這麼慢?
- 第一次使用要下載辨識引擎和語言資料,中文的有好幾 MB,之後都從快取載入。如果你的網路連到 jsDelivr 很慢或被封鎖,下載會卡住,工具就無法執行;只要成功執行過一次,之後就能直接從快取載入。
背後的開源專案
本工具執行在 naptha/tesseract.js 之上,以 Apache-2.0 授權發布。如果你需要在自己的程式裡實作同樣的能力,直接用這個函式庫。
naptha/tesseract.js也常被稱作
- 線上 ocr 辨識
- 圖片轉文字
- 圖片文字辨識
- 免費 ocr
- 截圖文字辨識
- 繁體中文 ocr