LibraTool logoLibraTool

免費OCR——圖片文字提取器

使用 PP-OCRv5 從圖片、截圖、掃描件和 PDF 中提取文字(或儲存為可搜尋的 PDF),全程在瀏覽器中執行。支援拉丁、中文、日文、韓文、西里爾、阿拉伯、天城文、泰文、希臘、泰米爾和泰盧固文字。

許多線上 OCR 網站限制每小時或每天的免費頁數——這裡沒有上限,圖片保留在你的裝置上。

將檔案拖放到此處或點選瀏覽

JPG, PNG, WebP, BMP, PDF, HEIC, HEIF · 無強制大小限制

或按 Ctrl+V 從剪貼簿貼上

你可以一次拖放多個檔案

瀏覽檔案

提示:可以用 Ctrl+V 貼上截圖

掃描版 PDF 同樣適用:每一頁都會被識別,最終您將獲得可搜尋的 PDF。

你的檔案永遠不會離開你的裝置。所有處理都在你的瀏覽器中本地進行。

工作原理

此處的 OCR(光學字元識別)直接在你的瀏覽器中執行 PP-OCRv5,這是 PaddleOCR 專案的開源模型集。它能識別照片或掃描件中的印刷文字,圖片全程不會離開你的裝置。

  1. 1
    先找出文字區域
    檢測模型會掃描圖片,勾勒出每一塊看起來像文字行的區域,處理時會使用最長邊縮放到約 960 畫素的副本。這就是收據照片也能識別的原因:模型會定位文字,而不是假定整張圖片是乾淨的頁面。無論你識別哪種語言,這一步都相同,所以只需下載一次(約 12 MB)並重復使用。
  2. 2
    為你的文字系統下載一個識別模型
    識別字形取決於文字系統,因此會為你選擇的文字下載第二個模型——大多數約 8 MB,韓文 13 MB,中文和日文 17 MB。選擇拉丁文字總共約 19 MB。每個模型都會快取,所以切換回用過的文字不會再下載。
  3. 3
    每一行都會被擺正並讀取
    每個檢測到的文字行都會檢查方向,必要時旋轉至正立,然後交給識別模型逐字元讀取。之後會重建閱讀順序,從上到下、從左到右,因此輸出與你看到的版面一致,而不是檢測器碰巧找到文字方塊的順序。
  4. 4
    返回帶文字方塊和置信度的文字
    每一行都帶有置信度分數和它的來源座標,因此你能清楚看到從哪裡讀到了什麼,還可以匯出保留這些位置的 hOCR。清晰、高對比度的文字得分遠高於 90%;低解析度、反光和手寫會拉低得分。

你的圖片保留在你的裝置上——甚至不會為處理而臨時上傳。模型檔案本身從我們自己的伺服器下載,絕不使用第三方 CDN。可安全用於身份證件、合同、醫療檔案或任何包含敏感內容的文字。

相關工具

常見問題