OCR工具 — 免費線上從圖片中擷取文字
光學字元辨識(OCR)是一種從圖片中讀取文字並將其轉換為可編輯、可選擇的數位文字的技術。在OCR出現之前,數位化列印文件需要人工逐字重新輸入。今天,OCR可以從掃描文件、標誌照片、不可複製內容的截圖以及收據、名片或手寫筆記的圖片中即時擷取文字。 我們的OCR工具直接在您的瀏覽器中執行Tesseract.js——世界上最準確的開源OCR引擎之一,最初由HP開發,由Google維護。由於Tesseract在客戶端執行,您的圖片永遠不會離開您的裝置:不會上傳檔案到伺服器,不會儲存資料,也不需要帳戶。這種隱私優先的方法使我們的工具適用於敏感文件——醫療表格、法律合約、財務報表——這些不適合上傳到第三方伺服器的情況。
圖片文字辨識
免費 · 無需註冊
分步指南
選擇辨識語言
根據圖片中文字的主要語言選擇英文、簡體中文(簡體中文)或繁體中文(繁體中文)。語言選擇至關重要——當應用錯誤的語言模型時,OCR準確性會顯著下降,因為不同語言有不同的字元形狀和頻率模式。對於混合語言圖片(例如,中文文件中的英文技術術語),選擇主導語言,之後手動糾正少數語言部分。
上傳或拖放您的圖片
將圖片檔案拖入上傳區域或點擊瀏覽。支援的格式:JPEG、PNG和WebP,最大50 MB。為獲得最佳OCR效果,使用具有以下特徵的圖片:清晰、高對比的文字(白底黑字);解析度至少300 DPI(對於掃描文件)或全螢幕解析度(對於截圖);最小的透視變形(正面拍攝的圖片,不是斜角的);沒有嚴重的模糊或運動偽影。低品質圖片仍會被處理,但準確性會隨圖片品質顯著下降。
點擊「擷取文字」並等待處理
點擊擷取文字按鈕。首次執行時,Tesseract會下載您所選語言的語言資料(英文約10-20 MB,中文約15-25 MB)。這次一次性下載會快取在您的瀏覽器中——後續使用相同語言即時完成。進度條顯示辨識進度從0%到100%。處理時間取決於圖片大小和複雜性:標準A4頁面的文字在現代電腦上通常需要3-10秒。
檢查並編輯擷取的文字
擷取的文字顯示在可編輯的文字區域中。OCR不是完美的——可能會出現錯誤,尤其是:異常字體、非常小的文字(8pt以下)、手寫體、降質或老化的文件以及具有顯著背景雜訊的圖片。檢查輸出是否有明顯錯誤。常見的OCR錯誤:"0"與"O"混淆,"1"與"l"或"I"混淆,"5"與"S"混淆,重音符號字元誤讀。文字區域完全可編輯——在複製或下載之前直接在輸出中糾正錯誤。
複製或下載文字
使用複製按鈕將擷取的文字放入剪貼簿,以便立即貼上到任何應用程式中。使用下載.txt按鈕將擷取的文字儲存為純文字檔案。出於法律或檔案目的,考慮下載.txt檔案作為記錄。文字區域下方顯示的字元計數可讓您快速驗證擷取的完整性——與您對圖片包含文字量的手動估計進行比較。
處理多頁文件
我們的OCR工具一次處理一張圖片。對於多頁掃描文件,分別處理每一頁並合併文字檔案。對於包含文字作為實際文字(而非掃描圖片)的PDF文件,請改用我們的PDF轉TXT工具——它無需OCR處理即可100%準確地擷取文字。將我們的OCR工具保留用於圖片和掃描PDF,其中文字僅以像素形式存在,而非嵌入的數位文字。
使用技巧與最佳實踐
以最低300 DPI掃描或拍攝文件以獲得最佳準確性——現代智慧型手機相機在良好照明下拍攝的照片通常足夠。
使用高對比:拍攝時將文件放在平坦、非反光的白色表面上。避免陰影橫跨文字。
在處理前校正傾斜圖片——文字傾斜超過5-10度時OCR準確性會明顯下降。首先使用我們的圖片裁切/旋轉工具來校正方向。
對於收據或小字體文件,拍攝近距離照片或以600 DPI掃描以獲得小文字的更好準確性。
手寫辨識:Tesseract可以處理印刷體手寫(清晰的印刷體字母),但難以處理草書或非正式手寫。對於手寫,使用專門的手寫OCR服務。
擷取後,在文字處理器中使用Ctrl+A然後拼字檢查,快速識別產生非單詞的OCR錯誤。
對於機密文件,在處理敏感檔案之前,驗證工具是否在客戶端執行(檢查瀏覽器開發者工具中的網路標籤——在OCR處理期間不應發生網路請求)。
常見問題解答
OCR技術已經改變了我們與物理和基於圖片的文字互動的方式,我們基於瀏覽器的實現使專業品質的文字擷取對所有人可用,無需帳戶、訂閱或隱私權犧牲。上傳圖片、選擇語言、擷取文字並將其直接複製到您的工作流程中——大多數文件的整個過程不到一分鐘。對於大量文件處理或手寫辨識,專用OCR服務提供額外能力;對於從圖片和截圖中進行日常文字擷取,我們的工具提供即時、私密和準確的結果。
免費試用此工具 →open_in_new