OCR工具 — 免費網上從圖片擷取文字
光學字符辨識(OCR)係一種從圖片入面讀取文字然後將佢轉換為可編輯、可選擇嘅數碼文字嘅技術。喺OCR出現之前,數碼化印刷文件需要人手逐個字重新輸入。今日,OCR可以從掃描文件、標誌相片、冇得複製嘅內容嘅截圖,以及收據、名片或者手寫筆記嘅圖片入面即時擷取文字。 我哋嘅OCR工具直接喺你嘅瀏覽器入面執行Tesseract.js——世界上最準確嘅開源OCR引擎之一,最初由HP開發,由Google維護。因為Tesseract喺客戶端執行,你嘅圖片永遠唔會離開你嘅裝置:唔會上傳檔案去伺服器,唔會儲存數據,亦都唔需要帳戶。呢種私隱優先嘅方法令我哋嘅工具適用於敏感文件——醫療表格、法律合約、財務報表——呢啲唔適合上傳到第三方伺服器嘅情況。
圖片文字識別
免費 · 無需註冊
分步指南
選擇辨識語言
根據圖片入面文字嘅主要語言選擇英文、簡體中文(簡體中文)或繁體中文(繁體中文)。語言選擇好重要——當應用錯嘅語言模型嗰陣,OCR準確性會顯著下降,因為唔同語言有唔同嘅字符形狀同頻率模式。對混合語言圖片(例如,中文文件入面嘅英文技術術語),選擇主導語言,之後手動修正少數語言部分。
上傳或拖放你嘅圖片
將圖片檔案拖入上傳區域或點擊瀏覽。支援嘅格式:JPEG、PNG同WebP,最大50 MB。為咗得到最佳OCR效果,使用有呢啲特徵嘅圖片:清晰、高對比嘅文字(白底黑字);解像度最少300 DPI(對掃描文件)或者全螢幕解像度(對截圖);最少嘅透視變形(正面影嘅相,唔係斜角嘅);冇嚴重嘅模糊或運動偽影。低質素圖片都會俾處理,但係準確性會隨住圖片質素顯著下降。
點擊「擷取文字」然後等待處理
點擊擷取文字掣。第一次執行嗰陣,Tesseract會下載你所選語言嘅語言數據(英文約10-20 MB,中文約15-25 MB)。呢次一次性下載會緩存喺你嘅瀏覽器入面——之後用相同語言會即時完成。進度條會顯示辨識進度由0%到100%。處理時間取決於圖片大細同複雜程度:標準A4頁面嘅文字喺現代電腦上通常需要3-10秒。
檢查同編輯擷取咗嘅文字
擷取咗嘅文字會顯示喺可以編輯嘅文字區域入面。OCR唔係完美嘅——可能會有錯誤,尤其係:唔常見嘅字體、非常細嘅文字(8pt以下)、手寫體、老化或者退咗色嘅文件,同埋有顯著背景雜訊嘅圖片。檢查輸出有冇明顯嘅錯誤。常見OCR錯誤:"0"同"O"混淆,"1"同"l"或"I"混淆,"5"同"S"混淆,重音符號字符誤讀。文字區域係完全可編輯嘅——喺複製或下載之前可以直接喺輸出入面修正錯誤。
複製或下載文字
使用複製掣將擷取咗嘅文字放入剪貼簿,咁就可以即刻貼上去任何應用程式。使用下載.txt掣將擷取咗嘅文字儲存做純文字檔案。出於法律或檔案保存目的,考慮下載.txt檔案作為記錄。文字區域下面顯示嘅字數統計可以畀你快速驗證擷取嘅完整性——同你對圖片包含幾多文字嘅手動估計進行比較。
處理多頁文件
我哋嘅OCR工具一次處理一張圖片。對多頁掃描文件,分開處理每一頁然後合併文字檔案。對包含文字作為實際文字(而唔係掃描圖片)嘅PDF文件,請改用我哋嘅PDF轉TXT工具——佢唔需要OCR處理就可以100%準確咁擷取文字。將我哋嘅OCR工具留返俾圖片同掃描PDF使用,當中文字淨係以像素形式存在,而唔係嵌入嘅數碼文字。
使用技巧與最佳實踐
以最少300 DPI掃描或影相以獲得最佳準確性——現代智能手機相機喺良好光線下影嘅相通常已經足夠。
使用高對比:影相嗰陣將文件放喺平坦、唔反光嘅白色表面上。避免陰影橫過文字。
喺處理之前校返正傾斜咗嘅圖片——文字傾斜超過5-10度嗰陣OCR準確性會明顯下降。先用我哋嘅圖片裁剪/旋轉工具去校返正方向。
對收據或細字體文件,影近鏡或者用600 DPI掃描以獲得細文字嘅更好準確性。
手寫辨識:Tesseract可以處理印刷體手寫(清晰嘅印刷體字母),但係好難處理草書或非正式手寫。對手寫,使用專門嘅手寫OCR服務。
擷取之後,喺文字處理器入面用Ctrl+A然後拼字檢查,快速識別產生非單詞嘅OCR錯誤。
對機密文件,喺處理敏感檔案之前,驗證工具係咪喺客戶端執行(檢查瀏覽器開發者工具入面嘅網絡標籤——喺OCR處理期間唔應該發生網絡請求)。
常見問題解答
OCR技術已經改變咗我哋同物理同基於圖片嘅文字互動嘅方式,而我哋基於瀏覽器嘅實現令到專業質素嘅文字擷取對每個人都可以使用,唔需要帳戶、訂閱或者犧牲私隱。上傳圖片、選擇語言、擷取文字然後將佢直接複製到你嘅工作流程入面——成個過程對大多數文件都唔使一分鐘。對大量文件處理或手寫辨識,專用OCR服務提供額外能力;對從圖片同截圖入面做日常文字擷取,我哋嘅工具提供即時、私密同準確嘅結果。
免費試用此工具 →open_in_new