OCR工具 — 免费在线从图像中提取文字
光学字符识别(OCR)是一种从图像中读取文字并将其转换为可编辑、可选择的数字文本的技术。在OCR出现之前,数字化打印文档需要人工逐字重新输入。今天,OCR可以从扫描文档、标志照片、不可复制内容的截图以及收据、名片或手写笔记的图像中即时提取文字。 我们的OCR工具直接在您的浏览器中运行Tesseract.js——世界上最准确的开源OCR引擎之一,最初由HP开发,由Google维护。由于Tesseract在客户端运行,您的图像永远不会离开您的设备:不会上传文件到服务器,不会存储数据,也不需要账户。这种隐私优先的方法使我们的工具适用于敏感文档——医疗表格、法律合同、财务报表——这些不适合上传到第三方服务器的情况。
图片文字识别
免费 · 无需注册
分步指南
选择识别语言
根据图像中文字的主要语言选择英文、简体中文(简体中文)或繁体中文(繁体中文)。语言选择至关重要——当应用错误的语言模型时,OCR准确性会显著下降,因为不同语言有不同的字符形状和频率模式。对于混合语言图像(例如,中文文档中的英文技术术语),选择主导语言,之后手动纠正少数语言部分。
上传或拖放您的图像
将图像文件拖入上传区域或点击浏览。支持的格式:JPEG、PNG和WebP,最大50 MB。为获得最佳OCR效果,使用具有以下特征的图像:清晰、高对比度的文字(白底黑字);分辨率至少300 DPI(对于扫描文档)或全屏分辨率(对于截图);最小的透视变形(正面拍摄的图像,不是斜角的);没有严重的模糊或运动伪影。低质量图像仍会被处理,但准确性会随图像质量显著下降。
点击"提取文字"并等待处理
点击提取文字按钮。首次运行时,Tesseract会下载您所选语言的语言数据(英文约10-20 MB,中文约15-25 MB)。这次一次性下载会缓存在您的浏览器中——后续使用相同语言即时完成。进度条显示识别进度从0%到100%。处理时间取决于图像大小和复杂性:标准A4页面的文字在现代计算机上通常需要3-10秒。
检查并编辑提取的文字
提取的文字显示在可编辑的文本区域中。OCR不是完美的——可能会出现错误,尤其是:异常字体、非常小的文字(8pt以下)、手写体、降质或老化的文档以及具有显著背景噪声的图像。检查输出是否有明显错误。常见的OCR错误:"0"与"O"混淆,"1"与"l"或"I"混淆,"5"与"S"混淆,重音字符误读。文本区域完全可编辑——在复制或下载之前直接在输出中纠正错误。
复制或下载文字
使用复制按钮将提取的文字放入剪贴板,以便立即粘贴到任何应用程序中。使用下载.txt按钮将提取的文字保存为纯文本文件。出于法律或档案目的,考虑下载.txt文件作为记录。文本区域下方显示的字符计数可让您快速验证提取的完整性——与您对图像包含文字量的手动估计进行比较。
处理多页文档
我们的OCR工具一次处理一张图像。对于多页扫描文档,分别处理每一页并合并文本文件。对于包含文本作为实际文本(而非扫描图像)的PDF文档,请改用我们的PDF转TXT工具——它无需OCR处理即可100%准确地提取文字。将我们的OCR工具保留用于图像和扫描PDF,其中文字仅以像素形式存在,而非嵌入的数字文本。
使用技巧与最佳实践
以最低300 DPI扫描或拍摄文档以获得最佳准确性——现代智能手机相机在良好照明下拍摄的照片通常足够。
使用高对比度:拍摄时将文档放在平坦、非反光的白色表面上。避免阴影横跨文字。
在处理前校正倾斜图像——文字倾斜超过5-10度时OCR准确性会明显下降。首先使用我们的图像裁剪/旋转工具来校正方向。
对于收据或小字体文档,拍摄近距离照片或以600 DPI扫描以获得小文字的更好准确性。
手写识别:Tesseract可以处理印刷体手写(清晰的印刷体字母),但难以处理草书或非正式手写。对于手写,使用专门的手写OCR服务。
提取后,在文字处理器中使用Ctrl+A然后拼写检查,快速识别产生非单词的OCR错误。
对于机密文档,在处理敏感文件之前,验证工具是否在客户端运行(检查浏览器开发者工具中的网络标签——在OCR处理期间不应发生网络请求)。
常见问题解答
OCR技术已经改变了我们与物理和基于图像的文字交互的方式,我们基于浏览器的实现使专业质量的文字提取对所有人可用,无需账户、订阅或隐私牺牲。上传图像、选择语言、提取文字并将其直接复制到您的工作流程中——大多数文档的整个过程不到一分钟。对于大量文档处理或手写识别,专用OCR服务提供额外能力;对于从图像和截图中进行日常文字提取,我们的工具提供即时、私密和准确的结果。
免费试用此工具 →open_in_new