0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0 1 0
OCR:图片和 PDF 转文字
从图片、截图或 PDF 中提取文字。对于 PDF,会将文档自身的文字(包括签名和字段)与图片的光学字符识别(OCR)结合起来。整个过程都在你的浏览器中完成,不会将文件上传到任何服务器。
拖入图片或 PDF,或点击选择
PDF, PNG, JPEG, WebP, GIF, BMP
西班牙语
工作原理
OCR(光学字符识别)可将出现在图片或 PDF 中的文字——照片、截图或扫描的文档——转换为可编辑的文本,方便你复制、搜索或粘贴到任何地方。
你可以选择一种或多种语言以提高准确度:指定正确的语言有助于引擎更好地识别重音符号、特殊字符和完整单词。首次使用某种语言时会下载其模型,之后会保存以备下次使用。
所有识别都通过 WebAssembly 在你的浏览器中完成:文件不会上传到任何服务器。结果包含置信度估计,让你了解识别的可靠程度。
使用场景
- 在无法选中时复制屏幕截图中的文字。
- 将扫描的文档、发票或收据数字化以便编辑。
- 从照片中提取代码片段或错误信息。
- 从图片中恢复文字以进行翻译或搜索。
- 从 PDF(无论是数字版还是扫描版)中提取文字以便重复使用。
常见问题
我的图片会上传到服务器吗?
不会。识别完全在你的浏览器中进行,图片绝不会离开你的设备。只有你选择的语言模型会下载一次。
为什么要选择文本语言?
每种语言都有自己训练的模型。选择正确的语言能显著提高准确度,尤其是对重音符号和该语言特有的字符。如果图片中混合了多种语言,你可以同时选择多种。
如何获得更好的结果?
使用清晰、光线充足、文字与背景对比良好的图片。水平且无变形的文字比倾斜、模糊或手写的照片效果更好。
我可以使用哪些格式?
你可以使用常见格式的图片(PNG、JPEG、WebP、GIF 和 BMP),也可以使用 PDF 文件。对于文档,高分辨率的截图或扫描效果更好。
PDF 是如何处理的?
会逐页处理并合并所有可用文字:PDF 自身的文字(包括表单字段和数字签名)会被直接、准确地提取,图片中的文字也会通过 OCR 识别。“数字版”PDF 可即时读取;扫描版或包含大量图片的 PDF 可能需要更长时间。