从图片中提取文字
在几秒内将 JPG、PNG 和 WebP 图片转换为可编辑文字。
如何从图片中提取文字
- 01从设备中选择一张 JPG、PNG 或 WebP 图片。
- 02选择图片中的文字语言,必要时旋转预览。
- 03提取并检查文字,然后复制或下载 TXT 文件。
此 OCR 可以处理什么
该工具可识别英语、越南语、德语、荷兰语、简体中文、日语、韩语和阿拉伯语印刷文字。清晰扫描件和截图通常比模糊或变形的照片效果更好。
OCR 限制
多栏页面、表格、手写内容和大幅弯曲文字的阅读顺序可能不准确。
图片 OCR 常见问题
什么图像质量可以产生更好的 OCR 结果?
清晰、高对比度的印刷文本效果最佳。使用具有足够像素的锐利光源来拍摄小字符,均匀的照明,有限的压缩,以及尽可能平坦和笔直拍摄的页面。在提取之前裁剪不相关的背景并垂直旋转文本。极低的分辨率、运动模糊、眩光、阴影、纹理纸、弯曲的页面、装饰字体和激进的图像增强可能会合并或破坏字符形状。放大真正的低分辨率源可能有助于提高可视性,但它无法重新创建从未捕获的细节。
为什么选择正确的 OCR 语言很重要?
语言选择决定了预期的识别模型和字符模式。选择英语作为中文、日语、韩语、阿拉伯语、越南语或德语文本可能会产生看似合理但不正确的替换,因为预期的字母、重音、方向和单词模式不同。选择图像中可见的主要语言。当一张图像混合多种语言时,将最重要的部分与其匹配的语言分开提取,并仔细比较名称、数字、日期和技术术语,因为它们从普通语言模式中获得的帮助较少。
什么会影响检测到的阅读顺序?
OCR 识别文本区域,然后按其位置对它们进行排序。多栏文章、表格、侧边栏、表格、标题、垂直文本、弯曲标签、重叠印记和手写注释可能会使预期的顺序模糊不清。当顺序很重要时,裁剪独立区域并单独提取它们。提取后,从上到下将结果与源进行比较,恢复段落分隔符,并验证标题、表格行、标签、脚注和图像旁边的文本,而不是假设重建了完整的文档布局。
OCR 可以保留表格和文档格式吗?
否。此工具返回可编辑文本和检测到的区域,而不是原始设计的 Word、电子表格或可搜索 PDF 重新创建。列可能会以意外的顺序读取,表格单元格可能会丢失行和列关系,并且字体、颜色、间距、边框、图像和页面家具不会保留为匹配的布局。使用结果来避免重新输入,然后在目标应用程序中重建所需的结构,并在依赖重要值之前将其与源值进行比较。
为什么 OCR 处理时间会有所不同?
时间取决于图像尺寸、文本区域的数量和大小、布局复杂性、所选语言、旋转以及准备识别所需的资源。中心有小文档的大照片可能需要更多的工作,同时仍然会产生比紧密裁剪的扫描更糟糕的文本。使用保留所需字符的最小清晰图像,裁剪不相关的区域,并避免重复放大已经清晰的源。保持页面打开,直到出现结果或有用的错误。
我应该如何验证提取的 OCR 文本?
比较姓名、日期、地址、总计、小数分隔符、帐号、标识符、标点符号以及任何因单个错误而改变含义的字符。常见的混淆包括零和 O、一和小写 l、类似的标点符号、重音字母以及 CJK 或阿拉伯文字中视觉相关的字符。检查图像或表格周围的行顺序和缺失文本。对于法律、财务、医学、学术或档案材料,请在将结果复制到另一条记录之前对原始图像进行第二次审查。