Scan.Plus 使用文本识别(OCR)技术读取扫描页面中的文本。此功能为应用内的文档搜索、智能命名和 AI 工具等功能提供支持——但不会使 PDF 直接可编辑,也不会为导出的文件添加可选中的文本层。
Scan.Plus 中有两种不同的 OCR 处理方式,它们的工作原理各不相同:
本地 OCR(自动,后台运行)
本地 OCR 会在扫描和保存过程中自动在您的设备上运行。您无需执行任何操作即可触发它。
它会在以下两个环节运行:
- 扫描第一页时——OCR 会读取页面内容,自动建议文档名称(智能命名)。
- 保存文档时——OCR 会处理所有页面,使文档的文本内容可以在应用内进行搜索。
这对您意味着什么:
- 您可以在 Scan.Plus 中通过文本内容(而不仅仅是文件名)搜索文档。
- 提取的文本会与文档的元数据一起存储,也可供 AI 功能使用(例如,作为 AI 助手的上下文)。
- 此过程在设备上运行。此类 OCR 不会将您的文档页面发送到服务器。
- 提取的文本仅供应用内部使用,不会在导出的 PDF 中显示为可选中或可见的文本层——导出的文件为图像格式。
- 对于已保存的文档,没有手动的“运行 OCR”或“重新扫描文本”按钮。
云端 OCR——图像转文本(手动,交互式)
第二种 OCR 类型需要在扫描过程中手动触发,并会为您提供可以直接阅读、复制和使用的结果。
使用方法:
- 扫描您的文档。
- 在扫描流程中,点击内容。
- 点击图像转文本。
- Scan.Plus 会将该页面上传至其处理服务器,并返回提取的文本。
- 您可以阅读、复制和分享结果。
这对您意味着什么:
- 与本地 OCR 不同,您可以查看并与文本输出进行交互。
- 由于处理是在云端进行的,此功能需要网络连接。
- 图像转文本功能仅在正在进行的扫描流程中可用——无法从“历史记录”中的已保存文档访问该功能。
文本识别语言
您可以在应用的设置 > 文档设置 > 文本识别语言中设置您首选的 OCR 语言。支持的语言包括英语、法语、德语、意大利语、西班牙语、葡萄牙语、中文、韩语和日语。
为文档选择正确的语言可以提高识别准确度。
套餐可用性
自动本地 OCR(搜索和智能命名)是标准扫描和保存流程的一部分,不受付费套餐限制。
云端 OCR(图像转文本)和 AI 相关功能可能受积分或套餐规则的限制——请在应用中查看您的套餐当前的可用情况。
OCR 不能做什么
- 它不会使导出的 PDF 文件支持文本搜索,也不会为导出的 PDF 添加可选中的文本。导出的文件为图像格式。
- 它不能替代清晰、光线良好的扫描——图像质量不佳会降低识别准确度。
- 对于已保存在“历史记录”中的文档,没有手动触发 OCR 的方式。