OCR.SPACE 是由 a9t9 software GmbH 提供的在线 OCR 服务,同时提供面向自动化处理的 OCR API。它可以把图片和 PDF 文档转换为可编辑文本,也支持生成可搜索 PDF。在线服务面向交互式使用,无需注册即可上传文件;需要自动化 OCR 或批量文档转换时,官网建议使用 OCR API,而不是对网页界面进行抓取。产品的一个明确特点是数据处理后的即时删除:上传文件和提取文本会在 OCR 处理完成后自动删除,不存储、归档或保留用户数据;其 OCR 服务器全部位于欧盟境内,OCR API 声明符合 GDPR。
核心功能
图片与 PDF OCR
服务支持将图片和 PDF 文档转换为可编辑文本。可上传 JPG、PNG、GIF 或 PDF 文件,识别结果用于后续编辑,而不是只生成不可编辑的图片副本。在线服务适合通过页面完成一次或少量文件的交互式识别。
多页与多栏文档识别
OCR.SPACE 支持多页文档处理,也支持多栏文本识别。对于包含多个页面或页面上存在分栏排版的文件,服务会进行相应的 OCR 识别;官网同时提供上传文件、开始 OCR、获取结果和检查 Overlay 的操作步骤。
可搜索 PDF 生成
除了输出可编辑文本,服务还支持创建可搜索 PDF 文档。该功能适用于希望保留 PDF 文档形式、同时让文档内容能够被搜索的场景,官网将其作为 Online OCR 服务的一项能力单独说明。
多语言 OCR
官网列出了阿拉伯语、中文、英语、法语、德语、日语、韩语、西班牙语等多种 OCR 语言,其中中文包含简体和繁体字符。不同 OCR 引擎支持的语言范围并不完全相同,官网建议用户分别尝试各个引擎,以确认哪一种更适合自己的文档。
语言自动检测与扩展语言
OCR Engine 2 和 OCR Engine 3 支持语言自动检测。OCR Engine 3 还支持超过 200 种额外 OCR 语言;如果需要识别的语言仍未列出,官网建议通过 OCR 论坛反馈。特殊字符如 §、%、&、(、)、=、@ 和 € 也在引擎支持说明中列出,但部分引擎对特殊字符的支持有限。
OCR API 自动化处理
OCR.SPACE 提供免费 OCR API,用于自动化 OCR 处理和批量文档转换。官网明确建议将 API 用于这些自动化场景,而网页界面仅用于交互式使用,避免通过网页抓取来处理自动化任务。API 页面同时提供 OCR API 状态面板和 API 论坛入口。
使用方式
在线 OCR 页面支持直接上传文件,操作流程包括 Upload File、Start OCR、Get Result 和 Check Overlay。无需注册即可使用,支持 JPG、PNG、GIF 和 PDF。若要进行自动化 OCR 或批量文档转换,应使用 OCR API;正文没有说明是否需要自备模型 Key,也没有列出客户端或命令行版本。服务还提供 Copyfish OCR 入口,但正文未说明其具体使用限制。
适用人群与场景
需要把图片或 PDF 内容转成可编辑文字的个人用户,可以直接使用无需注册的在线 OCR。处理多页资料或多栏排版文档的用户,可以使用对应的多页和多栏识别能力。需要批量转换文档或将 OCR 接入自动化流程的开发者和团队,可使用 OCR API。需要处理中英文、日文、韩文或其他列出语言文档的用户,可以根据不同 OCR 引擎的语言支持情况进行选择。
定价
官网将在线 OCR 描述为免费使用,且无需注册;免费层对每个文档设置 5MB 文件大小限制。OCR API 也被标注为免费 OCR API。正文没有给出更具体的 API 调用额度、付费档位或超额计费规则,因此这里只能确认免费使用和单文档大小限制。
注意事项
在线服务设计用于交互式使用,自动化 OCR 和批量文档转换应使用 OCR API,而不是抓取网页界面。不同 OCR 引擎支持的语言不同,部分语言只在特定引擎中提供;特殊字符在 Engine 1 中标注为有限支持。上传文件和提取文本会在 OCR 处理完成后自动删除,OCR 服务器位于欧盟境内,官网称 OCR API 符合 GDPR。