PDF 高质量 OCR

使用 olmOCR 或 Asta 远程 OCR,把扫描 PDF 和复杂版式提取为 Markdown;支持本地文件、批量任务和 S3 文件。

站长已收录待实测办公效率

效果预览

Ai2 Asta · 使用示意
复杂 PDF扫描页 · 多栏 · 表格 · 公式将难直接复制的文档提交远程 OCR,适合扫描件和复杂学术版式。
复杂 PDF
提取结果可继续编辑的 Markdown按页返回结构化文本,批量任务可下载结果包,也支持从 S3 读取。
提取结果

这个 Skill 能做什么

站长点评:面对复杂 PDF 比普通文本提取更有优势,但必须登录 Asta,文档会上传云端处理。

扫描件 OCR

处理没有文本层的扫描 PDF 和图片式页面。

复杂版式

适合多栏、表格、公式和学术文档等复杂内容。

批量与 S3

支持批处理,本地文件之外还可选接入 AWS S3。

三步开始使用

1

复制安装指令

把仓库和 Skill 子目录交给智能体。

2

登录 Asta

按仓库说明完成 Asta 账号登录与授权。

3

提交 PDF

例:“将这份扫描 PDF 提取为 Markdown,保留页码”。

安全与验证 ! 需要 Asta 登录 ! PDF 会上传云端处理 ! 敏感文档谨慎使用 ! AWS S3 为可选能力 ✓ 源码检查:2026-09-09·</> 原始源码·Apache-2.0·来源:Allen Institute for AI