PaddleOCR 中文识字

从图片、扫描件和 PDF 中提取中文与多语言文字,可返回文本坐标;适合截图识字、票据和复杂版面。

站长已收录待实测办公效率

效果预览

PaddleOCR · 使用示意
输入内容图片 · 扫描件 · PDF上传需要识别的文件,可指定语言、页码和是否返回文字坐标。
输入内容
识别结果正文 + 坐标 + 置信度可只取纯文本,也可保留每段文字所在位置,方便后续校对和结构化。
识别结果

这个 Skill 能做什么

站长点评:中文识别能力是亮点,但需要 PaddleOCR Token,文件会上传到对应服务,敏感材料先别用。

中文与多语言

识别中文小字、印刷体、手写文字及多种语言。

图片与 PDF

处理截图、扫描件和多页 PDF,可按页提取。

返回坐标

除正文外还能获取文字块位置,便于版面分析。

三步开始使用

1

复制安装指令

把仓库和 Skill 子目录交给智能体。

2

配置 Token

按仓库说明准备 PaddleOCR 服务 Token。

3

上传并识别

例:“提取这份扫描 PDF 的中文正文并按页整理”。

安全与验证 ! 需要 PaddleOCR Token ! 图片/PDF 会上传处理 ! 敏感文件谨慎使用 ✓ 源码检查:2026-09-09·</> 原始源码·Apache-2.0·来源:PaddleOCR-Skills