中文与多语言
识别中文小字、印刷体、手写文字及多种语言。
从图片、扫描件和 PDF 中提取中文与多语言文字,可返回文本坐标;适合截图识字、票据和复杂版面。
站长点评:中文识别能力是亮点,但需要 PaddleOCR Token,文件会上传到对应服务,敏感材料先别用。
识别中文小字、印刷体、手写文字及多种语言。
处理截图、扫描件和多页 PDF,可按页提取。
除正文外还能获取文字块位置,便于版面分析。
把仓库和 Skill 子目录交给智能体。
按仓库说明准备 PaddleOCR 服务 Token。
例:“提取这份扫描 PDF 的中文正文并按页整理”。