PDF扫描件 OCR 转换技能 📄
name: pdf-ocr
by dadaniya99 · published 2026-03-22
$ claw add gh:dadaniya99/dadaniya99-pdf-ocr---
name: pdf-ocr
description: PDF扫描件转Word文档。支持中文OCR识别,自动裁掉页眉页脚,保留插图,彩色章节封面页保留为图片。使用百度OCR API(免费额度1000次/月)。当用户要求把扫描PDF转成文字/Word时触发。
---
# PDF扫描件 OCR 转换技能 📄
配置
依赖安装
pip install pymupdf python-docx pillow使用方法
python3 {baseDir}/scripts/pdf_to_docx.py <PDF路径> [输出目录]输出文件在 `[输出目录]/xxx_全文_ocr.docx`,文件较大时用脚本压缩图片:
python3 {baseDir}/scripts/compress_docx.py <docx路径> <输出路径>处理策略
| 页面类型 | 判断方式 | 处理方式 |
|---------|---------|---------|
| 正文页 | 默认 | 裁掉顶部6%(页眉)+底部4%(页脚),OCR识别文字 |
| 插图页 | OCR无文字输出 | 保留为图片嵌入Word |
| 彩色封面/章节页 | 彩色像素占比>25% | 保留为图片,加灰色标注 |
已知限制
- 解决:用户找到问题页,告知PDF页码,截图后手动替换
- 解决:转换后人工替换目录页为图片
实战案例(《预测之书》592页)
注意事项
More tools from the same signal band
Order food/drinks (点餐) on an Android device paired as an OpenClaw node. Uses in-app menu and cart; add goods, view cart, submit order (demo, no real payment).
Sign plugins, rotate agent credentials without losing identity, and publicly attest to plugin behavior with verifiable claims and authenticated transfers.
The philosophical layer for AI agents. Maps behavior to Spinoza's 48 affects, calculates persistence scores, and generates geometric self-reports. Give your...