Ocr Kb

使用多模态大模型逐页读取长文档图片,精确提取文本、LaTeX公式和独立科研配图。支持环境清理、断点恢复、全局编号管理、失败页标记与部分重跑。逐页生成DOCX并每两页核查质量。本 Skill 专用于 Pipeline A(OCR 管道),处理 PDF 输入。中间产物全部放在 resources/,最终交付物放在 outputs/。Pipeline B / C 定义在主 SKILL.md 中。

tfboy1 c12c833 3 files · 19.8 KB Updated

File contents

tfboy1/academic-paper-writer/tree/main/ocr_kb commit c12c833634

Frequently asked questions

npx skillmds add tfboy1/ocr-kb