它是一个转换器兼 Agent 技能:把任意技术书籍、文档文件夹或源码集按照开放的 Agent Skills 标准(SKILL.md 格式)蒸馏成结构化"笔记型技能",供 Claude Code、Copilot CLI、Amp 按需加载,官方宣称比把全书塞入上下文节省 24–51 倍 token。Agent Skills(SKILL.md)生态正在成为连接人与模型的通用接口层,而上下文成本是所有重度使用者的共同痛点。

| 项目 | 内容 |
|---|---|
| 仓库 | virgiliojr94/book-to-skill |
| 语言 / 许可证 | Python / MIT |
| 总星标 | ⭐ 25798 |
| 本月净增星标 | +15982 |
| 榜单 | L1 月度趋势榜 #11、L3 增速榜 #8 |
它是一个转换器兼 Agent 技能:把任意技术书籍、文档文件夹或源码集按照开放的 Agent Skills 标准(SKILL.md 格式)蒸馏成结构化"笔记型技能",供 Claude Code、Copilot CLI、Amp 按需加载,官方宣称比把全书塞入上下文节省 24–51 倍 token。
Agent Skills(SKILL.md)生态正在成为连接人与模型的通用接口层,而上下文成本是所有重度使用者的共同痛点。book-to-skill 把"反复查 PDF、凭记忆胡编"这两个高频抱怨一并解决:一次转换,永久按需调用。它同时踩中了技能生态、token 经济学和企业内部知识资产化三条上升曲线,因此能在 8 月出现接近翻倍式增长。
核心是 Python 编写的提取器,解析逻辑模块化置于 scripts/extractor/parsers/ 下。PDF 提供多级工具选择:通用文本走 pdftotext(poppler)、pypdf 或 pdfminer.six,含代码、表格与公式的技术书优先使用 docling(约每页 1.5 秒)以保留 markdown 表格与代码块。EPUB 采用 ebooklib 加 beautifulsoup4 并以标准库 zipfile 兜底;MOBI/AZW3 依赖 Calibre 外部的 ebook-convert。配套 pytest 测试、tools/discovery_tax.py 做 token 成本基准、tools/validate_skill.py 按 claude/copilot/amp 三种镜头校验产物合规性。
推荐一条命令安装:`npx skills add virgiliojr94/book-to-skill`。也可手动克隆到 `~/.claude/skills/book-to-skill`(Copilot CLI 目标目录为 `~/.copilot/skills/`,Amp 为 `~/.agents/skills/`)。先用 `python3 scripts/extract.py --check` 检查依赖;扫描版 PDF 需先执行 OCR,例如 `ocrmypdf input.pdf output.pdf`。
装好后在 Claude Code 内输入:
/book-to-skill ./my-book.pdf
或写成 `/book-to-skill
相比向量数据库加 chunking 的传统 RAG,它无需 embedding 流水线,产出的是人类可直接阅读维护的 Markdown 笔记,检索发生在文件名与目录层面。相比把全文塞进上下文的做法,节省 24 至 51 倍 token。它与 archify、strix 等一起构成 SKILL.md 技能生态的应用样本,分工上专攻"长文档知识封装"这一格。
仓库主页见 github.com/virgiliojr94/book-to-skill;许可证 MIT,仅覆盖转换器代码与技能定义,不含被处理文档;OCR 前置工具参考 ocrmypdf 项目,高质量解析参考 docling 项目;技能校验细节见 tools/validate_skill.py,社区贡献的扫描版处理见 PR #130。