
book-to-skill 处理 PDF 时 technical 模式与 text 模式怎么选【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skill用 book-to-skill 把一本 PDF 转成 agent skill 时提取阶段Step 1.5会先问你一个问题这份内容是technical有代码块、表格、公式、图示还是text-heavy以散文为主几乎没有表格和代码。这个选择决定了提取工具链——technical 模式走 Docling约 1.5 秒/页text 模式走 pdftotext 及其回退链秒级完成——也决定了后续章节文件的结构模板和 token 预算。选错的代价是实实在在的technical 书用 text 模式会丢掉全部表格和代码结构散文书用 technical 模式则要白等几分钟。这篇文章按项目文档说明两种模式的判定标准、实际命令、以及提取后如何核对结果。判定标准什么时候选 technical什么时候选 textSKILL.md 的 Step 1.5 给出了原始提问文案What kind of content do these sources have? This helps me choose the best extraction method.Technical— has code blocks, tables, formulas, diagrams (e.g. programming books, academic papers, architecture guides)Text-heavy— mostly prose, few or no tables/code (e.g. management, productivity, narrative non-fiction)Not sure— Ill use the fast method and warn you if quality seems limited判定结果存入BOOK_TYPE选项 1 →BOOK_TYPEtechnical选项 2 和选项 3都→BOOK_TYPEtext。也就是说不确定时默认走快速的 text 模式而不是 technical 模式之后若提取质量明显受限agent 会主动提醒你。docs/performance.md 的结论一句话概括Pick text mode for prose, technical mode for code/tables.散文选 text 模式代码/表格选 technical 模式。两种模式实际会做什么工具链与实测差异README.md 按书籍类型给出的工具表Book typeToolInstallSpeedText-heavy (prose, few tables)pdftotext(poppler)sudo apt install poppler-utils⚡ instantText-heavy fallbackpypdfpip3 install pypdf⚡ instantText-heavy fallbackpdfminer.sixpip3 install pdfminer.six⚡ instantTechnical (code, tables, formulas)doclingpip3 install docling~1.5s/page注意sudo apt install poppler-utils是系统包安装Debian/Ubuntu 源需要相应权限另外两条是 Python 依赖。同一本 103 页技术书 PDF 上的实测对比来自 docs/how-it-works.md 与 docs/performance.mdCPU onlyMethodTimeTokensTablesCode blockspdftotext0.1s27K00Docling164s27K (1.2%)4836这是项目文档给出的测量数据用于说明两种模式的差异不是每本书都会得到的固定数值。它说明的关键点token 数量几乎相同27K vs 27K1.2%所以模式选择买到的不是更少的字而是结构保真度pdftotext 即时完成但会把结构压平——技术书里的表格和代码块全部丢失0 表格、0 代码块Docling 以约 1.5 秒/页的代价把表格和代码保留为 markdown。依赖缺失时的行为docling仅在--mode technical时需要否则回退到 text 提取链见 book_to_skill/dependencies.py。脚本在提取前会检查对应格式的可选依赖缺少更优提取器时会提示并给出可用回退非交互会话默认走回退除非安装模式显式设为yes可通过--install-missing ask|yes|no控制默认ask。执行从 agent 会话或独立 CLI 指定模式主路径——agent skill 会话/book-to-skill ~/path/to/your-book.pdf~/path/to/your-book.pdf是 docs/install.md 中的示例替换为你自己的 PDF 路径。执行到 Step 1.5 时agent 会按上面的文案提问你回答 technical 时会被告知 Technical mode selected — using Docling for structure-aware extraction (tables, code blocks, formulas preserved as markdown). This takes ~1.5s per page, so expect a few minutes for longer sources.回答 text 时则会被告知使用最快可用提取器PDF 在可用时走 pdftotext。随后 agent 运行提取脚本底层命令形态为scripts/extract.py paths… --mode technical|text见 docs/how-it-works.md 的流程图。可选分支——独立 CLI通过 pip 从仓库安装的是纯提取引擎不注册/book-to-skillagent skill完整 skill 流程需要git clone安装见 docs/install.md。CLI 下模式是显式参数book-to-skill ~/path/to/book.pdf --mode technical book-to-skill ~/path/to/book.pdf --mode text执行前可以先做环境预检不处理任何文件只报告每种格式已装了哪些提取器以及缺失项的确切安装命令book-to-skill --check # 或在仓库中 python3 scripts/extract.py --check模式还会影响生成章节的结构与预算BOOK_TYPE不止作用于提取。SKILL.md Step 7 规定章节文件按模式调整侧重点technical→ 优先 Code Examples、Reference Tables、Commands APIs 小节并保留精确语法text→ 优先 Frameworks Introduced、Mental Models、Key Takeaways跳过空的 technical 小节。每章 token 预算与 Step 4 得出的DEPTH组合DEPTHreferenceDEPTHstudyBOOK_TYPEtext800–1,200 tokens1,000–1,800 tokensBOOK_TYPEtechnical1,200–1,800 tokens2,000–3,000 tokensStep 2.5 的预估算时中位数也是按模式区分的text≈ 1,000 tokens/章technical≈ 1,800 tokens/章。所以给一本散文书选 technical代价不只是提取变慢还有更大的章节文件和更高的生成成本反之给技术书选 text则会直接丢失代码与表格。提取完成后如何核对结果一次运行完成时会打印三条路径Workdir -、Text -、Meta -。工作目录按运行隔离tempdir/book_skill_work-pid/并发提取不会互相覆盖因此应从本次输出的路径取结果不要假设固定位置。核对步骤来自 SKILL.md Step 2读本次运行的metadata.json检查filename/source_file或看full_text.txt首行的SOURCE:头确认提取到的确实是你要的那份文档如果是 technical 模式打开full_text.txt确认表格和代码块以 markdown 形式保留——这正是上一节实测表体现的差异那本 103 页技术书提取出 48 个表格、36 个代码块如果你在 Step 1.5 选了 Not suretext 模式而提取质量看起来受限agent 会给出警告。两个相关边界扫描版 PDF纯图片、无文字层无论选哪个模式都无法提取——提取器会检查前几页并立即停止并给出说明而不是跑完全书产出一个空 skill。文档建议先自行 OCR再转换结果ocrmypdf input.pdf output.pdfUpdate / Fold-inMode 4向已有 skill 追加新文件时Step 1.5 的类型判断会针对新来源重新执行需要为新内容再回答一次 technical/text 问题。核对完成后判断标准就是上面三条SOURCE:头指向正确文件、technical 书的表格和代码块以 markdown 存在、页数与metadata.json一致——满足即说明这次的模式选择执行正确。两种模式的完整流水线位置见 docs/how-it-works.md更多运行方式见 docs/usage.md。【免费下载链接】book-to-skillTurn any technical book PDF into a Claude Code skill — ready to study, reference, and use while you work.项目地址: https://gitcode.com/GitHub_Trending/bo/book-to-skill创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考