5 分钟装好国家图书馆 ISBN 插件:Calibre 中文书元数据一键补全 5 分钟装好国家图书馆 ISBN 插件Calibre 中文书元数据一键补全【免费下载链接】NLCISBNPlugin基于中国国家图书馆ISBN检索的calibre的source/metadata插件。https://doiiars.com/article/NLCISBNPlugin项目地址: https://gitcode.com/gh_mirrors/nl/NLCISBNPluginNLCISBNPlugin 是一个 Calibre 元数据插件输入 ISBN它就从中国国家图书馆的馆藏目录里把书名、作者、出版社、出版年、中图分类号一次性拉回书库没有 ISBN 时还能用书名模糊搜索。中文书库补元数据最容易卡在三个地方Calibre 自带的元数据源对中文书普遍不给力ISBN 明明写在书脊上下载完却只剩书名和作者出版社、出版年、简介全是空。更麻烦的是中图分类号——豆瓣和 Google 源都不返回这个字段想按学科给标签分组只能自己翻《中图法》。NLCISBNPlugin 直接抓国家图书馆 OPAC 的著录数据中图分类号是它独有的卖点而且会把分类号解析成软件学这种能看懂的名字再写进标签。先判断手里的书走哪条链路书上有 ISBN10 位或 13 位就走精确检索没有就走标题搜索。下面两条路都会走一遍。从 clone 到启用装插件只要 3 步git clone https://gitcode.com/gh_mirrors/nl/NLCISBNPlugin在 Calibre 里走 首选项 → 插件 → 加载插件从文件中选中仓库里的src/__init__.py或打包好的 zip装完在插件列表勾上国家图书馆ISBN插件就启用了。启用后到 首选项 → 插件 → 自定义 里能看到它的选项面板线程数、结果上限、延时等 10 个配置项都在那里后面批量刷之前会用到。刷第一本跟着走完整条链路挑一本带 ISBN 的书右键 → 编辑元数据 → 下载元数据勾选新出现的国家图书馆ISBN插件源等几秒。返回的字段比豆瓣源多两块标签主题词 出版社 出版年份 中图分类名比如计算机科学 清华大学出版社 1998以后按标签分架直接用nlchash 标识符书名年份的 MD5 值。同一 ISBN 对应不同版本的书比如修订版换了书名Calibre 的去重会误判成重复这个字段就是用来区分的。对比一下刷之前和刷之后之前是书名 作者两行干瘪的字段刷完出版社、出版年、内容简介、标签齐全语言也被标成 zh_CN。确认无误点确定第一本就跑通了。没有 ISBN 怎么办标题模糊搜索identifier 里没有 ISBN 时插件自动切到标题搜索默认会把第一作者拼进书名一起查提高命中率是否使用作者信息模糊搜索默认开启。搜到多条候选时默认最多返回 6 条最大返回量逐条点选即可。两个提高命中率的动作标题用封面全称别用俗称或省略版搜到结果但信息不对多半是撞了同名书把作者字段补全再试一次。已知局限单一 ISBN 对应多本书时目前无法精确挑出目标版本这是作者列在待办里的功能。批量整理前先调这 3 个配置批量刷几百本书时服务器压力和 IP 安全是主要矛盾3 个配置项对应 3 个问题最大线程数默认 2控制并发。调到 3–4 能明显提速但官方注释写明过大可能导致 IP 被封锁别贪。最大返回量默认 6标题搜索的候选上限。书库里没 ISBN 的书多就调高一点否则一次只能看 6 条候选。爬虫基础间隔时间默认 200ms每次请求前还会额外随机加 30–600ms模拟人工操作节奏不建议改小。另外中图分类号解析层级默认是 2标签里显示到二级分类改成 3 会显示更细的三级分类书库偏学术的可以试。建议先拿 20 本书测一轮看耗时和有没有请求失败再决定线程数加不加。装不上或搜不到先查这 2 个点装不上报错It does not contain a top-level init.py file基本是选错了文件。要选src/__init__.py本身或完整 zip 包而不是仓库里随便某个子文件装完确认插件列表里出现了国家图书馆ISBN插件才算装对。搜不到先核对 ISBN 位数——插件内置了 ISBN-10 校验和自动转 13 位的逻辑但你手输的数字必须本身合法校验位错一位都会查不到再确认这本书是否真的在国家图书馆馆藏里老书、内部资料、外文版都可能没有记录这种情况退回标题搜索或直接手工补字段。【免费下载链接】NLCISBNPlugin基于中国国家图书馆ISBN检索的calibre的source/metadata插件。https://doiiars.com/article/NLCISBNPlugin项目地址: https://gitcode.com/gh_mirrors/nl/NLCISBNPlugin创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考