ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

给Calibre补全中文图书元数据:国家图书馆ISBN插件安装与批量检索实操

给Calibre补全中文图书元数据:国家图书馆ISBN插件安装与批量检索实操 给Calibre补全中文图书元数据国家图书馆ISBN插件安装与批量检索实操【免费下载链接】NLCISBNPlugin基于中国国家图书馆ISBN检索的calibre的source/metadata插件。https://doiiars.com/article/NLCISBNPlugin项目地址: https://gitcode.com/gh_mirrors/nl/NLCISBNPluginCalibre默认的元数据源对中文图书覆盖有限字段经常是空的。本文按三个小目标演示国家图书馆ISBN插件NLCISBNPlugin一个Calibre元数据源插件ISBN精确匹配、按书名模糊搜索、几十本书的批量整理全部数据来自中国国家图书馆官方书目。三步装好插件克隆、打包、加载进 Calibre先确认本机已装好Calibre。拉取代码git clone https://gitcode.com/gh_mirrors/nl/NLCISBNPlugin插件源码在src/目录。把该目录的内容压缩成zip——zip顶层应直接是__init__.py、clc_parser.py、data_wrapper.py多包一层目录都不行。然后进入Calibre的首选项 插件点加载插件从文件选中zip在列表里启用国家图书馆ISBN插件。坑在这里如果你把项目根目录整个压进去zip顶层就是src文件夹Calibre会报It does not contain a top-level init.py file。重新按上面的方式打包即可。第一次检索有ISBN的书直接补全在书库选中一本书右键 编辑元数据在元数据编辑器窗口点下载元数据来源列表里会出现国家图书馆ISBN插件。书里已有ISBN时插件直接走ISBN精确检索回填题名、作者、出版社、出版年份和内容提要。标签不用你手动维护插件按主题分类、出版年份、出版社自动生成一组标签并把中图分类号转成具体分类名默认解析到第2级可在1~3级间调——这是目前Calibre插件里唯一能拿到中图分类号的来源。同时会写入一个nlchash标识符题名加出版年份的MD5后面做版本区分时要用。字段确认无误后点确定保存。没有ISBN时按书名模糊搜出候选书书里没有ISBN时插件自动改用书名做模糊搜索并且默认把第一位作者拼进题名一起查能过滤掉同名无关结果在插件设置里关掉使用作者信息进行模糊搜索就变回纯书名。模糊搜索默认最多返回6条用2个线程并发抓取结果列表里挑出与手上一致的那条再核对字段保存即可。如果某本书搜不到大概率是国家图书馆目录里根本没有这条记录——绝版书、老书常见——或题名与馆藏记录写法不一致试试换成完整官方题名多卷书加上卷名。批量整理几十本书并发、延时与版本区分批量入口和单本相同多选 右键 编辑元数据 下载元数据插件逐本处理。两个与稳定性相关的参数值得看一眼每次请求间隔 基础200毫秒 30~600毫秒随机附加模拟人工浏览避免高频访问触发国家图书馆服务器风控最大线程数保持默认2。插件自己的提示写得很直白开太大可能导致IP被封锁批量整理时别手痒。同一ISBN对应多本书同书不同印次、多卷合集时ISBN本身分不出差别靠nlchash题名出版年份的MD5写在identifiers里区分版本。不想让标签带上出版社和年份的话设置里开纯净的标签只留核心分类标签。装不上或搜不到时的排查顺序安装报It does not contain a top-level init.py file打包时选了项目根目录按src内容重压再加载。单一ISBN对应多本书、下载失败已知问题仓库README的可能遇到的麻烦一节有记录等版本更新或先手动改题名区分。检索无结果先在浏览器确认能打开国家图书馆书目页面网络正常仍为空换完整官方题名再试一次。下一步挑5本元数据缺失的书做批量检索确认标签里出现中图分类书库里有同名不同版次的书用nlchash核对一下是否分得开【免费下载链接】NLCISBNPlugin基于中国国家图书馆ISBN检索的calibre的source/metadata插件。https://doiiars.com/article/NLCISBNPlugin项目地址: https://gitcode.com/gh_mirrors/nl/NLCISBNPlugin创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表