茉莉花:右键一次,抓全中文文献元数据
2026/8/22 23:32:09 网站建设 项目流程

茉莉花:右键一次,抓全中文文献元数据

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

手动补全一篇文献的字段是什么体验?作者、期刊、期号、页码逐项对,三五分钟起步;碰上字段缺失、文件名对不上,一篇就要十分钟。攒上二十篇,一个下午就这么耗在复制粘贴里。

茉莉花(Jasminum)是 Zotero 的中文元数据抓取插件。它负责检索中文数据库、把字段回填进条目、把散落的 PDF 匹配回条目,你只负责点确认。录文献耗掉的那半天,就此还给了你的研究。

茉莉花能替你做什么:四件自动化任务

它替你做了什么你省掉了哪步手工活
按标题检索知网等多个数据库,回填元数据逐项复制作者、期刊、期号、页码
扫描本地文件夹,找回缺失的 PDF 附件翻资源管理器、逐个比对文件名
在阅读器里生成可点击的章节树靠滚动条一段段翻找章节
一键合并/拆分姓名,更新知网引用数手动修正姓名与引文格式

装好它,你只需要会一个动作:右键。

三条命令,从零到可用

这一节把插件装到你电脑上,全程三条命令加两次点击。

第一步,拿源码。机器上装好 Node.js 后,在终端执行:

git clone https://gitcode.com/gh_mirrors/ja/jasminum

作用是把项目源码完整拷到你的电脑上。

第二步,构建插件包。在项目目录依次执行:

npm install npm run build

第一条装依赖,第二条负责打包。build 目录里出现一个.xpi文件,就说明构建成功——它就是插件本体。

第三步,拖进 Zotero。打开 Zotero 的「工具 → 附加组件」,点齿轮图标选「从文件安装附加组件」,选中那个.xpi,重启 Zotero。

💡 插件首次运行会自动检测你在大陆还是海外,并把结果写进配置,默认值通常无需改动。

装完怎么确认生效?打开偏好设置面板,看到「茉莉花」一项即可;顺手看一眼「附件下载文件夹」,它默认已经填好你的浏览器下载目录。

右键就能跑通的三个高频场景

三个场景彼此独立,哪个用得多就从哪个读起。

右键一次,回填全部元数据

  • 什么时候用:手上只有一个 PDF 或网页快照,条目缺作者、期刊、页码。
  • 怎么操作:选中条目,右键选「茉莉花抓取 → 抓取期刊元数据」。它会先从文件里解析出标题,再带标题去多个数据库依次检索。
  • 拿到什么结果:候选列表按相似度排好序,勾选最像的那条点确认,字段立刻回填完毕。

扫描文件夹,自动找回漏下的 PDF

  • 什么时候用:条目建好了,PDF 却没下载成功,散落在下载目录里。
  • 怎么操作:选中条目,右键选「在下载文件夹中查找附件」。
  • 拿到什么结果:插件把候选文件名与条目标题做相似度打分,列出最可能的几项,你挑中一个,PDF 即作为附件挂到条目上,全程不用打开资源管理器。

给长文 PDF 生成可点击的章节目录

  • 什么时候用:中文期刊 PDF 没内嵌书签,长文定位全靠滚动条。
  • 怎么操作:在阅读器打开 PDF,从阅读器标签打开「显示大纲(茉莉花)」面板。
  • 拿到什么结果:多级章节逐层展开,点任意节点直接跳转;手动增删书签后保存到 PDF 文件,下次打开依旧在。

让它更贴合你的用法

默认配置可以直接开工,下面三个参数值得花两分钟拧一拧。

  • 附件下载文件夹:当你的 PDF 总是落在某个固定目录时,把它指定过来。本地找附件、批量导入都以这个目录为准,设对一次,后面不用再翻目录。
  • 相似度阈值与候选数量:文件名越规范,阈值越该调高,误报随之变少;候选总是漏掉正确文件时再往下调。调完的效果是候选列表更干净,误匹配更少。
  • 元数据抓取来源:知网、万方、中华医学期刊、ChinaDOI 可自由勾选。只保留你常用的数据库,检索更快,干扰项也更少。

避开最常见的三个坑

这三个坑都指向同一个原因:先理解机制,动作就不会白做。

坑一:文件名不规范,抓取总失败

  • 症状:选中条目发起抓取,无结果,或者搜回来的东西驴唇不对马嘴。
  • 原因:插件先从文件名解析标题当检索词,「新建文档.pdf」这类命名什么都解不出来。
  • 解法:在设置里选一个与你命名相符的文件名解析模板,之后按「标题_作者」的习惯命名文件,成功率明显回升。

坑二:扫描版 PDF 生成不了大纲

  • 症状:打开长文 PDF,大纲面板空空如也。
  • 原因:大纲解析靠的是 PDF 里的文本层,扫描版只有图像、没有文字。
  • 解法:先用 OCR 工具给 PDF 补一层文字,再回来重新生成大纲即可。

坑三:全库批量抓取,Zotero 卡住不动

  • 症状:一次全选几十篇批量抓取,整个窗口迟迟无响应。
  • 原因:并发网络检索太多,任务队列积压,进度窗口也来不及刷新。
  • 解法:按文献类型分批,一次选十几篇;任务窗口能看到每篇的处理进度,发现问题及时中止,不必干等。

装它只花五分钟,此后每篇文献入库省回三五分钟的字段来回。补上二十篇,省下的就是那一个下午。碎活交给工具,精力留给研究。

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询