
Jasminum 茉莉花Zotero 中文元数据插件实战指南30 分钟完整上手【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum中文文献进了 Zotero常常带着三处毛病作者和期刊字段是空的、PDF 没有挂在条目下面、长文没有目录可跳。Jasminum 茉莉花是一款开源的 Zotero 中文元数据插件正好针对这三件事。照本教程操作大约 30 分钟你可以从零装好它并完成第一次元数据抓取、附件配对和大纲生成。你将做到读完这篇文章你手里会有一个能自己处理中文文献元数据、附件和大纲的 Zotero。具体是四件事补全一篇中文 PDF 空着的作者、期刊、期号字段把手动下载的 PDF/CAJ 文件自动配回对应条目给没有内置书签的长 PDF 生成可跳转大纲支持键盘操作按个人习惯调整抓取来源、文件名模板等偏好项准备工作先确认环境就绪下表检查项全部通过之后后面的安装过程不会卡住。项目要求检查方式Zotero8 或 9 版本已安装并能正常打开「帮助 → 关于」中查看版本号Node.js已安装构建插件时使用终端执行node -v能输出版本号即可网络可访问 npm 仓库较慢时先设置国内镜像终端执行npm config get registry查看地区设置若不在中国大陆装好后需取消勾选「当前位于中国大陆」插件偏好设置「中文元数据抓取设置」区域确认测试材料一篇只有文件名、没有条目信息的中文 PDF拖进 Zotero 后能生成新条目安装与启用完成下面三步后你会得到一个可以直接装入 Zotero 的插件文件右键菜单里会出现「茉莉花抓取」选项。获取项目源码一条命令把整个项目复制到本地git clone https://gitcode.com/gh_mirrors/ja/jasminum安装依赖并打包完成后build目录里会生成.xpi插件文件cd jasminum npm install npm run build装入插件。在 Zotero 打开「工具 → 插件」点右上角齿轮图标选「从文件安装插件」选中build目录里的.xpi按提示重启。✅ 验证重启后插件列表里能看到「Jasminum」右键任意附件菜单中出现「茉莉花抓取」说明插件已生效。核心功能实测这一节按使用顺序实操三个主功能做完你会得到一条完整条目、一份配好的附件和一棵可跳转的大纲。中文 PDF 元数据抓取场景从知网下载的中文期刊 PDF 拖进 Zotero条目建出来了作者、期刊、期号却都是空的。操作步骤右键该 PDF 附件。选择「茉莉花抓取 → 抓取期刊元数据」文献是书籍时选「抓取书籍元数据」。等待「茉莉花任务窗口」弹出候选结果已按相似度排好序。选中你认为最匹配的一条点击「确认」。✅ 验证此时你会看到条目元数据字段更新标题、作者、期刊名都填上了。上图是抓取成功后的「茉莉花任务窗口」任务列表顶部是正在处理的附件文件名每条候选都标有来源和发布日期。建议重点看前几条的来源类型期刊、报纸、会议与日期是否对得上。常见卡点同一篇文献常命中多个版本确认前务必人工核对别直接选最上面一条。抓取能否成功很大程度上取决于文件名里能不能认出标题命名太随意就先改成「标题_作者」。⚠️ 注意默认「文件名解析模板」是「标题_作者」。如果你的命名习惯不同去设置里换成「智能识别」或自定义模板。元数据抓取相关代码位于 元数据抓取源码 目录。下载文件夹附件匹配元数据补全之后下一个麻烦是附件和条目对不上——场景用 Zotero Connector 抓中文期刊时元数据写好了但 PDF 下载失败很常见。手动补下之后文件孤零零躺在下载目录里。操作步骤右键目标条目注意是条目不是附件。选择「小工具 → 在下载文件夹中查找附件」。插件扫描下载目录按标题与文件名的相似度给候选打分列出最匹配的文件。确认后附件自动挂到条目下。匹配成功的原始文件有三种处理方式可在设置中选择无须处理文件原样留在下载目录备份附件移入下载目录下的jasminum-backup文件夹默认方式删除附件直接从下载目录删除条目里已有一份删得放心✅ 验证此时你会看到条目下多出了附件节点原始文件按你选的方式被处理。⚠️ 注意设置里把「附件下载文件夹」指向浏览器真实的下载目录否则扫描覆盖不到全部下载的 PDF。匹配逻辑的实现可以在 本地附件匹配模块 查看。PDF 大纲书签生成元数据和附件都齐了最后一步是给长文装一棵可跳转的目录——场景中文期刊 PDF 普遍没有内嵌书签几十页的长文只能一页页滚动。操作步骤双击打开目标 PDF进入阅读器窗口。点击左侧边栏的茉莉花书签图标大纲面板展开。用顶部 5 个按钮调整大纲展开所有、折叠所有、添加书签、删除书签、保存到 PDF。需要换设备使用大纲时点「保存到 PDF」把它写进文件本身。常用键盘快捷键读长文时不用碰鼠标按键功能↑ / ↓在书签间上移下移自动跳过折叠内容← / →折叠或展开节点空格编辑书签文字\新建子节点[ / ]节点上移一级 / 下移一级Delete删除当前节点✅ 验证此时你会看到左侧出现层级大纲点击任意书签直接跳到对应页。上图是展开大纲面板后的 PDF 阅读器顶部红框区域是展开、折叠、添加、删除、保存 5 个按钮下方是多层书签树点任意一条直接跳到该页。常见卡点大纲解析依赖 PDF 的文本层扫描版 PDF 没有可识别文字要先做 OCR。若插件大纲和 Zotero 自带大纲同时出现、不好区分确认设置中「禁用 Zotero 自带的大纲」已勾选默认开启。进阶配置过一遍下表、改动其中两三项之后插件的行为就会贴合你的习惯其余保持默认即可。配置项默认值何时需要改当前位于中国大陆勾选不在大陆就取消勾选影响抓取的数据源选择添加中文 PDF/CAJ 时自动从知网抓取元数据勾选希望每次手动右键抓取时取消文件名解析模板标题_作者命名不符合该格式时换「智能识别」或自定义元数据抓取来源中国知网、万方数据、中华医学期刊想省时间就取消不用的来源想查得全就多勾附件下载文件夹系统默认下载目录浏览器下载到自定义位置时指向真实目录附件匹配后原始文件处理备份附件想让下载目录干净就选「删除附件」想留原件选「无须处理」启用大纲书签开启不需要大纲面板时取消禁用 Zotero 自带的大纲勾选希望同时看到自带大纲时取消导入新条目时自动拆分姓名未勾选希望导入时自动拆中文作者姓名就勾选拆分/合并姓名时包括英文名未勾选用姓名工具时想连英文名一起处理就勾选补充两点。「文件名解析模板」支持自定义规则%t标题、%g作者、%y年份、%j其他信息分隔符可自由组合例如%t_%g。中文作者的名和姓被拆成两条时右键条目选「小工具 → 合并姓名」可一键还原。设置界面定义在 偏好设置界面定义。故障排查出问题时按这张表逐行对照最常碰到的问题都在这里。现象可能原因处理方法任务窗口里期刊版、报纸版都有分不清选哪条同一文献命中期刊、报纸、会议等多个来源依次对比相似度、来源类型、发表年份三者一致即为正解勾了自动抓取拖入 PDF 却没反应开关、地区、文件名三项条件之一不满足依次检查自动抓取是否勾选、「当前位于中国大陆」是否符合实际、文件名是否符合解析模板先改成「标题_作者」再试自定义文件名模板识别不了模板写法有误或与实际命名不符用占位符%t标题、%g作者、%y年份、%j其他分隔符自由组合识别不了时换「智能识别」兜底没点「保存到 PDF」担心重启后大纲丢失书签默认以配置文件形式保存在本地无需处理随时打开都在「保存到 PDF」是额外写入文件用于换设备或分享大纲面板是空的生成不出大纲扫描版 PDF 没有文本层先给 PDF 做 OCR再回来生成若仍无法解决可在插件「关于」页查看版本与构建时间作为求助时的依据。30 分钟里你给 Zotero 装上了三项新能力中文文献元数据自动补全、失散附件自动归位、长 PDF 自带可跳转目录。之后每新增一篇文献拖进去等结果就行。现在就去挑一篇最让你头疼的中文文献试一次元数据抓取看着字段一条条补齐就知道这步安装值了。【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考