知网文献元数据不全?茉莉花插件的知网元数据抓取与中文文献管理实战教程
2026/8/27 3:52:52 网站建设 项目流程

知网文献元数据不全?茉莉花插件的知网元数据抓取与中文文献管理实战教程

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

茉莉花(Jasminum)是一款面向中文文献的开源 Zotero 插件:为知网 PDF 抓取期刊元数据、把下载文件夹里的 PDF 匹配回对应条目、给没有书签的长 PDF 补章节大纲。装好后,所有操作都走右键菜单,不需要额外学习流程。

适合谁:三类中文文献痛点对照

你遇到的情况插件提供的能力
知网下载的 PDF 拖入 Zotero 后,条目只剩文件名,作者、期刊、摘要全空检索知网,把作者、期刊、年份、摘要、关键词等字段一次性写入条目
Connector 只存下题录,附件缺失,PDF 散在浏览器下载文件夹里按条目标题与文件名的相似度自动认领并导入附件,支持按合集批量处理
学位论文等长 PDF 没有书签,阅读器里翻不到章节手动建立多级大纲,支持快捷键跳转、编辑、增删节点
姓名字段错位,或想查某篇文献的知网被引次数按百余个复姓库拆分/合并姓名,把知网引用数写入条目

从零安装:5 步装好插件

  1. 安装 Zotero(项目 README 徽章标注支持 Zotero 8/9),构建插件还需要 Node.js。
  2. 克隆源码到本地:
git clone https://gitcode.com/gh_mirrors/ja/jasminum
  1. 进入项目目录,安装依赖并执行构建:
npm install npm run build

构建成功后,build/目录下会生成.xpi安装包。 4. 打开 Zotero 的「工具 → 插件」,点右上角齿轮图标,选择「从文件安装插件」,选中刚才生成的.xpi,然后重启 Zotero。 5. 验证:把一个知网 PDF 拖入 Zotero,右键附件选择「茉莉花抓取 → 抓取期刊元数据」,弹出「茉莉花任务窗口」并列出候选结果,即表示安装成功。

功能实操

用知网元数据抓取批量补全空白条目

条目信息不全时,逐条打开网页对照填写最耗时间,这一步让插件代劳。

  1. 右键中文附件,选择「茉莉花抓取 → 抓取期刊元数据」。默认按「标题_作者」模板解析文件名,得到标题后到知网检索;文件名不规范时,可在设置中切到「智能识别」,插件会先从 PDF 正文提取标题再检索。
  2. 任务窗口中列出候选结果,标注来源、标题与匹配度,核对期刊名和日期后选中正确的一条。
  3. 点击「确认」,作者、期刊、年份、摘要、关键词、引用格式写入新条目,原附件自动挂到该条目下。

多选附件再执行同一命令,插件会为每个附件创建独立任务并行处理,互不干扰。

下载文件夹里的 PDF 自动认领回条目

Connector 抓中文期刊时题录常有、附件常缺,手动下载的 PDF 只能靠这个功能归位。

  1. 把手动下载好的 PDF(支持 PDF、CAJ 等)放在浏览器下载目录,Windows 默认为C:\Users\用户名\Downloads
  2. 在 Zotero 中右键对应条目,选择「小工具 → 在下载文件夹中查找附件」。插件用条目标题与文件名做相似度比对,取匹配度不低于 0.8 的前 3 个候选,匹配则导入条目。
  3. 导入后,原始文件默认移动到下载目录/jasminum-backup备份;在设置中可改为直接删除或保持不动。

右键整个合集(分类)执行同一命令,可批量扫描分类下所有缺附件的条目;分类右键菜单里另有「从下载文件夹中导入附件」,把文件夹内全部中文命名附件直接导入该合集。

给中文 PDF 建立自己的章节大纲

没有书签的长文档在阅读器里缺少章节导航,这一步为你手动补一本目录。

  1. 在 Zotero 阅读器中打开 PDF,点击左侧边栏的「显示大纲(茉莉花)」按钮,进入大纲管理面板。
  2. 用顶部 5 个按钮依次完成:展开所有、收起所有、添加书签、删除书签、将大纲保存到 PDF 文件;逐级添加、编辑章节节点,层级清晰可查。
  3. 建好后日常跳转交给快捷键:↑/↓ 跳上一个/下一个书签(自动跳过折叠节点),←/→ 折叠与展开,空格编辑文字,\新建子节点,[]上移/下移节点,Delete 删除节点。

默认大纲以本地配置文件形式保存,原 PDF 不受影响;需要分享带书签的文件时,再点「将大纲保存到 PDF 文件」写入文件本身。

小工具修姓名错位与查引用数

右键「小工具」菜单下还有三个针对中文文献的常用项:

  • 「拆分姓名」/「合并姓名」:拆分按内置百余个复姓(欧阳、司马、诸葛等)切分,兼容带「·」的姓名;英文名拆合需在设置中开启对应开关。
  • 「更新知网引用数」:选中中文条目运行,自动到知网查询被引次数,写入条目的「知网引用数」字段,写综述时按引用量筛选文献方便。
  • 设置面板还提供中文社区转换器与 CSL 引用样式的下载,用于修复知网抓取异常和 Word 中中文文献格式问题。

关键设置

设置项默认行为何时需要改
文件名解析模板按「标题_作者」({%t}_{%g})解析文件名文件名规律不同时,改选「智能识别」(先读 PDF 正文)、「标题」或自定义模板({%t}标题、{%g}作者)
元数据抓取来源知网 CNKI、万方数据、中华医学期刊只依赖单一来源,或想调整多来源检索优先级时
附件下载文件夹系统默认下载目录浏览器下载位置不是默认目录时
匹配阈值与导入后动作相似度阈值 0.8;原文件备份到jasminum-backup常漏配/误配附件,或希望原文件删除、保留时

常见问题

PDF 大纲保存在哪里?会改动原 PDF 吗?默认以本地配置文件形式保存,不影响原 PDF;只有点击「将大纲保存到 PDF 文件」时,大纲才写入文件本身。

附件匹配支持学位论文和会议论文吗?支持。期刊、学位论文、图书、会议论文、报告等类型条目都在匹配范围内,也可以右键整个合集批量处理。

装好后为什么有些条目上看不到「茉莉花抓取」菜单?该菜单只对中文附件或网页快照显示,右键普通文献条目时不出现,属于正常行为。

添加中文 PDF 后会自动抓取吗?「添加中文 PDF 时自动从知网抓取元数据」开关默认开启,拖入即自动抓取,无需再手动执行。

文件名没有固定格式怎么办?没有硬性要求。切到「智能识别」后,插件会先从 PDF 正文提取标题再检索,文件名解析失败时也可作为兜底。

建议先拿 5 个已下载的知网 PDF 跑一次元数据抓取,确认候选匹配无误后,再对下载文件夹做批量附件认领,并根据实际命中率微调文件名模板与相似度阈值。

【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询