知网文献元数据不全?茉莉花插件的知网元数据抓取与中文文献管理实战教程
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
茉莉花(Jasminum)是一款面向中文文献的开源 Zotero 插件:为知网 PDF 抓取期刊元数据、把下载文件夹里的 PDF 匹配回对应条目、给没有书签的长 PDF 补章节大纲。装好后,所有操作都走右键菜单,不需要额外学习流程。
适合谁:三类中文文献痛点对照
| 你遇到的情况 | 插件提供的能力 |
|---|---|
| 知网下载的 PDF 拖入 Zotero 后,条目只剩文件名,作者、期刊、摘要全空 | 检索知网,把作者、期刊、年份、摘要、关键词等字段一次性写入条目 |
| Connector 只存下题录,附件缺失,PDF 散在浏览器下载文件夹里 | 按条目标题与文件名的相似度自动认领并导入附件,支持按合集批量处理 |
| 学位论文等长 PDF 没有书签,阅读器里翻不到章节 | 手动建立多级大纲,支持快捷键跳转、编辑、增删节点 |
| 姓名字段错位,或想查某篇文献的知网被引次数 | 按百余个复姓库拆分/合并姓名,把知网引用数写入条目 |
从零安装:5 步装好插件
- 安装 Zotero(项目 README 徽章标注支持 Zotero 8/9),构建插件还需要 Node.js。
- 克隆源码到本地:
git clone https://gitcode.com/gh_mirrors/ja/jasminum- 进入项目目录,安装依赖并执行构建:
npm install npm run build构建成功后,build/目录下会生成.xpi安装包。 4. 打开 Zotero 的「工具 → 插件」,点右上角齿轮图标,选择「从文件安装插件」,选中刚才生成的.xpi,然后重启 Zotero。 5. 验证:把一个知网 PDF 拖入 Zotero,右键附件选择「茉莉花抓取 → 抓取期刊元数据」,弹出「茉莉花任务窗口」并列出候选结果,即表示安装成功。
功能实操
用知网元数据抓取批量补全空白条目
条目信息不全时,逐条打开网页对照填写最耗时间,这一步让插件代劳。
- 右键中文附件,选择「茉莉花抓取 → 抓取期刊元数据」。默认按「标题_作者」模板解析文件名,得到标题后到知网检索;文件名不规范时,可在设置中切到「智能识别」,插件会先从 PDF 正文提取标题再检索。
- 任务窗口中列出候选结果,标注来源、标题与匹配度,核对期刊名和日期后选中正确的一条。
- 点击「确认」,作者、期刊、年份、摘要、关键词、引用格式写入新条目,原附件自动挂到该条目下。
多选附件再执行同一命令,插件会为每个附件创建独立任务并行处理,互不干扰。
下载文件夹里的 PDF 自动认领回条目
Connector 抓中文期刊时题录常有、附件常缺,手动下载的 PDF 只能靠这个功能归位。
- 把手动下载好的 PDF(支持 PDF、CAJ 等)放在浏览器下载目录,Windows 默认为
C:\Users\用户名\Downloads。 - 在 Zotero 中右键对应条目,选择「小工具 → 在下载文件夹中查找附件」。插件用条目标题与文件名做相似度比对,取匹配度不低于 0.8 的前 3 个候选,匹配则导入条目。
- 导入后,原始文件默认移动到
下载目录/jasminum-backup备份;在设置中可改为直接删除或保持不动。
右键整个合集(分类)执行同一命令,可批量扫描分类下所有缺附件的条目;分类右键菜单里另有「从下载文件夹中导入附件」,把文件夹内全部中文命名附件直接导入该合集。
给中文 PDF 建立自己的章节大纲
没有书签的长文档在阅读器里缺少章节导航,这一步为你手动补一本目录。
- 在 Zotero 阅读器中打开 PDF,点击左侧边栏的「显示大纲(茉莉花)」按钮,进入大纲管理面板。
- 用顶部 5 个按钮依次完成:展开所有、收起所有、添加书签、删除书签、将大纲保存到 PDF 文件;逐级添加、编辑章节节点,层级清晰可查。
- 建好后日常跳转交给快捷键:↑/↓ 跳上一个/下一个书签(自动跳过折叠节点),←/→ 折叠与展开,空格编辑文字,
\新建子节点,[]上移/下移节点,Delete 删除节点。
默认大纲以本地配置文件形式保存,原 PDF 不受影响;需要分享带书签的文件时,再点「将大纲保存到 PDF 文件」写入文件本身。
小工具修姓名错位与查引用数
右键「小工具」菜单下还有三个针对中文文献的常用项:
- 「拆分姓名」/「合并姓名」:拆分按内置百余个复姓(欧阳、司马、诸葛等)切分,兼容带「·」的姓名;英文名拆合需在设置中开启对应开关。
- 「更新知网引用数」:选中中文条目运行,自动到知网查询被引次数,写入条目的「知网引用数」字段,写综述时按引用量筛选文献方便。
- 设置面板还提供中文社区转换器与 CSL 引用样式的下载,用于修复知网抓取异常和 Word 中中文文献格式问题。
关键设置
| 设置项 | 默认行为 | 何时需要改 |
|---|---|---|
| 文件名解析模板 | 按「标题_作者」({%t}_{%g})解析文件名 | 文件名规律不同时,改选「智能识别」(先读 PDF 正文)、「标题」或自定义模板({%t}标题、{%g}作者) |
| 元数据抓取来源 | 知网 CNKI、万方数据、中华医学期刊 | 只依赖单一来源,或想调整多来源检索优先级时 |
| 附件下载文件夹 | 系统默认下载目录 | 浏览器下载位置不是默认目录时 |
| 匹配阈值与导入后动作 | 相似度阈值 0.8;原文件备份到jasminum-backup | 常漏配/误配附件,或希望原文件删除、保留时 |
常见问题
PDF 大纲保存在哪里?会改动原 PDF 吗?默认以本地配置文件形式保存,不影响原 PDF;只有点击「将大纲保存到 PDF 文件」时,大纲才写入文件本身。
附件匹配支持学位论文和会议论文吗?支持。期刊、学位论文、图书、会议论文、报告等类型条目都在匹配范围内,也可以右键整个合集批量处理。
装好后为什么有些条目上看不到「茉莉花抓取」菜单?该菜单只对中文附件或网页快照显示,右键普通文献条目时不出现,属于正常行为。
添加中文 PDF 后会自动抓取吗?「添加中文 PDF 时自动从知网抓取元数据」开关默认开启,拖入即自动抓取,无需再手动执行。
文件名没有固定格式怎么办?没有硬性要求。切到「智能识别」后,插件会先从 PDF 正文提取标题再检索,文件名解析失败时也可作为兜底。
建议先拿 5 个已下载的知网 PDF 跑一次元数据抓取,确认候选匹配无误后,再对下载文件夹做批量附件认领,并根据实际命中率微调文件名模板与相似度阈值。
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考