保姆级教程:茉莉花 Zotero 插件 30 分钟搞定知网元数据抓取与 PDF 大纲
保姆级教程:茉莉花 Zotero 插件 30 分钟搞定知网元数据抓取与 PDF 大纲
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
把知网下载的论文拖进 Zotero,作者、期刊、摘要一片空白;PDF 孤零零躺在下载文件夹里,挂不到条目上;200 页的学位论文连一个书签都没有——这三件事几乎是中文文献用户的日常。茉莉花(Jasminum)是一款 Zotero 插件,专为这类知网文献场景设计:一键从知网抓取元数据、按标题相似度自动认领本地 PDF 附件、给没有书签的中文 PDF 手动建立章节目录,另附姓名整理、引用数查询等小工具。
装完你能得到什么:4 个知网文献痛点的处理方案
| 你会遇到的情况 | 插件怎么处理 | 入口在哪 |
|---|---|---|
| 知网 PDF 拖入后条目字段全空 | 到知网检索,把作者、期刊、摘要、关键词一次写入 | 右键附件 →茉莉花抓取 |
| 条目只存了题录,附件缺失 | 扫描下载文件夹,按标题相似度自动认领 PDF 并导入 | 右键条目 →小工具 → 在下载文件夹中查找附件 |
| 长篇中文 PDF 没有书签 | 手动建立多级章节大纲,支持键盘快捷导航 | PDF 阅读器侧边栏的茉莉花按钮 |
| 姓名错位、被引次数不明、Word 引用乱码 | 拆分/合并姓名、查询知网引用数、下载中文转换器与 CSL 样式 | 右键条目 →小工具 |
茉莉花 Zotero 插件怎么装:构建 + 导入两步走
整个安装只分两个阶段:先构建出安装包,再导入 Zotero。
阶段一:构建 .xpi 安装包
先准备好两样东西:Zotero 9 及以上版本,以及 Node.js(构建过程需要)。然后打开终端执行:
git clone https://gitcode.com/gh_mirrors/ja/jasminum cd jasminum npm install npm run build构建完成后,.xpi安装包会生成在项目的build/目录里,记住它的位置,下一步要用。
阶段二:导入 Zotero 并完成首次运行
- 打开 Zotero 的
工具 → 插件(部分版本显示为工具 → 附加组件),点窗口右上角的齿轮图标 →从文件安装插件,选中刚才的.xpi文件,重启 Zotero。 - 验证是否生效:随便右键一个知网附件,如果菜单里出现了
茉莉花抓取,说明安装成功。 - 打开插件设置面板,确认
添加中文PDF/CAJ时自动从知网抓取元数据处于开启状态(默认已开)。打开之后,以后再拖入知网 PDF 就会自动抓元数据,连右键都省了。
💡 建议先把设置面板快速过一遍,尤其是「附件下载文件夹」这一项,它决定后续附件匹配去哪儿找文件。
知网元数据怎么一键补齐:批量写入作者、期刊与摘要
拖进 Zotero 的知网论文往往只剩一个文件名,逐篇打开网页对照填写最磨人。
- 右键附件 →
茉莉花抓取 → 抓取期刊元数据。插件会先解析 PDF 文件名得到标题;文件名不规范时,它还能从 PDF 正文里智能提取标题再上知网检索。 - 任务窗口弹出候选结果,按相似度排好序。核对来源、期刊名和日期,挑出正确的那一条。
- 点确认,作者、期刊、年份、摘要、关键词、引用格式一次性写入条目。
时间上对比很直观:20 篇论文逐篇手工填写题录,通常需要 40~60 分钟;换成在窗口里逐条确认候选结果,整个过程压缩到几分钟的级别。批量处理时直接多选附件再执行抓取,插件会为每个附件创建独立任务,互不干扰。
👉 如果候选结果明显不对,多半是文件名规律和默认模板不匹配,先跳到下文「设置」一节调整文件名解析模板再重试。
下载文件夹的 PDF 怎么自动归位:按标题认领缺失附件
用浏览器 Connector 抓中文期刊时,题录一般能存下来,附件却常常失败——知网这类需要登录态的站点尤为常见。PDF 只能手动存到本地,再想办法和条目对上。
- 把手动下载好的 PDF 放进浏览器的下载目录,Windows 默认是
C:\Users\用户名\Downloads。 - 在 Zotero 中右键对应条目 →
小工具 → 在下载文件夹中查找附件。 - 插件扫描下载文件夹,用条目标题与文件名做相似度比对,把最匹配的附件自动导入该条目。
匹配成功后,原始下载文件有三种处理方式,在设置里任选其一:
| 处理方式 | 效果 |
|---|---|
| 无须处理 | 原文件留在下载目录,Zotero 里已多一份副本 |
| 备份(默认) | 原文件移入下载目录/jasminum-backup |
| 删除 | 直接删除原文件,Zotero 已保存一份,可放心删 |
期刊之外,学位论文、会议论文、书籍、报告、专利等条目类型都支持;右键整个合集(分类)执行同一命令,能批量扫描分类下所有缺附件的条目。
👉 匹配靠的是标题与文件名的相似度,文件名被改得面目全非时认领率会下降,尽量保留知网下载的原始命名。
没有书签的中文 PDF 怎么加目录:手动大纲 + 键盘导航
学位论文、长篇综述这类中文 PDF 经常不带书签,阅读器里想跳到"第四章 结论"只能一页页翻。
- 在 Zotero 阅读器中打开该 PDF,点击左侧边栏的茉莉花书签按钮,弹出独立的大纲/书签管理窗口。
- 在窗口中逐级添加、编辑章节节点,可以折叠或展开各级,层级一目了然。
- 窗口顶部 5 个按钮依次是:展开所有、收起所有、添加书签、删除书签、将大纲保存到 PDF 文件。
大纲建好后,日常跳转交给键盘:
| 按键 | 作用 |
|---|---|
| ↑ / ↓ | 上一个 / 下一个书签(自动跳过折叠的子节点) |
| ← / → | 折叠 / 展开当前节点 |
| 空格 | 编辑当前书签的文字 |
| [ / ] | 把节点上移一级 / 下移一级 |
| \ | 在选中节点下新建子节点 |
| Delete / Backspace | 删除当前节点 |
默认情况下,大纲以配置文件形式单独保存在本地,不改动原 PDF;只有点击「将大纲保存到 PDF 文件」时,大纲才写入文件本身——需要把带书签的文件发给别人时再点它。
👉 超长文档建议先只建一级章节,再用 ← / → 折叠后逐层细化,视图更清爽。
姓名错位、引用数、引用乱码:3 个中文特有的收尾动作
这三个功能都藏在右键菜单的小工具下,各解决一类中文文献的残留问题。
拆分姓名/合并姓名:处理"张三"被存成"Zhang San"、"张三 李四"挤在同一个字段这类错位。拆分时按内置的百余个复姓库(欧阳、司马、诸葛等)智能切分,带"·"的少数民族姓名也能正确拆分;英文名的处理由设置里的开关控制。更新知网引用数:选中中文条目运行,插件自动到知网查询该文献的被引次数,写入"知网引用数"字段,写综述时筛选高引文献很省事。- 下载中文转换器与 CSL 引用样式:转换器可修复知网抓取异常,CSL 样式解决 Word 中插入中文文献的格式乱码,两者均来自 Zotero 中文社区。
👉 批量抓取完元数据后,顺手选中整批条目跑一次拆分姓名,导出和引用都会规整很多。
插件设置面板里,哪些选项值得在大批量使用前确认
打开插件设置面板,重点核对这几项:
| 设置项 | 默认值 | 什么时候需要改 |
|---|---|---|
| 文件名解析模板 | 智能识别 | 文件名有固定规律时,可改选标题_作者、标题或自定义 |
| 元数据抓取来源 | 勾选知网 CNKI | 需要万方数据、中华医学期刊、ChinaDOI 时加开 |
| 添加中文 PDF 时自动抓取元数据 | 开启 | 想完全手动控制时关掉 |
| 附件下载文件夹 | 系统下载目录 | 浏览器下载位置改过就同步改这里 |
| 匹配后原始文件处理 | 备份 | 按习惯改选"无须处理"或"删除" |
| 相似度阈值 | 附件 0.8 / 元数据 0.6 | 误匹配多就调高,匹配不到就调低 |
自定义模板的写法:{%t}代表标题、{%g}代表作者、{%y}代表年份、{%j}代表其他信息,分隔符按实际文件名指定。另外,海外用户可以取消勾选"当前位于中国大陆",让检索走对应入口。
避坑清单:最容易踩的 6 个坑
- ⚠️大纲会改动原 PDF 吗?不会。默认以配置文件单独保存在本地;只有点"将大纲保存到 PDF 文件"时才写入文件本身。
- 附件匹配支持学位论文、会议论文吗?支持。期刊、学位论文、会议论文、书籍、报告、专利均可,右键合集还能批量处理。
- PDF 文件名有格式要求吗?没有硬性要求。默认智能识别能解析大多数知网下载的文件名(如
论文标题_作者.pdf);命名不规律时切换解析模板,或依赖正文标题提取。 - Connector 抓取时附件就是下载不下来,正常吗?这是已知现象——知网需要登录态,网页端只能存题录。这正对应插件"在下载文件夹中查找附件"的使用场景:手动下载后让它认领。
- 知网抓取偶尔抽风怎么办?先在设置面板下载/更新中文转换器;仍不稳定的话,检查"元数据抓取来源"里勾选的数据源和网络环境。
- WPS 用户能用 Zotero 吗?可以。设置面板里有一键为 WPS 安装 Zotero 加载项的入口,装完即可在 WPS 里插入文献。
先拿 5 篇知网 PDF 把元数据抓取完整走一遍,确认候选结果匹配准确后,再依次启用附件认领和大纲功能,遇到偏差不再顺手、而是回到设置面板对应调整。
【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件,用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
