ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

3 步装好茉莉花:Zotero 中文文献元数据抓取插件的保姆级上手

3 步装好茉莉花:Zotero 中文文献元数据抓取插件的保姆级上手 3 步装好茉莉花Zotero 中文文献元数据抓取插件的保姆级上手【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum手动补录一篇中文期刊作者、刊期、页码逐个对齐一篇要磨掉三五分钟。Zotero 插件「茉莉花 Jasminum」把中文元数据抓取、附件匹配、PDF 大纲整条链路接了过去。装好之后录文献从手抄降级成一次右键。装完是什么效果一次右键出候选结果先看装好之后的样子。右键任意一篇中文 PDF 附件选「茉莉花抓取 → 抓取期刊元数据」几秒后任务窗口弹出知网、万方等来源的候选结果排成一列标题、作者、期刊、日期一条比一条清楚。核对作者和日期选中头上一条点「确认」标题、作者、刊期、页码自动填进条目之前要翻半小时的核对活到这里只剩一次点击。再打开这篇 PDF阅读器左侧多出一级一级的章节大纲点哪里跳哪里。它替你做掉的重复劳动以前你手动干的活现在它替你干的翻知网网页逐字抄标题、作者、期刊、期号、页码右键一次候选按相似度排序点「确认」回填条目Connector 抓到了条目却没带下 PDF翻下载目录人肉对文件名扫描下载文件夹按文件名与标题的相似度挑出附件长文 PDF 没内嵌目录找内容全靠滚动条侧栏生成多级章节大纲能增删节点还能写回 PDF作者姓名被拆成两条引文格式对不上「小工具」菜单一键合并/拆分姓名、更新知网引用数最短安装路径从源码到可用插件环境只要装好 Node.js。把源码拉下来git clone https://gitcode.com/gh_mirrors/ja/jasminum打包出插件npm install npm run build成功的标志build/ 目录里多出一个 .xpi 文件它就是插件本体。交给 Zotero「工具 → 附加组件」→ 右上角齿轮 →「从文件安装」选中 .xpi重启 Zotero。成功的标志右键任意 PDF 附件菜单里出现「茉莉花抓取」。 稳妥的做法先拿手头三五篇中文 PDF 走一遍完整流程跑通了再处理整库。拿一篇 PDF 实测找回元数据、附件和目录挑一篇只有文件名、没有任何元数据的 PDF 走一遍。先把身份找回来右键附件「茉莉花抓取 → 抓取期刊元数据」。插件先从 PDF 内容里解析标题再拿标题去各数据源检索。同一条文献往往有期刊版、会议版等多个版本不用纠结候选按相似度从高到低排头一条通常就是答案扫一眼作者和日期点确认字段全部落位。再收拢漏网的附件Connector 建好了条目、PDF 却没下下来时手动下载后右键条目选「小工具 → 在下载文件夹中查找附件」。插件按相似度阈值扫描你设定的文件夹列出最可能的几个文件名确认后附件直接挂上条目原件按设置移入备份目录下载文件夹顺手清出一块。匹配逻辑在 src/modules/attachments/感兴趣的可以翻。最后给长文装上目录PDF 阅读器左侧工具栏点书签按钮大纲面板展开章节逐级铺开点节点跳页顶部按钮管展开、折叠、增删「将大纲保存到 PDF 文件」能把手工调整的大纲写回文件下次打开还在。全程也能用方向键加快捷键完成手可以不离开键盘。这条线的本质把找的活交出去你只保留判断。三处参数调完更顺手 都在偏好设置里围绕「中文元数据抓取设置」一带找。文件名规则namePattern文件按标题_作者命名时配好对应规则标题、作者直接从文件名解析抓取成功率明显上涨。相似度阈值similarityThreshold默认 0.8漏掉真实附件就调低误匹配多就调高候选列表立刻变准。数据源勾选metadataSource知网、万方、医脉通默认全开不用的来源取消勾选候选更少、检索更快。调参没有标准答案哪次误匹配多了就去改哪一条一次只动一个。卡住了怎么办为什么抓取总是失败文件名太随意新建文档.pdf之类标题解析不出来。在偏好设置里配好文件名规则或先把文件改成标题_作者再抓。为什么大纲面板是空的扫描版 PDF 没有文本层无字可解析。先跑一遍 OCR 把文字层补上再回来生成大纲。为什么匹配不到下载文件夹里的附件文件名和条目标题差距太大没过相似度阈值。阈值调低一点或让文件名离标题更近一点。为什么重启后书签又不见了大纲默认只以配置文件形式存在本地。点「将大纲保存到 PDF 文件」写回一次之后才是永久的。现在就能动手工具做得好的样子是你用着用着忘了它存在——录文献不再占注意力就是它干对了。克隆仓库两条命令出 .xpi装进 Zotero从库里挑最乱的一篇中文 PDF右键抓一次填完字段打开 PDF看侧栏里的大纲【免费下载链接】jasminumA Zotero add-on to retrive CNKI meta data. 一个简单的Zotero 插件用于识别中文元数据项目地址: https://gitcode.com/gh_mirrors/ja/jasminum创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表