steven-jianhao-li/zotero-AI-Butler · 上手攻略
- 仓库:steven-jianhao-li/zotero-AI-Butler
- 链接:https://github.com/steven-jianhao-li/zotero-AI-Butler
- 分类:academic-writing
- 作者:Tom
- 更新:2026-08-09
是什么
Zotero-AI-Butler 是一个 Zotero 论文管理插件,利用大模型(如 Google Gemini、OpenAI GPT、Claude)自动精读论文库中的 PDF 文献,将总结内容以 Markdown 笔记形式保存到 Zotero 条目下。核心价值是把"文献阅读"从手动逐篇消化,变成自动化流水线作业。
解决什么问题
学术阅读的三大痛点:
- 读不过来:论文太多,逐一发给 AI 效率低下
- 读完就忘:辛辛苦苦读完一篇,两天后想不起来讲了什么
- 抓不住重点:长篇论文有翻译也难以把握核心逻辑
Zotero-AI-Butler 的解法是:你只管把 PDF 扔进 Zotero,AI 管家自动扫描、分析、生成笔记,全程在 Zotero 内闭环。
快速安装
# 1. 访问 GitHub Releases 下载最新 .xpi 文件
# https://github.com/steven-jianhao-li/zotero-AI-Butler/releases/latest
# 2. 打开 Zotero → 工具 → 插件
# 3. 将 .xpi 文件拖入插件窗口,完成安装
# 4. 重启 Zotero(关闭并重新打开)
# 5. 打开仪表盘:任意条目右键 → "AI管家仪表盘" → "快捷设置"
# 6. 填入 API 密钥(推荐 Google Gemini),测试连接
# 7. 开启自动扫描:界面设置 → 勾选"自动扫描新文献"
首次安装后新拖入 Zotero 的 PDF,会在约 1 分钟后自动生成 AI 笔记。
核心用法
三种触发方式
方式一:右键即时处理(单篇) 在论文条目上右键 → "召唤AI管家进行分析" → 任务进入队列,可在仪表盘查看实时进度。
方式二:自动巡航(新文献) 开启"自动扫描新文献"后,任何新拖入 Zotero 的 PDF 自动排队处理,适合长期订阅arXiv/论文源的场景。
方式三:批量回溯(积压论文) 仪表盘 → "扫描未分析论文" → 勾选历史积压论文 → "添加到队列",后台慢慢消化。
核心功能速查
| 功能 | 触发方式 | 说明 |
|---|---|---|
| 单次总结 | 右键 → 召唤AI管家 | 最少 token 消耗 |
| 多轮精读 | 右键 → 多轮对话重新精读 → 多轮拼接/总结 | 深度分析,token 消耗较高 |
| 一图总结 | 右键 → AI管家一图总结 | 需要配置 Nano Banana Pro API |
| 思维导图 | 右键 → 召唤AI管家生成思维导图 | 支持导出 PNG / OPML |
| 文献综述 | 右键分类 → AI管家文献综述 | 多篇综合分析生成报告 |
| 侧边栏追问 | 右键条目 → 完整追问 / 快速提问 | 对已有笔记进行多轮对话 |
API 配置推荐
| 平台 | 推荐模型 | 配置要点 |
|---|---|---|
| Google Gemini | gemini-3-pro-preview | 🌟 多模态最强,推荐 PDF 理解 |
| OpenAI | gpt-5(官方新接口) | 需科学网络 |
| Anthropic | claude-opus-4-5-20251101 | 综合能力优秀 |
| OpenAI 兼容 | 自定义(硅基流动等) | 标准 Chat Completions 格式 |
| 火山方舟 | doubao-seed-1-8-251228 | 每日200万tokens免费额度 |
| Ollama | llama3.2 | 本地/局域网模型,文本提取模式 |
PDF 处理方式:多模态模型(如 Gemini 2.5 Pro)建议用 Base64 上传模式;不支持多模态的模型(如本地 Ollama)用文字提取模式。
多轮对话模式
单次对话: 一键生成完整总结,token 最少,适合快速浏览
多轮拼接: 分轮深入提问,拼接所有回答,token 消耗较高,适合深度研读
多轮总结: 多轮对话后 AI 自动汇总精炼,平衡深度与简洁
每轮的提示词均可自定义(研究背景与问题 / 研究方法与技术 / 实验设计与结果 / 结论与展望)。
典型适用场景
- 研究生 / 博士生日常文献管理:把读研期间所有论文扔进 Zotero,AI 自动生成可检索的笔记体系
- arXiv 追踪流水线:设置自动巡航,每天新论文自动分析,下班前浏览 AI 笔记即可
- 论文精读训练:多轮对话模式对高水平论文进行逐节精读,理解方法论细节
- 文献综述快速起步:对 10-30 篇相关论文批量生成综述报告,节省综述初期的文献梳理时间
- 跨语言论文阅读:中英文论文均支持,Base64 多模态模式保留公式、图表原始信息
坑与注意
-
多模态 API 费用:Gemini 3 Pro 等多模态模型处理 Base64 PDF 消耗 token 较多;开启"自动一图总结"前建议确认 API 额度,一图总结消耗最大。
-
Zotero 版本兼容性:作为 Zotero 插件,需要 Zotero 桌面版(Zotero 7+);Zotero connector(浏览器插件)无法使用此功能。
-
本地 Ollama 需要 PDF 预处理:Ollama 等本地模型不支持多模态,需切换到文字提取模式,或配合 MinerU 等 PDF 解析工具预处理。
-
自动扫描影响性能:默认关闭自动扫描是有意设计;若 Zotero 库超过 5000 篇论文,开启后首次扫描可能较慢,建议配合"任务处理速度"限制(每分钟论文数)。
-
笔记样式可自定义:侧边栏笔记渲染支持 Typora 主题(CSS 文件放入
addon/content/markdown_themes/),可自行开发主题或参考 Theigrams/My-Typora-Themes。 -
API Key 安全:所有请求直接从本地设备发往大模型服务商,插件不收集任何数据;但需妥善保管 API Key,不要提交到公开代码库。
与同类对比
| 特性 | Zotero-AI-Butler | zotero-ainote | Zotero GPT |
|---|---|---|---|
| 安装方式 | Zotero 插件 (.xpi) | Zotero 插件 | Zotero 插件 |
| 多模型支持 | ✅ Gemini/OpenAI/Claude/Ollama 等 | ✅ | ⚠️ 主要 OpenAI |
| 多模态 PDF | ✅ Base64 | ⚠️ | ⚠️ |
| 批量处理 | ✅ | ❌ | ❌ |
| 思维导图 | ✅ | ❌ | ❌ |
| 一图总结 | ✅ | ❌ | ❌ |
| 多轮对话 | ✅ | ❌ | ⚠️ |
| 文献综述 | ✅ | ❌ | ❌ |
| 开源 | ✅ MIT | ✅ | ❌ |
Zotero-AI-Butler 是目前功能最完整的 Zotero AI 插件,覆盖从单篇总结到批量综述的全链路;zotero-ainote 是早期参考实现,功能较基础;Zotero GPT 主要面向 OpenAI 生态。
一句话推荐结论
如果你是 Zotero 重度用户且需要系统化管理论文阅读笔记,Zotero-AI-Butler 是目前中文社区最值得安装的 AI 插件——安装一次,让它帮你把十年积累的论文库变成可检索的知识库。
最小可跑命令(核验路径)
# 环境:Zotero 7+ (桌面版), Node.js(仅安装时可选)
# 1. 下载 .xpi:https://github.com/steven-jianhao-li/zotero-AI-Butler/releases/latest
# 2. Zotero → 工具 → 插件 → 拖入 .xpi → 重启 Zotero
# 3. 任意论文右键 → "AI管家仪表盘" → 快捷设置 → 配置 Gemini API Key → 测试连接
# 4. 同一论文右键 → "召唤AI管家进行分析"
# 5. 约 30-120 秒后,侧边栏显示 AI 笔记
# 硬件要求:无特殊,4GB RAM + 网络即可
⚠️ Gemini 3 Pro API 需申请(建议配合 gcli2api 工具获取免费额度);Ollama 需本地部署模型(推荐 7B 以上量化模型以保证总结质量)。
原始 commit:https://github.com/steven-jianhao-li/zotero-AI-Butler · MIT License · DOI: 10.5281/zenodo.20457937 · 作者 Li Jianhao