blazickjp/arxiv-mcp-server · 上手攻略
- 仓库:blazickjp/arxiv-mcp-server
- 链接:https://github.com/blazickjp/arxiv-mcp-server
- 分类:skill
- 作者:Tom
- 更新:2026-08-11
是什么
arxiv-mcp-server 是一个 Model Context Protocol(MCP)服务器,为 AI 编程助手提供搜索、下载、阅读和分析 arXiv 论文的能力。通过 MCP 协议,Claude Code、OpenAI Codex、Kiro 等 AI 客户端可以直接调用工具查询 arXiv、追踪引用图、管理研究追踪任务,所有论文和索引存在本地。
解决什么问题
AI 做学术研究时面临三个核心痛点: 1. 论文发现难:手动在 arXiv 网站搜索费时,无法用自然语言让 AI 帮忙找。 2. 全文获取慢:PDF 下载后需要 OCR 或手动复制;LaTeX 源码获取更麻烦。 3. 引用追踪烦:追踪某篇论文的引用和被引用关系需要跳转到 Semantic Scholar 多次操作。
arxiv-mcp-server 把这整个流程封装成 AI 可调用的工具,让 AI 在研究任务中直接操作论文数据。
快速安装
方式一:直接安装 MCP 服务器(最短路径)
前置:安装 uv(Python 包管理 + 运行时工具)。
# Claude Code 全局安装
claude mcp add --transport stdio --scope user arxiv \
-- uvx arxiv-mcp-server
# OpenAI Codex 安装
codex mcp add arxiv -- uvx arxiv-mcp-server
# 验证安装
claude mcp get arxiv
方式二:安装为插件(含研究技能工作流)
# Claude Code 插件安装
claude plugin marketplace add blazickjp/arxiv-mcp-server
claude plugin install arxiv-mcp-server@arxiv-mcp
# Codex 插件安装
codex plugin marketplace add blazickjp/arxiv-mcp-server
codex plugin add arxiv-mcp-server@arxiv-mcp
⚠️ 不要用
npm install arxiv-mcp-server(存在同名 npm 包,来源不同)。
手动配置(任意 MCP 客户端)
{
"mcpServers": {
"arxiv": {
"type": "stdio",
"command": "uvx",
"args": ["arxiv-mcp-server"]
}
}
}
核心用法
核心工具一览(14 个工具)
| 工具 | 功能 | 备注 |
|---|---|---|
search_papers |
按关键词、分类、日期搜索 arXiv | 调用远程 arXiv API |
get_abstract |
获取论文元数据 + 摘要 | 不下载论文 |
download_paper |
下载并转为本地 Markdown | HTML 优先,PDF 兜底 |
list_papers |
列出本地缓存论文 | 返回 arXiv ID |
read_paper |
读取本地已缓存论文内容 | 支持分页 |
get_paper_latex |
按章节获取 LaTeX 源码 | 来自 arXiv 源存档 |
list_paper_latex_sections |
获取 LaTeX 目录大纲 | |
get_paper_latex_section |
读取指定 LaTeX 章节 | 按 ID 或标题选择 |
citation_graph |
获取引用图(references + citations) | 调用 Semantic Scholar API |
export_citations |
导出 BibTeX | |
watch_topic |
保存研究主题追踪 | 本地存储 |
check_alerts |
检查追踪主题的新论文 | |
semantic_search |
本地语义搜索已下载论文 | 需要 [pro] 额外 |
reindex |
重建本地语义索引 | 需要 [pro] 额外 |
典型工作流示例
研究发现流程:
AI 调用 search_papers:
{
"query": "\"Kolmogorov-Arnold Networks\"",
"categories": ["cs.LG", "cs.AI"],
"max_results": 5,
"sort_by": "date"
}
→ get_abstract 查摘要:
{ "paper_id": "2404.19756" }
→ download_paper 下载全文:
{ "paper_id": "2404.19756", "max_chars": 12000 }
→ read_paper 分页阅读:
{ "paper_id": "2404.19756", "start": 0, "max_chars": 12000 }
LaTeX 源码追踪:
get_paper_latex: { "paper_id": "1706.03762" }
→ list_paper_latex_sections: 获取章节大纲
→ get_paper_latex_section: 按 section_id 读取指定节
引用图探索:
citation_graph: { "paper_id": "1706.03762" }
→ 获取所有引用(references)和被引用(citations)论文
配置选项
{
"mcpServers": {
"arxiv": {
"type": "stdio",
"command": "uvx",
"args": [
"--storage-path",
"/absolute/path/to/papers",
"arxiv-mcp-server"
]
}
}
}
| 参数 | 默认值 | 说明 |
|---|---|---|
--storage-path |
~/.arxiv-mcp-server/papers |
本地存储目录 |
MAX_RESULTS |
50 | 服务端结果上限 |
REQUEST_TIMEOUT |
60 秒 | PDF 下载超时 |
PDF 转换(老论文需要)
{
"mcpServers": {
"arxiv": {
"type": "stdio",
"command": "uvx",
"args": [
"--from", "arxiv-mcp-server[pdf]",
"arxiv-mcp-server"
]
}
}
}
HTTP 传输模式(非 stdio 环境)
TRANSPORT=http HOST=127.0.0.1 PORT=8080 \
uvx arxiv-mcp-server --storage-path /path/to/papers
典型适用场景
- 文献调研:让 AI 帮找某个领域的最新论文,追踪最新进展。
- 论文精读:AI 分段读取论文内容,结合 LaTeX 源码理解公式细节。
- 引用图探索:从一篇核心论文出发,批量获取其引用和被引用关系。
- 持续追踪:设置
watch_topic,定期check_alerts获取新论文。 - AI 研究助手:在 Claude Code 中做研究任务时,AI 直接调用工具读论文而非复制粘贴。
坑与注意
- PyPI 同名包风险:npm/pnpm/npx 有个同名包,不要用这些安装,只用
uvx。 - PDF 转换额外依赖:
[pdf]额外安装 pymupdf4llm,老旧无 HTML 版本的 arXiv 论文才需要。 - 内容截断:
download_paper有max_chars上限;read_paper大内容会返回next_start供继续读取。 - 论文内容不可信:论文内容是外部非可信输入,可能含 prompt injection;AI 客户端需开启审批控制。
- semantic_search 需要 [pro]:本地语义搜索是付费功能,需要
uv tool install 'arxiv-mcp-server[pro]'。 - 存储空间:大量下载论文会占用本地存储,默认在
~/.arxiv-mcp-server/papers。
与同类对比
| 工具 | 类型 | 特点 | 适用场景 |
|---|---|---|---|
| arxiv-mcp-server | MCP Server | 原生 AI 集成,支持 LaTeX 源码、引用图、追踪 | AI 编程助手 + 学术研究 |
| Semantic Scholar API | REST API | 引用图数据全,但需自己写调用 | 纯 API 调用场景 |
| arXiv API | REST API | 基础搜索免费 | 简单搜索,不需要 AI 集成 |
| Zotero + 插件 | 本地工具 | 完整文献管理生态 | 非 AI 助手的传统研究流程 |
arxiv-mcp-server 的核心优势是AI 原生集成 + LaTeX 源码 + MCP 协议,是专门为 AI 研究助手设计的产品。
一句话推荐结论
在 Claude Code 或 Codex 中做学术研究时,装上 arxiv-mcp-server 就能让 AI 直接搜索、阅读、追踪 arXiv 论文,省去手动复制粘贴的繁琐流程,是 AI 学术研究的效率利器。