blazickjp/arxiv-mcp-server · 上手攻略

  • 仓库:blazickjp/arxiv-mcp-server
  • 链接:https://github.com/blazickjp/arxiv-mcp-server
  • 分类:skill
  • 作者:Tom
  • 更新:2026-08-11

是什么

arxiv-mcp-server 是一个 Model Context Protocol(MCP)服务器,为 AI 编程助手提供搜索、下载、阅读和分析 arXiv 论文的能力。通过 MCP 协议,Claude Code、OpenAI Codex、Kiro 等 AI 客户端可以直接调用工具查询 arXiv、追踪引用图、管理研究追踪任务,所有论文和索引存在本地。

解决什么问题

AI 做学术研究时面临三个核心痛点: 1. 论文发现难:手动在 arXiv 网站搜索费时,无法用自然语言让 AI 帮忙找。 2. 全文获取慢:PDF 下载后需要 OCR 或手动复制;LaTeX 源码获取更麻烦。 3. 引用追踪烦:追踪某篇论文的引用和被引用关系需要跳转到 Semantic Scholar 多次操作。

arxiv-mcp-server 把这整个流程封装成 AI 可调用的工具,让 AI 在研究任务中直接操作论文数据。

快速安装

方式一:直接安装 MCP 服务器(最短路径)

前置:安装 uv(Python 包管理 + 运行时工具)。

# Claude Code 全局安装
claude mcp add --transport stdio --scope user arxiv \
  -- uvx arxiv-mcp-server

# OpenAI Codex 安装
codex mcp add arxiv -- uvx arxiv-mcp-server

# 验证安装
claude mcp get arxiv

方式二:安装为插件(含研究技能工作流)

# Claude Code 插件安装
claude plugin marketplace add blazickjp/arxiv-mcp-server
claude plugin install arxiv-mcp-server@arxiv-mcp

# Codex 插件安装
codex plugin marketplace add blazickjp/arxiv-mcp-server
codex plugin add arxiv-mcp-server@arxiv-mcp

⚠️ 不要用 npm install arxiv-mcp-server(存在同名 npm 包,来源不同)。

手动配置(任意 MCP 客户端)

{
  "mcpServers": {
    "arxiv": {
      "type": "stdio",
      "command": "uvx",
      "args": ["arxiv-mcp-server"]
    }
  }
}

核心用法

核心工具一览(14 个工具)

工具 功能 备注
search_papers 按关键词、分类、日期搜索 arXiv 调用远程 arXiv API
get_abstract 获取论文元数据 + 摘要 不下载论文
download_paper 下载并转为本地 Markdown HTML 优先,PDF 兜底
list_papers 列出本地缓存论文 返回 arXiv ID
read_paper 读取本地已缓存论文内容 支持分页
get_paper_latex 按章节获取 LaTeX 源码 来自 arXiv 源存档
list_paper_latex_sections 获取 LaTeX 目录大纲
get_paper_latex_section 读取指定 LaTeX 章节 按 ID 或标题选择
citation_graph 获取引用图(references + citations) 调用 Semantic Scholar API
export_citations 导出 BibTeX
watch_topic 保存研究主题追踪 本地存储
check_alerts 检查追踪主题的新论文
semantic_search 本地语义搜索已下载论文 需要 [pro] 额外
reindex 重建本地语义索引 需要 [pro] 额外

典型工作流示例

研究发现流程

AI 调用 search_papers:
{
  "query": "\"Kolmogorov-Arnold Networks\"",
  "categories": ["cs.LG", "cs.AI"],
  "max_results": 5,
  "sort_by": "date"
}

→ get_abstract 查摘要:
{ "paper_id": "2404.19756" }

→ download_paper 下载全文:
{ "paper_id": "2404.19756", "max_chars": 12000 }

→ read_paper 分页阅读:
{ "paper_id": "2404.19756", "start": 0, "max_chars": 12000 }

LaTeX 源码追踪

get_paper_latex: { "paper_id": "1706.03762" }
→ list_paper_latex_sections: 获取章节大纲
→ get_paper_latex_section: 按 section_id 读取指定节

引用图探索

citation_graph: { "paper_id": "1706.03762" }
→ 获取所有引用(references)和被引用(citations)论文

配置选项

{
  "mcpServers": {
    "arxiv": {
      "type": "stdio",
      "command": "uvx",
      "args": [
        "--storage-path",
        "/absolute/path/to/papers",
        "arxiv-mcp-server"
      ]
    }
  }
}
参数 默认值 说明
--storage-path ~/.arxiv-mcp-server/papers 本地存储目录
MAX_RESULTS 50 服务端结果上限
REQUEST_TIMEOUT 60 秒 PDF 下载超时

PDF 转换(老论文需要)

{
  "mcpServers": {
    "arxiv": {
      "type": "stdio",
      "command": "uvx",
      "args": [
        "--from", "arxiv-mcp-server[pdf]",
        "arxiv-mcp-server"
      ]
    }
  }
}

HTTP 传输模式(非 stdio 环境)

TRANSPORT=http HOST=127.0.0.1 PORT=8080 \
  uvx arxiv-mcp-server --storage-path /path/to/papers

典型适用场景

  • 文献调研:让 AI 帮找某个领域的最新论文,追踪最新进展。
  • 论文精读:AI 分段读取论文内容,结合 LaTeX 源码理解公式细节。
  • 引用图探索:从一篇核心论文出发,批量获取其引用和被引用关系。
  • 持续追踪:设置 watch_topic,定期 check_alerts 获取新论文。
  • AI 研究助手:在 Claude Code 中做研究任务时,AI 直接调用工具读论文而非复制粘贴。

坑与注意

  1. PyPI 同名包风险:npm/pnpm/npx 有个同名包,不要用这些安装,只用 uvx
  2. PDF 转换额外依赖[pdf] 额外安装 pymupdf4llm,老旧无 HTML 版本的 arXiv 论文才需要。
  3. 内容截断download_papermax_chars 上限;read_paper 大内容会返回 next_start 供继续读取。
  4. 论文内容不可信:论文内容是外部非可信输入,可能含 prompt injection;AI 客户端需开启审批控制。
  5. semantic_search 需要 [pro]:本地语义搜索是付费功能,需要 uv tool install 'arxiv-mcp-server[pro]'
  6. 存储空间:大量下载论文会占用本地存储,默认在 ~/.arxiv-mcp-server/papers

与同类对比

工具 类型 特点 适用场景
arxiv-mcp-server MCP Server 原生 AI 集成,支持 LaTeX 源码、引用图、追踪 AI 编程助手 + 学术研究
Semantic Scholar API REST API 引用图数据全,但需自己写调用 纯 API 调用场景
arXiv API REST API 基础搜索免费 简单搜索,不需要 AI 集成
Zotero + 插件 本地工具 完整文献管理生态 非 AI 助手的传统研究流程

arxiv-mcp-server 的核心优势是AI 原生集成 + LaTeX 源码 + MCP 协议,是专门为 AI 研究助手设计的产品。

一句话推荐结论

在 Claude Code 或 Codex 中做学术研究时,装上 arxiv-mcp-server 就能让 AI 直接搜索、阅读、追踪 arXiv 论文,省去手动复制粘贴的繁琐流程,是 AI 学术研究的效率利器。