FeiZhuLulu/real-api-pricing · 上手攻略

  • 仓库:FeiZhuLulu/real-api-pricing
  • 链接:https://github.com/FeiZhuLulu/real-api-pricing
  • 分类:AI · API 定价与选型数据
  • 作者:Tom
  • 更新:2026-09-11

是什么

real-api-pricing 是一个开放数据项目,核心目标是回答一个简单但长期被回避的问题:订阅制 AI API 的真实单价到底是多少?

厂商宣传的往往是「月费 × 额度」,但不同厂商的 token 计量方式、额度刷新规则、缓存计费方式差异巨大,直接比较毫无意义。该项目用统一的标准工作负载(97.5% 缓存读取 + 2.15% 普通输入 + 0.35% 输出)将所有厂商的订阅方案折算成同一口径下的「每月实际可用 token」,再用月费除以该 token 数得出真实单价($/MTok,越低越好)。

数据快照日期 2026-09-09,覆盖 196 个订阅/按量 API 点,涵盖 OpenAI、Anthropic、Google、OpenRouter、各中国厂商(Kimi、智谱 GLM、阶跃 StepFun 等),以及 Ollama、OpenCode 等本地/开源方案。


解决什么问题

订阅制 AI API 的定价长期存在三大陷阱:

陷阱 说明
额度陷阱 厂商标注「百万 token」,但实际按输入/输出/缓存三段分别计费,感知额度远低于标称
刷新陷阱 周池 vs 月池、额度叠加 vs 独立、是否清零——不同厂商规则不同,无法直接比
缓存陷阱 缓存读取是否免费(或打折),直接影响实际可用 token 量

real-api-pricing 通过标准工作负载折算,把所有方案拉到同一基准线上对比,同时提供多维度帕累托图(按 Code Arena、Agent Arena、AA 智力榜等不同榜单分数作 Y 轴),帮助用户在性能-价格二维空间中找到真正的最优选择。


快速安装

这不是一个需要安装的程序,而是一个数据项目。直接访问 GitHub 仓库下载即可:

# 直接克隆(不含 git 历史)
git clone --depth 1 https://github.com/FeiZhuLulu/real-api-pricing.git

# 关键文件
cd real-api-pricing
ls data/          # adopted.csv(采用数据原始值)
ls derived/       # points.csv / points.json(完整计算结果)
ls charts/en/     # 英文图表(SVG/PNG)
ls charts/zh/     # 中文图表(SVG/PNG)

无需任何依赖,纯静态数据,随拿随用。


核心用法

1. 查单个方案的真实单价

打开 derived/points.csv,按列筛选。例如查 Claude Max($100/月):

grep "Claude Max" derived/points.csv | head -5

输出字段包括:套餐名、模型、月费、实际可用 token/月、真实单价($/MTok)。

2. 看帕累托前沿图

每个榜单目录下有 Pareto 图(SVG/PNG 两种格式),中文用户访问:

charts/zh/pareto/

关键图表:

文件 内容
帕累托图_CodeArena榜.svg 编程能力 vs 真实单价
帕累托图_AgentArena榜.svg Agent 任务能力 vs 真实单价
帕累托图_AA智力榜.svg 通用智力 vs 真实单价

图例中连线即为帕累托前沿,连线右下方的方案为「被支配」方案(同等价格性能更差,或同等性能价格更高)。

3. 看全量单价对比总图

charts/zh/overview/real-price-overview.svg   # 全部196点 $/MTok 对数轴
charts/zh/overview/月额度总览_月费0-30美元.svg   # $0-30档
charts/zh/overview/月额度总览_月费30-100美元.svg  # $30-100档

4. 下载原始数据做自定义分析

# 采用数据(含原始定价与额度)
curl -LO https://raw.githubusercontent.com/FeiZhuLulu/real-api-pricing/main/data/adopted.csv

# 完整计算结果(已含折算后 token 数与单价)
curl -LO https://raw.githubusercontent.com/FeiZhuLulu/real-api-pricing/main/derived/points.csv

典型适用场景

  • 订阅选型:准备订阅哪个 AI 服务(Plus/Pro/Max/国内套餐),先用数据算清楚真实单价
  • 成本核算:企业内部评估 AI 成本,基准化各厂商报价
  • Pareto 选优:在预算约束下最大化性能,参考帕累托前沿图找非支配方案
  • 透明度监督:AI 圈从业者追踪各厂商定价策略变化(项目快照每月更新多次)

坑与注意

⚠️ 标准工作负载是统一口径,不代表实际使用

项目明确声明:97.5% 缓存 + 2.15% 输入 + 0.35% 输出是统一比较口径,不是任何厂商实际负载的真实反映。如果你实际业务的缓存命中率不同,换算结果会有偏差。

⚠️ 缓存写入(Cache Write)未单独建模

部分厂商对缓存写入也收费,项目折算时未单列 cache write 成本,实际账单可能偏高估。

⚠️ 美元/月费换算汇率

凡涉及美元换算(额度池 vs 月费),项目使用项目级标准汇率,不是实时汇率,跨时区比较时注意时间差。

⚠️ 快照时效性

数据快照为 2026-09-09,厂商定价随时可能调整(特别是促销活动期)。重要决策前再次确认官方最新报价。

⚠️ Claude Max 157亿 token 估算来源

项目注释明确:157亿/月是 2026-09-14 起永久口径(非活动上限)。GPT-5.6 Luna 的 Plus 基准(75.11亿/月)是从用户面板实测推算,5x/20x 套餐为等比推算、置信度标注为 medium。

⚠️ 同套餐不同模型额度是替代关系

同一订阅下不同模型共享额度,不能把多个模型的 token 数相加。例如 Claude Max $100/月 同时支持 Opus/Sonnet/Haiku,三者取其一,而非三者叠加。


与同类对比

对比项 real-api-pricing OpenRouter Price Calculator API.Bot
覆盖广度 196 点,国内外全覆盖 主要海外 主要 API 监控
折算口径 统一标准工作负载 各自计算 无标准化折算
帕累托图 ✅ 多榜单 SVG
缓存处理 三段式(含缓存 token) 基础 不统一
中文支持 ✅ 完整中英文 英文为主 中文
数据格式 CSV/JSON 开放下载 Web 界面 付费数据
更新频率 快照级更新(频繁) 实时 定期

核心差异:real-api-pricing 的护城河是「统一工作负载折算」+「帕累托前沿可视化」,两者结合起来是市面上其他工具缺失的。


一句话推荐结论

做 AI 订阅选型时,先查 real-api-pricing 的帕累托图和数据表——用统一口径把「真实性价比」算清楚,再决定掏多少钱。

项目地址:https://github.com/FeiZhuLulu/real-api-pricing 数据快照:2026-09-09 覆盖:196 个订阅/API 点 · Code Arena · Agent Arena · AA 智力榜 · Terminal-Bench 4.0