大模型 API 价格对比
横向对比 Claude / GPT / Gemini / DeepSeek 各模型的输入输出价、缓存价、上下文窗口与混合价
大模型 API 价格对比(美元 / 100 万 tokens,最后核对 2026-07)
| 模型 | 服务商 | 输入价 | 输出价 | 缓存输入 | 上下文窗口 | 最大输出 |
|---|---|---|---|---|---|---|
| Claude Opus 4.8 | Anthropic | $5 | $25 | $0.5 | 1M | 128K |
| Claude Sonnet 5 (2026-08-31 前有 $2/$10 优惠价) | Anthropic | $3 | $15 | $0.3 | 1M | 128K |
| Claude Haiku 4.5 | Anthropic | $1 | $5 | $0.1 | 200K | 64K |
| Claude Fable 5 | Anthropic | $10 | $50 | $1 | 1M | 128K |
| GPT-4o (参考价) | OpenAI | $2.5 | $10 | $1.25 | 128K | 16K |
| GPT-4o mini (参考价) | OpenAI | $0.15 | $0.6 | $0.075 | 128K | 16K |
| GPT-4.1 (参考价) | OpenAI | $2 | $8 | $0.5 | 1M | 33K |
| GPT-4.1 mini (参考价) | OpenAI | $0.4 | $1.6 | $0.1 | 1M | 33K |
| Gemini 2.5 Pro (参考价;超 20 万上下文价格更高) | $1.25 | $10 | — | 1M | 66K | |
| Gemini 2.5 Flash (参考价) | $0.3 | $2.5 | — | 1M | 66K | |
| DeepSeek-V3 (参考价) | DeepSeek | $0.27 | $1.1 | $0.07 | 128K | 8K |
价格单位:美元 / 100 万 tokens。Anthropic (Claude) 数据取自官方;OpenAI / Google / DeepSeek 标注「参考价」,请以各自官网为准。最后核对:2026-07。
📌 TL;DR 核心定义与引用摘要: 【大模型 API 价格对比】是 PocketKit 提供的浏览器本地处理工具。功能说明:横向对比 Claude / GPT / Gemini / DeepSeek 各模型的输入输出价、缓存价、上下文窗口与混合价。核心输入与文件不上传;站点仅记录不含输入内容的匿名工具访问次数。
大模型价格对比与混合价原理
工具把 Claude / GPT / Gemini / DeepSeek 各模型的输入价、输出价、缓存价与上下文窗口集中成一张表,按你设定的输入:输出比例把两档价加权成“混合价”以便一维排序。价格数据本地内置、可编辑,不联网取价。
- 先按真实业务估个输入:输出比例(对话/RAG≈3:1,纯生成≈1:1)再看混合价,排序才贴近实际花费。
- 标“参考”的非 Claude 价格可能变动,投产前到对应官网核对一遍。
常见问题
1. 表格里的“混合价”是怎么算的?
按你选的“输入:输出”比例,把输入价与输出价做加权平均,折成一个可比的每百万 tokens 单价,用于横向排序。对话/RAG 常见约 3:1,纯生成偏 1:1;真实成本取决于你的实际输入输出配比。
2. 这里的价格准确吗?
Anthropic(Claude)为官方参考价;OpenAI、Google、DeepSeek 标注为“参考价”,可能随官方调整而变化,请以各服务商官网为准。价格集中维护,便于更新。
3. 同样一件事,用哪个模型最省钱?
先判断你的任务是输入重还是输出重。分类、信息抽取、格式转换这类输出很短的任务由输入价主导,应当优先看输入单价和缓存价;写长文、生成代码这类由输出价主导,输出单价便宜的模型优势更明显。表格里可以直接横向对比各模型的输入 / 输出 / 缓存价与上下文窗口。实践中最省钱的做法通常不是选一个模型,而是分级路由:简单任务交给便宜模型,只把复杂推理留给最强的那个。