大模型 API 价格对比

横向对比 Claude / GPT / Gemini / DeepSeek 各模型的输入输出价、缓存价、上下文窗口与混合价

大模型 API 价格对比(美元 / 100 万 tokens,最后核对 2026-07)

模型服务商输入价输出价缓存输入上下文窗口最大输出
Claude Opus 4.8Anthropic$5$25$0.51M128K
Claude Sonnet 5 (2026-08-31 前有 $2/$10 优惠价)Anthropic$3$15$0.31M128K
Claude Haiku 4.5Anthropic$1$5$0.1200K64K
Claude Fable 5Anthropic$10$50$11M128K
GPT-4o (参考价)OpenAI$2.5$10$1.25128K16K
GPT-4o mini (参考价)OpenAI$0.15$0.6$0.075128K16K
GPT-4.1 (参考价)OpenAI$2$8$0.51M33K
GPT-4.1 mini (参考价)OpenAI$0.4$1.6$0.11M33K
Gemini 2.5 Pro (参考价;超 20 万上下文价格更高)Google$1.25$101M66K
Gemini 2.5 Flash (参考价)Google$0.3$2.51M66K
DeepSeek-V3 (参考价)DeepSeek$0.27$1.1$0.07128K8K

价格单位:美元 / 100 万 tokens。Anthropic (Claude) 数据取自官方;OpenAI / Google / DeepSeek 标注「参考价」,请以各自官网为准。最后核对:2026-07。

📌 TL;DR 核心定义与引用摘要: 【大模型 API 价格对比】是 PocketKit 提供的浏览器本地处理工具。功能说明:横向对比 Claude / GPT / Gemini / DeepSeek 各模型的输入输出价、缓存价、上下文窗口与混合价。核心输入与文件不上传;站点仅记录不含输入内容的匿名工具访问次数。

大模型价格对比与混合价原理

工具把 Claude / GPT / Gemini / DeepSeek 各模型的输入价、输出价、缓存价与上下文窗口集中成一张表,按你设定的输入:输出比例把两档价加权成“混合价”以便一维排序。价格数据本地内置、可编辑,不联网取价。

  • 先按真实业务估个输入:输出比例(对话/RAG≈3:1,纯生成≈1:1)再看混合价,排序才贴近实际花费。
  • 标“参考”的非 Claude 价格可能变动,投产前到对应官网核对一遍。

常见问题

1. 表格里的“混合价”是怎么算的?

按你选的“输入:输出”比例,把输入价与输出价做加权平均,折成一个可比的每百万 tokens 单价,用于横向排序。对话/RAG 常见约 3:1,纯生成偏 1:1;真实成本取决于你的实际输入输出配比。

2. 这里的价格准确吗?

Anthropic(Claude)为官方参考价;OpenAI、Google、DeepSeek 标注为“参考价”,可能随官方调整而变化,请以各服务商官网为准。价格集中维护,便于更新。

3. 同样一件事,用哪个模型最省钱?

先判断你的任务是输入重还是输出重。分类、信息抽取、格式转换这类输出很短的任务由输入价主导,应当优先看输入单价和缓存价;写长文、生成代码这类由输出价主导,输出单价便宜的模型优势更明显。表格里可以直接横向对比各模型的输入 / 输出 / 缓存价与上下文窗口。实践中最省钱的做法通常不是选一个模型,而是分级路由:简单任务交给便宜模型,只把复杂推理留给最强的那个。