模型价格对比
AI 模型价格对比:GPT、Claude、Gemini 与 DeepSeek
经人工审核的当前 LLM API 定价参考——包括输入与输出 Token 费用、上下文范围、适用工作负载和官方来源。选择生产模型前请核实厂商条款。
价格存储在本地目录中,仅在人工审核后更新。每条记录都链接到对应厂商的官方价格页面。
价格数据最近检查:2026年8月22日 · 数据来源:各厂商官方价格页面
| 厂商 | 模型 | 输入 / 1M Token | 输出 / 1M Token | 上下文窗口 | 最佳用例 | 最近检查 | 来源 |
|---|---|---|---|---|---|---|---|
| OpenAI | GPT-5.6 Sol | $5 | $30 | Short-context tier | Complex professional reasoning and coding | 最近检查:2026年8月22日 | 官方 |
| OpenAI | GPT-5.6 Terra | $2.5 | $15 | Short-context tier | Balanced intelligence and cost | 最近检查:2026年8月22日 | 官方 |
| OpenAI | GPT-5.6 Luna | $1 | $6 | Short-context tier | Cost-sensitive, high-volume workloads | 最近检查:2026年8月22日 | 官方 |
| Anthropic | Claude Opus 5 | $5 | $25 | See provider model limits | High-capability analysis and agentic work | 最近检查:2026年8月22日 | 官方 |
| Anthropic | Claude Sonnet 5 | $2 | $10 | See provider model limits | General production, coding and agents | 最近检查:2026年8月22日 | 官方 |
| Anthropic | Claude Haiku 4.5 | $1 | $5 | See provider model limits | Fast, lower-cost Claude workloads | 最近检查:2026年8月22日 | 官方 |
Gemini 3.7 Flash | $0.75 | $3.75 | See provider model limits | Agentic workflows and multimodal reasoning | 最近检查:2026年8月22日 | 官方 | |
Gemini 3.5 Flash | $1.5 | $9 | See provider model limits | Fast grounded and search-oriented workloads | 最近检查:2026年8月22日 | 官方 | |
Gemini 3.5 Flash-Lite | $0.3 | $2.5 | See provider model limits | High-volume translation and simple processing | 最近检查:2026年8月22日 | 官方 | |
| DeepSeek | DeepSeek V4 Flash | $0.44 | $1.32 | 1M | Low-cost general and reasoning workloads | 最近检查:2026年8月22日 | 官方 |
| DeepSeek | DeepSeek V4 Pro | $1.32 | $3.96 | 1M | Higher-capability DeepSeek workloads | 最近检查:2026年8月22日 | 官方 |
免责声明: 价格是经人工审核的参考值,以每百万 Token 的美元计,并非实时数据。在做出购买决策前,请务必以各厂商官方页面核实当前价格。
为何价格不是全部
最便宜的模型未必是最佳选择
较低的单位 Token 价格在电子表格上看着诱人,但生产环境的 AI 成本受制于价目表之外的诸多因素。在为应用锁定模型前,请权衡这三项取舍。
准确性与成本
更便宜的模型往往需要更多重试、更长提示词或额外的验证步骤才能达到同等输出质量。单位 Token 价格更高但生成失败更少的模型,可能在每个成功任务上反而更便宜——同时保护用户体验。
延迟与成本
更小、更便宜的模型通常更快,这对实时聊天或 Agent 循环很重要。更大的旗舰模型即便推理更好也可能更慢——因此“最佳”模型取决于您的产品是需要即时响应,还是能容忍多花几秒换取更高质量的输出。
生产环境要求
速率限制、上下文窗口大小、函数调用支持、可用性和数据处理策略在各厂商与层级之间各不相同。在孤立测试中便宜的模型,一旦计入宕机、限流或在规模上规避其限制所需的工程时间,可能变成昂贵的选择。
经验法则: 对高频、低风险任务(分类、提取、简单聊天)使用快速便宜的模型,而将高准确性模型留给出错代价高昂的环节——然后衡量每个成功结果的真实成本,而非仅仅每个 Token 的成本。
看看这些价格对您的工作负载意味着什么
将您的 Token 数量输入计算器,即可查看上述任一模型每次请求和每月的真实成本。