AI 大模型的 API 价格,又降了。而且这次不是”腰部模型小打小闹”,是 OpenAI 第一次把旗舰模型的价格砍了下来——GPT-5.6 Sol 的调用价格直接降超 20%。同一时间,DeepSeek 宣布周末全天执行低谷价,把”错峰省钱”玩出了新花样。
对开发者来说,这意味着什么?一句话:你的 AI 账单,真的能省下真金白银了。
一、OpenAI 首次给旗舰降价:具体降了多少
8 月 21 日,OpenAI 宣布下调 GPT-5.6 Sol 的 API 与 Credit 调用价格,降幅超过 20%,部分档位超过 30%,为期三个月。这是 Sol 自 7 月 9 日发布以来,第一次动价格。
具体数字(每百万 token):
- 输入:5 美元 → 4 美元(降 20%)
- 输出:30 美元 → 20 美元(降 33%)
- 缓存输入:0.5 美元 → 0.4 美元
- 缓存写入:6.25 美元 → 5 美元
- 长上下文输入:10 美元 → 8 美元
- 长上下文输出:45 美元 → 30 美元
覆盖范围包括 API、ChatGPT Work 的 credits 和 Codex credits,Plus/Pro/Business 订阅用户不受影响。
注意一个背景:7 月 30 日 OpenAI 刚给中端模型 Terra 降了 20%、低成本模型 Luna 降了 80%,当时旗舰 Sol 按兵不动。这次对旗舰动手,是 OpenAI 在价格战里第一次”伤筋动骨”。
二、DeepSeek 周末错峰:怎么算账最划算
跟 OpenAI 走”三个月优惠”路线不同,DeepSeek 玩的是错峰计费。
8 月 17 日 DeepSeek 刚上线峰谷定价:工作日高峰时段(北京时间 9:00-12:00、14:00-18:00)价格翻倍,低谷时段半价。不到一周,8 月 23 日又出新规:周末(周六、周日)全天统一按低谷价计费。
以旗舰 V4 Pro 为例(每百万 token):
- 工作日高峰:输入 9 元(缓存未命中)、输出 27 元
- 工作日低谷:输入 4.5 元、输出 13.5 元
- 周末全天:输入 4.5 元、输出 13.5 元(和低谷一样)
轻量级 V4 Flash 更狠,周末输出价直接到 0.66 元/百万 token。
算笔账:如果你有个每天要跑 1000 万 token 输出的批处理任务,工作日高峰跑要 270 元,挪到周末跑只要 135 元——一天省 135 块,一个月省 4000 多。对个人开发者和小团队,这可不是小钱。
三、为什么现在集体降价:价格战打到旗舰了
这次降价不是孤例,而是全球 AI 定价体系的一次集体松动。我们把竞争格局摊开看:
- Anthropic:Claude Sonnet 5 首发价 2 美元/10 美元(8 月 31 日后涨到 3 美元/15 美元),Opus 5 卖 5 美元/25 美元——比降价前的 Sol 便宜
- DeepSeek:V4 Pro 输出 100 万 token 约 0.87 美元,是 Sol 的 1/23
- Kimi:K3 输出 15 美元,也低于 Sol
- 实际迁移案例:DoorDash 已把编程负载迁到 Moonshot,西门子、Airbnb 在测试 DeepSeek 和阿里的模型
OpenAI 嘴上说”三个月优惠是试探”,但身体很诚实:旗舰模型利润再厚,也扛不住客户用脚投票。这轮价格战,已经从”中端比价”打到了”旗舰让利”,说明顶级模型的溢价护城河,正在被中国厂商和 Anthropic 两面夹击。
四、开发者实操:四个场景怎么省钱
说再多不如算账,直接给四个省钱场景,都是能立刻用上的:
场景 1:批量任务 / 数据清洗 / Agent 跑批 → 周末用 DeepSeek
把不紧急的批处理任务(数据清洗、批量翻译、Agent 批量测试、评测脚本)排到周六日跑,享受全天低谷价。V4 Pro 输出价直接砍半,V4 Flash 低到 0.66 元。注意:DeepSeek 的 Agent 能力(V4 Pro 正式版) 已经很强,编程和工具调用场景完全够用,DeepSeek 专题页 有更多上手内容可以看。
场景 2:长文档 / RAG 检索 → 用 OpenAI 长上下文档
Sol 长上下文输出从 45 美元降到 30 美元,降幅 33%。跑 10 万字以上的合同分析、年报解析、知识库问答,这个档位省得最狠。
场景 3:高频小调用 → 盯紧缓存命中
缓存输入价降到 0.4 美元。同一段 prompt 反复调用时,把系统提示词、few-shot 示例固化成稳定前缀,缓存命中率上去了,成本直接掉一个量级。想系统性优化,可以配合多模型路由把成本再砍一截。
场景 4:Codex / 编程助手 → 用降价窗口,但盯紧额度
Codex credits 这次同步降价,但最近大量用户反馈周额度缩水(有 Plus 用户从 160 美元砍到 80 美元)。降的是单价、缩的是额度,实际能用多少得自己实测,别只看宣传。
选型总原则:别为省钱牺牲能力,也别为能力多花冤枉钱——重推理、高复杂度任务留给旗舰,批量、简单任务下沉到便宜模型,把价格战的整体格局吃透再动手。
五、老达点评
这轮降价我总结三个信号:
第一,“三个月优惠”是 OpenAI 的试探气球。它不敢直接永久降价,怕利润崩盘;但如果三个月后开发者流量回不来,这个”临时价”大概率会变成”新常态”。对开发者,窗口期内该迁移就迁移。
第二,错峰计费是国产厂商的差异化打法。OpenAI 拼降价幅度,DeepSeek 拼计价方式——用价格杠杆把算力闲置时段盘活,既降了用户成本,又缓解了高峰拥堵,一举两得。这种玩法国外厂商很难抄,因为它们的客户分布在全球时区。
第三,对普通开发者,这是最好的时代。还记得几个月前国产模型那轮集体涨价吗?当时很多人担心 AI 成本要起飞。现在回头看,竞争才是最好的降价手段——巨头打架,开发者省钱。
最后提醒一句:价格战归价格战,模型能力才是一切的前提。把账算清楚、把场景匹配好,省钱和效果是可以兼得的。