DeepSeek V4 Flash正式版API于7月31日上线公测,直接放出了一个让开发者们直呼“离谱”的价格——每百万Token输入仅1元、输出2元,在性能逼近国际顶级模型的前提下,成本却只有GPT-5.6 Luna的几分之一甚至几十分之一。
一、击穿地板的价格:具体多少钱?
平峰时段基础定价:输入1元/百万token,输出2元/百万token,模型结构未变但Agent能力大幅跃升,真正做到“加量不加价”。
缓存命中几乎是免费:缓存命中时,输入仅需0.02元/百万token,官方提供约98%的缓存命中折扣,大幅降低重复调用成本。
峰谷定价动态调整:每日9:00-12:00和14:00-18:00两个高峰时段价格翻倍,即输入2元、输出4元/百万token,引导开发者错峰使用。
二、性价比有多炸?——横向对比
碾压海外旗舰:即使GPT-5.6 Luna降价80%,V4 Flash在DeepSeek自有API上的单任务成本仍比Luna低约60%。
对比同类国产模型:输出价格仅为Kimi K3的2%左右,实际跑一个51万Token的复杂任务(本地文件阅读+全网检索汇总),账单仅显示0.53元,而同等工作量若用GPT-5.6 Sol,成本差距可达数十倍到上百倍。
真实用户验证:有开发者用V4 Flash跑完一个长任务,账单仅3.67元;此前用Kimi K3跑同一任务花费了200多元——成本差了近60倍。
三、凭什么这么便宜?——定价背后的逻辑
MoE稀疏架构:总参数2840亿,但每次推理仅激活130亿参数,单次算力消耗极低,这是成本把控的硬件基础。
纯后训练优化:正式版与预览版模型架构完全一致,没有重做预训练,而是通过重新后训练将Agent跑分拉满,省去了巨额算力开支。
缓存命中率是核心杠杆:官方自研计费策略,利用约98%的缓存命中折扣把边际成本压到极致,这在业内相当激进,也是其他竞品难以复制的优势。
内容由AI生成