2. DeepSeek V4-Flash 把 284B、13B 激活与低价绑在一起,价格战开始伤到高端模型腹地
发生了什么:DeepSeek 发布 V4-Flash-0731,采用 284B 参数的 MoE 架构、13B 激活参数,并支持 1M 上下文;同一窗口里的行业简报和资讯汇总都把它归为“低成本高性能”的代表案例。
为什么重要:这类发布以前常被看作“又一个便宜模型”,但今天不一样。V4-Flash 的关键不是便宜本身,而是它把 Agent、编程和长上下文这些原本由更贵模型占据的能力段,往更低价格区间压。只要企业发现一个更便宜的模型在代码、工具调用和长文档任务上已经“够用”,高端模型的定价权就会被持续削弱。行业过去靠旗舰模型拉高天花板,现在越来越要面对另一个现实:中高端能力正在被快速平价化。
具体细节:几组参数很值得记。第一,284B 总参数与 13B 激活参数意味着它试图在总能力和单位推理成本之间找平衡,这是典型的 MoE 工程路线。第二,1M 上下文把它直接放进企业知识库、长代码库和复杂 Agent 任务的候选名单。第三,报道明确提到价格约为 V4-Pro 的三分之一,这不是小幅优惠,而是对产品分层的直接重构。把它和今天另一条新闻Kimi K3 需要 80 张 RTX 5090 才能实现约 20 token/s放在一起看,会发现一个更现实的问题:前沿模型越来越强,但真正决定扩散速度的,还是谁能在普通预算下跑出可接受的吞吐和成本。