DeepSeek新模型内测+正式降价,没见过这样玩的
直接在官方群里,问自己的flash模型能否替换掉pro模型,这个在商业逻辑上就等于,让自家的低价产品替代高价产品,对自己进行革命。
没见过哪家公司这样干的。
9月8日刚宣布新模型内测,9月9日就发布降价通知,DeepSeek在两天内连续放出两个关于Flash系列的重磅消息,节奏相当紧凑。
先看新模型:V4.1 Flash中间版本开启内测
这款名为 “deepseek-v4.1-flash-expires-on-0910” 的模型已开放调用,采用新结构,原生支持多模态,主打“能力更强、速度更快且成本更低”。从网友晒出的实测看,输出速度最高达到507 tokens/s,生成HTML动画等任务也稳定在300 tokens/s以上。不过这是张“限时体验卡”,9月10日就会自动过期下线。内测期间计费与老款V4 Flash相同。

更值得关注的是,内测同步发放了一份反馈问卷,其中直接向开发者抛出了一个关键问题:“V4.1 Flash 能否全面替换线上的 DeepSeek V4 Pro?”——这相当于DeepSeek在主动试探“用更便宜的Flash替代更贵的Pro”的可行性。
再看正式降价:新价格9月10日生效
新价格将于北京时间2026年9月10日12:00正式生效。

为直观对比,我们将内测时沿用老价格、涨价前价格与调整后新价格整理如下(单位:元/百万Tokens):
| 计费项 | 时段 | 内测/老价格 | 涨价前价格 | 调整后新价格 | 降幅(vs老价格) |
|---|---|---|---|---|---|
| 输入(缓存命中) | 空闲 | 0.05 | 0.02 | 0.02 | ↓ 60% |
| 高峰 | 0.1 | - | 0.04 | ↓ 60% | |
| 输入(缓存未命中) | 空闲 | 1.5 | 1 | 1 | ↓ 33% |
| 高峰 | 3 | - | 2 | ↓ 33% | |
| 输出 | 空闲 | 4.5 | 2 | 4 | ↓ 11% |
| 高峰 | 9 | - | 8 | ↓ 11% |
组合起来看,传递出几个信号
-
“我打我自己”:V4.1 Flash内测问卷直接问能否替换Pro,说明DeepSeek在追求更高的“智能密度”——用更便宜、更快的模型交出接近Pro的表现。Pro与Flash之间,高峰期每百万输出token差价高达18元(Pro 27元 vs Flash 9元),若能替代,开发者成本将大幅下降。
-
技术迭代支撑降价:新模型结构带来的成本优化,为降价提供了底气。“更强、更快、更便宜”正在同步推进。
-
降价是“结构性”而非“全面”回归:虽然输入价格已回到涨价前水平,但输出单价4元(高峰8元)仍比涨价前的2元高出一截。输出成本的优化,看来是真正的硬骨头。
对于开发者而言,新模型值得抓紧9月10日前体验并参与问卷反馈——你的意见可能直接影响Pro与Flash的未来定位。而正式降价后,综合成本能降多少,则取决于缓存命中率与能否错峰调用。
这波“技术+价格”组合拳,最终能否让Flash真正“上位”,是否“王者(梁圣)归来”?
评论
发表评论