DeepSeek新模型内测+正式降价,没见过这样玩的

DeepSeek宣布降价,新价格将于北京时间2026年9月10日12:00正式生效;同时推出V4.1 Flash内测模型,原生支持多模态,输出速度最高507 tokens/s,限时体验至9月10日。

直接在官方群里,问自己的flash模型能否替换掉pro模型,这个在商业逻辑上就等于,让自家的低价产品替代高价产品,对自己进行革命。
图片
没见过哪家公司这样干的。

9月8日刚宣布新模型内测,9月9日就发布降价通知,DeepSeek在两天内连续放出两个关于Flash系列的重磅消息,节奏相当紧凑。

先看新模型:V4.1 Flash中间版本开启内测

这款名为 “deepseek-v4.1-flash-expires-on-0910” 的模型已开放调用,采用新结构,原生支持多模态,主打“能力更强、速度更快且成本更低”。从网友晒出的实测看,输出速度最高达到507 tokens/s,生成HTML动画等任务也稳定在300 tokens/s以上。不过这是张“限时体验卡”,9月10日就会自动过期下线。内测期间计费与老款V4 Flash相同。

图片

更值得关注的是,内测同步发放了一份反馈问卷,其中直接向开发者抛出了一个关键问题:“V4.1 Flash 能否全面替换线上的 DeepSeek V4 Pro?”——这相当于DeepSeek在主动试探“用更便宜的Flash替代更贵的Pro”的可行性。

再看正式降价:新价格9月10日生效

新价格将于北京时间2026年9月10日12:00正式生效。

图片

为直观对比,我们将内测时沿用老价格涨价前价格调整后新价格整理如下(单位:元/百万Tokens):

计费项 时段 内测/老价格 涨价前价格 调整后新价格 降幅(vs老价格)
输入(缓存命中) 空闲 0.05 0.02 0.02 ↓ 60%
高峰 0.1 - 0.04 ↓ 60%
输入(缓存未命中) 空闲 1.5 1 1 ↓ 33%
高峰 3 - 2 ↓ 33%
输出 空闲 4.5 2 4 ↓ 11%
高峰 9 - 8 ↓ 11%

组合起来看,传递出几个信号

  1. “我打我自己”:V4.1 Flash内测问卷直接问能否替换Pro,说明DeepSeek在追求更高的“智能密度”——用更便宜、更快的模型交出接近Pro的表现。Pro与Flash之间,高峰期每百万输出token差价高达18元(Pro 27元 vs Flash 9元),若能替代,开发者成本将大幅下降。

  2. 技术迭代支撑降价:新模型结构带来的成本优化,为降价提供了底气。“更强、更快、更便宜”正在同步推进。

  3. 降价是“结构性”而非“全面”回归:虽然输入价格已回到涨价前水平,但输出单价4元(高峰8元)仍比涨价前的2元高出一截。输出成本的优化,看来是真正的硬骨头。

对于开发者而言,新模型值得抓紧9月10日前体验并参与问卷反馈——你的意见可能直接影响Pro与Flash的未来定位。而正式降价后,综合成本能降多少,则取决于缓存命中率与能否错峰调用。

这波“技术+价格”组合拳,最终能否让Flash真正“上位”,是否“王者(梁圣)归来”?

评论

发表评论

登录后可发表评论并对评论点赞。

去登录
暂无评论,快来发表第一条评论吧!