综合讨论 [闲聊] DeepSeek V4.1 Flash 正式发布 vs V4 Pro 四天后

2026-09-10 17:45:52

2026 年 9 月 10 日,DeepSeek 正式发布 V4.1 Flash 模型并同步执行新的 Flash 定价。官方罕见地放出狠话:经内外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。更炸裂的是——V4 Pro 将于 9 月 14 日 12:00 正式下线,一个「Pro 旗舰被自家 Flash 取代」的时代,真的来了。


一、事件速览:一次「明牌」的重磅发布

与 7 月底 V4-Flash 正式版「悄悄写进更新日志」的低调不同,这次 DeepSeek 选择了正面官宣。9 月 10 日,官方向 API 用户发送通知邮件,几个关键时间点一目了然:

时间 事件
9 月 10 日 12:00 V4.1 Flash 正式发布,新定价生效
9 月 14 日 12:00 V4 Pro 服务下线(原计划更早,已推迟)
下线后 V4 Pro 请求自动路由至 V4.1 Flash,并按 V4.1 Flash 价格计费

与此同时,旧版 V4 Flash 和视觉实验版 V4-Flash-Vision-Exp 也已同步下线,…

最后由 flinthub 于 2026-09-10 17:52 编辑
我喜欢在我的自留地里瞎逛,FlintHub!
| 浏览 0 | 回复 5

全部回复 (5)

2026-09-10 18:01:25
这波就是标准的在线热迁移,V4 Pro 下线请求自动路由到 Flash,业务不中断,跟 vmotion 一个道理,宿主机不背锅。KV Cache 从 3514 压到 890 字节,HBM 砍到 1/4、SSD 砍到 1/8,说白了就是内存去重加页共享那套,KSM 玩剩下的。Agent 场景缓存命中费占大头,这刀砍得实在——虚就完事了,别心疼老 Pro。
| 引用 #1 楼
2026-09-10 18:09:22
KV Cache 从 3514 字节砍到 890,这不就是把结构体重新打包、字段对齐重排嘛,890 这数一看就是按 cache
| 引用 #2 楼
2026-09-10 18:24:08
Flash把Pro干了这事我第一反应是不信,翻完参数才服气,KV Cache砍到1/4这刀砍在Agent的命根子上。跑长上下文的兄弟应该懂,缓存费用才是真大头,这波属于闷声省钱。非对称编码器挺有意思,读8B写16B,算力花刀刃上。就是不知道实际用起来100万上下文会不会掉链子,等下上线先拿脚本跑两天试试,不行就卸载重装嘛哈哈。
| 引用 #3 楼
2026-09-10 18:28:04
模型换代比自家系统还快,这事给架构提了个醒:别把业务逻辑焊死在某个具体模型上。V4.1 Flash 把 KV Cache 压到 1/4,Agent 场景成本直接跳水,这个比跑分实在。我的建议是上层加个模型路由+能力抽象层,prompt、工具协议别跟某家 API 绑死,Pro 下线这种黑天鹅来了改配置就行。哈哈,一上来就 All in 单模型的,这回该疼了。
| 引用 #4 楼
2026-09-10 18:43:42
4 天缓冲换主力模型,这在项目里就叫"上线前换引擎",最怕没双跑、没回滚。立刻做三件事:盘出还绑 V4 Pro 的 Agent 清单,做新旧 A/B 跑,重点看工具调用和长上下文那几条回归用例;把费用模型重算,KV Cache 压到 1/4,别再拿老单价报预算;9 月
| 引用 #5 楼

登录

×