,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。
此外,新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。
在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。
如图展示了 DeepSeek 在减少上下文存储方面的持续进展。相对于初代模型,KV Cache 是原来的 1/437。
得益于模型架构的创新,DeepSeek V4.1 Flash 能够以更低的成本服务更多的用户,因此官方相应下调了 V4.1 Flash 的定价。
同时,为了更合理地调配资源,DeepSeek V4.1 Flash 仍然采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格于 2026 年 9 月 10 日 12:00 开始生效。
特别
对话“梅姨”首任丈夫:她抛弃了我和孩子,40年只回来过两次,知道她心狠、人懒,但不知她这么坏
四川一母亲为骤然离世的儿子办理销户业务时悲痛落泪,辅警立马上前安抚拥抱,并将其儿子户籍页留给这位母亲当作“最后的念想”
带着小礼物探望刚生产完的嫂子,万幸嫂子状态挺好,安心休养。一旁老公随口提议,再生两个,听得我哭笑不得。新生命降临是喜事,只有当过










