性能反超旗舰!DeepSeek发布V4.1-Flash大模型 同步筹备科创板IPO
北京时间9月10日,DeepSeek正式发布V4.1-Flash大模型。该模型采用全新Causal Encoder-Decoder非对称架构,在大幅压缩缓存占用、降低推理成本的同时,基准测试性能超越自家旗舰级V4-Pro模型。新API定价于当日12时正式生效。
就在此前一日,市场消息显示DeepSeek已聘请辅导机构筹备科创板IPO,技术迭代与资本化进程同步推进。
非对称架构实现性能越级
V4.1-Flash为5520亿参数的MoE模型,核心创新在于非对称编解码架构设计:输入阶段仅激活80亿参数,输出阶段激活160亿参数,远低于同规模模型的激活参数量。配合新的预训练方法与大规模强化学习后训练,模型在多项基准测试中超越DeepSeek V4-Pro等旗舰产品。
模型原生支持图文多模态理解与100万Token上下文窗口,可覆盖长文档处理、多轮Agent交互等场景。
目前所有性能数据均为官方自测结果,尚未经第三方独立验证。
缓存效率量级提升压减推理成本
新一代模型在KV缓存效率上实现量级突破。官方数据显示,V4.1-Flash全局KV Cache降至890字节/Token,约为上一代V4-Flash的四分之一;对HBM显存的需求缩减至1/4,对SSD存储的需求缩减至1/8。
缓存占用的大幅下降直接降低长上下文任务的调用成本。在Agent、长文档推理等场景中,缓存命中费用通常占总账单的较大比例,压缩缓存后,同等预算可支撑的任务量显著提升。同时解码成本几乎不随上下文长度增长,为百万级上下文的规模化应用提供了成本基础。
产品线启动迭代更替
DeepSeek同步调整产品线与定价体系。API定价延续峰谷机制,闲时价格为高峰时段的50%,新定价于9月10日12时正式生效。
产品迭代方面,旧版V4-Flash与V4-Flash-Vision-Exp已正式退役,相关API请求暂时路由至新模型;V4-Pro将于9月14日起全面下线,所有请求将自动切换至V4.1-Flash并按其标准计费。这意味着定位轻量高速的Flash系列,已在性能上完成对旗舰Pro系列的替代,DeepSeek产品线正围绕新架构重构。
生态层面,模型权重采用MIT许可证开源,官方将与开源社区协同推进推理适配。腾讯WorkBuddy、OpenCode等官方合作伙伴已完成全量接入。
技术迭代同步推进IPO进程
就在模型发布前一日,9月9日,多家权威媒体援引知情人士消息称,DeepSeek已聘请中信证券作为辅导机构,筹备上交所科创板IPO,计划年内启动上市流程。目前具体募资规模与目标估值尚未最终确定。
此前DeepSeek在6月完成首轮外部融资,投后估值超350亿元;新一轮融资目标估值约500亿元。本次V4.1-Flash在架构效率与成本控制上的突破,进一步夯实其技术壁垒,也为其资本化进程提供了业绩支撑。

陈宥文
关注:具身智能/产业财经
邮箱:youwen.chen@infocase.world




