
DeepSeek 发布 V4.1 Flash:552B MoE、原生多模态、KV 缓存降至 1/4,同步筹备科创板 IPO
一句话:9 月 10 日,DeepSeek 发布 V4.1 Flash——全新 Causal Encoder-Decoder 架构系列最小尺寸模型,552B 参数 MoE、原生多模态,KV 缓存降至上一代 1/4 HBM,并同步下调 API 定价、采用峰谷机制;公司亦已聘中信证券筹备科创板 IPO(估值约 70B 美元)。
背景
2026 年 9 月 10 日,DeepSeek 发布 V4.1 Flash,是全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力。它采用 Causal Encoder-Decoder 结构,552B 参数 MoE,输入激活仅 8B、输出激活 16B;得益于架构创新,KV 缓存需求降至上一代的 1/4(HBM)、1/8(SSD),上下文从 4K 拉到 1M。新模型同步上线 DeepSeek API(模型名改 deepseek-flash),旧版 V4 Flash 与 V4 Flash Vision Exp 已下线;V4 Pro 将有序下线,9 月 14 日 12:00 起至 V4.1 Pro 上线前,deepseek-v4-pro 请求全部路由到 V4.1 Flash。API 采用峰谷定价,闲时价为高峰一半,新价 9/10 12:00 生效。腾讯 WorkBuddy/CodeBuddy、OpenCode 已全量接入;权重与技术报告已在 Hugging Face 开源。同一日路透称 DeepSeek 已聘中信证券筹备科创板 IPO,估值约 70B 美元。

核心要点
- 9-10 发布 V4.1 Flash,全新 Causal Encoder-Decoder 架构
- 552B 参数 MoE,输入激活 8B / 输出激活 16B
- KV 缓存降至 1/4 HBM、1/8 SSD,上下文 1M
- 原生多模态
- 峰谷定价闲时半价,新价 9/10 生效
- Hugging Face 开源权重 + 技术报告
- V4 Pro 有序下线
- 同步筹备科创板 IPO(中信证券,估值约 70B 美元)
为什么重要
以架构创新把 Agent 类任务成本显著压低,KV 缓存缩减直接改善长上下文与高并发的经济性;开源 + 低价延续 DeepSeek 的效率颠覆叙事,对闭源前沿模型形成价格压力。科创板 IPO 则标志中国最强开源模型公司从研究实验室走向资本市场,估值与当前营收的缺口也将接受公众市场检验。
关键事实速记
- 发布:2026-09-10
- 参数:552B MoE
- 激活:8B / 16B
- KV:1/4 HBM、1/8 SSD
- 上下文:1M
- 闲时价:0.02 元缓存命中 / 4.0 元输出