资讯动态

一文读懂DeepSeek V4.1|从架构创新、模型性能、模型价格讲解

发布时间:2026/9/15 8:23:18 来源:尧图企业网站定制
2026 年 9 月 10 日DeepSeek 正式发布DeepSeek V4.1 Flash。需要先说明目前正式发布的是V4.1 Flash它也是 DeepSeek 全新 V4.1 架构家族中的首个、同时也是目前最小的成员V4.1 Pro 尚未正式发布。如果用一句话概括这次升级DeepSeek V4.1 的重点不是单纯“堆参数”而是换了一套更省资源的新发动机。它希望解决一个大模型长期存在的问题模型越来越大效果越来越强但运行成本也越来越高。一、架构创新552B 参数但不是每次全部工作DeepSeek V4.1 Flash 是一个552B 参数的 MoE 模型。看到 552B不要理解成每生成一个字都要把 552B 参数全部运行一遍。MoE 可以理解成一家拥有很多专家的大医院医院医生很多但你看眼科时不需要把所有医生都叫过来。V4.1 Flash 也是类似的思路根据任务选择部分参数参与计算。更重要的是这一代采用了新的Causal Encoder-DecoderCED非对称架构处理输入时只激活约8B 参数生成输出时激活约16B 参数总参数量则达到552B可以把它理解成“读题”和“答题”使用不同规模的大脑。用户输入大量文档、代码、聊天记录时模型先用更轻量的部分完成“阅读”真正需要推理和生成答案时再调用更多参数。这样就不需要从头到尾都开着“大功率发动机”。KV Cache 也被大幅压缩长对话和 Agent 最大的问题之一就是需要不断记住之前的内容。这些内容会占用大量 KV Cache。V4.1 Flash 相比上一代HBM 显存需求降低到约 1/4SSD 存储需求降低到约 1/8。就像以前读一本书需要把前面所有笔记全部摊在桌子上现在则把笔记进行了高度压缩只留下真正需要的信息。因此对于Codex、Claude Code 类代码 Agent、长上下文、多轮工具调用这种架构尤其重要。二、原生多模态终于可以直接“看图”V4.1 Flash 还有一个非常重要的变化原生支持视觉理解。也就是说模型不仅可以读取文字还可以直接处理图片例如截图分析、图表理解、代码截图、文档图片、视觉问答等。以前的 V4 Flash 需要单独的 Vision 实验模型而 V4.1 Flash 已经把视觉能力整合进模型本身。从这个角度看V4.1 不只是一次普通的小版本升级更像是 DeepSeek 在重新设计下一代模型的底层结构。三、模型性能代码和 Agent 是这次最大的亮点从 DeepSeek 官方公布的数据来看V4.1 Flash 在Coding 和 Agent场景进步尤其明显。下面选几个比较有代表性的指标BenchmarkV4 ProV4.1 FlashCodeforces Rating33483471Terminal-Bench 2.187.990.6DeepSWE v1.162.774.2NL2Repo-Bench61.564.0CyberGym83.388.1AutomationBench43.254.8尤其是DeepSWE 62.7 → 74.2提升比较明显。这意味着它并不只是“会写几段代码”而是更加偏向读项目 → 修改代码 → 调工具 → 运行命令 → 继续修复这样的完整 Agent 工作流。不过这里需要注意一点。不能简单说“V4.1 Flash 所有测试都超过 V4 Pro。”例如 GPQA DiamondV4 Pro92.4V4.1 Flash90.9HLE 等部分纯推理测试中V4.1 Flash 也并非全部领先。因此更准确的说法应该是V4.1 Flash 在代码、Agent、工具调用等实际工作场景提升非常明显但并不是每一个纯推理 Benchmark 都超过 V4 Pro。四、模型价格V4.1 最大的“杀手锏”V4.1 Flash 不只是性能升级价格也同步下调。2026 年 9 月 10 日 12:00 起国内 API 价格调整为每百万 Tokens空闲时段高峰时段输入缓存命中0.02 元0.04 元输入缓存未命中1 元2 元输出4 元8 元高峰时段为工作日9:00—12:00、14:00—18:00其他时间以及周末属于空闲时段。相比此前 V4 Flash 的空闲价格缓存命中0.05 →0.02 元下降 60%缓存未命中1.5 →1 元下降约 33%输出4.5 →4 元下降约 11%这里最值得关注的是缓存价格下降 60%。因为 Agent 会反复读取系统提示词、代码仓库和历史上下文所以缓存命中次数非常多。换句话说普通聊天可能只是便宜了一点但长代码、长上下文和 Agent 工作流可能会更加受益。五、为什么一个 Flash反而要替代 Pro这也是 V4.1 最有意思的地方。以前大家通常认为Flash 快、便宜但能力弱一些Pro 慢一点、贵一点但是更聪明V4.1 Flash 开始打破这种简单划分。DeepSeek 官方表示综合性能、速度、费用和任务总耗时等指标后V4.1 Flash 已经足以替代 V4 Pro。因此从2026 年 9 月 14 日 12:00起在 V4.1 Pro 正式上线之前原来的deepseek-v4-pro请求将被路由到 V4.1 Flash并按照 V4.1 Flash 的价格计费。这也释放了一个很重要的信号V4.1 Flash 只是这套新架构家族中最小的成员。真正值得期待的可能还是后面的V4.1 Pro。六、总结如果把 DeepSeek V4.1 Flash 的升级压缩成几个关键词就是新架构、低激活、低缓存、原生多模态、Agent 增强、价格下降。它的核心思路并不是继续无脑扩大模型而是让该工作的参数工作该休息的参数休息。552B 参数提供能力上限输入只激活 8B、输出激活 16B再配合新的 CED 架构和 KV Cache 压缩让“更强”和“更便宜”第一次有了同时实现的可能。从目前的数据来看V4.1 Flash 最值得关注的不是聊天能力而是 Coding、Agent、长上下文和工具调用。而且别忘了——这还只是 V4.1 家族中最小的那个模型。

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价