资讯动态

DeepSeek 系列模型包含哪些主要版本(V1/V2/V3/V4/R1 等)?各版本的演进主线是什么?

发布时间:2026/8/24 21:40:00 来源:尧图企业网站定制
DeepSeek 系列模型主要版本与演进主线一、完整版本时间线发布时间模型核心定位2023.11DeepSeek Coder首个开源模型代码生成/调试2023.11DeepSeek-LLM 67B首款通用大语言模型2023.12DreamCraft3D文生3D模型2024.01DeepSeek-MoE国内首个 MoE 大模型2024.02DeepSeek-Math数学推理模型2024.03DeepSeek-VL多模态大模型2024.05DeepSeek-V2通用 MoE引入 MLA性能接近 GPT-42024.06DeepSeek-Coder-V2代码模型迭代2024.09DeepSeek-V2.5融合模型2024.12DeepSeek-VL2多模态迭代2024.12.26DeepSeek-V3671B MoE MLA训练成本仅 557.6 万美元性能对标 GPT-4o/Claude 3.52025.01.20DeepSeek-R1推理模型纯强化学习对标 OpenAI o12025.09V3.2-Exp实验版2025.12V3.2 / V3.2-Speciale正式升级2026.07-08DeepSeek-V4V4-Pro / V4-Flash百万级上下文Agent 能力大幅跃升二、各版本演进主线DeepSeek 的迭代呈现一条清晰的「通用能力 → 成本/效率 → 推理/Agent」技术主线1. 起步阶段2023 下半年——垂直切入建立基础先从**代码Coder和数学Math**这两个推理密集的垂直领域切入再推出通用 LLM走小步快跑、单点突破路线。2. V22024.05——引入 MLA开启降本基因核心创新是MLA多头潜在注意力通过矩阵分解压缩 KV 缓存显著降低推理时的显存/带宽需求让高性能模型的部署成本大幅下降。这是 DeepSeek 一切性价比能力的源头。3. V32024.12——MoEMLA 组合成本/性能双里程碑采用671B 总参 37B 激活的 MoE共享专家 256 个独立专家仅激活 8 个配合 FP8 混合精度训练。总训练成本仅557.6 万美元对标 GPT-4o 约 1 亿美元却达到对标 GPT-4o、Claude 3.5 的性能一举奠定低成本训出顶级模型的行业地位。4. R12025.01——纯强化学习推理以 V3 为基础采用带可验证奖励的强化学习 GRPO 算法训练出推理模型性能对标 OpenAI o1且证明了大模型推理能力可被蒸馏到小模型。这是 DeepSeek 在推理/Agent 智能方向的布局。5. V3.22025.12——能力持续增强通用能力的稳步升级。6. V42026.07/08——百万上下文 Agent 跃升当前旗舰V4 预览版原生支持百万级 token 上下文。V4-Flash 正式版284B 总参 / 13B 激活的轻量快速版引入DSpark 推测解码加速框架2026.07.31 API 上线重点增强Agent 能力工具调用、终端操作单周调用量达 8.83 万亿 token。V4-Pro2026.08 正式版Terminal Bench 2.1 达 87.9 分逼近全球顶尖主打最强 Agent 能力。一句话总结演进主线DeepSeek 走的是“通用 → 降本MLA→ 极致性价比MoEFP8→ 推理R1 纯RL→ Agent 智能化V4”的路径每一代都牢牢围绕用更低的成本做出更强、更智能的开源模型这一核心。

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价