资讯动态

AI前沿 | 2026年9月21日:Step 5 大模型来了 + 600B 稀疏 MoE 架构 + 1/8 成本 API

发布时间:2026/10/5 2:24:36 来源:尧图企业网站定制
AI前沿 | 2026年9月21日Step 5 大模型来了 600B 稀疏 MoE 架构 1/8 成本 API首屏导读 · 本教程配套付费专栏《大模型工程师修炼手记》19.9 元AI 编程 · Agent 实战 · 本文同主题系统课程· 《AI时代程序员的自我提升》49.9 元AI 时代成长方法论单篇不过瘾订阅解锁全量源码、实战与答疑文末附资料包领取方式 ↓本期导读9 月 20 日阶跃星辰StepFun正式开放 Step 5 Preview 的 API——一款 600B 总参数、每 Token 仅激活 27B 的稀疏 MoE 旗舰支持 1M 上下文与图像输入Artificial Analysis 智能指数 44模型榜第 24、开源权重模型第三。最抓眼的是它的价格输入 1 美元/百万 Token缓存命中低至 0.05 美元、输出 2.7 美元/百万 Token、缓存折扣最高 95%——厂商宣称单任务成本约为 Claude Opus 5 的 1/8。但「便宜智能」有个结构性代价它在 AA 评测里吐了惊人的 1.6 亿输出 Tokenverbosity 陷阱、首 Token 时延约 2.96 秒、终端评测 Terminal-Bench v4 只得 33.3%而且官方页面的开源权重排期是10 月 15 日当前 Hugging Face 仓库只有一个小小占位文件——「今天能调、月底才能下载」。本期拆六讲事件、架构、账单、实测、开源节奏、给工程师的路由清单。一、事件一场「可以调用、还不能下载」的开源启幕Step 5 Preview 的发布节奏很有 2026 年中国开源厂商的味道9 月 18-20 日之间模型先出现在 Artificial Analysis 的评测列表早期甚至以测试标签被第三方提前抓到随后公开产品页上线、API 在同一时间开放。官方给出的叙事是「Advancing the Pareto Frontier」——即用 600B/27B 的激活率把「便宜」与「能用」画进同一条曲线。但注意它的措辞StepFun 自己的页脚写着as of Sep. 19, 2026而第三方把正式发布日期标为9 月 20 日与此同时Hugging Face 仓库stepfun-ai/Step-5-Preview-BF16在发布日下午就存在里面只有.gitattributes一个文件没有权重、没有 license、没有 model card。一句话总结它的真实状态模型今天就能用权重三周半后才能拿到这是两件事。二、架构600B 稀疏 MoE27B 激活1M 上下文 视觉规格数值解读总参数600B稀疏 MoESparse MoE每 Token 激活27B激活率约 4.5%大部分参数被路由跳过上下文窗口1M tokens文本 图像输入输出上限64K tokens第三方口径长文/Agent 循环注意截断AA 智能指数44#24/200开源权重模型第三官方定位软件工程 / 长任务工具链 / 金融针对 Agent 化工作负载架构上它与同场竞技的开源梯队GLM-5.3 高它 1 个指数点、Kimi K3 与其同位、DeepSeek V4 系价格更激进但 Agent 画像不同最大的区分点是它是为『长上下文 Agent 循环』设计的——1M 窗口 95% 缓存折扣缓存命中 0.05 美元/百万 Token意味着系统提示、大代码库、多轮工具调用的重复前缀成本被压到近乎免费。这个组合才是它真正的差异化而不是单纯的总参数量。三、账单$2.70 的输出 vs Opus 5 的 $25但「便宜」要加三个注脚接口层是 OpenAI 兼容的 RESTful API价格分三档计费项价格备注输入缓存未命中$1.00 / 1M tokens官方列表价输入缓存命中$0.05 / 1M tokens缓存折扣最高 95%输出$2.70 / 1M tokens约 Opus 5$25的 1/9单位智能任务成本约 $0.71AA 口径约 GPT-5.6 Sol 的 1/7、Opus 5 的 1/8三个注脚决定了这笔账的真实含义①verbosity 陷阱——AA 指数评测中 Step 5 Preview 累计吐出了1.6 亿个输出 Token比榜单多数竞品啰嗦得多输出单价再低乘以 1.6 亿的膨胀系数「便宜」可能被「话痨」吃光②交互时延——输出吞吐约 99.8 token/s 不算慢但首 Token 时延约 2.96 秒聊天/交互场景的体感会明显变钝③终端表现——它在 Terminal-Bench v4命令行执行/真实环境交互得 33.3%超过 DeepSeek-V4.1 Flash26.8%与 Kimi K3约 12.6%但离 GLM-5.3 与两家闭源旗舰仍有真实差距——跑分最强的是它做脏活最稳的不一定是它。四、开源节奏一个「占位仓库」背后的信任排期官方确认开源权重将随10 月 15 日发布。在此之前Step 5 Preview 在 Artificial Analysis 上仍被标记为「proprietary」——因为权重拿不到手就不能算开源。对开发者这个空仓库传递了三个信号① 厂商把「发布」和「开源」拆成了两件事来管理节奏先用 API 铺生态、再放权重承接自托管需求② 想当下就基于权重做私有化/数据合规部署的团队10 月 15 日之前没有可落地工件③ 谨慎派已经把结论写成了「pilot 候选不是默认端点」——在计费细则、model page、能力清单齐备之前别把生产依赖压在一个 Preview 标签上。五、给工程师的路由清单本周就能做把 Step 5 Preview 加进路由器的 A/B 池跑 1-2 个长上下文 Agent 基准同一系统提示反复用、大仓库分析、工具多轮调用——重点测缓存命中的实际折扣而不是只比对 token 单价。量力迁移的条件如果你的工作负载是低交互延迟敏感 输出长度可预期批处理、代码审查、文档标引Step 5 的价格模型划算如果是实时聊天或强交互编程先压测 2.96s 的 TTFT。盯住 verbosity上线前给它的输出做长度预算与摘要/截断兜底用「单任务成本$0.71」而不是「token 单价」做月度账单口径。自托管等 10/15需要权重落地方案数据合规/私有化的团队现在就把推理服务、license 审查、模型卡审计排进 10 月中旬的窗口。别踩双平台坑StepFun 的全球平台api.stepfun.ai与中国平台api.stepfun.com密钥不互通选型时确认你的 key 与 base URL 属于同一平台否则会直接 401。启示Step 5 Preview 真正的行业信号不是『又一款千亿模型』而是『开源模型的竞争抓手从跑分转移到了成本曲线与缓存策略』。对创业者① 「智能指数 44 1/8 成本」的组合意味着对标 Opus 这类旗舰的『低价平替』叙事已经写进开源谱系你靠『调用最贵模型拼小作文』的差异化空间进一步被压缩价值得长在垂直数据与交付闭环上② 它的 1M 上下文 95% 缓存折扣是为 Agent 长循环特供的经济学——做 Agent 产品的人该重算一遍『常驻系统提示 × 海量用户』的毛利这可能是 2027 年成本结构的分水岭③ 记住「发布 ≠ 开源、Index ≠ 生产力」评估任何新模型用『单任务真实成本 × 交互时延 × 终端实测』三件套而不是榜单分数。来源StepFun 官方产品页2026-09-20/ Artificial Analysis2026-09-20/ 智东西2026-09-20/ OrcaRouter 评测2026-09-20/ AgentBreaking2026-09-20/ AIReiter2026-09-20。本文为 AI 辅助整理的前沿技术解读事实以官方与权威第三方口径为准不构成任何投资建议。 延伸阅读 · 我的付费专栏觉得这篇文章对你有帮助我把同类主题的系统化内容沉淀成了付费专栏欢迎订阅支持持续输出专栏定价内容大模型工程师修炼手记19.9 元AI 编程 / Agent 深度实战AI时代程序员的自我提升49.9 元AI 时代成长方法论觉得有用请一键三连点个收藏方便随时查转发给需要的同事朋友有问题评论区见—— 收藏的人越多越能帮到更多同路人你的每个赞都在为原创内容投票。本文配套代码 / 资料包欢迎在评论区留言「求代码」我会私信发送完整资源

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价 →
↑