资讯动态

国产模型包揽前三:DeepSeek V4.1 Flash首次登顶OpenRouter周榜

发布时间:2026/9/22 10:14:18 来源:尧图企业网站定制
截至9月20日的OpenRouter周度榜单出现了一个标志性的变化。DeepSeek V4.1 Flash以15.8万亿Token首次登顶周榜第一环比增长219%。智谱GLM 5.3 Flash以14.1万亿Token位居第二腾讯Hy4 preview以12.5万亿Token排名第三。GPT-5.6 Luna跌至第四周消耗9.72万亿Token。国产模型在真实调用量上完成了对海外旗舰的全面反超。三个模型三种上量逻辑DeepSeek V4.1 Flash的登顶速度最快。这款9月10日发布的模型上线不到24小时就在OpenRouter处理了约1万亿Token48小时约2.8万亿。它的技术架构决定了成本优势总参数552B的MoE输入侧仅激活8B输出侧激活16BKV缓存压到约890字节/token。约90%的调用来自缓存读取等效市场定价约为0.006美元/百万Token。对于大量重复上下文的长链路Agent任务这个价格几乎没有对手。智谱GLM 5.3 Flash的路径略有不同。它在8月底以“Ox Alpha”的匿名身份在OpenRouter上测试以15.7万亿Token登顶后退役正式版GLM 5.3 Flash接棒。它采用混合稀疏与线性注意力架构在保持长上下文准确性的同时降低计算开销OpenRouter上的定价为输入$0.075/百万Token、输出$0.25/百万Token目前提供50%折扣。腾讯Hy4 preview是这一轮国产模型中最“重”的一个。总参数770B、激活49B上下文1M定位在Coding Agent和复杂工具调用场景。它在8月28日发布后首周就以14.7万亿Token登顶。9月1日又推出轻量版权重从1.5TB压缩到约214GB本地部署门槛进一步降低。一个反直觉的对比能力榜和用量榜的错位值得注意的是在Artificial Analysis的智能指数榜上排名前列的仍然是海外模型。但OpenRouter的用量榜上国产模型占据了前三。这个错位的解释在账单里。当AI从“试一试”变成“天天用”开发者算的不再是“谁最聪明”而是“每一块钱能换来多少活”。DeepSeek V4.1 Flash的缓存命中价0.02元/百万Token、输出4元GLM 5.3 Flash的OpenRouter渠道价$0.075/$0.25。这些价格让“用得起”成为可能。据OpenRouter数据截至9月19日的一周全球大模型周调用量127万亿Token环比增长10.4%中国模型61.2万亿连续20周压过美国前十榜单里占了7席——而一年前这个前十里只有2个中国模型。对开发者意味着什么国产模型包揽前三对开发者来说最直接的变化是选择变多了但选择的复杂度也变高了。DeepSeek V4.1 Flash便宜、快、缓存友好GLM 5.3 Flash在多模态和长上下文上更均衡腾讯Hy4 preview在Coding Agent和工具调用上更强。三个模型各有侧重价格和缓存策略也各不相同。当你在多个模型之间做调度时调用层的管理成本会悄悄吃掉一部分省下来的钱。聚合入口的价值就在这里一个Key接入所有主流模型统一记录调用和成本按任务类型分配模型切换只改配置不碰业务代码。国产模型在榜单上轮流登顶但你的调用层不需要跟着每一周的排名变化重写一遍。数据来源OpenRouter周度榜单数据截至2026年9月20日腾讯混元Hy4 preview发布信息数字化转型网报道智谱GLM 5.3 Flash的Ox Alpha匿名测试数据DeepSeek V4.1 Flash 24小时处理量OpenRouter官方数据中国模型份额数据每日经济新闻、CSDN博客等报道

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价