# 阶跃星辰发布 Step 3.7 Flash，196B 参数的 MoE 模型每次推理只激活 11B，速度冲到 400 tokens/秒，跑 Agent 任务...

> 原标题：400 tokens/秒！阶跃Step 3.7 Flash，把Agent任务成本打到Claude零头

- 来源：新智元 · 公众号
- 发布时间：2026-06-01T10:00:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/33437
- 原文：https://mp.weixin.qq.com/s?__biz=MzI3MTA0MTk1MA==&mid=2652704261&idx=1&sn=d7395d05a4be0c782a4855e098e15961

## 摘要

阶跃星辰这次放出的 Step 3.7 Flash 是个混合专家模型，总参数量 196B，还挂了一个 1.8B 的视觉编码器，但每次推理实际只动用 11B 参数，所以能跑到每秒 400 个 token。官方说在 Agent 任务上，它的成本只有 Claude 的零头。不过正文因为微信环境验证没抓到具体内容，实际跑分、具体任务对比和定价细节都没披露，这点先...

## 推荐理由

速度和参数数字都摆出来了，标题里那个成本对比很抓人。但正文没披露具体定价、基准测试的细节和开源条款，所以分数只能停在 82 这个质量更新档位。

## 锐评

这条消息最抓人的点就一个：便宜。阶跃星辰的Step 3.7 Flash是个混合专家模型，总参数196B，但每次推理只激活11B，所以能跑到每秒400个token。官方说在让模型进业务流程干活的Agent任务上，成本只有Claude的零头。这个说法如果属实，对大量调用API做自动化任务的团队确实有吸引力。

但问题在于，正文因为微信环境验证没抓到具体内容。实际跑分、具体任务对比、定价细节都没披露。196B总参数里挂了1.8B的视觉编码器，说明它走多模态路线，但视觉能力在Agent场景里到底怎么用、效果如何，也没说清楚。每秒400个token的生成速度确实快，但延迟和首token时间这些更影响体验的指标也没提。

这条消息目前只能当个预告看。等官方放出完整技术报告和定价页，才能判断这个"零头"到底是打一折还是打骨折。
