会懂网AI资讯获悉,9月3日,阶跃星辰宣布开源Step 3.7 Flash——一枚1960亿参数(196B)的MoE模型,推理速度达每秒400 tokens,主打高吞吐与低延迟的实时交互。在国产大模型集体提速的9月,阶跃把”快且便宜”作为开源模型的卖点。

MoE架构让Step 3.7 Flash在保持大体量知识容量的同时,仅激活部分专家,从而降低单次推理成本。400 tokens/s的速率,意味着长文生成、实时对话与Agent多步调用都更跟手,适合客服、助手与代码等高频场景。
开源是阶跃的既定路线。把权重开放给开发者,既能借社区力量做后训练与生态,也能在”可用、可改、可信任”上建立国产模型心智。与闭源API比,开源的损失是短期调用费,换来的是长期生态粘性。
阶跃同时强调多模态与Agent能力,而非单文本。其模型要支撑”看、想、做”的连贯任务——理解图文、规划步骤、调用工具,这正是2026年模型竞争的主线。Flash系列的高速度,让端到端任务在真实产品里更顺。
会懂网观察到,阶跃与MiniMax、百川、智谱等同城上海力量,正把上海推上大模型重镇。Step系列的节奏感(频繁迭代Flash/Pro),反映国产模型从”跑分”转向”单位成本与迭代速度”的竞争迁移。
独立复现仍是硬标准。会懂网会等待第三方在真实负载下的基准,看400 tokens/s能否在长上下文与多工具场景里稳住。
196B的MoE架构配合每秒400 tokens的输出速度,指向的是典型的推理优化取向。会懂网认为,开源这一规模与性能的模型,对阶跃星辰而言既是技术宣示,也是生态卡位:开发者一旦基于某套权重建立起工具链与工作流,迁移成本就会自然形成黏性。真正的考验在于后续迭代节奏能否跟上,以及社区能否形成持续的贡献与反馈循环。






















暂无评论内容