跳到正文
北京时间
原文
StepFun· @StepFun_ai · X·· 2026-06-04精选AI 评分77
AI 导读

阶跃星辰的 Step 3.7 Flash 已上架 Fireworks AI。该模型为 198B 稀疏 MoE 多模态大模型(VLM),含 196B 语言骨干和 1.8B 视觉编码器,从设计之初优化推理效率,采用硬件友好架构与 MTP 辅助解码,速度达 400 tokens/s。具备原生多模态理解与行动、可靠工具使用、增强搜索能力,面向真实智能体工作负载,采用 Apache 2.0 开源许可。

推荐理由

198B稀疏MoE加MTP解码把速度推到400 tok/s,还开源Apache 2.0,这规格做agent的大脑正合适,做实时应用的可以试试手。

正文 · AI 翻译

很高兴看到 Step 3.7 Flash 在 @FireworksAI_HQ 上线。

Step 3.7 Flash 从第一天起就专为推理设计,它将硬件友好的架构与 MTP 辅助解码相结合,实现了高达 400 tokens/s 的速度。

它快速、多模态,并随时准备为实际工作流程中的强大 AI 智能体提供动力。

引用Fireworks AI@FireworksAI_HQ
许多研究实验室只在事后才考虑推理效率。Step 3.7 Flash 是一个 198B 稀疏 MoE VLM,由 @StepFun_ai 从一开始就为推理而设计。196B 语言主干,搭配 1.8B 视觉编码器。 为真实世界的智能体工作负载而构建,运行速度最高可达 400 tok/sec。原生多模态理解与行动、可靠的工具使用,以及增强的网页与视觉搜索。 Apache 2.0。立即试用 → https://fireworks.ai/models/fireworks/step-3p7-flash-nvfp4
原文

Many research labs only consider inference efficiency after the fact. Step 3.7 Flash is a 198B sparse MoE VLM designed by @StepFun_ai for inference from the start. 196B language backbone with a 1.8B vision encoder. Built for real-world agent workloads, running at up to 400 tok/sec. Native multimodal understanding and action, reliable tool use, and enhanced web and visual search. Apache 2.0. Try it now → https://fireworks.ai/models/fireworks/step-3p7-flash-nvfp4

在 X 查看被引用的帖子

来源:StepFun · x.com