2026-05-30 0
阶跃星辰重磅发布Step 3.7 Flash模型,这款面向生产级Agent的多模态AI具备高速推理与可靠工具调用能力,为智能应用开发带来全新突破。

阶跃星辰最新推出的Step 3.7 Flash模型采用196B MoE架构,激活参数仅11B,支持最高400 Tokens/s的生成速度。这款开源模型已适配主流Agent框架并上架魔搭社区,为开发者提供强大的多模态理解和工具调用能力。
01
核心特性
当前AI模型竞争已从单纯追求智能峰值转向规模化高效智能。Step 3.7 Flash专为生产环境设计,在复杂输入理解、信息搜索、工具调用等方面表现出色。该模型主要优化了四大核心能力:
原生多模态理解能力:可处理UI、图表、文档等多种视觉信息,并将其转化为可执行任务。
增强的搜索功能:强化联网检索与图像搜索,支持跨文本图像的多源信息比对。
可靠的工具调用:在多轮工作流中稳定调用各类工具,保持任务执行一致性。
生态兼容性:适配主流Agent框架,降低开发者的接入成本。

性能对比显示,Step 3.7 Flash在多方面优于前代产品。模型正在适配OpenRouter等海外平台,相关体验入口将陆续开放。
Step 3.7 Flash具备出色的视觉理解能力,可自主处理复杂图像信息。典型案例包括:
在"如何起飞"指令下,模型能自动识别驾驶舱仪表信息并生成操作教程。
面对"删除方块"指令,可准确理解Photoshop界面并给出操作步骤。
针对设计分析需求,能够识别应用界面并生成专业见解。
采用稀疏MoE架构的Step 3.7 Flash,在保持高性能的同时实现效率优化。400 Tokens/s的生成速度使其特别适合:
构建Agent集群进行并行决策
实时构建大型知识图谱
模型在多轮工作流中展现出稳定的工具调用能力,适配主流框架并支持本地部署。关键指标表现如下:
Toolathlon | 49.5% | 多工具协同 |
ClawEval-1.1 | 67.1% | 真实环境任务执行 |
GDPval | 45.8% | 跨44种职业 |
τ²-bench Telecom | >98% | 多难度推理 |
02
模型体验与部署
魔搭社区提供免费体验入口,无需配置环境即可试用。开发者可通过多种方式部署:
API调用:兼容OpenAI接口,支持多模态输入。
vLLM部署:推荐使用预构建Docker镜像。
SGLang部署:支持推测解码加速。
本地部署:提供多种量化版本满足不同需求。

03
直播预告
6月2日将举办技术直播,由阶跃多模态后训练负责人深度解析Step 3.7 Flash的技术细节。
Step 3.7 Flash的发布标志着生产级Agent技术迈入新阶段,其多模态理解、高速推理和可靠工具调用能力,将为AI应用开发带来全新可能。
大家都在看