核心事件:Step 5 Preview 正式发布
- 发布时间:2026年9月20日
- 新版本:Step 5 Preview(正式版将于10月15日开源)
- 可用性:当前为预览版本,10月15日正式开源
- 开通状态:未提及是否已开放调用,仅说明将开源
- 架构类型:稀疏MoE(Mixture of Experts,专家混合)架构
阶跃星辰于9月20日发布新一代旗舰基座模型 Step 5 Preview,定位为面向真实世界智能体(Agentic)任务的主力工作模型,在能力、成本、效率与场景覆盖之间寻求最大化平衡。该模型最大的亮点在于单任务成本仅为Claude Opus 5的1/8,大幅降低高性能AI应用的运行门槛。
技术特性与榜单表现
Step 5 Preview 采用稀疏MoE架构,总参数量600B(6000亿),激活参数仅27B(270亿),兼顾强大推理能力与高效推理成本。这一设计逻辑与Meta的Llama系列、Mistral的MoE模型类似——通过动态激活部分专家网络,在不显著增加计算开销的前提下提升模型复杂度。
模型支持100万Token上下文窗口,原生支持文本与视觉输入,可处理长文档、多模态输入等复杂任务。在软件工程、专业知识工作流和金融等场景的公开与内部评估中表现突出,尤其擅长长期规划类任务。
在最新发布的国际权威榜单 Artificial Analysis Intelligence Index(AA综合智能指数)中,Step 5 Preview 跻身全球开源模型前三。这一成绩意味着其综合智能水平已接近或超过部分闭源模型,成为开源阵营的重要突破。
关键数据对比(基于官方披露)
| 模型 | 架构 | 总参数量 | 激活参数量 | 上下文窗口 | 单任务成本(相对) | AA榜单排名(开源) |
|---|---|---|---|---|---|---|
| Step 5 Preview | 稀疏MoE | 600B | 27B | 100万Token | 1× | 前三 |
| Claude Opus 5 | 未公开 | 未公开 | 未公开 | 未公开 | 8× | — |
意外反差点:尽管总参数量高达600B,但因稀疏激活机制,实际运行时仅27B参数被启用,这解释了其为何能在低成本前提下保持高性能——传统 dense 架构若要达到同等能力,通常需要更高参数量和算力。
场景定位与商业逻辑
Step 5 Preview 的核心卖点是拓展智能与成本之间的最优边界。阶跃认为,大模型 scaling 的下一阶段应从"用更多算力换更强智能"转向"提升计算转化为智能的效率"。这一思路体现在三代连续迭代中:从 Step 3.5 Flash、Step 3.7 Flash 到 Step 5 Preview。
在帕累托最优(Pareto Frontiers)概念下,** Intelligence Index 每提升一点,通常伴随成本指数级增长**;而 Step 5 Preview 将这一边界向外推移,使得同等预算可买到更高强度的智能。
读者落地建议
- 适合立即尝试:AI编程、软件工程自动化、金融建模等场景的开发者与企业,可借预览版评估迁移可行性;预算敏感但对算力有硬性需求的团队,Step 5 Preview 的性价比优势明显。
- 建议再等等:追求极致精度的闭源专用任务(如高风险医疗诊断),或需要闭源模型SLA保障的生产环境,可等待10月15日开源后结合社区反馈再做决策。
写在最后
开源模型的性能逼近闭源头部产品,标志着AI算力民主化进程加速;而成本效率的持续优化,则为智能体(Agent)在真实业务场景的大规模落地扫清了关键障碍。



