阶跃星辰发布 Step 5 Preview:跻身全球开源前三,单任务成本仅为 Claude Opus 5 的 1/8
2026/09/20 10:20阅读量 5
9月20日,阶跃星辰发布新一代旗舰基座模型 Step 5 Preview,凭借在软件工程、金融等专业场景的优异表现,跻身 Artificial Analysis Intelligence Index (AA) 全球开源前三。该模型采用稀疏 MoE 架构,总参数 600B 但激活参数仅 27B,支持百万级上下文窗口。其核心亮点在于极致优化了智能与成本的平衡,单任务成本仅为 Claude Opus 5 的八分之一,标志着大模型竞争焦点从单纯规模扩张转向计算效率提升。
事件概述
2026年9月20日,阶跃星辰(StepFun)正式发布新一代旗舰基座模型 Step 5 Preview。该模型重点面向 AI 编程、软件工程、专业知识工作(如法律、医疗文档处理)及金融等垂直场景,旨在提升模型在真实世界 Agentic(智能体)任务中的综合表现。根据最新的权威榜单 Artificial Analysis Intelligence Index (AA) 评估,Step 5 Preview 已跻身全球开源模型前三名。
官方透露,该模型将于 2026年10月15日 正式开源。
核心技术与性能指标
- 架构设计:采用稀疏混合专家(Sparse MoE)架构。总参数量为 600B,但每次推理激活的参数仅为 27B。这种设计在保证强大算力的同时,显著降低了推理延迟和硬件资源消耗。
- 上下文能力:原生支持 100万 Token 的超长上下文窗口,并具备文本与视觉输入的多模态处理能力。
- 基准测试表现:在公开及内部评估中,Step 5 Preview 在复杂的软件工程任务(包括长期规划类任务)、专业知识工作流以及金融领域的基准测试中均表现出色,超越了多数同类竞品。
行业意义:从“规模扩张”到“效率优先”
Step 5 Preview 的核心卖点在于重新定义了大模型发展的“帕累托前沿”(Pareto Frontier),即在能力、成本、效率与场景覆盖之间寻求最大化平衡。
- 极致的成本优势:数据显示,Step 5 Preview 的单任务推理成本仅为 Anthropic 的 Claude Opus 5 的 1/8。这意味着在同等预算下,企业可以调用更强或更多的智能服务。
- Scaling 逻辑的转变:阶跃星辰指出,过去大模型的发展逻辑是“用更多计算换取更强智能”,但随着模型规模扩大,计算成本呈指数级攀升。下一阶段的关键在于提升“计算转化为智能”的效率。
- 连续迭代验证:从 Step 3.5 Flash、Step 3.7 Flash 到 Step 5 Preview,阶跃星辰连续三代基座模型均延续了对这一效率问题的探索,证明了其在稀疏架构和高效训练算法上的技术积累。
值得关注的影响
Step 5 Preview 的发布将市场竞争焦点从单纯的参数规模比拼,推向了对智能效率和实际落地成本的考量。对于依赖大规模 AI Agent 进行复杂任务处理的行业(如自动化软件开发、金融量化分析)而言,该模型提供了更具可持续性的主力工作模型选择。
