阶跃星辰发布旗舰大模型Step 5 Preview:600B参数跻身全球开源前三

来源:爱集微 #稀疏MoE# #600B参数# #开源# #智能指数#
385

9月20日,阶跃星辰发布旗舰多模态大模型Step 5 Preview,并同步开放API与Studio平台服务。该模型采用稀疏MoE架构,总参数量600B、激活仅27B,支持100万token上下文,AA智能指数得分44、居全球开源前三,单任务成本约为Claude Opus 5的1/8,完整版权重拟于10月15日正式开源。

一、600B稀疏MoE旗舰登场,剑指Agentic核心场景

架构方面,Step 5 Preview采用稀疏MoE(混合专家)架构,总参数量达600B,每个token仅激活27B参数,在撑大模型能力上限的同时显著压低推理成本;模型支持100万token超长上下文窗口,原生支持文本与视觉双输入。阶跃星辰将其定位为可持续处理复杂任务的主力工作模型,在软件工程、专业工作流和金融等场景表现突出。

应用落点上,Step 5 Preview重点面向AI编程、软件工程、专业知识工作和金融等Agentic(智能体)场景。据CSDN等科技媒体报道,该模型面向真实世界Agentic任务设计。另据AIbase报道,其性能对标参数量达2.8万亿的K3模型。

二、权威评测跻身全球开源前三,单任务成本约为Claude Opus 5的1/8

在第三方评测机构Artificial Analysis发布的Intelligence Index(智能指数)上,Step 5 Preview得分44,位居全球开源模型前三。官方称,其单任务成本约为Claude Opus 5的1/8。

定价方面,据腾讯新闻报道,Step 5 Preview的API价格为每百万token输入7元、输出20元、缓存0.35元。据AIbase报道,模型已全量开放,API与阶跃星辰的Studio平台均已可用,新用户可获得最长75天的免费使用权益。

【图表:AA智能指数得分对比图】

 

从上图的对比可以看到,同为国产厂商旗舰开源模型的智谱GLM-5.3-Flash在此前的Artificial Analysis智能指数评测中获得57分,与Anthropic的Claude Opus 4.8持平;Step 5 Preview此次以44分跻身全球开源模型前三。两家厂商均依托稀疏MoE架构压低激活参数与推理成本,国产开源阵营在“能力—成本”曲线上的竞争正在加速。

口径说明:GLM-5.3-Flash的57分为智谱官方于2026年8月披露的AA智能指数成绩;据智东西对2026年9月AA榜单的核对,开源模型赛道排在Step 5 Preview之前的是Qwen3.8 Max(0902)与GLM-5.3(max),故Step 5 Preview以44分位居全球开源第三。

三、已上架Hugging Face,Step 5正式版10月15日开源

开源节奏上,Step 5 Preview已在Hugging Face开源平台建立模型仓库(当前为占位仓库,权重尚未上传),并可通过阶跃星辰官方产品与API直接使用。据金融界等媒体报道,完整版权重预计于10月15日正式开源释放。

定价策略上,据智东西报道,Step 5 Preview的API价格可对标DeepSeek-V4-Pro-0813的高峰时段,在相近能力水平下进一步凸显性价比优势。

四、稀疏MoE路线延续:从196B到600B的参数跃迁

Step 5 Preview的发布是阶跃星辰稀疏MoE技术路线的自然延伸。此前,阶跃星辰发布的开源Agent基座模型Step 3.5 Flash即采用稀疏MoE架构,总参数量196B,每个token仅激活约11B参数,单请求代码类任务最高推理速度达每秒350个token,沐曦股份、壁仞科技、燧原科技、天数智芯、阿里平头哥等多家芯片厂商已完成适配。

随后发布的Step 3.7 Flash同样基于稀疏MoE架构,总参数量196B并配备1.8B视觉编码器(合计约198B),激活参数11B,最高生成速度可达400 Tokens/s,围绕Agent、Coding、Search与多模态工作流进行系统优化。

从Step 3.5 Flash的196B、Step 3.7 Flash的约198B,到Step 5 Preview的600B,阶跃星辰旗舰模型总参数量提升约3倍,激活参数仅从11B增至27B,“大参数、低激活”的成本控制逻辑一以贯之。

【图表:阶跃星辰稀疏MoE模型家族参数对比图】

从上图对比可见,Step 5 Preview将总参数量推高至600B、激活参数27B,能力上限与推理经济性的平衡点进一步向高性能侧移动;早期Flash系列350至400 Tokens/s的生成速度优势,也为Agentic高频调用场景奠定了工程基础。

生态协同方面,阶跃星辰于2025年7月联合近10家芯片及基础设施厂商发起“模芯生态创新联盟”,旨在打通芯片、模型与平台之间的技术壁垒,通过联合优化提升算力利用效率[5]。业内认为,随着推理模型成为主流,模型与算力的深度协同将成为推动大模型规模化应用的重要路径。

五、行业观察:开源竞争白热化,性价比与Agentic成主战场

Step 5 Preview发布之际,全球开源大模型竞争已进入白热化阶段。8月26日,智谱上线并开源GLM-5.3-Flash,总参数量320B、激活参数18B,在Artificial Analysis智能指数中取得57分,与Claude Opus 4.8持平,定价仅为GLM-5.3的1/10。

从行业格局看,自DeepSeek R1发布以来,开源模型持续抬升行业基础标准:百度宣布开源下一代文心大模型,MiniMax开源MiniMax-Text-01与MiniMax-VL-01,阶跃星辰此前也已联合吉利开源Step-Video T2V和Step-Audio模型。开源有利于吸引用户和构建生态,闭源更侧重持续的商业化运营;当一个优秀的开源模型被推出时,它实际上提升了整个行业的基础标准。

在此背景下,Step 5 Preview以44分跻身全球开源模型前三,叠加约为Claude Opus 5的1/8的单任务成本,延续了国产厂商“以开源换生态、以性价比换规模”的竞争策略。待10月15日Step 5正式版开源后,国产开源旗舰之间的正面竞争有望进一步升级。

六、结语

从196B到600B,从Flash系列到Step 5 Preview,阶跃星辰以稀疏MoE架构在模型能力与推理成本之间寻找平衡点,并以明确的开源节奏加入全球开源竞争。Step 5 Preview能否在10月15日正式版权重开源后持续巩固全球开源前三的位置,值得行业持续关注。


责编: 爱集微
来源:爱集微 #稀疏MoE# #600B参数# #开源# #智能指数#
THE END

*此内容为集微网原创,著作权归集微网所有,爱集微,爱原创

关闭
加载

PDF 加载中...