阶跃星辰发布旗舰模型 Step 5 Preview,AA 指数 44 分跻身全球开源模型前三,10 月 15 日开源 这条更新来自 ithome.com,发布时间为 2026-09-20,Aioga 保留原文入口以便核验。
摘要:阶跃星辰发布旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识和金融场景,将于 10 月 15 日开源完整权重。

背景:来源称,Step 5 Preview 总参数量为 600B、激活参数为 27B,支持 100 万 Token 上下文窗口;其 AA 综合智能指数得分 44 分,位居全球开源模型前三。官方还介绍了 StepCodeBench 及多项软件工程、专业知识和金融评测结果。

Aioga 观察:Aioga 判断:该发布将模型能力重点放在真实软件工程流程与长程 Agentic 任务上,公开权重时间也使后续可复现验证成为关键。当前材料主要来自厂商介绍及媒体摘录,评测结论仍需结合完整方法和独立结果观察。
影响与后续:可能影响:若 10 月 15 日按计划释放完整权重,开发者将获得进一步测试其代码、文档处理、设备交互和多模态能力的机会;但单项榜单成绩不代表所有任务表现,成本比较、内部评估与演示结果也不足以替代独立复核。 后续观察:核验 10 月 15 日是否实际开放完整权重,并关注公开模型、许可证、部署要求和评测细节;同时建议比较其在长上下文、代码修复、金融研究及真实设备调试任务中的可重复表现。

IT之家:https://www.ithome.com/ 9 月 20 日消息,阶跃今天宣布推出旗舰模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作、金融等场景,提升模型执行真实世界 Agentic 任务表现,10 月 15 日开源完整权重。
据介绍,该模型采用稀疏 MoE 混合专家架构, 总参数量 600B 、激活参数仅 27B,支持 100 万 Token 上下文窗口,原生支持文本与视觉输入。

在全球人工智能权威榜单 Artificial Analysis Intelligence Index(IT之家注:AA 综合智能指数)中,该模型得分 44 分, 位居全球开源模型前三 。与此同时,该模型的单任务成本仅为 Anthropic Claude Opus 5 的 1/8。

优化方面,阶跃为该模型建立了 StepCodeBench,覆盖 553 个独立代码仓库、9 类任务、20 个应用领域和 33 种编程语言。在测试中,Step 5 Preview 能够覆盖多种编程语言, 以及 Bug 修复 、 功能开发 、 代码重构 、 环境配置等真实开发任务 。
同时,该模型能根据自然语言需求,自主阅读 ESP32 设备及相关 API 的大量开发文档,将一块 ESP32-S3 开发板改造成支持蓝牙按键与语音输入的 Vibe Coding 键盘。它不仅能写代码,还可以访问串口、获取截图、调用摄像头、 模拟鼠标操作 ,并根据真实设备返回的状态和报错持续修改、运行和调试代码,连续执行超过 3 小时。

在公开和内部评估中,Step 5 Preview 在复杂的软件工程任务(包括长程规划任务)、专业知识工作和金融领域等基准测试中展现出较为均衡的综合能力,并在 Agents' Last Exam 的 CLI 子集 ALE-CLI、金融投资研究评测 FrontierFinance, 以及跨领域深度研究评测 DRACO 上仅次于 GPT-6 Astra 或 Claude Opus 5 。
该模型从今日起全量开放, 官方将于 10 月 15 日释放模型权重 ,敬请期待。
阶跃星辰开放平台:https://platform.stepfun.com/
Step 5 Preview - Intelligence, Performance & Price Analysis | Artificial Analysis:https://artificialanalysis.ai/models/step-5