阶跃星辰发布旗舰模型 Step 5 Preview,10 月 15 日开源权重
核心亮点
国内 AI 公司阶跃星辰(StepFun)发布旗舰基座模型 Step 5 Preview,采用稀疏的多位专家协作(MoE)架构,总模型复杂度 600B、激活参数 27B,支持 100 万 token 上下文,并接受文本与视觉双模态输入。在 Artificial Analysis Intelligence Index 上取得 44 分,位居全球"代码公开可免费使用"模型前三,单任务成本据称仅为 Claude Opus 5 的 1/8。
具体能力
Step 5 Preview 的定位是通用基座,而非某个垂直小模型。100 万 token 上下文让它能在一次会话里吃下整本书或一整套代码库;文本+视觉输入则意味着它可以看图说话、读图表、理解带图的文档。对于需要长程推理和跨文档综合的任务,这类长上下文+多模态的组合比短上下文模型更顺手。
技术细节
稀疏专家架构的核心是"总参大、激活小":600B 的总容量负责知识广度,每次推理只唤醒 27B 的活跃参数,兼顾能力与算力成本。这种设计的难点在于路由——如何让合适的专家在合适的时刻被激活。阶跃星辰选择把权重在 10 月 15 日开源,等于把训练成果摊开给社区审计和二次开发,这对建立信任很关键。
与竞品对比
在同档开源/开放模型中,Step 5 Preview 直接用"600B/27B MoE + 百万上下文 + 视觉"的组合去对标 Claude Opus 5 这类闭源旗舰,并以 1/8 成本作为卖点。它的对手既包括 DeepSeek、Qwen 等国内开放模型,也包括 Llama、Mistral 等国际开源阵营。能否真正落地,要看开源后的实测表现和社区生态,而不是发布时的基准分数。
行业影响
对国内开发者而言,又一个强力的开放基座意味着在闭源 API 之外多了可控、可本地化的选择,尤其利好对数据合规和成本敏感的企业。说白了,当顶尖能力开始以"开源+低成本"的姿态出现,闭源厂商的定价逻辑会被持续施压。10 月 15 日的权重开放,将是检验这份承诺成色的关键节点。
延伸视角
Step 5 Preview 的出现,意味着国产大模型在「基座能力 + 开放权重 + 可控成本」三条线上同时发力。对中小开发者,开源意味着可以在本地微调、做领域适配而不必担心 API 限流与数据出境;对企业,1/8 的单任务成本配合百万上下文,使「把一整套知识库喂给模型做长程推理」从奢侈变为日常。值得警惕的是,600B 总参的模型对显存与推理框架要求不低,社区能否真正「跑得动、改得动」,仍取决于 10 月 15 日开源后的工程就绪度,而非发布时的宣传口径。