600亿参数,K3级性能:Step 5 Preview向所有人开放
Step 5 Preview,国内AI公司JumpStellar的新大型模型,已正式向所有人开放。该模型昨天首次引起关注,大胆宣称:仅用600亿参数即可提供2.8万亿参数K3级系统的性能。今天,API和Studio已上线,完整权重版本定于10月15日发布。
内部机制:稀疏MoE和百万Token上下文
Step 5 Preview的核心采用了稀疏专家混合(MoE)架构。它拥有总计6000亿参数,但每个任务仅激活270亿——这种设计在保持强大能力的同时降低了成本。它还支持100万Token上下文窗口并处理多模态输入,意味着它可以处理文本、图像等。

性能:匹配K3,但更便宜
在AA智能指数上,Step 5 Preview得分44分,与Kimi K3 Max持平。其输出速度约为每秒100个Token,每个任务成本仅为0.71美元——而Kimi K3 Max为2美元。对于相似性能,这是显著的节省。
长时任务:24小时不间断优化
Step 5 Preview真正出彩的地方是长时任务。在一项实验中,它自主优化了一组H100 GPU内核,连续24小时——编写代码、运行测试、比较结果并迭代。约22小时后,它达到了508 TFLOPS,在同一测试中略胜Claude Opus 5的493 TFLOPS。
在另一次24小时运行中,该模型设计并训练了自己的数据,将Qwen3-30B-A3B在AIME24上的准确率从53.3%提升至60%——与Claude Opus 5相当,同时使用了更少的标注Token。
免费访问:长达75天免费
JumpStellar为新用户铺开红毯。注册即可立即获得99元套餐。登录可获得15天访问权限;首次调用再获得15天。邀请朋友注册,每邀请一位可获得15天,最多45天。总计,最多可免费使用75天。
细则:并非完全K3,但接近
早期反馈表明,Step 5 Preview并非在所有方面都匹配K3——但它并非仅为追逐基准而构建。其整体能力据说接近DeepSeek V4.1 Flash。然而,实际使用速度并不快,如果免费用户涌入,可能会进一步变慢。
关键点:
- Step 5 Preview采用稀疏MoE架构,总参数6000亿,每个任务激活270亿。
- 在AA智能指数上与Kimi K3 Max持平,但每个任务成本为0.71美元,而后者为2美元。
- 长任务能力包括24小时自主GPU内核优化,达到508 TFLOPS。
- 新用户可通过注册、登录、首次调用和推荐获得长达75天的免费访问。
- 实际性能接近DeepSeek V4.1 Flash,但速度可能随用户负载而变化。