张大妈

阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!

源自公众号:阶跃星辰

02-11 21:50

阶跃星辰推出的Step 3.5 Flash开源模型,专为Agent场景设计。凭借稀疏MoE架构和创新的Parallel Thinking技术,在推理速度、智能表现和稳定性方面实现突破,为AI开发者提供了成本可控的高性能选择。

阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!智能速览

  • 推理速度最高达350 TPS,单请求代码类任务表现突出

  • 稀疏MoE架构仅激活110亿参数,总计1960亿参数

  • MTP-3技术一次预测4个Token,效率翻倍

  • 支持256K长文本上下文,采用SWA与全局注意力混合架构

  • 在Agent场景和数学任务上媲美闭源模型表现

  • 支持本地部署,可在个人工作站流畅运行

阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!精华内容

Step 3.5 Flash不仅仅是一个更聪明的模型,更是一个值得信任、响应迅速、成本可控的AI解决方案,为Agent应用场景量身打造。

极速推理

Step 3.5 Flash在推理速度方面表现卓越,单请求代码类任务最高可达350 TPS。这一速度优势源于其采用的MTP-3技术,让模型一次能够预测4个Token,相比传统方式效率直接翻倍。在实际应用中,复杂数学题计算仅需数秒即可完成,大幅提升了用户体验。

速度提升的同时,模型还通过3:1滑动窗口与全局注意力混合架构,在处理256K长文本时仅关注重点内容,显著降低了计算开销。这种设计让模型在保持高性能的同时,实现了更低的资源消耗。

稀疏架构

Step 3.5 Flash采用先进的稀疏MoE架构,总计拥有1960亿参数,但在实际运行时每个Token仅激活约110亿参数。这种设计在保持模型能力的同时,大幅降低了计算成本和内存占用。

稀疏架构的优势在于,模型能够根据不同任务动态选择最专业的专家网络进行处理,避免了传统稠密模型中参数冗余的问题。实测数据显示,这种架构在Agent场景下的表现尤为出色,能够有效应对复杂的推理任务。

Agent能力

在Agent场景测试中,Step 3.5 Flash展现了与闭源模型相媲美的性能。特别是在数学任务和代码生成方面,模型表现突出,能够准确完成复杂的计算和编程任务。

通过Parallel Thinking技术增强后,模型在XBench-DeepSearch测试中获得了超过81分的成绩,显著领先于其他开源模型。这种表现使其成为构建智能Agent的理想基座模型。

本地部署

Step 3.5 Flash专门优化了本地部署性能,支持在个人工作站上流畅运行。无论是NVIDIA DGX Spark、Apple M3/M4 Max还是AMD AI Max+ 395,都能够获得良好的使用体验。

这种本地化部署能力让开发者能够在保障数据隐私的前提下,充分利用模型的强大功能。同时,云端协同的架构设计,让本地执行更加稳定可靠,显著提升了任务成功率。

应用场景

Step 3.5 Flash在实际应用中展现出强大的适应能力。在气象情报仪表盘案例中,模型能够基于文字描述自动生成完整的可视化平台,处理超过15000个动态节点的实时数据流。

在价格比较任务中,模型作为云端大脑,能够将复杂需求拆解为具体子任务,指导本地执行并汇总结果。这种端云结合的模式,既保证了结果的准确性,又降低了本地端的执行难度。

Step 3.5 Flash的开源为AI社区带来了新的可能性,其在速度、智能和成本控制方面的平衡表现,为Agent应用的发展奠定了坚实基础。随着Step 4模型训练的启动,期待看到更多创新应用的出现。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章