沉寂已久的阶跃星辰携Step-3.5-Flash模型回归,其核心思路是“唯快不破”。在Agent时代,该模型以极致的响应速度和低成本为特点,通过短小精悍的设计,探索出一条以速度弥补模型规模、实现高效工具调用与快速试错的新路径。这为AI应用开发提供了新的可能性。
智能速览
Step-3.5-Flash平均接近200 TPS,峰值可达300 TPS,远超行业平均水平。
模型采用“小而快”策略,认为在Agent时代,速度比规模更重要。
其智力水平已追至第二梯队,与体量更大的DeepSeek V3.2持平。
模型推理成本极低,每千Token成本约为1.96元,具备高性价比。
精华内容
在AI模型竞赛中,阶跃星辰另辟蹊径,将宝押在了“速度”上。Step-3.5-Flash的问世,不仅是技术参数的突破,更是一种对未来AI应用形态的深刻思考。
极致速度解析
Step-3.5-Flash最引人注目的便是其惊人的推理速度。在当前国产大模型50 TPS已成为常态的背景下,该模型平均速度接近200 TPS,峰值甚至能冲至300 TPS。这种“极速”表现,意味着用户在进行复杂交互时能获得近乎实时的反馈。
即便面对平均33K的推理输出任务,其速度优势依然稳固,为流畅的用户体验奠定了基础。这背后是阶跃对Agent时代需求的精准判断:快速试错、高效交付,是AI Agent成功的关键。
智力的取舍
在追求极致速度的同时,Step-3.5-Flash的智力表现并未被牺牲。评测显示,其逻辑能力已从原先的掉队水平,一跃追至行业第二梯队,与参数量远大于自己的DeepSeek V3.2持平。这样的智力水平,对于驱动Agent完成大部分任务已绰绰有余。
更重要的是,其推理成本极具竞争力,每千Token仅需1.96元,实现了性能与成本的良好平衡,印证了其“多、快、好、省”的设计哲学。
Agent时代新解
阶跃星辰对Agent时代的理解是:模型并非越大越好。Step-3.5-Flash的定位是一个短小精悍的执行单元,它自身不追求无所不能,而是作为大脑,借助Agent完善的工具链,快速调用外部工具,通过不断试错来解决问题。
这种以快补拙的策略,将最终交付的产物质量作为核心衡量标准,为大模型的发展提供了一条差异化的技术路径,证明了小模型也能在复杂应用场景中发挥巨大价值。
Step-3.5-Flash的发布,不仅是阶跃星辰技术实力的展现,更为开源社区提供了一个高效、经济的新选择。它以“速度”为切入点,挑战了“大力出奇迹”的传统观念。未来,这种以速度和效率为核心的模型形态,会如何影响AI应用的生态,值得关注与期待。
关键评论
模型的高速度非常适合用于代码生成等需要快速响应的场景。
与DeepSeek V3.2相比,该模型在输出效率上实现了数量级的领先。
有观点认为,Step系列未来可能定位为配合硬件产品的主力模型。