阿里云李飞飞谈DeepSeek开源:推动AI系统架构创新与技术普惠
阿里云副总裁李飞飞在2025阿里云PolarDB开发者大会上发表了关于DeepSeek开源周的讲话,深度探讨了AI下半场的竞争趋势和开源生态的发展。李飞飞提出,随着模型算法创新趋缓,AI竞争焦点逐渐回归系统架构领域,分布式系统工程能力成为企业提升算力效率的关键。当前大模型预训练正在走向中心化和寡头化,少数机构承担得起高昂成本。李飞飞指出,通过开源,DeepSeek已成功推动复杂逻辑推理能力普及,并将推理成本降低了60%以上,阿里云也在通过优化GPU资源配置来降低在线推理成本。

DeepSeek开源项目,特别是像DeepGEMM矩阵计算库,通过动态编译内核等技术,使高性能计算技术更加普惠。李飞飞认为,开源模型与系统级创新的结合,将加速AI应用落地,推动行业格局重构。具体案例包括斯坦福大学团队只需50美元就能复刻尖端模型,这在一定程度上印证了技术普惠的巨大潜力。

李飞飞在大会上强调,AI的第一波浪潮主要集中在模型和算法的研究,但随着逐渐进入下半场,创新的瓶颈使得系统和硬件结构优化成为新的竞争核心。DeepSeek在这一点上通过分段配置等技术,将Linux等思路应用到GPU缓存上,产生了巨大的变化,为硬件结构带来了新的构想和应用前景。未来的大模型预训练将更加寡头化,在商业模式上形成闭环仍然是待解决的挑战,而DeepSeek的开源加速了这一过程,使低成本大模型运用成为可能。
DeepSeek开源周在杭州的举行,吸引了众多开发者和企业代表参与,共同探讨开源技术的发展趋势,分享实践经验。除了李飞飞的主题演讲外,活动还举办了多场技术论坛、开源项目展示和开发者工作坊等,涵盖人工智能、云计算、大数据等热门技术领域。阿里云通过积极参与开源社区建设,努力推动技术创新,促进了全球科技产业的发展。

李飞飞团队基于阿里通义千问Qwen模型,仅用16块H100 GPU、26分钟时间,成功训练出性能媲美OpenAI o1和DeepSeek R1的推理模型。这一实例再次展示了阿里云开源模型的强大潜力。通义千问Qwen模型凭借其优秀性能,已在多个开源社区中广受瞩目,成为新的开源AI基座,推动技术普惠进程。自2023年8月以来,阿里云持续推出多款开源模型,技术实力和社区影响力不断扩大,为全球AI开发生态的繁荣做出了巨大贡献。

李飞飞的讲话强调,技术普惠的进程离不开开源生态的支持。DeepSeek开源行动不仅大幅降低了使用门槛,还激发了全球开发者的创新热情。在硬件架构和系统优化方面的创新,将为AI系统带来新的突破,进一步推动AI技术从实验室走向大规模应用。
李飞飞的发言在引导AI下半场竞争回归系统架构的同时,也强调了开源在推动AI普惠中的不可替代的作用。DeepSeek开源周的成功举办,标志着技术创新和应用普及的新阶段,同时彰显了阿里云在全球AI技术发展中的重要贡献。随着AI技术的不断创新与应用的深入,未来中国AI产业的发展前景广阔,开发者们也将在这场技术变革的浪潮中发挥关键作用。
