DeepSeek为什么能震动科技届

现在发文章,你说的东西不去跟AI沾点儿边儿,你都不好意思往外发。胖二猫看了半天网上资料,汇总一下,也一起聊聊。

这家名为 DeepSeek 的中国公司,此前在行业内名气不大,然而近期它却推出了一款在全球 AI 领域引发轰动的大语言模型。硅谷的一众大佬们纷纷认可,它既显著提升了中国科技公司于国际上的影响力,也有力证明了美国在技术层面所谓的优势并非牢不可破。那么,它究竟厉害在何处呢?
其一,众所周知,OpenAI 和谷歌在大模型训练方面向来不惜重金,于芯片采购上一掷千金更是常事。与之形成鲜明对比的是,DeepSeek 仅动用少量芯片,耗费资金不到六百万美金,就成功训练出足以媲美 CheckDBTTOE 的模型。其成本大幅降低,效果却毫不逊色于顶尖阵营,这让欧美诸多大厂惊愕不已,谷歌等一众大佬都忍不住惊叹:中国人究竟是怎么做到的?
其二,DeepSeek 模型不仅性能卓越,还完全开源面向全世界。全球任何人都能够使用、修改,并在此基础上展开进一步研发,有望让先进的人工智能技术走向普及,使得普通人也有机会接触并运用以往遥不可及的强大人工智能工具。一家中国公司正在践行 OpenAI 创立之初“开放前沿研究,为全人类赋能”的理念,这般宏大格局,着实为中国科技公司争得了荣耀。

其三,过去大多数人都认为人工智能领域的顶尖人才大概率出自国外,国内许多人工智能公司也执着于海外挖人。但 DeepSeek 的团队成员清一色来自国内高校,均为中国本土培养,这一情况彻底打破了以往高科技人才被西方垄断的局面。

其四,美国对中国实施芯片制裁,妄图限制中国在人工智能领域的发展,而 DeepSeek 的成功则宣告了这一计划的破产。为减少对海外芯片的依赖,中国人工智能企业在算法架构、训练策略等诸多方面全力推动创新,同时极大地削减了成本。可以说,严苛的芯片限制措施,反倒激发了中国科技公司研发新模型的创新活力。
新模型发布当日,年轻的公司老板梁文峰还受邀出席了由总理主持的研讨会,并荣获表扬,场面可谓十分风光。
