Meta实质性退出开源大模型主战场,中国力量加速填补空白

源自157位全网作者

04-12 11:43

内容由AI生成

精选参考来源

1. 刚刚,「欧洲的DeepSeek」发布Mistral 3系列模型,全线回归Apache 2.0

2. 最近,彭博社爆出来一个消息:Meta不仅打算放弃了开源,还在搞一个代号叫牛油果的新模型项目,这个项目蒸馏了好几家的开源模型,其中就包括阿里的千问大模型。作为曾经研究过技术研发的程序员,Meta选择蒸馏阿里千问、中国开源AI横扫硅谷,在我眼里就不是什么偶然逆袭。在开发者领域,中国开源模型的口碑一直强势。选开源模型从来不是只看榜单跑分,更看能不能落地、好不好用、省不省力,而阿里千问恰恰把这三点做到了极致,这也是它能让Meta、亚马逊等企业放弃硅谷同类模型的关键。这种技术话语权的转移,不仅让中国开源更有底气,更让全球开发者有了更多选择,不再被硅谷的技术标准绑架,能根据自己的需求选最适配的模型,这才是开源技术的本质,也是千问带给全球开发者最珍贵的价值。真正的技术强者,不仅要能做出高跑分的模型,更要懂开发者要什么、懂行业落地需求是什么,不仅要打破技术垄断,更要构建让全球开发者共赢的生态。

3. 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看

4. 最近海外开发者圈子里,确实开始频繁提到中国的开源大模型了,小米 MiMo 也在其中。 OpenRouter 的真实调用数据显示,MiMo-V2-Flash 开源之后,API 使用量一路走高,已经冲到周榜前列,国产模型里更是排在第一。这个榜单不是主观评测,是开发者真用出来的结果,这一点分量不小。 当然,海外评价和调用数据只是参考,但你不得不承认,小米在大模型这条路上,进步是真的快,不少海外开发者直言,MiMo-V2-Flash 在分析能力上已经明显超过同级竞品,尤其是在 Agent 场景下,实用性非常强,不再是演示型智能了 更有意思的是,MiMo-V2-Flash 在海外的讨论热度,甚至不输同期发布的 Gemini 3 Flash。很多人干脆把它当成Gemini 平替,原因也很直接,效果够用,价格极低,而且现在还是免费。 这波不是情绪输出,是全球开发者用脚投票。中国开源大模型,真的开始被认真对待了。

5. 如何看待「80% 的 AI 创业公司都在用中国开源模型」的现象?

6. “DeepSeek R1 时刻” 一周年 huggingface.co/blog/vansin/one-year-since-the-deepseek-moment-cn“这是系列博客的第一篇,将审视中国开源社区在过去一年的历史性进步及其对整个生态系统的深远影响。2025 年的许多进展可以追溯到 1 月的“DeepSeek 时刻”,当时位于杭州的 AI 公司 DeepSeek 发布了他们的 R-1 模型。第一篇博客探讨战略变化以及新开源模型和开源参与者的井喷式增长。第二篇将涵盖主要由中国公司在日益增长的开放生态系统背景下做出的架构和硬件选择。第三篇将分析知名组织的轨迹和全球开源生态系统的未来。对于贡献并依赖开源生态系统的 AI 研究人员和开发者,以及试图理解这一快速变化环境的政策制定者而言,正如过去一年由 DeepSeek 催化的巨大增长所证明的那样,现在是构建和发布开源模型及制品的最佳时机。值得注意的是,地缘政治推动了应用;虽然中国开发的模型在 2025 年的各项指标中占据主导地位,且新玩家不断实现跨越式发展,但西方 AI 社区正在寻求可商业部署的替代方案。”#HOW I AI#

7. #千问3.5成本仅为谷歌大模型5%#除夕这天千问3.5的发布太惊喜!成本压到谷歌大模型的5%,性能对标Gemini 3 Pro,API价格却低至每百万Token0.8元 。我认为这才是AI普惠的关键:高性能不再是大厂专属,中小企业和开发者能低成本用上顶级能力。开源+低门槛,会让更多创新落地,期待2026年AI应用百花齐放!

8. 小小的也很厉害?这个只有6B参数的开源图像模型把我看傻了

9. #雷军公布小米机器人最新进展##小米发布机器人基座模型#小米其实很早就布局了机器人业务,也取得显著的成果,今天雷总再次公布小米机器人最新进展:小米开源首代机器人 VLA 大模型,划重点:开源,期待大家的加入。原文在此,小米开源首代机器人 VLA 大模型,刷新多项 SOTA!,相比VLA(Vision-Language-Action)模型,小米对外发布:Xiaomi-Robotics-0架构是一个拥有 47 亿参数、兼具视觉语言理解与高性能实时执行能力的开源 VLA 模型,这种“大脑+小脑”的组合,能在现实真机任务中实现物理智能的泛化——在动作执行时保持极高的物理灵活性,概括:动作连贯、反应灵敏。还能在消费级显卡上实现实时推理,牛!这意味着离走出实验室正式商用应该不远了,进厂干活只是第一步,第二步为走进千家万户,指日可待。

10. 机器人开源革命:“免费大脑”背后的四派力量与博弈|机器人系列

11. 【MiMo 大模型实力强劲震惊海外开发者 】 国产大模型这波在海外直接杀疯!OpenRouter 最新周榜里,小米 MiMo-V2-Flash API 调用量飙到第二,还是国产大模型第一;Artificial Analysis 数据里,它更是冲进全球开源大模型第二。海外开发者都在夸:AI 分析碾过同价位对手,面向 Agent 时代的实用性不搞虚的,甚至被当成 Gemini3 Flash 平替 —— 关键这模型不仅效果能打,还免费又便宜!之前总说国产大模型出海难,现在小米这进步是真肉眼可见,全球关注都不输同期的 Gemini3 Flash,这波确实有点东西!

12. 除夕夜开源 Qwen3.5,这种操作阿里是真的懂氛围感,陪全球开发者过年,还送一份压轴礼。新一代千问的混合注意力机制很吸引人,尤其是原生支持 VLM,意味着模型在图文理解上的能力直接打包好给你。开源阵容也不含糊,既有 2B 的密集模型满足轻量需求,也有 35B-A3B MoE 型号给你硬核算力体验,推理成本大幅下降,对中小团队来说是个实实在在的福音。更关键的是,代码已经提到 HuggingFace Transformers,春节一到,就能第一时间“撸”起来。阿里连续两年在除夕夜撒大招,这份坚持也让它在全球 AI 开源生态的地位更稳了。#千问Qwen3.5大模型发布#

13. 小米MiMo有点东西,小米MoE大模型MiMo-V2-Flash开源后,已经成为最近阶段国产大模型调用量第一。之前都觉得谷歌Gemini无敌,小米的新模型MiMo-V2-Flash又好用又免费,开发者没理由不选小米。从DeepSeek爆火,再到小米的AI大模型热度攀升,咱们国产AI的能力真的有点太强了!

14. 迟来,26年2月开源模型汇总!DeepSeek虚晃一枪,国内大模型狂卷~

15. 第7期 | 豆包手机努比亚M153,大势不可逆新世界即将开 从封杀到掀桌!中国AI这10天,改写了手机未来 这10天,中国AI圈,发生了一件很有意思的事。 不,应该说,是一系列很有意思的事。 12月1日,字节跳动发布了豆包手机助手。 12月2日,vx闪电出手,开始封号。 12月3日,豆包认怂,下线了操作微信的功能。 12月9号,智谱AI直接“掀桌子”——宣布开源 AutoGLM! 短短10天。从新品亮相到大厂阻击,再到开源“掀桌”,节奏快得像一部科技大片。 说实话,已经很久没见到国内AI圈这么精彩的剧情了。 豆包手机努比亚M153的历史地位 #豆包 #中兴 #AI手机 #豆包手机 #努比亚

16. 小扎千亿新模型被曝「套壳」Qwen!Meta开源已成笑话

17. 【华为昇腾 0 Day 适配阿里 Qwen3.5,MindSpeed MM 框架实现 " 开箱即用、快速迭代 "】阿里在 chat.qwen.ai 页面低调上线了 Qwen3.5-Plus 和 Qwen3.5-397B-A17B 两款新模型(均支持文本和多模态任务)。Qwen3.5 Plus 定位为 Qwen 3.5 系列最新大语言模型;Qwen3.5-397B-A17B 定位则是 Qwen3.5 开源系列旗舰大语言模型。华为计算官方昨晚宣布,Qwen3.5 模型一经开源发布,昇腾 0 day 实现基于 MindSpeed MM 在 Atlas 800 A3、Atlas 900 A3SuperPoD 上的训练复现,同时也支持基于 vLLM-Ascend 和 SGLang 在 Atlas 800 A2、Atlas 800 A3 上的高效推理部署。据介绍,基于 FSDP 训练后端的设计,MindSpeed MM 框架大幅缩短了新模型的适配周期,实现了 " 开箱即用、快速迭代 " 的开发体验,为多模态大模型的研究与应用提供了技术支撑。另据阿里云介绍,Qwen3.5 实现了底层模型架构的全面革新,其中,Qwen3.5-Plus 版本总参数为 3970 亿,激活仅 170 亿,性能超过万亿参数的 Qwen3-Max 模型,部署显存占用降低 60%,推理效率大幅提升,最大推理吞吐量可提升至 19 倍。Qwen3.5 在能力、效率与通用性三个维度上推进预训练:能力(Power):在更大规模的视觉-文本语料上训练,并加强中英文、多语言、STEM 与推理数据,采用更严格的过滤,实现跨代持平:Qwen3.5-397B-A17B 与参数量超过 1T 的 Qwen3-Max-Base 表现相当。效率(Efficiency):基于 Qwen3-Next 架构 —— 更高稀疏度的 MoE、Gated DeltaNet + Gated Attention 混合注意力、稳定性优化与多 token 预测。在 32k/256k 上下文长度下,Qwen3.5-397B-A17B 的解码吞吐量分别是 Qwen3-Max 的 8.6 倍 / 19.0 倍,且性能相当。Qwen3.5-397B-A17B 的解码吞吐量分别是 Qwen3-235B-A22B 的 3.5 倍 / 7.2 倍。通用性(Versatility):通过早期文本-视觉融合与扩展的视觉 / STEM / 视频数据实现原生多模态,在相近规模下优于 Qwen3-VL。多语言覆盖从 119 增至 201 种语言 / 方言;25 万词表(vs. 15 万)在多数语言上带来约 10–60% 的编码 / 解码效率提升。vllm 部署指导可参见魔乐社区和 gitcode 社区链接:网页链接网页链接SGLang 部署指导可参见 SGLang 社区链接:网页链接

18. 开源最强,逼平闭源顶流!DeepSeek发布V3.2系列模型,推理能力追平GPT-5

19. #微博发布首个开源大模型#微博居然悄悄憋出这么个大招,首个开源大模型VibeThinker-1.5B也太牛了,居然能在高难度数学测试里干过400倍参数量的DeepSeek-R1!以前吧,我就总觉得大模型是科技巨头的专属,堆参数、烧钱才是标配,没想到微博靠频谱到信号原理这种创新算法,直接走出了不一样的路~ 现在模型已经在Github、HuggingFace这些平台开源了,我觉得这对中小企业和高校研究团队真的太友好了,这下子终于不用担心被算力门槛劝退了

20. OpenAI宣布聘请OpenClaw创始人Peter Steinberger2月16日,OpenAI宣布,OpenClaw的创建者Peter Steinberger正式加入公司,担任重要开发角色,专注于推动下一代个人AI智能体的研发。OpenAI首席执行官Sam Altman确认了这一人事变动。他表示:“Peter拥有许多关于智能体相互协作的绝妙想法。未来将极度依赖多智能体系统,这种智能体间协作能力将迅速成为我们产品核心。” Altman还强调,OpenClaw项目将转型为一个基金会形式,继续作为开源项目存在,并获得OpenAI的持续支持。Peter Steinberger是一位来自奥地利的独立开发者,此前以个人力量开发并维护OpenClaw。该项目在短短数周内迅速走红,被誉为GitHub上增长最快的开源项目之一,曾获得超过18万颗星标。它允许用户在本地硬件(如 Mac Mini)上运行智能体,通过WhatsApp、Telegram等聊天应用进行交互,支持多种AI模型接入,并具备自我修改、自主完成复杂任务的能力,包括处理旅行预订、智能家居控制、监控摄像头分析等实际场景。OpenClaw前身包括Clawdbot和Moltbot等迭代版本,其病毒式传播得益于高度开放、本地运行和强大的自主性。Steinberger在其个人网站上发文解释加入OpenAI的决定:“加入OpenAI能让我专注于前沿AI研究与开发,继续实现将智能体带给大众的愿景,而无需独自承担公司运营的压力。OpenAI与我在愿景上高度一致,他们已承诺全力支持社区和开源发展。”这一招聘被视为OpenAI在智能体领域的重大战略布局。业内普遍认为,智能体是继聊天机器人之后AI的下一个关键进化方向,多智能体协作系统有望实现更复杂的现实世界任务自动化。OpenClaw的爆火也曾吸引Meta等巨头抛出收购或合作橄榄枝,但Steinberger最终选择OpenAI,并坚持项目保持开源。OpenClaw项目此前由Steinberger个人每月自掏腰包10,000至20,000美元维护,加入OpenAI后,其资源与社区支持预计将大幅提升。分析人士指出,此举不仅强化了OpenAI在个人助理与智能体赛道的竞争力,也体现了当前AI行业对顶尖独立开发者和开源创新的激烈争夺。OpenAI表示,Steinberger将领导下一代个人智能体开发工作,相关产品细节将在未来逐步公布。

21. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌

22. #雷军公布小米机器人最新进展##小米发布机器人基座模型#就在刚刚,我米技术对外发布开源VLA模型Xiaomi-Robotics-0,该模型有47亿参数,兼具视觉语言理解与高性能实时执行能力,刷新多项SOTA。采用MoT架构,大脑VLM理解人类指令、捕捉空间关系,小脑Action Expert生成平滑动作,训练上采用两阶段法,先跨模态预训练,再后训练,解决真机动作断层等问题。在测试中,在仿真测试和现实真机任务中表现优异,保持了VLM多模态理解能力,将模型开源,有望推动机器人在工业、服务业、家庭等场景的应用,加速具身智能落地,相信很快就会运用在更多的生态产品上。 而Xiaomi-Robotics-0机器人基座模型,Benchmark全面超越OpenVLA和Pi,跻身行业第一梯队,结合近期Mimo等成果,我米AI成长迅猛,且开源VLA与触觉模型,构建完整手脑技术栈,务实推进,为机器人商用铺路。

23. #千问Qwen3.5大模型发布#除夕夜,阿里再放大招,新一代千问大模型Qwen3.5今晚开源,实现模型架构创新。继去年除夕Qwen2.5-Max后,阿里再次选择在这个节点发布重磅技术,持续推动大模型技术开源共享,为AI生态注入新活力。

24. 在开源大模型领域,小米可能是领先华为的。#小米发布最新MiMo大模型#小米重磅开源新模型MiMo-V2-Flash!3090亿总参数+150亿活跃参数,性能媲美DeepSeek-V3.2,SWE-Bench编程得分73.4%超所有开源模型,256k超长上下文+150 tokens/秒推理速度,百万token成本低至0.1美元起~ 混合注意力+MTP+MOPD三大黑科技拉满效率,MIT协议开源可直接用,这波是小米AGI路线图的硬核第二步,全硬件生态AI底座稳了!#小米开源大模型##MiMo-V2-Flash#不过也许华为在闷声憋大招,余承东掌舵AI资源后,明年应该会有更多新动作

25. 除夕夜,国产顶流压轴上线,QWEN3.5多模态开源!

26. 正面硬刚Gemini 3 Pro,阿里开源Qwen3.5-Plus|甲子光年

27. 昨天谷歌发了 Gemma 4 开放权重模型系列,升级挺猛的。一共四个版本,除了端侧轻量版,还头一回上了 MoE 架构的 26B 模型。全系支持多模态,能看懂图片听懂语音,自带推理思考功能,上下文直接拉到了 25 万。最香的是改用 Apache 2.0 彻底开源了。感觉谷歌这次是真的放开手脚了,那个 26B 单卡就能跑,性价比挺高,可以试着本地部署跑个试试看。#谷歌发布Gemma4开源大模型# #微博跨域计划# #AI创造营#

28. DeepSeek V3.2来了,首个会"思考"的Agent模型,首个开源性能打平GPT-5的模型

29. 据新加坡《商业时报》网站报道,新加坡国家人工智能计划日前宣布了一项重大的战略调整。在其最新的东南亚语言大模型项目中,该机构已决定从美国Meta Platforms公司的开源模型,转向采用中国阿里巴巴集团的千问(英文名Qwen)开源架构。

30. DeepSeek开源IMO金牌模型,OpenAI和谷歌如何接招?

31. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型

32. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

33. Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西

34. 【小米罗福莉:OpenClaw 是 Agent 框架的颠覆性事件】小米集团 MiMo 负责人罗福莉在 2026 中关村论坛上表示,OpenClaw 是 Agent 框架层面“非常革命性、颠覆性的事件”,其开源特性有利于社区深度参与持续改进,并将国内开源模型的上限“显著拉高”。关键背景:小米“龙虾”Xiaomi MiMo Claw 已上线官网,支持文档生成、开发提效等功能。罗福莉认为,OpenClaw 框架设计领先,Claude 的近期更新也在向其靠拢。罗福莉的发言点明了一个关键趋势:开源 Agent 框架正成为国内模型能力跃升的“杠杆”,通过生态协同弥补单体模型与闭源巨头的差距,推动中国 AI 开源生态进入“框架驱动”新阶段。#OpenClaw #AI智能体 #小米AI #开源模型#

35. 一个视频带你快速盘点2025年GitHub热点项目

36. 阿里千问大模型又有新动作#阿里新一代模型Qwen3.5曝光#HuggingFace上Qwen3.5并入Transformers的PR已上线,新一代基座模型发布在即。更猛的是,开源阵容也很亮眼,至少包含2B密集模型+35B-A3B的MoE模型,这波技术开源的操作,格局直接打开!相信这次3.5版本的到来,又会掀起一波AI开发的新热潮了~

37. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格

38. 华为FlexAI才是真·算力革命,把GPU/NPU利用率从30%拉到70%,10%精细切分能实现一卡多用,更重要的是开源+兼容多芯片完全可以让中小企业不用堆硬件也能玩AI,华子在重构规则的路上从来不玩虚的#华为发布AI新技术##华为发布AI容器软件#

39. 相比美国,中国发展人工智能最大优势是:1.成本与开源生态——中国以“更低成本+开源模型”快速占领全球应用层市场。截至2025年10月,中国模型在HuggingFace累计下载量已超5.4亿次,美国多家短租、零售平台明确采用中国开源方案,理由是“速度更快、价格更低”。 2. 场景落地速度——中国庞大的制造、物流、城市场景为AI提供实时数据与试验田,形成“算法—场景—反馈”闭环,压缩从论文到产品的时间。 3. 政策与供应链韧性——出口管制倒逼国产GPU、框架和轻量化模型迭代,2024年斯坦福测试显示中美顶尖模型差距已从17.5%缩至0.3%,证明“限制反而加速创新”。 简言之,中国把AI做成了“高性价比、快速落地、逆境迭代”的系统性优势,而非单点技术领先。

40. CES2026 ,老黄谈开源模型:图1,开源模型大概落后顶尖模型6个月(从落后一年逐渐缩小,现在应该不到半年了),大概四分之一的token来自开源模型(OpenRouter)。图2,用 Kimi K2 Thinking 模型来展示新GPU架构的性能。看Kimi在老黄那还是蛮受宠的。

41. 国产模型开源封神,谷歌Genie3紧急开源?蚂蚁AGI撕开世界模型闭源防线

42. #马斯克第一时间狂夸千问开源模型#3月2日,阿里千问宣布开源4款 Qwen3.5 小尺寸模型系列:Qwen3.5-0.8B/2B/4B/9B。官方称,这一系列模型继承了 Qwen3.5 家族的强大基因,采用原生多模态训练、最新的模型架构,表现出卓越的性能,以满足从极端资源受限到高性能轻量级应用的不同需求。模型发布后,马斯克很快在X上点赞并评论道:“惊人的智能水平”。#千问开源模型被马斯科狂夸#

43. 坐稳开源大模型榜首,靠的什么?

44. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴

45. DeepSeek新模型爆火,硅谷玩疯了 #DeepSeek团队开源新模型 DeepSeek新模型爆火,硅谷玩疯了!把文字变成图像,让AI一目十行读完一本书!这次,它真的在教AI们,怎么省算力、怎么学会“遗忘” #AI #DeepSeek

46. #AI大模型上市第一股#2026年1月8日,智谱AI登陆港交所(股票代码2513),成为全球首家以AGI大模型为核心的上市公司,发行市值超511亿港元,摘得“AI大模型第一股”。公司源自清华KEG实验室,GLM架构适配国产芯片,模型GLM-4.7评测居全球开源前列。2024年收入3.1亿元,服务超1.2万企业客户,但尚未盈利。上市被视为中国AI从技术研发迈向资本验证的关键转折。

47. #阿里将开源千问Qwen3.5模型# 阿里这波操作太秀了!除夕夜不整春晚,直接整大模型开源。去年Qwen2.5-Max,今年Qwen3.5,这是要把代码当年夜饭送啊!技术创新+开源精神,给开发者们最好的新年礼物,这格局真的绝了!#千问Qwen3.5大模型发布#

48. 【阿里千问下载超 10 亿、衍生模型破 20 万,刷新全球开源模型新纪录】AI 开源社区数据显示,阿里千问衍生模型数突破 20 万个,成全球首个达成此目标的开源大模型。千问系列模型下载量突破 10 亿次,日均下载 110 万次,超越美国 Llama,居开源大模型全球第一。

49. #微博发布首个开源大模型#今天的微博真的有AI那味道了。因为微博AI团队开源了仅1.5B参数的VibeThinker模型。亮点一:超低训练成本,仅仅7800美元。(DeepSeek-R1的294万美元)亮点二:数学推理能力强,在AIME2024(80.3分)、AIME2025(74.4分)等基准测试中,超越DeepSeek-R1(671B参数)和Claude Opus 4。想到了一个词“小而美”,微博这可不就是小而美的小模型嘛!

50. 九坤投资至知研究院发布开源大语言模型,将给国内大模型开源生态带来哪些改变?

51. 12 个主流小型AI模型对比评测 本地部署的选择是Qwen3-4B?

52. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何

53. 源码被开源,Claude Code之父回应了:纯内部开发者手滑

54. "今天,孟晚舟在华为年报致辞中表示,生态的繁荣是产业发展的基础。#孟晚舟称生态繁荣是产业发展基础# 2026年,华为将持续做强根生态。在AI领域,昇腾CANN异构计算架构,Mind系列软件,MindSpore AI框架全面开源开放。CANN已经支持和适配业界主流的开源社区和开源项目,如PyTorch、vLLM、SGLang、xLLM、VeRL、Triton、TileLang等,匹配开发者习惯,加速自主创新,推动计算产业的生态繁荣。#孟晚舟华为2025年报致辞# "

55. 没想到今年除夕夜,阿里又整了一波“AI年货”,直接开源新一代千问大模型 Qwen3.5!这次架构上玩了混合注意力机制,还自带视觉理解能力,等于是文本、图片一锅端。开源的规格也够狠,至少 2B 参数的密集模型,外加 35B-A3B MoE 大模型,推理成本下降、效率提升,感觉就是冲着让更多开发者随手用、用得起来的。更有意思的是,Qwen3.5 的代码已经提交到 HuggingFace Transformers,随时可以拉下开干。阿里去年的 Qwen2.5-Max 就是除夕放大招,今年继续延续“春节爆款”策略,这波真的把全球 AI 开源圈的存在感拉满了。#千问Qwen3.5大模型发布#

56. #阿里新一代模型Qwen3.5曝光#大的要来了,昨天在全球最大AI开源社区HuggingFace的开源项目页面中,最新出现Qwen3.5并入Transformers的新PR。事实上,在本月初,就有业内人士爆料,近期将有包括 DeepSeek v4、Qwen3.5、GLM-5 在内的众多新模型登场。千问点外卖是应用层的出圈,而作为底部支撑的大模型,感觉也越来越强了,这是要多点开花了。

57. 开源大模型背后的架构

58. 开源大模型与闭源大模型的差距是在缩小还是在扩大?关键因素是什么?

59. 【#阿里Qwen负责人宣布离开##阿里Qwen管理层突发地震#】 阿里Qwen大模型负责人林俊旸深夜在社交平台发文,宣布离开Qwen团队,未透露去向与接任者,也未说明是否离开阿里,截至目前阿里官方与本人均未回应。内部人士透露,此事突发,暂无明确接替人选,其部分职能或被空降人员接管,暂无人能完全替代。 消息引发行业震动,多位AI研究者在朋友圈以表情致敬,并有“Qwen is nothing without its people”的声音出现,场面堪比当年Sam Altman离开OpenAI。林俊旸1993年生,年仅32岁,是阿里最年轻的P10级技术高管,作为通义千问开源大模型的核心推手,他在大模型领域影响力突出。此次人事变动,被视为阿里AI业务与千问团队的重要转折点。

60. 失衡的乌托邦:Meta的开源AI路线是如何遭遇滑铁卢的【硅谷101】

61. 盘点一周AI大事(1月11日)|最强人形机器人 OpenAI公布2026研发路线图 DeepSeek被爆2月发布DeepSeek V4 Google推出Veo3驱动的数字人Vids 字节开源换脸视频模型DreamID-V 阿里开源数字人框架HRM2Avatar Lightricks开源顶级视频模型LTX-2 ElevenLabs推出最强语音转录模型Scribe v2 斯坦福开源睡眠分析模型SleepFM 港大发布开源版NotebookLM DeepTutor Razer推出全息AI老婆Project AVA 波士顿动力推出下一代Atlas #抖音知识年终大赏 #前沿科技趋势发布月 #AI新星计划 #AI #机器人

62. #谷歌发布gemma4开源大模型#谷歌终于把最强开源大模型放出来了等了这么久Gemma 4总算来了,采用Apache 2.0的同时,针对不同的硬件环境发布了四种规模的模型。整体来说,Gemma 4这次所有规模的模型都原生支持处理视频和图像了,在OCR和图表理解方面表现得相当不错 #谷歌发布gemma4开源大模型##how i ai#

63. 对话云栖大会:下一个AI爆款、大模型进化与Agent万亿级企业市场

64. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

65. 盘点一周AI大事(3月15日)|首次上传大脑成功 工程师开源龙虾办公室Claw3D 龙虾彻底出圈,,百虾大战正式开打 工程师开源一键装龙虾AlphaClaw 斯坦福开源科学家龙虾LabClaw 工程师Karpathy 开源龙虾版GitHub AgentHub Chrome上线龙虾Web协议 WebMCP 工程师开源龙虾软件协议CLI-Anything 吴恩达开源龙虾上下文工具Context Hub 研究员开源最强动漫图像模型Anima-v2 研究员开源最强视频分割模型MatAnyone 2 科学家成功上传了一只果蝇的大脑 #AI新星计划 #AI #AIGC #龙虾 #openclaw

66. 2026 开源大模型全景图

67. GLM-5.1开源背后

68. 2026 年开源大模型 TOP10 完整榜单

69. 国产大模型集体开源,2026年AI彻底平民化

70. 鏖战2025年,大模型围着开源转

71. 开源大模型

72. 谷歌Gemma4开源大模型引爆AI生态 Apache2.0协议或改写行业格局

73. Meta突然不玩了,开源社区要靠中国模型了?

74. Meta开源路线动摇

75. AI开源模型的本质

76. 开发者实测,用了中国开源AI后,Llama突然不香了?

77. 再见Llama,你好闭源——Meta烧掉143亿美元后,终于亲手埋葬了开源信仰

78. 78%核心团队出走,Meta的AI乌托邦为何梦碎?

79. Kun开源LLM突然崩塌

80. 图灵奖得主 Yann LeCun

81. Google Gemma 4 突然开源

82. 2026年回头看

83. 千问之问

84. 从Qwen 3.6闭源看国内大模型的商业化困境与开源生态的未来

85. 开源终结?国产大模型跑步拥抱“闭源时代”

86. 复盘22亿次下载

87. 开源大模型商业化爆发!2026企业零成本用AI,定制化模型千元起

88. Google Gemma 4 重磅升级

89. Gemma 4改用Apache 2.0,开源模型商用更近一步

90. DeepSeek

91. OpenAI的技术迭代放缓的迹象

92. 智谱GLM-5.1成全球最强开源模型;Suno与环球音乐谈判陷僵局;日本放宽AI数据使用 | 方狗AI早报

93. Perplexity 最危险的地方,不是它没模型,而是它可能只剩“路由层”

94. Karpathy 开源了个社交平台,智谱开源 GLM-5.1,Intel加入马斯克Terafab,Perplexity月入暴涨

95. Anthropic开源OpenClaud

96. Anthropic正式封杀OpenClaw

97. 封杀OpenClaw,Anthropic一刀切,国产大模型嗅到机会

98. 中小企业用开源AI模型,研发成本降低80%是怎么实现的?

99. 京东公布五项AI进展 开源大模型JoyAI-LLM Flash 并推出“龙虾天团”

100. AI开源大模型合规

101. 从Grok开源到中国大模型反超,AI中美开始平分秋色

102. 大模型排名大洗牌!开源逆袭闭源,最可信选手出人意料

103. 国产大模型逆袭!这款开源模型把Claude踩在脚下

104. 开源大模型三国争霸:Google、微软、Meta混战!

105. 大模型时代的开源模式与治理机制变革

106. 年终盘点|大模型洗牌、分化、冲上市,无人再谈AI六小龙

107. 2026年AI大模型进入实用新纪元:国产崛起、开源逆袭与智能体爆发

108. Qwen-3.5:当混合专家架构遇上原生多模态,国产大模型站上新高度

109. 大模型下半场彻底变天!开源抢地盘,多模态开天眼,Agent赚真金

110. Gemma-4、GLM-5.1连发:企业怎么使用开源大模型?

111. 国产大模型吹响反攻号角:开源阵营全面碾压海外

112. 国产大模型硅谷“破圈”:爱彼迎弃ChatGPT选Qwen,Hugging Face下载量超Meta

113. Qwen3.5:3970 亿参数开源,「小身材」撬动大模型新格局

114. 开源大模型最新榜单:前十名中国造占八席,千问3.5登顶

115. Google 开源大模型 Gemma4 来了,IT 科技圈炸了

116. 开源模型性能比肩闭源巨头,企业如何低成本快速部署智能体应用?

117. Gemma4改用Apache2.0、千问3.6Plus迭代:2026年全球大模型开源战

118. 2026 年 AI 全景对比:国内外大模型 + 程序员工具终极选型指南

119. 7个基于OpenAI的顶级开源项目,AI编程生态正在裂变

120. 国产开源模型Kimi K2 Thinking上线美国知名AI搜索应用Perplexity

121. 2026年03月01日热门模型洞察

122. 2026年开源大模型爆发:性能追平GPT-5,成本低10倍

123. 9个最强大的本地开源LLM

124. Stability AI正式启动商业化转型:开源繁荣但盈利危机

125. Meta离职风波,小扎不愿“真金白银”,LeCun要终结LLM霸权?

126. 2026年3月国际国内开源大模型对比分析梳理

127. 它不生产模型,却掌握着巨头们的研发命脉。揭秘 Hugging Face不可撼动的“底座帝国”

128. 云端模型越强,为什么开发者反而转向本地部署?

129. Google Gemma 4开源评测:31B参数跑满单卡,这可能是2026年最强的开源大模型

130. 开源项目也会突然消失?Lunary 的 404 给开发者的警示

131. 2026年03月02日热门模型洞察

132. 9个最好的开源大模型(2026)

133. Perplexity即将上线Kimi K2推理模型!开源模型能力直逼顶级产品

134. 谷歌开源大模型Gemma 4官宣在即,参数量直接翻4倍,性能升级引全网高度关注

135. Hugging Face新动作:Claude模型即将登陆开源社区

136. 从"小学生"到"竞赛选手"!Google开源模型一夜封神 Google突然发布核弹级开源模型! 编程能力暴涨20倍,直接从"小学生"变成"竞赛选手" 数学能力从20%飙升到89% 而且,不是发布一个,是直接发布四个版本 从手机到服务器,全部覆盖 最轻量版只有1.5GB内存 你手里的iPhone,理论上都能运行 最关键的是:彻底开源,Apache 2.0协议 任何人免费商用,想怎么改就怎么改 Google史上,对开源社区最彻底的一次开放 2024年国产大模型爆发元年 2026年,Google带着杀手锏正式回归开源战场 #Google #Gemma4 #开源大模型 #AI #大模型

137. 【AI开源雷达】GitHub 最热 AI 项目:LangChain、RAGFlow 与 LLM 应用精选

138. 国产万亿参数多模态大模型开源:OpenClaw企业级最强拍档来了

139. 重磅!AI大模型开源竞赛突现“黑马玩家”

140. Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度

141. 对比 Gemini 3、MiniMax M2.5、GPT-5 和 GLM-5 这四款模型的本地部署配置要求与云端API的优缺点

142. 国产大模型MiniMax2.7即将开源 开启AI普惠新纪元

143. 何为“开源AI大模型”

144. 【AI开源雷达】Claude Code 重磅开源!Anthropic 命令行 AI 助手来了

145. 重磅!AI大模型开源生态现重大突破

146. 性能超DeepSeek-V3.2!国产大模型又开源了,限时免费用

147. 一人能顶一个公司,DeskClaw 团队版开源了!

148. 震惊!它改成阿帕奇开源协议了,不怕被云厂商“白嫖”吗?

149. 2025年,开源把大模型江湖搅得天翻地覆

150. 微软Phi-4-Vision-15B开源:小参数多模态模型,挑战行业大模型?

151. 数据安全下的AI突围:中小企业如何用开源模型打造核心竞争力

152. 微软开源 Phi‑4‑Reasoning‑Vision‑15B:可自主判断思考时机的轻量化多模态 AI

153. 给阿里千问一个“客观估计”——围绕QWen3的大模型横评

154. Mistral开源两大编程模型!大参数模型性能超Kimi、Qwen,小参数模型PC可跑

155. 98页|开源大模型法律风险及防范研究报告(2025)

156. 开源大模型法律风险及防范(2025)-99页(附下载)

157. 企业接入第三方开源模型合规自查清单(2026通用版)

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章