十万预算也能跑赢GPT-4?选对开源大模型架构比参数更重要

源自210位全网作者

04-01 08:38

内容由AI生成

精选参考来源

1. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC

2. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格

3. 最近,彭博社爆出来一个消息:Meta不仅打算放弃了开源,还在搞一个代号叫牛油果的新模型项目,这个项目蒸馏了好几家的开源模型,其中就包括阿里的千问大模型。作为曾经研究过技术研发的程序员,Meta选择蒸馏阿里千问、中国开源AI横扫硅谷,在我眼里就不是什么偶然逆袭。在开发者领域,中国开源模型的口碑一直强势。选开源模型从来不是只看榜单跑分,更看能不能落地、好不好用、省不省力,而阿里千问恰恰把这三点做到了极致,这也是它能让Meta、亚马逊等企业放弃硅谷同类模型的关键。这种技术话语权的转移,不仅让中国开源更有底气,更让全球开发者有了更多选择,不再被硅谷的技术标准绑架,能根据自己的需求选最适配的模型,这才是开源技术的本质,也是千问带给全球开发者最珍贵的价值。真正的技术强者,不仅要能做出高跑分的模型,更要懂开发者要什么、懂行业落地需求是什么,不仅要打破技术垄断,更要构建让全球开发者共赢的生态。

4. 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看

5. 大模型未来生态要想繁荣,一定是低消耗的,电能,水能,算力都要低消耗,海外模型含着金钥匙诞生的,没吃过苦。国产模型受限各种资源,从一开始就是主打一个低消耗,肯定将来是无敌的。加上全球从事AI的大部分是中国人,技术交流也非常方便,人员流动也是优势在我。最后就看落地场景,无论是工业场景,人的消费场景,都是中国市场更大,更蓬勃,中国解决方案更开放,美国的Gemini,GPT都是闭源,Meta的模型很可能未来也会闭源,就剩马斯克的Grok是开源,其实模型界开源是非常有学问的,我下一篇小作文就会写这个,开放的程度各有不同。。最终我认为,中国在大模型已经有领先的苗头了,努力吧,同志们。

6. 垄断、脱钩、闭源渐成主流?为什么鲲鹏选择全面开源?这背后藏着什么?

7. #微博发布首个开源大模型#微博居然悄悄憋出这么个大招,首个开源大模型VibeThinker-1.5B也太牛了,居然能在高难度数学测试里干过400倍参数量的DeepSeek-R1!以前吧,我就总觉得大模型是科技巨头的专属,堆参数、烧钱才是标配,没想到微博靠频谱到信号原理这种创新算法,直接走出了不一样的路~ 现在模型已经在Github、HuggingFace这些平台开源了,我觉得这对中小企业和高校研究团队真的太友好了,这下子终于不用担心被算力门槛劝退了

8. 中国正凭借开源生态与应用优势,在发展潜力上实现对美国的赶超。全球前十开源 AI 模型均源自中国,64% 的市场份额远超美国的 30%,中国已构建全球领先的开源生态。中国开源模型在可定制化、安全可控、部署灵活等五大维度形成显著优势,打破了美国闭源模型的技术垄断,80% 的美国 AI 创新企业已在使用中国开源模型。这种技术民主化趋势,让 AI 从奢侈品变为基础设施,彻底重构行业竞争逻辑。AI Agent 将成为拉开价值差距的核心力量,而中国正抢占这一赛道。中国的这类企业已将 15% 的 AI 预算投向 Agent 技术,实现 1.7 倍于行业平均的营收增长。中国庞大的制造业与服务业场景,为 AI Agent 提供了丰富的训练数据,形成数据飞轮效应。美国虽在顶尖闭源模型与算力芯片上仍有优势,但中国通过开源降维与硬件绑定的生态战略,在重塑竞争规则。中国掌控的硬件供应链与应用场景成为核心壁垒,是中国 AI 长期发展的底蕴。#科技先锋官##AI创造营##AI生活指南#

9. 海外明星公司被曝套壳中国开源模型,负责人出面致歉

10. 最近老有人问我中美AI到底谁更厉害? 但我觉得,这个问题本身就有问题,因为美国和中国在AI上走的,根本就不是一条路。#红衣聊AI #大有学问 #中美博弈 #开源

11. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型

12. 很多人问我:现在做AI创业,到底还有没有机会? 其实机会很大,但试错的空间正在被快速压缩。#大咖观察 #红衣聊AI #创业 #AI创业 #人工智能技术

13. 一个视频带你快速盘点2025年GitHub热点项目

14. 综合能力比肩GPT5,万亿参数思考模型Ring-1T来了!#AI #国产大模型 #蚂蚁百灵 #AIGC

15. 自动驾驶技术成熟后,会诞生哪些有意思的商业模式#自动驾驶 #Robotaxi #城市机器人 #无人驾驶

16. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

17. 盘点一周AI大事(1月11日)|最强人形机器人 OpenAI公布2026研发路线图 DeepSeek被爆2月发布DeepSeek V4 Google推出Veo3驱动的数字人Vids 字节开源换脸视频模型DreamID-V 阿里开源数字人框架HRM2Avatar Lightricks开源顶级视频模型LTX-2 ElevenLabs推出最强语音转录模型Scribe v2 斯坦福开源睡眠分析模型SleepFM 港大发布开源版NotebookLM DeepTutor Razer推出全息AI老婆Project AVA 波士顿动力推出下一代Atlas #抖音知识年终大赏 #前沿科技趋势发布月 #AI新星计划 #AI #机器人

18. 对话云栖大会:下一个AI爆款、大模型进化与Agent万亿级企业市场

19. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

20. 「Github一周热点94期」 开源AI渗透测试智能体、模块化智能镜子、开源AI Coding、多平台热点聚合、IPTV 频道集合和开源游戏合集

21. 探访云栖(二):AI Agent元年,谁在打造“数字员工”?【101 Weekly】

22. #黄仁勋新年第一场演讲提了DeepSeek#黄仁勋CES演讲中点名DeepSeek R1,并将Kimi K2、Qwen等中国开源模型纳入全球展示名单,标志着中国AI技术已跻身全球开源核心阵营。这不仅是对中国模型技术实力的认可,更印证了开源生态成为AI创新主旋律的行业趋势。DeepSeek R1以纯强化学习突破推理能力天花板,训练成本仅为行业平均的1/50,其开源实践大幅降低了AI应用门槛;Qwen的多语言优势、Kimi K2的低成本部署特性,形成差异化竞争力。这些模型性能逼近顶尖闭源产品,打破了海外技术垄断。中国开源力量的崛起,源于超150万开发者的生态积淀与企业持续技术攻坚。黄仁勋的认可,本质是对中国AI“开源普惠”理念的呼应。但需清醒看到,底层算力依赖仍是短板。未来,唯有持续夯实技术根基、完善商业化闭环,中国开源模型才能在全球AI工业化浪潮中真正掌握话语权。黄仁勋新年第一场演讲提了deepseek 川北小哥的微博视频

23. openclaw没思路?多场景分享+官方推荐的成本优化方案

24. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌

25. 我和欧洲“达里奥”做了一场对谈,如何用AI预测未来,用AI把工作效率提升10倍#AI #拉斯特维德 #超智能与未来 #AI预测未来#AI对普通人的影响

26. Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西

27. 拆解路子最野的AI出海生意,用开源AI快速跑通完整工作流

28. AI原生电商出现,Agent帮你从建站到运营

29. #小米发布机器人基座模型#小米此次开源的机器人具身智能模型,在多项行业基准测试中全面超越OpenVLA、Pi等同类模型,拿下当前最优成绩,称得上是现阶段机器人基座模型的能力天花板,稳稳站在行业第一梯队。而这并非偶然,此前小米刚推出实现毫米级精细操作的触觉模型,短短两周完成两大核心模型开源,一手夯实决策“大脑”,一手打磨操作“巧手”,完整搭建起机器人手脑协同的技术栈,每一步都紧扣“进厂干活”的落地目标,技术路径清晰且务实。 不止机器人领域,从Mimo-flash大模型交出亮眼成绩,到如今机器人技术持续突破,小米AI各技术板块正齐头并进、加速会师。更难得的是,小米始终坚持技术开源与成果透明,以严谨的科研论文和实打实的技术突破说话,不浮躁造势,只埋头攻坚。这种深耕技术的态度,不仅彰显了大厂的研发实力与行业格局,更以实际行动为国内机器人和AI行业的发展添砖加瓦,让行业看到了技术落地的更多可能。

30. #千问Qwen3.5大模型发布#千问 Qwen3.5 是采用极致稀疏 MoE 架构在保持超强性能的同时,显存占用降低 60%,推理效率大幅提升,部署成本显著下降。模型支持最高 256K 超长上下文,让长文本处理变的更加的轻松有效率了!原生多模态统一也是Qwen3.5的特点之一,也是目前国内外大模型的发展的主要趋势,模型在图文、视频理解能力全面升级,精准解析图表、文档与复杂视觉内容。实现了一个入口实现多种属性。Qwen3.5对于中小企业特别友好, 很大程度上降低了企业运营成本,可以让中小企业得到高效、普惠、全能的运营工具。不再因为高昂的费用而排斥企业去追逐AI。#过个有AI年##HOW I AI#

31. #小米新模型什么水平#开源模型竞争从“唯性能论”转向“场景价值论”,小米MiMo-V2-Flash以“高性能+低门槛”组合拳,稳居新赛道第一梯队。3090亿参数的MoE架构并非噱头,73.4%的SWE-bench编程通过率刷新开源纪录,直逼闭源顶尖水平。其核心优势直击行业痛点:150 tokens/秒推理速度、每百万token最低0.1美元成本,搭配256k长上下文窗口,让大模型从实验室走向实用。混合滑动窗口注意力与多Token预测技术,实现效率与性能的双赢,而MIT全量开源策略更降低了开发者使用门槛。深度思考与联网搜索双模式,适配编程、创作等多元场景,完美契合小米“人车家全生态”布局。在性能趋同的当下,MiMo-V2-Flash用架构创新重构性价比标杆,既证明中国开源模型与顶尖水平差距缩至数月,更以“好用不贵”的特质,成为场景落地的优选基座。#秒懂热点就用智搜# 小米新模型什么水平

32. 小米开始秀技术了小米开源首代机器人 VLA 大模型,刷新多项 SOTA!Xiaomi-Robotics-0,拥有 47 亿参数、兼具视觉语言理解与高性能实时执行能力的开源 VLA 模型。它不仅在三大主流的仿真测试中获得优异成绩,更在现实真机任务中实现了物理智能的泛化——动作连贯、反应灵敏,且能在消费级显卡上实现实时推理。仿真标杆: 在 LIBERO、CALVIN 和 SimplerEnv 测试中,模型在所有的 Benchmark、30种模型对比中,均取得了当前最优的结果。真实挑战: 我们在双臂机器人平台上部署了模型并与行业标杆进行了横向对比。在积木拆解和叠毛巾这种长周期、高度挑战的任务中,机器人展现出了极高的手眼协调性。无论是刚性的积木还是柔性的织物,都能处理得游刃有余。多模态能力:模型保留了 VLM 本身的多模态理解能力,尤其是在具身更相关的 benchmark 中表现优异,这是之前的 VLA 模型所不具备的。#汽场全开##小米# 小马甲不小的微博视频

33. 万亿赛道!AI生成视频零门槛变现

34. 小小的也很厉害?这个只有6B参数的开源图像模型把我看傻了

35. OpenClaw出事后开发者怒了,48小时造出省99%成本的AI技能共享系统-EvoMap

36. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴

37. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何

38. DeepSeek新模型爆火,硅谷玩疯了 #DeepSeek团队开源新模型 DeepSeek新模型爆火,硅谷玩疯了!把文字变成图像,让AI一目十行读完一本书!这次,它真的在教AI们,怎么省算力、怎么学会“遗忘” #AI #DeepSeek

39. Qwen3.5 开源王炸!多模态性能屠榜,本地部署 + OpenClaw 实战全流程!|零度解说

40. #微博发布首个开源大模型#微博开源VibeThinker - 1.5B堪称“整活”成功,打破了大模型依赖巨量参数的固有认知。其轻量化特性适配社交高频需求,15亿参数体量推理快,能快速响应评论互动、话题总结等即时需求,无明显延迟。低成本优势适配社交多元开发,不足8000美元的后训练成本,让中小团队也能基于它开发社交趣味插件、舆情分析工具。SSP训练法带来的强推理能力,可精准拆解社交复杂诉求,比如梳理热点脉络、生成适配不同风格的文案。且开源属性能汇聚开发者力量,定制化优化野奢分享、赛事讨论等各类社交场景功能,为社交AI应用提供高性价比新方案。#秒懂热点就用智搜# 分析:【#微博发布首个开源大模型#】微博AI开源 VibeThinker-1.5B:小模型也可以有大智慧目

41. #DeepSeek新模型有多猛# DeepSeek V3.1发布,6850亿参数量仅激活370亿,计算成本降90%。性能超GPT-4o,中文问答准度89.3%。岚图汽车、江苏银行已应用,未来将突破多模态,推理成本再降50%。#微博声浪计划##听见微博# 凯文思考的微博音频

42. #95后小伙手搓AI眼镜体验失明的一天# 最近刷到一条正能量视频,上海一位95后开发者为了帮助视障人士专门开发出一款辅助视障人群的AI眼镜。这款AI视障眼镜不仅可以通过语音交互辅助视障人士逛超市、旅游观光,还能通过语音交互引导视障人士安全出行,如辅助视障人群实时盲道、红绿灯、斑马线和障碍物等,整套硬件成本仅百元左右。在真实的街头测试中,他借助这款AI眼镜蒙眼成功独立穿越多个复杂路口,四街区通行只用了27分钟,虽说AI技术已经能帮助视障人群处理不少问题了,但在这位开发者看来,仅靠技术还是远远不够的,还需要全社会一起行动起来。据悉,这位开发者是依托魔搭社区和开源模型Qwen-Omni 开发的这款AI视障眼镜,这也凸显开源大模型在推动科技进步和社会发展是有重要意义的,希望未来越来越多的开发者基于开源大模型研发出更多推动人类文明的技术,让科技真正的造福人类,或许这就是科技向善的力量吧!#AI能帮视障群体做什么#

43. #DeepSeekv4要来了吗# 应该是普通用户最期待的一款专业模型了,因为现在国内不少的AI应用都是用的DeepSeek的模型,DeepSeek升级了对于用户来说也一种普惠的的升级,毕竟谁不想用更方便便捷的AI应用呢?DeepSeek V4根据目前的信息来看是一次底层架构创新,V4搭载mHC流形约束超连接与Engram条件记忆模块,实现“计算与记忆双稀疏”新范式,将GPU显存占用降低30%-50%,同时解决深层模型训练不稳定难题。DeepSeek这次升级从效率、性能与适配性完善了国产AI行业的生态,能够很好的推动国内AI应用模型-算力-应用的良性循环。#HOW I AI##过个有AI年#

44. aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍

45. 在 AI 模型研发上,美国赌的是其前沿模型(GPT-5.1,Gemini 3)将始终领先世界18-24个月。 而中国赌的是其开源,高性能和廉价的可用标准模型,能在全球范围内的普及和广泛应用以及出现在不停迭代模型的蓬勃生态。从 IT 行业的历史经验看,这两拨人是可以双赢的。或者准确点说,闭源是可能赢的,而无论闭源是否胜出,其实与此同时,开源,也都没有输过。 deepseek 和 阿里巴巴在这条道路的开辟上,居功至伟。

46. #阿里新一代模型Qwen3.5曝光# AI圈春节前再放大招,阿里通义千Qwen3.5即将登场,已HuggingFace提交PR并入Transformers,发布在即。全新混合注意力机制加持,长文本与推理效率全面升级;更支持原生VLM多模态视觉理解,看图理解能力一步到位。开源阵容同样亮眼:2B密集小模型+35B-A3B MoE大模型双路线覆盖,轻量部署与旗舰性能兼顾。从技术架构到生态布局持续领跑,国产开源大模型再迎重磅升级,期待正式上线!

47. #DeepSeekV4要发布了吗#传闻DeepSeek v4会是第一个在性能上不输闭源前沿模型的开源模型,有些能力甚至能反超。V4 如果真像传闻那样,那其他几家压力确实不小。不过国产大模型卷成这样,最后还是用户赚了。你们更看好谁?

48. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型

49. 你最想让智能体机器人先帮你搞定生活,还是提升工作效率? #大咖观察 #ai新星计划 #红衣聊AI #机器人

50. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

51. 2026企业级智能体白皮书|甲子光年智库

52. 在 AI 落地的实操场景中,垂直大模型凭借精准适配性,在技术迭代、实施成本与性能比上展现出显著优势,成为行业智能化的优选方案。垂直大模型聚焦特定领域,知识更新路径更清晰。其无需适配多元场景,可通过领域内动态反馈快速优化,迭代周期较通用大模型缩短 50% 以上。垂直大模型具备轻量高效特质。数据层面,无需大规模泛化数据,依托领域专属数据集即可训练,数据获取成本降低 60% 以上。垂直大模型实现精准覆盖。在细分场景中,小参数量专业模型性能反超通用大模型,#AI生活指南##AI创造营##一分钟视频创作季# 种斌Marco的微博视频

53. 全球AI开发者新宠!阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜

54. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#

55. 从能聊天的大模型,到会干活的智能体,AI正迎来全新进化。 企业AI落地的机会就藏在这里。#网络名人赞两会 #2026全国两会 #红衣聊AI #产业升级

56. 如果明天算力不再决定胜负,你觉得你手里的哪张牌能赢? #大咖观察 #红衣聊AI #ChatGPT #算力 #AI

57. 盘点一周AI大事(12月21日)|谷歌手撕OpenAI OpenAI 上线最强图像模型GPT Image 1.5 OpenAI发布最强编码模型GPT-5.2-Codex Google发布 Gemini 3 Flash Google开源A2UI协议 微软开源最强3D模型TRELLIS 2 阿里开源分层编辑图像模型Qwen-Image-Layered 阿里发布Veo 3平替Wan2.6 字节发布Veo 3平替Seedance 1.5 pro 腾讯开源首个实时交互世界模型WorldPlay 研究员开源照片重新对焦Genfocus Pipeline 研究员开源实时换脸视频模型PersonaLive Meta开源最强声音分割模型SAM Audio #抖音知识年终大赏 #AI新星计划 #OpenAI #AIGC #前沿科技趋势发布月

58. OpenClaw + Ollama 本地部署!无需 API,断网可用,多模型自由切换(GPT-OSS / Qwen 3 / GLM 4.7)

59. 以「更懂开发者」之名:2026全球开发者先锋大会,看Agent如何重塑生产力

60. 【张捷财经】美国的AI泡沫与中国的开源超越#热点观点# #张捷财经# #中国开源AI模型市场首超美国# 中美 AI 发展呈现鲜明路线差异,美国大模型路线陷泡沫争议,中国开源小模型则实现突破。据麻省理工学院与开源企业研究,中国开源 AI 模型下载份额达 17.1%,首超美国的 15.8%,DeepSeek、阿里千问占主导。中国因美国算力芯片限制,走 “农村包围城市” 之路,深耕本地化、专业化小模型,依托领先的 5G 等通讯技术,形成全民参与的开源生态,科大讯飞等模型表现突出。美国巨头如 OpenAI 坚持封闭策略控技术获利,但大模型成本高、适用场景少,成本难回收,引发泡沫焦虑。未来竞争或延伸至军事领域,但经济层面美国路线已显困境。 张捷观察-谁是谁非任评说的微博视频

61. 盘点一周AI大事(2月15日)|王炸视频模型 字节正式上线最强视频模型「Seedance 2.0」 字节发布最强开源视频模型「Alive」 工程师davidohyun开源龙虾女友「Clawra」爆火 Google升级最强推理模型「Gemini 3 Deep Think」 智谱发布最强开源大模型「GLM-5」 MiniMax发布最强开源编码模型「M2.5」 Google官宣AI互联网协议「WebMCP」 Claude上线Windows版「Cowork」 Google Stitch炸裂升级 千问发布最强开源图像模型「Qwen-Image-2.0」 研究员开源最强语音合成模型「MOSS-TTS」 研究员推出最强开源音乐模型「SoulX-Singer」 研究员开源最强配音模型「Just-Dub-It」 #AI新星计划 #抖音年味新知贺岁 #前沿科技趋势发布月 #AIGC #人工智能

62. 在这个开源「从夯到拉」榜单,我终于明白中国 AI 为什么能逆袭

63. Cursor 上线 Composer 2 不到 24 小时,就被开发者扒出了底裤。(以下内容 Claude 辅助生成)一个叫 Fynn 的开发者在调试 Cursor 的 API 时,发现返回的模型 ID 赫然写着:kimi-k2p5-rl-0317-s515-fast。翻译成人话:这就是月之暗面(Moonshot AI)的 Kimi K2.5,加了一层强化学习(RL)微调。Moonshot AI 预训练负责人 Yulun Du 随即在 X 上发帖确认,经测试 Composer 2 的 tokenizer 和 Kimi 的完全一致,并直接 @ 了 Cursor 联合创始人 Michael Truell,质问为什么不遵守许可证、也没有支付任何费用。另外两名 Moonshot 员工也发帖证实,不过三条帖子后来都被删除了。而 Cursor 在 3 月 19 日发布 Composer 2 时,只提到性能提升来自"对基座模型的持续预训练加强化学习",全程没有提到 Kimi K2.5。这两件事并不矛盾,持续预训练和 RL 本来就是在某个基座模型上做的,Cursor 只是没说基座是谁的。Cursor 回应:承认用了开源基座舆论发酵后,Cursor 开发者体验副总裁 Lee Robinson 在 X 上做出了官方回应。他承认 Composer 2 确实基于一个开源基座模型构建,但强调最终模型只有约四分之一的算力来自基座,其余都是 Cursor 自己的训练。他还表示 Cursor 正在通过推理合作伙伴的条款遵守许可证,并称未来会做完全自主的预训练。这个回应有几个值得注意的地方。第一,Lee Robinson 全程没有提"Kimi K2.5"这个名字,只说了"开源基座"。第二,"四分之一算力来自基座"这个说法很巧妙,把外界"拿了别人的模型换个壳"的指控转化成了一个算力比例问题。第三,"通过推理合作伙伴条款遵守许可证"这句话很模糊,并没有解释 Cursor 的界面上为什么看不到任何 Kimi K2.5 的标识,而这正是许可证条款明确要求的。这不是第一次了去年 10 月 Cursor 发布 Composer 1 时,多国开发者发现生成的代码中频繁出现中文。Alley Corp 合伙人 Kenneth Auchenberg 当时贴出截图,直言这是"铁证",认为 Composer 1 就是基于中国开源模型微调的。KR-Asia 和 36Kr 后来证实,Cursor 和 Windsurf 都在使用中国开源模型,其中 Windsurf 承认用的是智谱的 GLM。Cursor 从来没有公开披露 Composer 1 的底层模型,后来悄悄发了 Composer 1.5 就翻篇了。许可证才是核心问题Kimi K2.5 使用的是修改版 MIT 许可证,里面有一条专门为这种场景设计的条款:如果使用该模型(包括衍生作品)的商业产品月活超过 1 亿或月收入超过 2000 万美元,必须在产品界面上醒目展示"Kimi K2.5"字样。Cursor 今年 2 月的年化收入已经突破 20 亿美元,换算成月收入大约 1.67 亿美元,是许可证门槛的 8 倍多。但 Cursor 的界面上只写着"Composer 2",没有任何 Kimi 的标识。与此同时,Cursor 正在跟投资人谈一轮新融资,估值目标约 500 亿美元,相比去年 11 月的 293 亿美元估值几乎翻倍。而 Moonshot AI 上一轮估值据报道约 43 亿美元。一个估值是对方 12 倍的公司,拿了对方的模型包装成自研技术,用来支撑"前沿实验室"的叙事去融资。截至目前,Cursor 没有做出任何公开回应。这件事的后续走向,对整个开源 AI 生态有标杆意义。如果 Moonshot 不对一家年收入 20 亿美元的公司执行许可证,那以后所有开源模型的署名条款就成了摆设。每家 AI 实验室都会算同一笔账:为什么要开源自己的模型,让分发能力更强的公司去掉署名、包装成自研、然后以 12 倍于你的估值去融资?

64. 用科技行业的黑话说:LLM 的护城河,本质是智商(Intelligence)。“用过了就回不去”的效应非常明显。春节砸钱推广能短暂占据非早期采用者(Late Majority),但回报短暂(聪明的模型可以迅速转移用户),且ROI 可疑(低净值用户潜在回报无法抵消聪明的模型的推理成本,RLHF 价值也可疑)。要知道 Apps 根本不同的地方在于,因为 LLM 的推理成本,用户扩张的边际成本并不是 0 。这种推广的 LTV(用户生命周期价值)> CAC(获客成本)+ 长期推理成本的公式?大概率破产。这波推广本质上是大型互联网公司在 AI 时代的一次‘路径依赖’(Path Dependence)的症状发作。。。而 Apps 时代的 “流量入口逻辑”(Traffic Entry Logic)已经过时,超大规模云端模型的逻辑是 SOTA(State of the Art),能力强就是最大的流量入口。

65. #AI圈为何流行养龙虾了#AI圈养龙虾,不是真养水产,是玩OpenClaw开源AI智能体,图标是龙虾,部署调教像养宠物,所以叫养龙虾。 它能自动操作电脑、7×24干活、本地跑不泄露隐私,比只会聊天的AI实用太多。傅盛躺床14天养出AI团队,腾讯、小米纷纷降低门槛推一键部署,普通人也能玩。 本质是AI从“聊天工具”变“干活员工”,是效率革命。这波热潮不是跟风玩梗,是大家都想拥有免费、听话、能干的数字助手,谁先用上,谁先省力。

66. 让AI直接解决用户的问题,是创业者适应AI时代的必修课。 #大咖观察 #红衣聊AI #创业 #用户思维

67. 大模型更像人的大脑,智能体是大模型的手和脚。 #大咖观察 #红衣聊AI #智能体 #大模型

68. 「Github一周热点91期」deepseek OCR、量化交易工具、Notebook开源替代、Linux换源工具、Windows优化项目和API 客户端

69. 「Github一周热点105期」Rust 版openclaw,本地语音克隆工具,Qwen3.5, AI 渗透测试系统和精美源码图片生成工具

70. 提速10倍!Mac Mini 本地跑 AI 大模型,OpenClaw + oMLX 加速神器实测效果惊人! | 零度解说

71. #DeepSeek新模型为何被夸爆#DeepSeek新模型被广泛认可,核心在于其实现了性能与成本的双重突破。其V3模型凭借MLA架构、MoE架构和混合精度框架三大技术,在降低资源消耗的同时实现了性能跃升。训练成本仅为OpenAI同类模型的1%,却能在主流榜单跻身开源模型榜首,与顶级闭源模型性能相当。这种高效设计打破了大模型高成本的固有认知,让更多开发者能以低门槛获取强大AI能力。 文字变图像等多模态能力的实现,标志着AI从单一文本处理迈向多信息维度融合的新阶段,能更全面地理解和生成不同形态的内容。这种技术思路必然会被其他大模型借鉴,因为轻量化与多模态融合已成为行业趋势,前者解决资源瓶颈,后者拓展应用边界,二者结合能显著提升模型的实用价值,这也是AI技术落地的关键方向。#科技#

72. 最佳欧美脸Qwen模型:Jib Mix Qwen

73. #微博声浪计划##听见微博# 深圳龙岗“AI龙虾十条来了”,针对开源AI智能体OpenClaw及“一人公司”创业,从技术、数据、算力、OPC护航四方向破解痛点。提供免费部署、数据硬件补贴、算力支持等,还推动国产化替代平衡安全风险,拟打造全球智能体创业高地。 种斌Marco的微博音频

74. 为了AI创业,高中生勇闯华强北!

75. 「Github一周热点97期」开源AI手机、AI画架构图、AI编程的指导、看板工具、GO语言的游戏引擎和具身智能资料库

76. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen

77. 刚刚,OpenAI买下Python最强基建,准备垄断开发者「生产资料」

78. #千问Qwen3.5大模型发布#除夕夜,阿里再放大招,新一代千问大模型Qwen3.5今晚开源,实现模型架构创新。继去年除夕Qwen2.5-Max后,阿里再次选择在这个节点发布重磅技术,持续推动大模型技术开源共享,为AI生态注入新活力。

79. 把手教你用上开源版Claude Code,Windows系统接入保姆级教程!

80. 把AI从“精英玩具”变成“全民工具” 让全世界都能用上便宜的AI。#大咖观察 #红衣聊AI #开源

81. 「Github一周热点101期」IT咖啡馆的开源项目,cowork的开源替代大批出现

82. #阿里发布性能比肩英伟达H20的芯片#阿里推出的“真武810E”AI芯片,不仅性能强劲,还通过与云计算和大模型的结合,帮助企业降低了算力成本,直接把AI算力的门槛拉低。不用承担高额成本,也能用上顶尖算力,AI创业、转型都更轻松了

83. #2月DeepSeek还会发新模型吗#AI圈2月模型的发布和迭代处于一个高峰期!头部厂商扎堆上新大模型,DeepSeek的新模型动态目前其新模型已完成灰度测试,技术储备到位,大概率会在2月正式亮相。根据目前媒体的爆料来看,DeepSeek的新模型主要亮点应该在:1M Token超长上下文,可轻松处理完整长篇文档;Engram条件记忆架构,大幅降低推理成本;强化数学与代码能力三个方面。巩固开源领域优势,同时更新知识库,提升多模态文档理解能力。也是DeepSeek稳稳抓住关注的关键。因为“长上下文+低成本”的差异化优势,精准匹配法律、金融等专业场景,开源属性也贴合开发者与企业需求。#过个有AI年# #HOW I AI#

84. 【#阿里将开源千问Qwen3.5模型#】据新浪科技消息,阿里巴巴将于除夕夜开源新一代千问大模型Qwen3.5。该模型实现架构级创新,延续阿里除夕发布大模型的惯例,去年同期曾推出Qwen2.5-Max。AI赛道新春再添重磅变量。 #千问Qwen3.5大模型发布#

85. 2026 开源大模型全景图

86. 大模型不再藏着掖着,开源成主流,谁在闷声发财?

87. LLaMA 的开源革命

88. 2026年开源大模型爆发

89. 哈佛教授

90. 普通人创业别过于依赖AI?

91. 普通人如何借助AI创业?找对赛道、用对工具,零门槛也能分一杯羹

92. AI一人公司狂欢落幕

93. AI 降低了技术难度,创业的门槛是高了还是低了?

94. AI能降低创业门槛,但不能降低成功门槛

95. GenAI 时代的创业,需要的不是更强的"组织能力",而是更敏锐的"个人判断力"和"工具使用力"

96. AI创业真香?门槛是低了,但竞争更卷了!

97. AI全链路赋能

98. 2026深度拆解

99. 大模型围着开源转!DeepSeek引爆AI革命,闭源模式彻底出局!

100. 开源大模型,还能追上闭源模型吗?

101. 每个闭源模型都有平替

102. 开源模型击败闭源 斯坦福英伟达研发 重构AI科研逻辑

103. 开源VS闭源 I AI企业如何抉择+合规指南

104. 全球AI技术格局新动向

105. 国内AI大模型为何多开源,国外为何多闭源?

106. AI产品选择开源还是闭源模型

107. DeepSeek V3

108. 企业部署算力成本估算

109. 大模型十大高频问题之五

110. 开源社区一个 “又强又便宜” 的大模型选择—DeepSeek-V3.2

111. 开源模型优选

112. AI

113. AI让门槛更低,也让竞争更狠

114. 开源与闭源 AI 之争

115. 中小创业破局

116. AI或帮助更多人开启创业之路,但雇员规模或更少

117. 一人公司悄然兴起 AI技术降低创业门槛

118. 普通人可以选择的AI创业赛道有哪些?

119. 2026全球AI大模型竞争白热化:开源阵营与闭源巨头正面交锋

120. 中国大模型开源出海,流量暴涨却不赚钱,美国推理商反而赚麻了

121. 别再吹模型了

122. 开源模型的生存之道

123. 从大语言模型到世界模型 开源成必要选择

124. 开源模型再突破,全球AI行业的拐点要来了?

125. 开源破局AI落地

126. 开源与落地

127. 开源平台的商业悖论

128. 低代码平台开源!自动生成、数据大屏等多种功能,大幅提升开发效率,降低开发成本。完整开源

129. Llama3大模型原理代码精讲与部署微调评估实战

130. 运行本地 LLM 比您想象的更有用且更容易

131. 本地AI推理普及

132. 「人民想念DeepSeek」

133. DeepSeek V3.2硬刚GPT-5,推理成本狂砍70%,100万token才2块钱?

134. DeepSeek V3.2震撼发布!成本暴降60%碾压GPT-5

135. 1/50成本,8倍上下文

136. DeepSeek们崛起

137. 成本直降60%!DeepSeek V4引爆国产算力革命,中国AI终于打破“卡脖子”困局

138. 【深度】DeepSeek V4 正式发布

139. DeepSeekV3.2发布!实测惊艳,便宜优势

140. 又强大又便宜!DeepSeek V3.2又来了

141. GLM-4.7震撼发布!开源 MoE 大模型真的能在本地跑起来吗

142. 从零部署本地大模型|LMStudio傻瓜式上手+llama.cpp命令行教程,隐私离线双保障

143. 大模型本地部署踩坑实录——本地部署需要注意的几个问题

144. 源代码开源和大模型开源区别

145. 给AI初创团队一个残酷建议

146. Ai如何创业?

147. AI创业者的福音:0成本上云方案与DeepSeek-R1-0528

148. 3分钟搞懂开源大模型

149. 通义千问Qwen 3.5:国产开源大模型迈入效率新纪元

150. ChatGPT三岁生日之际,Deepseek反手一刀

151. 开源大模型?通俗回答(说人话)就是一文带你了解什么

152. 中国目前大语言模型领域主要是开源形式与美国竞争,但是随着后来国家逐步投入竞争,会不会出现直接在开源模型基础上应用,省去研发成本,直接弯道超车式发展?叠加低人力成本优势,可以很快占领市场?

153. 200刀的ChatGPT沦为昂贵矿泉水

154. DeepSeek V3.2 性价比之王!GPT-4 级别性能,价格只有 1/10

155. 2026年算力基建新格局:云厂商AI战略全面转向,创业者的黄金窗口期来了

156. 2025年,开源把大模型江湖搅得天翻地覆

157. 狠!DeepSeek两年估值1.05万亿 成本砍至GPT-4 1/70 硬刚全球AI大佬

158. 5 分钟搞懂开源大模型选型核心维度,16G显卡也能选对

159. 企业大模型私有化部署方案选型指南

160. Ollama × 魔搭社区:超简单的大模型本地部署方案

161. 开源模型霸榜Hugging Face!DMXAPI推22款免费大模型 API,qwen3.5-plus-free 零门槛体验顶级AI能力

162. 何为“开源AI大模型”

163. 开源➕国产算力!DeepSeek-V3.2在降成本

164. 开源大模型背后的架构

165. 反转!曾搞开源AI大模型的Meta竟然闭源了!如今开源第一是Qwen!

166. 开源大模型崛起:闭源模型还有优势吗?

167. 做大“超级个体”,要了解AI技术对轻资产创业的全方位赋能

168. 2026深度拆解:6个AI创业方向,总有一个适合你

169. 2026 年 AI 创业方向深度调研报告

170. Qwen2.5本地AI模型,解压后直接运行无压力,普通用户也能快速部署,无需担心隐私泄露

171. DMXAPI最新福利:22+款免费的大模型API,MiniMax-M2.7-free零成本畅用 - 哔哩哔哩

172. 600万美元训练出ChatGPT杀手?DeepSeek让快捷回复软件成本暴跌90%!

173. 大模型开源、闭源的区别、优缺点、如何选择

174. 创新工作室开课啦!第24弹 |开源和闭源:大模型世界的“安卓”和“iOS”

175. DeepSeek V3.5 深度评测

176. AI赋能下一人公司崛起,政协委员建言打造专属创新创业生态

177. 大模型私有化部署全指南:方式、硬件配置与Ollama实操

178. 创业者应如何利用AI工具降低成本

179. 1.6万本地部署Qwen大模型!2026实测稳跑,新手照着装就成

180. 普通人AI创业黄金窗口:2026三大风口与避坑指南

181. 严一-亚马逊云科技高级解决方案架构师-基于Python的开源大模型云原生MLOps部署实践

182. 初创公司缺法务、缺设计、缺运营,如何靠AI提高工作效率?

183. 字节炸场开源!47k的AI研究框架,让大模型真正会“深度思考”

184. 2025年主流AI模型能力与使用建议

185. Lemony开源动态路由工具可削减85%AI成本

186. DeepSeek-V3.2系列模型发布:开源大模型技术与产业应用新突破

187. 创业者如何借助AI增加存活率?

188. 2026年本地部署大模型对决:Llama 4 vs Qwen3.5 谁更强?

189. 开源模型性能比肩闭源巨头,企业如何低成本快速部署智能体应用?

190. DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro

191. AI 正降低创业门槛,15 岁高中生独立创办科技公司

192. 本地部署大模型方法,新手不二选择

193. 大模型部署太难?用对方法,DataEyes聚合平台10分钟就能搞定!

194. 原来AI大模型开发只需要学这些

195. 国内AI大模型已168个,哪个最有前途?

196. 在初创期,如何平衡AI工具的订阅成本和人工成本?

197. 企业如何建立自己的大模型:一套可复制的“端到端”保姆级指南

198. AI:小公司诞生的催化剂?

199. 鏖战2025年,大模型围着开源转

200. Llama3大模型原理代码精讲与部署微调评估实战 - 哔哩哔哩

201. 完整讨论:阿里巴巴集团董事会主席蔡崇信关于人工智能经济学、开源、权力和利润的辩论

202. Vibe Coding“血洗”开源,社区吵翻了:封杀菜鸡 AI 开发者?不如给维护者打钱!

203. 京东首次开源大模型,同样任务Token消耗大幅降低

204. 大模型选型决策全流程:从需求分析到生产上线的六步法

205. 极客-LLaMA3前沿模型实战课

206. 创业初创期财商(1-2 年):衔接职场,资金与成本把控 + AI 智能运营

207. 别不好意思问!大模型开源是什么意思?

208. 开源模型屠榜闭源巨头?GLM 4.7实测性能爆炸 开源模型首次在核心能力上实现对闭源巨头的全面反超?GLM 4.7的实测表现给出了肯定答案。凭借创新的思维链技术,它在代码与推理任务中不仅匹敌甚至超越了Claude 4.5与GPT-5。其在前端开发领域能自主产出高质量项目代码,证明了强大的工程实用性。加之极低的成本与开放免费使用,这款模型无疑给整个AI开发领域带来了新的选择与冲击。#热门小助手 #知识前沿派对 #人工智能技术 #aigc #AI技术前沿

209. 2025轻资产创业风口:AI加持,普通人也能快速入局实体相关赛道

210. 2026年最详细Llama3教程,手把手教你从原理到代码实战,零基础全套教程,带你少走99%的弯路

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章