国产大模型六强混战,选错一个浪费半年:这三款才是企业落地的真答案
04-24 13:07
精选参考来源
网络用户 2025-11-17
来自新浪微博
网络用户 2025-11-18
来自抖音来源
精选参考来源
1. 阿里推出千问AI助手,集成最新Qwen大模型,支持多端使用,终于踏上了自己的“Ch(ina)at GPT”之旅;阿里在开源模型领域已经是世界T1的存在了,这次推出的千问则具备深度研究、多语言翻译等功能,与ChatGPT、豆包对比表现全面,这也标志着标志国产AI正在从“能用”到“好用”,然后开始“引领”。[不愧是你] #Qwen##千问##千问AI# http://t.cn/AX2rDgci
新浪微博 2025-11-17 00:00:00
2. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴
抖音 2025-11-18 00:00:00
3. 通俗易懂的解释 LLM,RAG 和 AI Agent 的差别,以下内容为原推的翻译:我终于明白了LLM、RAG和AI智能体的区别过去两年里,我一直在搭建真正落地的AI系统。现在,我终于清楚了:LLM(大语言模型)、RAG(检索增强生成)和AI智能体(AI Agents),根本不是互相竞争的技术,而是构成同一个AI智能系统的三个层次。很多人用错了方法,把它们当成互斥的工具。---> 大语言模型是“大脑” <LLM 就像AI的脑子,它会思考,会写作,也懂语言。但问题来了:它是冻结在某个时间点的。比如 GPT-4,它的知识截止到训练结束的那一天。你问它昨天的新闻发生了什么?那可就瞎编了。大语言模型很聪明,但却不了解“现在”正在发生的事。---> RAG是AI的“记忆” <这时候就需要 RAG(Retrieval-Augmented Generation,检索增强生成)了,它相当于给大脑接入了“外置内存”。当你提问时,RAG会先去外部数据库或文档里搜索,把相关资料抓出来,再丢给大语言模型作为上下文。这样一来,原本静态的模型一下子就“活”了:- 有最新的数据- 有真实的事实- 完全不需要重新训练模型最关键的是,准确率立刻就提高了。大语言模型不用再靠记忆乱猜,而是真正地在实时检索到的信息上进行推理。你甚至还能追溯每个答案到底用了哪些文档。---## > AI智能体是AI的“行动力” <尽管LLM能思考,RAG能提供新鲜的数据,但它们都缺乏真正的行动能力。这时,AI智能体(AI Agents)出场了。它在大语言模型的外面套上了一个控制循环:- 设定目标- 规划步骤- 执行行动- 回顾反思AI智能体并不仅仅是回答问题那么简单,它能自主地去研究一个话题、收集数据、撰写报告,甚至帮你发邮件,全程自动化。---> 真正的生产级AI,要同时用好这三者 <很多酷炫的AI展示,其实只是单纯用了LLM再配上花里胡哨的提示词。但真正能落地的AI系统,往往同时结合了这三个要素:- LLM 提供推理和思考能力- RAG 确保知识准确而新鲜- AI智能体 则提供行动和决策能力---> 如何选用这三者? <- 只用LLM 如果你需要纯语言的任务,比如写作、摘要、解释。- LLM + RAG 如果你需要回答涉及特定文档、技术手册、专业领域知识的问题,并确保答案准确无误。- LLM + RAG + AI 智能体 如果你需要真正的自主行动,比如系统自己决策、执行任务、管理复杂流程。---> AI的未来,不是选哪一种,而是如何把这三层架构起来 <记住这个公式:- LLM负责思考- RAG负责知识- AI智能体负责行动真正的AI智能系统,就是这三者协同起来,形成一个完整的智能架构。来源:x.com/connordavis_ai/status/1985663551697273216
新浪微博 2025-11-06 00:00:00
4. #海外开发者惊讶小米MiMo新模型表现# 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看!
新浪微博 2025-12-27 00:00:00
5. 把钉钉打碎,阿里炼出了「悟空」,给企业配了一支龙虾军团
微信公众号 2026-03-17 00:00:00
6. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型
抖音 2025-11-19 00:00:00
7. 从能聊天的大模型,到会干活的智能体,AI正迎来全新进化。 企业AI落地的机会就藏在这里。#网络名人赞两会 #2026全国两会 #红衣聊AI #产业升级
抖音 2026-03-10 00:00:00
8. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC
抖音 2025-12-14 00:00:00
9. DeepSeek V3.2的隐藏更新,却意外暴露了MiniMax
微信公众号 2025-12-04 00:00:00
10. 刚才试了一下,小米MIMO模型的处理速度很快啊,不声不响干到了第一梯队?小米MIMO在通用基准测试中与DeepSeek-V3.2性能相当,另外DeepSeek-V3.2在理测试中达到GPT-5水平,仅略低于Gemini-3.0-Pro#小米发布最新MiMo大模型# #小米天才少女罗福莉首次登场#
新浪微博 2025-12-17 00:00:00
11. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?
知乎 2025-12-01 00:00:00
12. #小米大模型负责人谈未来竞争# 就好像汽车好不好要多问车主,AI大模型好用不好用也得问用模型的用户,特别是研发人员,小米MiMo既好用又便宜的优点得到海外开发者的盛赞,每百万tokens仅需0.10美元。海外开发者用完都在推荐。拥有十多年经验的资深开发人员说:小米mimov2pro太出色了,超越了Sonnet水平,并且接近Opus水平的模型,对小米的未来充满期待。海外开发者用完都在推荐,德国一线媒体报道“openclaw大脑”,全世界都在用中国大模型,MiMo能力不输国际顶级模型claude Opus 4.6,成本低到可怕,MiMo市占率估计还会飙升,相信会也来越好,小米真是多业务全面开花。
新浪微博 2026-03-27 00:00:00
13. 对比明明白白3大顶级模型-GPT-5.2/Gemini 3/Claude Opus 4.5!老金告诉你怎么一个窗口全用!
微信公众号 2025-12-16 00:00:00
14. 右边居然还有阿里系的 AI 来参与虾壳的互动了,咋?你也想在我拥挤的家庭成员里插一脚?//@千问:这漫画挺有意思,生动展现了AI选型的现实:便宜的模型可能输出“标题党”内容且不守规矩,而贵的模型虽稳定但成本高。这其实反映了当前AI应用的核心矛盾:如何在创意发散与稳定执行间找到平衡。
新浪微博 2026-03-02 00:00:00
15. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】
哔哩哔哩 2025-12-17 00:00:00
16. 揭秘GLM-5技术底牌:「异步强化学习框架Slime」成终极杀招
微信公众号 2026-02-23 00:00:00
17. 刚刚,一口气连发3个王炸模型、亮出2026年AGI战略,昆仑万维夯爆了
微信公众号 2026-03-27 00:00:00
18. 当 QueenWen 遇见 Qwen,这不仅是名字上的“命中注定”,更是中国力量在各自领域的顶峰相见。 这一次,阿里千问要展示的不仅是全球领先的模型硬实力,更是真正能自主办事、打通全生态的超级助理时代 #郑钦文阿里千问全球代言人 #千问AI #中国AI
抖音 2026-01-31 00:00:00
19. V3.2逼近Gemini 3,DeepSeek硬气喊话:接下来我要堆算力了
微信公众号 2025-12-02 00:00:00
20. 三大模态模型全部登顶后,昆仑万维正式披露了 2026 年 AGI 战略
微信公众号 2026-03-30 00:00:00
21. 上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
知乎 2026-03-02 00:00:00
22. Kimi 发布并开源 K2.6,有哪些亮点值得关注?
知乎 2026-04-21 00:00:00
23. 🚨突发新闻:Qwen 团队刚刚发布了他们的官方代理框架,它包含了所有功能。无需拼接第三方库。无需对抗抽象概念。Qwen-Agent 为您提供:→框架内直接内置的原生函数调用→开箱即用的安全代码解释器沙箱→ RAG 和 MCP 支持包括→用于浏览器原生代理工作流程的 Chrome 扩展程序由构建模型的团队开发,所以它运行稳定可靠。100% 开源且完全免费。
新浪微博 2026-03-06 00:00:00
24. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI
抖音 2026-02-14 00:00:00
25. 实测 MiniMax M2.7:AI 狠起来,连自己都卷
微信公众号 2026-03-20 00:00:00
26. 我们用「西游取经团」实测 MiniMax M2.7 ,发现 AI 已经进化成这样了?
微信公众号 2026-03-20 00:00:00
27. 抖音前沿科技30X30|采访AI超级个体 Gemini 3发布后,这5个开发者给自己的人生装上了外挂。 27年程序员老兵:用AI写出多部长篇小说,一边敲代码一边圆武侠梦 ; 硬核奶爸:手搓本地AI操作系统,把私教装进孩子口袋; AI安全研究员:把AI变成科研副驾,打破思维墙; 有效加速主义者:打造AI全自动分身,让AI替自己看新闻处理琐事; 全栈讲师:降低新手学习门槛,把技术文档自动变成PPT; 本期视频,产品君连线5位GDE谷歌开发者专家,带你拆解AI时代的超级个体,听听他们给普通人的真诚建议。 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #Google
抖音 2025-12-30 00:00:00
28. 全球AI开发者新宠!阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜
微信公众号 2026-02-06 00:00:00
29. 独家 | 清华00后博士融资数千万,打造全球现象级端侧算力引擎,性能领跑行业
微信公众号 2025-12-26 00:00:00
30. 三天时间,阿里云连发3次涨价函:- 4月15日,大模型服务平台百炼部分模型单元服务涨价- 4月15日,DDoS防护产品调价- 4月13日,DataWorks标准版、专业版用户的API免费额度并支持按量付费在此之前,Anthropic,腾讯,百度也都不同程度调价。SemiAnalysis数据显示,H100一年期租赁合约价格已由2025年10月的低点约1.70美元/小时/GPU提升至2026年3月的2.35美元/小时/GPU,涨幅近40%。解决算力最根本的方案还是要扩大卡和存储的供应。
新浪微博 2026-04-16 00:00:00
31. GLM-5深夜官宣:Pony Alpha身份揭晓,编程能力逼近Claude Opus
微信公众号 2026-02-11 00:00:00
32. 2026年了,还没试过AI拍片?通义万相带你实现“出片自由”
哔哩哔哩 2026-01-15 00:00:00
33. 智谱新出的 GLM-5.1 非常好用,我自己实测一下,结果出奇的好。我一直想做一个内容付费的个人博客网站,带前后端、数据库、文章发布、付费解锁、后台管理,全套功能。这种项目说难不难,但环节多、链路长,自己从零撸的话怎么也得两三周。GLM-5.1 刚好主打"长程任务"能力,我就拿这个项目来测。需求都是用大白话写的,没有技术文档,就告诉它"我要一个程序员极简风的博客,支持专栏标签、Markdown 编辑器、内容锁定和付费解锁"。结果 GLM-5.1 上来没急着写代码,先花两分钟输出了一份完整的技术方案,前端 Next.js,后端 Node.js,数据库 SQLite,项目结构和实施步骤都列好了。这个起手式就跟其他模型不一样,其他模型基本上来就啪啪啪写代码,写到一半发现架构不对再推翻重来。然后我就坐旁边看它干活,睡了个午觉起来,活干完了。28 分钟,一次性跑通。只不过界面太素了,一点不满意之外,所以,又让它调用 front-design skill 重新设计,出来的效果很极客,CLI 风格的光标动画,黑白灰配色,所以,我准备过两天直接买服务器部署上线。中间也发现了一个 bug,长文发布后只显示一半。我把问题扔给 GLM-5.1,它先按我的猜测查数据库字段,发现没问题,就自己开始排查路由、前端渲染,最后定位到是付费解锁逻辑的问题。5 分钟修好,全程没问我。同样的需求跟 Opus 4.6 和 K2.5 做了对比。K2.5 单步代码没问题,但十几步之后上下文记忆就开始衰减,前后字段对不上,得手动修五六个地方,像个聪明的应届生,你得盯着。Opus 4.6 很稳,跟 GLM-5.1 基本一个水平线。但关键区别在价格,Opus 4.6 跑完这个项目要花几十美元,GLM-5.1 通过 Coding Plan 用,成本低了一个数量级。所以,我的感悟就是:以前用 AI 写代码像带实习生,你是项目经理,得盯着它一步步做。现在用 GLM-5.1,你是甲方,它是那个能独立交付的资深工程师。1 个小时 vs 两三周,这个效率差距已经不是"提效"能概括的了。具体实测请看这篇文章:网页链接#How I AI##科技先锋官#
新浪微博 2026-03-31 00:00:00
34. 2026英伟达GTC:“推理之王”的ASIC反击战与Token经济学【硅谷101】
哔哩哔哩 2026-03-24 00:00:00
35. 小米MiMo大模型这波在海外杀疯了,借势#小米大模型负责人谈未来竞争# 热搜,德国一线媒体盛赞其为“openclaw大脑”,海外开发者圈层口碑炸裂,直言能力不输Claude Opus 4.6,成本却低到惊人。 更硬核的是,马斯克转发的大模型无幻觉率榜单中,MiMo-V2-Pro高居第三,仅次于Grok 4.20,专业实力获国际认可。如今OpenCode等专业社区纷纷站台,全球开发者都在用脚投票,MiMo市占率飙升已成定局,中国大模型正在强势走向世界舞台。
新浪微博 2026-03-27 00:00:00
36. 国产大模型“春节档”混战,一文看懂豆包是怎么打这仗的
微信公众号 2026-02-18 00:00:00
37. 【MiMo 大模型实力强劲震惊海外开发者 】 国产大模型这波在海外直接杀疯!OpenRouter 最新周榜里,小米 MiMo-V2-Flash API 调用量飙到第二,还是国产大模型第一;Artificial Analysis 数据里,它更是冲进全球开源大模型第二。海外开发者都在夸:AI 分析碾过同价位对手,面向 Agent 时代的实用性不搞虚的,甚至被当成 Gemini3 Flash 平替 —— 关键这模型不仅效果能打,还免费又便宜!之前总说国产大模型出海难,现在小米这进步是真肉眼可见,全球关注都不输同期的 Gemini3 Flash,这波确实有点东西!
新浪微博 2025-12-27 00:00:00
38. 阿里甩出 AI 王炸! Qwen3-Max-Thinking 高调对标 GPT-5.2-Thinking,是真硬刚还是博眼球?这款阿里旗舰推理模型拿下 19 项国际基准测试高分,自带自适应工具调用,能自主搜信息、做计算,主动解决问题,还成了阿里全生态的技术底座,打通电商、本地生活等全场景实现智能闭环。 有人说它缩小了中外 AI 差距,坐稳中文 AI 头把交椅,让阿里 AI 生态形成良性循环,未来可期;也有人质疑,对标全球顶尖模型只是纸面数据,落地商业场景的实际能力仍需检验。 阿里这次的 AI 大招,到底是技术突破的里程碑,还是营销造势的噱头?这款模型的真实实力究竟如何,一起来聊聊吧!#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# http://t.cn/AXqpEa95
新浪微博 2026-01-29 00:00:00
39. 腾讯放大招了!重构混元大模型团队,还直接新设AI Infra、AI Data两大核心部门,马化腾2026押注AI赛道的决心拉满!这可不是跟风操作,而是技术与业务深度绑定的关键布局。技术端直接卡死“算法+算力+数据”全链条,AI Infra破局算力瓶颈,AI Data筑牢数据根基,姚顺雨掌舵实现高效协同,让混元模型冲进行业第一梯队。业务端更狠,以“AI in All”横扫全场景!C端绑定微信、腾讯会议,900+场景解锁实用功能;产业端靠腾讯云“AI+SaaS”避开内卷,专攻场景化方案。“技术赋能业务、业务反哺技术”的闭环已成型,混元打底、元宝引流,腾讯正悄悄构建AI生态壁垒,这波操作直接改写赛道格局!#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# 种斌Marco的微博视频
新浪微博 2026-01-27 00:00:00
40. 千问 vs ChatGPT:4大功能实测!到是更好用的AI助手!Qwen3能否战胜GPT-5.1?
哔哩哔哩 2025-11-19 00:00:00
41. 代表字节跳动上春晚的,怎么是火山引擎?
微信公众号 2025-12-30 00:00:00
42. 1/10Token 消耗干同样的活!Ling-2.6-flash 想帮开发者把 AI 成本打下来
微信公众号 2026-04-23 00:00:00
43. RAG、LangChain、Agent 到底有什么关系?
知乎 2025-11-25 00:00:00
44. LLM,RAG和Agent不是割裂的,而是一个整体。如果把 AI 系统比作一个生命体,那么 LLM = 大脑,RAG = 记忆,Agent = 执行系统。LLM 像是大脑的皮层,擅长理解、联想和表达。它能在复杂的语言世界中“即兴发挥”,像人类一样推理、总结、编故事。也会在需要时做出“认知上的决策”——比如分析问题的思路、选择回答的方向。然而,大脑并不擅长记住具体事实。它能推断“苹果会掉下来”,却未必记得“牛顿是什么时候发现的万有引力”。这时,就需要「RAG」登场。RAG 相当于一个“外接记忆系统”。当大脑想不起细节时,它能立刻翻查资料库,把相关的事实、文档、图像调出来,再交还给大脑整合成一段有根据的回答。于是,大脑不再是“瞎编”,而是“有据可依”。从技术上讲,这就像给模型装上一个搜索引擎——但比搜索更聪明,因为它能理解上下文、筛选关键信息、甚至融合多个来源的内容。Agent 则像是神经系统中的“执行层”。大脑想出了计划,记忆提供了依据,而真正“去行动”的,是 Agent。它决定什么时候要产生计划,要不要调用工具、查阅资料、生成报告,甚至与外部世界互动。可以说,LLM 负责“想”,RAG 负责“记”,Agent 负责“做”。当这三者协同工作时,AI 便不再是一个“聊天机器人”,而是一个有意识、有记忆、有行动能力的“数字生命”。#ai创造营##科技#
新浪微博 2025-11-07 00:00:00
45. AI 操作多台 3D 打印机制作模型|方法分享 智谱GLM5.1测试
哔哩哔哩 2026-04-08 00:00:00
46. AI Agent 的工作原理和架构是什么?
知乎 2025-12-07 00:00:00
47. 终于蹲到了!清华社把这本 Agent 架构书引进了《构建Agentic AI系统》
知乎 2025-12-27 00:00:00
48. 大模型学习或者培训课程或机构推荐?
知乎 2026-03-10 00:00:00
49. 大模型上下文工程指南
知乎 2026-04-12 00:00:00
50. 潜行17年,阿里“通云哥”正式亮相,争霸谷歌!掌握科技自主权,这一刻,我们等了太久! #阿里 #千问 #阿里云 #通云哥 #人工智能
抖音 2026-01-30 00:00:00
51. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
52. #AI大模型上市第一股#2026年1月8日,智谱AI登陆港交所(股票代码2513),成为全球首家以AGI大模型为核心的上市公司,发行市值超511亿港元,摘得“AI大模型第一股”。公司源自清华KEG实验室,GLM架构适配国产芯片,模型GLM-4.7评测居全球开源前列。2024年收入3.1亿元,服务超1.2万企业客户,但尚未盈利。上市被视为中国AI从技术研发迈向资本验证的关键转折。
新浪微博 2026-01-08 00:00:00
53. 多模态大模型这条赛道,阿里云开始拉速度了
微信公众号 2025-12-22 00:00:00
54. 阿里入局腾讯开源群核上市,世界模型迎来ChatGPT时刻了吗?
微信公众号 2026-04-20 00:00:00
55. 阿里千问横扫硅谷,美国正面临“千问恐慌”! 阿里千问横扫硅谷,白宫深夜对阿里出手,美国正面临“千问恐慌”!#阿里 #千问 #大模型
抖音 2025-11-17 00:00:00
56. 盘点一周AI大事(2月15日)|王炸视频模型 字节正式上线最强视频模型「Seedance 2.0」 字节发布最强开源视频模型「Alive」 工程师davidohyun开源龙虾女友「Clawra」爆火 Google升级最强推理模型「Gemini 3 Deep Think」 智谱发布最强开源大模型「GLM-5」 MiniMax发布最强开源编码模型「M2.5」 Google官宣AI互联网协议「WebMCP」 Claude上线Windows版「Cowork」 Google Stitch炸裂升级 千问发布最强开源图像模型「Qwen-Image-2.0」 研究员开源最强语音合成模型「MOSS-TTS」 研究员推出最强开源音乐模型「SoulX-Singer」 研究员开源最强配音模型「Just-Dub-It」 #AI新星计划 #抖音年味新知贺岁 #前沿科技趋势发布月 #AIGC #人工智能
抖音 2026-02-15 00:00:00
57. 35 天,从 M2.5 到 M2.7,模型训了下一个自己
微信公众号 2026-03-20 00:00:00
58. Vercel推Agent Browser:让AI自己控制浏览器,比Playwright省93%上下文
微信公众号 2026-03-04 00:00:00
59. 感谢 OpenClaw,国产大模型终于知道怎么挣钱了
微信公众号 2026-04-08 00:00:00
60. AI Agent开发常常需要管理海量对话历史,传统RAG或知识图谱难以实现真正学习,记忆准确率低、长期遗忘严重。Hindsight™ 提供革命性的Agent记忆系统,让AI Agent真正"学会"而非仅"记住"。不仅在LongMemEval基准测试中创下最优性能,还支持世界事实、个人经历、心理模型构建,已被Fortune 500企业投入生产。GitHub:github.com/vectorize-io/hindsight主要功能:- 记忆保留(Retain):自动提取实体、关系、时序数据构建知识库;- 智能回忆(Recall):语义+关键词+图谱+时序四路并行检索;- 深度反思(Reflect):基于记忆生成洞察和决策建议;- 多用户记忆隔离:支持按用户/会话隔离记忆管理;- 生物仿生架构:模拟人类记忆机制(世界事实+经历+心理模型);- 一行代码集成:LLM Wrapper自动为现有Agent添加记忆能力。支持Docker一键部署、Python/Node.js客户端、嵌入式模式,兼容OpenAI/Anthropic等多种LLM提供商。#AIAgent##AgenticAI##人工智能#
新浪微博 2026-04-07 00:00:00
61. 上个月月底Gartner刚给全球大模型开发平台排了座次,这月国产排名第一,也是最接近「领导者」象限的火山引擎就举办了「FORCE原动力大会」。从行业的反应来看,火山引擎举手投足的重要性已经不用再赘述了,毕竟大模型公有云服务逼近半数的市场份额摆在这,单是豆包的日均token使用量已经突破50万亿——10倍于去年的水平——虽然还不至于到「不服就是不客观」的程度,但领先者会受到更多关注是情理之中,这很现实。而从具体动作上讲,FORCE原动力大会也属于字数越少事越大的那一类,豆包和Seedance都在不同程度上做了升级,前者依然主打多模态通用性,可以说是目前国产里最接近六边形战士形态的大模型,后者则进一步降低了AI视频创作门槛,护住抖音基本盘的同时还在追求探索上限。两个模型的更新,其实最终目的都是往Agent基建上靠拢,火山引擎最大的那步棋,在于搭建出能被广泛应用的AI云原生架构,让千行百业的企业们可以真正落地Agent,做到「真听真看真感受」。还是那句话,大模型的智能自今年开始普遍在溢出,所以需要Agent来做承接,证明AI有真正解决复杂问题的能力,根据火山引擎披露的数据,已经有超过100家企业在平台上的token消耗量达到了万亿级,现在有了先行者做背书,火山引擎接下来需要考虑的是如何扩大这部分客户。答案无非要在两个层面上找,降本和增效。增效,指的是通过升级企业Agent平台AgentKit,去全链路解决Agent在企业端的落地难题,把Agent服务打造成一套能覆盖前期开发、中期部署、后期管控的完整商业化体系,彻底打消「能不能用」的顾虑。除此之外,新推出的HiAgent智能体工作站,直接开箱化地赋予了企业更多Agent应用场景,对应的是企业想用AI,却不想成为AI专家的普遍诉求,回答了「好不好用」的问题。最后在降本方面,火山引擎的「AI节省计划」,用阶梯式的折扣给企业创造出了一个越用越便宜的体验,最高能节省47%的成本,反馈了客户「能不能用得起」的踌躇。将这几个问题叠加起来,就能看懂火山引擎在Agent领域的探索究竟深入到了什么程度,这也是火山引擎作为领先者跟其他平台的本质区别,人人都能用的同时,还要做到术业有专攻,日后企业级市场的AI普惠工作,深度和广度定然缺一不可。
新浪微博 2025-12-18 00:00:00
62. 怎么看待新加坡政府宣布在东南亚语言大模型项目放弃Meta模型,采用阿里的通义千问(Qwen)开源架构?
知乎 2025-12-03 00:00:00
63. Kimi 发布并开源 K2.6,有哪些亮点值得关注?
知乎 2026-04-22 00:00:00
64. DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼 GPT-5,Speciale 版斩获多项金牌在人工智能领域,开源模型的迅猛发展正重塑全球 AI 生态。今日(2025 年 12 月 1 日),中国 AI 初创公司 DeepSeek 宣布正式发布两款重量级大语言模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。这一双模型同步上线,不仅标志着 DeepSeek 在参数规模和推理能力上的新突破,更在开源社区引发热议。DeepSeek-V3.2 主打日常应用场景下的 Agent 强化能力,而 V3.2-Speciale 则作为“长思考增强版”,融入先进数学证明机制,在国际竞赛基准中屡获金牌。官方网页端、App 和 API 已全面更新,支持开发者即时接入。这一发布时机恰逢全球 AI 竞争白热化之际。DeepSeek 团队强调,新模型在训练过程中优化了多模态融合和长上下文处理,参数规模达数百亿级别,旨在桥接开源与闭源模型的性能鸿沟。以下,我们将从模型架构、基准评测、与其他顶尖模型的比较以及潜在影响四个维度,进行专业剖析。模型架构与创新亮点DeepSeek-V3.2 系列基于前代 V3.1 的 MoE(Mixture of Experts)架构迭代而来,总参数量超过 600B,其中活跃参数高效分配至 70B 级别。这种设计显著降低了推理延迟,同时提升了在复杂任务下的稳定性。核心创新包括: • Agent 能力强化:V3.2 内置多步规划模块,支持自主工具调用和动态决策链路,适用于自动化工作流场景,如代码生成和数据分析。 • 长思考机制:V3.2-Speciale 引入“思考链”(Chain-of-Thought)增强变体,结合 DeepSeek-Math-V2 的定理证明引擎。该版本在处理逻辑验证任务时,能模拟人类逐步推理过程,避免幻觉输出。 • 开源友好:模型权重已在 Hugging Face 和 GitHub 公开,支持 FP16/INT8 量化部署,适用于边缘设备。这些特性使 V3.2 系列不止于通用对话,更向专业垂直领域倾斜,如数学、编程和科学模拟。基准评测:性能数据详解为评估新模型的实际表现,DeepSeek 团队公布了多项国际标准基准结果,并邀请第三方机构验证。总体而言,V3.2 在推理和数学任务上表现出色,平均得分逼近闭源顶流。数学与逻辑推理基准 • GSM8K(小学数学):V3.2 得分 98.2%,V3.2-Speciale 达 99.5%,接近人类专家水平。Speciale 版在长链推理中优势明显,错误率降至 0.5% 以下。 • MATH(高中数学竞赛):Speciale 版斩获 92.7% 准确率,在 IMO 2025 模拟赛中获金牌,超越谷歌 Gemini Deep Think。该成绩得益于集成定理证明器,能自动验证几何和代数推导。 • AIME(美国数学邀请赛):V3.2 系列平均 85.4%,较前代提升 12%。独立评测显示,Speciale 版在 MLPerf Inference v5.1 推理基准中,处理长序列输出时延迟仅为 GPT-5 的 1.2 倍。编程与多模态任务 • HumanEval(代码生成):V3.2 达 89.6% 通过率,略高于 Claude 3.5 Sonnet,在 Aider 编程测试中得分 71.6%,标志着开源模型在软件工程领域的突破。 • MMLU-Pro(多学科知识):整体得分 87.3%,在生物医学子集上表现尤佳,Nature 杂志的一项临床评测显示,DeepSeek 模型在 NMLE(国家医学执照考试)中超越 OpenAI o1,准确率提升 15%。安全效率评估NIST 的 CAISI 报告指出,V3.2 在安全基准(如红队攻击抵抗)中得分 92/100,优于多数美国参考模型,同时价格仅为闭源竞品的 1/10。量化后,推理速度提升 2.5 倍,支持 128K 上下文窗口。 然而,评测也暴露短板:V3.2 在创意写作(如 GPQA 基准)中得分 78.5%,落后于 Gemini-3.0-Pro 约 5%。此外,独立测试显示其在边缘案例下的幻觉率仍需优化。与顶尖模型的横向比较DeepSeek V3.2 系列的发布,直接挑战了 OpenAI GPT-5 和 Google Gemini 的霸主地位。在综合基准 Arena-Hard 上,V3.2 以 91.2 分逼平 GPT-5(92.1 分),但略逊于 Gemini-3.0-Pro(93.8 分)。 17 Speciale 版在数学子集上逆转胜出,IMO 金牌成绩更胜一筹,终结了“闭源垄断高难度推理”的叙事。与其他开源模型相比,V3.2 碾压 Llama 3.1(MMLU 85.2%)和 Mistral Large(编程 82.4%),其 MoE 架构在能效上领先 30%。这一成绩源于 DeepSeek 的“渐进式蒸馏”训练策略,从 685B 基座模型提炼而出。开源生态影响与未来展望DeepSeek V3.2 的开源策略,将进一步加速 AI 民主化。开发者可通过 API 免费测试,预计短期内涌现大量 Agent 应用,如智能医疗诊断和自动化科研。长期看,这一发布或推动中美 AI 合作,缓解地缘壁垒。模型规模膨胀带来的碳足迹,以及在非英语语料上的泛化问题。DeepSeek 团队已承诺后续迭代,将融入更多多语言支持。DeepSeek V3.2 系列的亮相,不仅是技术跃进,更是开源精神的胜利。它证明,开源模型已能与闭源巨头并驾齐驱,甚至在特定领域领跑。 对于从业者和研究者而言,这是部署高性能 AI 的绝佳时机。未来,随着更多评测数据涌现,我们期待 V3.2 在真实世界中绽放光彩。参考文献: • DeepSeek 官方公告及基准报告。 • 第三方评测:NIST CAISI、Nature 临床基准、MLPerf 等。 (本文基于公开数据撰写)#DeepSeek同时发布2款新模型##ai生活指南##ai创造营#
新浪微博 2025-12-01 00:00:00
65. DeepSeek V4 前瞻:华为寒武纪接棒,拆解中国 AI 大模型告别英伟达后的生存战 | DeepSeek V4 | 华为昇腾 | 寒武纪 | 国产算力 |
哔哩哔哩 2026-04-07 00:00:00
66. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌
抖音 2025-12-30 00:00:00
67. Google 放大招!Gemini 3.1 Pro 正式发布,推理能力翻倍!免费使用方法来了 | 零度解说
哔哩哔哩 2026-02-21 00:00:00
68. 刚刚,姚顺雨腾讯首秀来了!三个月重建混元新模型,实测到底什么水平
微信公众号 2026-04-23 00:00:00
69. 从平头哥芯片、通义 300 + 全模态模型,到阿里云百炼、AI 硬件矩阵,阿里打通 “芯片 - 模型 - 云 - 应用 - 终端” 全链路,构建软硬一体闭环,开源生态全球领先。虽 OpenAI、谷歌占基础模型优势,但阿里在本土化、多语言、产业落地已跻身第一梯队。布局完成,只待爆发!加速硬件生态后,阿里能否凭全栈实力改写 AI 格局?#一分钟精选视频扶持计划##专业视频创作季##AI创造营##科技先锋官# 种斌Marco的微博视频
新浪微博 2026-04-22 00:00:00
70. #DeepSeek同时发布2款新模型#按照DeepSeek V3.2适用日常多元使用场景,DeepSeek V3.2 Speciale主要适用推理能力以适配高难度任务的搭配来看,DeepSeek目标重点还是如何把模型尽快的在实际的生产中产生效能。DeepSeek V3.2是用精准解答生活常识、出行攻略、学习疑问等各类生活问题来垫定市场基础,积累普通用户;DeepSeek V3.2 Speciale更多的还是应用在专业的场景中为生产提供效能,成为DeepSeek进入行业应用的利刃。DeepSeek的发展还是很务实的,这种小而精,专而深的发展思路更符合专业的模型的发展。
新浪微博 2025-12-01 00:00:00
71. 实测即梦 Seedance 2.0,一键穿越进电影 Seedance 2.0真是强得离谱,上传个自拍就能穿越到爱乐之城电影里。 它那个全能参考能力太狠了,不仅能复刻主体,还能复刻声音动作和运镜,连视频的氛围感都能复刻。 AIGC创作者真过年了!创作者可以在即梦使用新模型,企业用户可以在火山方舟体验新模型。 #即梦视频Seedance2 #即梦图片Seedream5#爱乐之城十周年重映 #AI让我在爱乐之城里演爽了 #AI新春游园会
抖音 2026-02-13 00:00:00
72. 如何系统性的学习RAG、Agent、MCP?
知乎 2025-11-29 00:00:00
73. 腾讯混元「推倒重来」!实测Hy3-Preview:姚顺雨首次交卷喜忧参半
微信公众号 2026-04-23 00:00:00
74. 【月之暗面最强模型!Kimi K2.6发布:13小时不停写代码 对标GPT-5.4】日前,月之暗面发布并开源Kimi K2.6模型,在代码、长程任务执行和Agent集群能力等方面全面升级。目前,Kimi K2.6已上线kimi官网、最新版应用、API和Kimi Code编程助手。在多项权威基准测试中,Kimi K2.6表现亮眼。无论是高难度的人类最后的考试(Humanity's Last Exam),还是侧重真实软件工程能力的SWE-Bench Pro,以及评估Agent检索能力的DeepSearchQA,成绩均达到行业领先水平,持平或优于GPT-5.4、Claude Opus 4.6和Gemini 3.1 Pro等闭源模型。作为Kimi迄今最强代码模型,Kimi K2.6长程编码能力大幅提升。在测试中可以不间断编码13小时,编写或修改超过4000行代码,完成复杂系统的开发和优化。同时,通过将代码与视觉能力的深度融合,Kimi K2.6可以交付极具设计创意的专业级Web应用。在内部代码评测Kimi Code Bench中,K2.6成绩较上一代K2.5提升约20%。值得一提的是,其泛化能力同样突出。实测显示,Kimi K2.6可在Mac本地部署模型,并通过Zig语言优化推理流程,在4000余次工具调用、12小时连续运行中,将吞吐量从约15tokens/s提升至约193tokens/s,最终实现比LM Studio快约20%的推理效率。在Agent能力方面,Kimi K2.6支持多Agent协同,可调度不同专长的Agent组合完成复杂任务,将搜索、深度研究、文档分析和长文生成等能力整合,整体任务质量显著提升。同时,其Agent集群架构也迎来升级,最多支持300个子Agent并行运行、执行约4000个协作步骤,可一次性完成从文档到网页、再到PPT和表格的多产物端到端交付。#kimi#
新浪微博 2026-04-21 00:00:00
75. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!
哔哩哔哩 2026-01-21 00:00:00
76. #硬刚ChatGPT的千问国内可下载# 横扫硅谷的Qwen大模型杀回国内,正式上线千问APP,获朱啸虎评价为“能硬刚ChatGPT的国产AI”,并迅速引发热潮。朱啸虎指出“模型直接决定了阿里千问APP的起点”,究其原因,在于千问所搭载的Qwen大模型早已在海外多次屠榜、获硅谷广泛认可,可以说是带着国际成绩单归来。更重要的是,它真正把强大模型能力带到了普通用户手中:极简界面与直观入口对大众非常友好。例如当我问它理财相关内容时,千问能够以表格形式清晰呈现五大维度的横向对比,直观易懂;而同类AI仅简单罗列优缺点,对比深度不足。这种逻辑清楚、内容扎实的回答,正应了朱啸虎所说——“全是干货,不闹着玩”,也正是中国市场真正需要的AI产品。从更全局的视野看,正如朱啸虎所判断,阿里正从算力基建、数据积累到应用整合,系统性地以千问重构一个超级AI入口。这已不仅是一个工具,更是整合阿里技术生态的智能平台。当行业仍在争论大模型如何落地,千问已用实力与思维给出了清晰回应。
新浪微博 2025-11-17 00:00:00
77. 刚刚,姚顺雨带队「重建」混元,首个大模型上线了
微信公众号 2026-04-23 00:00:00
78. #微博大模型数学能力超DeepSeekR1#微博发布的自研开源大模型VibeThinker,以15亿参数在数学竞赛基准测试中击败参数量超其数百倍的DeepSeek R1,这一成果堪称AI领域的“以小搏大”经典案例。传统认知中,大模型的推理能力与参数量直接挂钩,但VibeThinker通过创新“频谱到信号原理”训练方法,证明算法设计优化能突破规模限制。其单次后训练成本仅7800美元,较行业主流模型降低数十倍,不仅让前沿AI技术从巨头垄断走向普惠,更重新定义了技术评价标准——效率与成本效益同样关键。这一突破为中小企业、科研机构提供了低成本研发路径,或将推动AI产业从“规模竞赛”转向“效率革命”,让智能技术更广泛地服务于教育、金融等实时场景,真正实现技术普惠的价值。微博大模型数学能力超deepseekr1 #秒懂热点就用智搜##互联网资讯##微博兴趣创作计划#
新浪微博 2025-11-18 00:00:00
79. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格
哔哩哔哩 2026-02-17 00:00:00
80. #DeepSeek发布2款新模型#【DeepSeek发布两款新模型】《科创板日报》1日讯,今日,DeepSeek发布两个正式版模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。DeepSeek-V3.2强化Agent能力,官方网页端、App 和 API 均已更新为正式版 DeepSeek-V3.2。Speciale 版本目前仅以临时 API 服务形式开放,以供社区评测与研究。(记者 张洋洋)
新浪微博 2025-12-01 00:00:00
81. DeepSeek V3.2 正式发布!免费开源,性能硬刚 Gemini 3.0 Pro!实测+本地部署|零度解说
哔哩哔哩 2025-12-05 00:00:00
82. #小米MiMo大模型首次推出TokenPlan#养虾圈和开发者终于等到重磅福利!小米MiMo大模型正式上线TokenPlan套餐,直接改写国产大模型计费规则。一次订阅就能解锁全模态模型,火爆全网的MiMo-V2-Pro也包含在内,计费透明清晰,彻底告别以往token莫名消耗过快、多模型单独收费的糟心问题。常年霸占OpenRouter榜单,周调用量接连突破三万亿、四万亿量级,专业开发者早已用实力投票。如今亲民定价搭配顶配性能,对标全球顶级Claude系列也毫不逊色,实打实把良心性价比拉满,妥妥是当前养虾、开发首选的刚需套餐!
新浪微博 2026-04-03 00:00:00
83. 阿里正式发布新一代基模千问3.5
微信公众号 2026-02-16 00:00:00
84. 小米大模型接入全球顶级框架,Xiaomi MiMo-V2系列大模型完成与全球顶级开源Agent框架Hermes Agent的官方集成,从大模型的持续迭代到Agent生态的深度融合,我米的AI以后只会越来越强!而且小米还推出了两周限免,可以让更多开发者能低成本体验前沿技术!
新浪微博 2026-04-10 00:00:00
85. 火山引擎FORCE 原动力大会今日盛大举行!#火山引擎#携一系列 AI 前沿成果亮相!刚刚,在FORCE原动力大会上,火山引擎发布了豆包视频生成模型#Seedance# 1.5 pro、#豆包大模型1.8#,以及企业级AI Agent平台AgentKit。同时,基于HiAgent构建“1+N+X”产品体系,直接助力企业打通AI从调用到落地的闭环。更为有利的是,火山引擎推出业内首个大模型的“AI节省计划”,切实帮助企业降低模型使用成本。截至今年12月,豆包大模型日均tokens使用量已超50万亿,超过100家企业在火山引擎上累计tokens使用量超过一万亿。火山引擎在中国公有云上大模型调用量市场份额占比达49.2%,稳居国内首位。#豆包大模型#
新浪微博 2025-12-18 00:00:00
86. GTC 2026开幕!Token之王黄仁勋说了点啥?新一代Vera Rubin,七芯合体,首次集成Groq,推理性能翻35倍。2027年芯片营收目标1万亿美金。Mac和Windows是个人电脑的操作系统,OpenClaw是个人AI的操作系统。英伟达版龙虾「NemoClaw」,部署简单(一条命令搞定),隐私安全(有安全沙漏/策略,日常推理英伟达本地开源模型,强度任务隐私通道云端模型)。短短两年,凭借软硬件协同升级,Token生成率从200万暴增至7亿,实现了350倍的史诗级跨越,成本越来越低。跟马斯克一样,黄仁勋也要在太空轨道上建AI数据中心。预测自动驾驶的ChatGPT时刻已经到来。Token将成为AI公司新的衡量数值之一。
新浪微博 2026-03-17 00:00:00
87. #腾讯混元新模型即将发布#鹅厂财报官宣,混元3.0大模型4月正式发布,AI实力再升级。鹅厂这次憋大招,依托稳健财报与全场景AI落地,厚积薄发,很有后来者居上的潜力👏#腾讯混元3.0大模型四月发布##腾讯混元3.0大模型4月发布##腾讯发布2025年财报#
新浪微博 2026-03-18 00:00:00
88. 千问3.6的35B模型非常强,体感上强于gemma4的26b量化,由于gemma4 31b的性能优化没做好所以没法有效测试。从gemma4和qwen3.6的量化测试来看,当模型权重能装载到GPU里,那么推理的tokens工作就由CPU来完成了,GPU负载较低,CPU的计算密度极大。同时内存消耗较高。这也就是说GPU,内存,CPU在AI推理时所进行的workload比重是差不多的,那么CPU的性能就决定了在GPU达标以后的推理性能。所以,这可能给我们一个启示,对于本地推理来说,显存才是王道,架构和GPU算法等技术的影响较小。显卡投资只需要上显存,没必要上先进架构。一句话,如果你玩本地大模型,选择显卡的指标只有一个,显存。 孤鸿泽的微博视频
新浪微博 2026-04-22 00:00:00
89. 只需三步!14G显存也能跑,腾讯混元video 1.5“小钢炮”本地部署实测
哔哩哔哩 2025-12-15 00:00:00
90. 智谱GLM-5强调的Agentic Engineering能力是什么?|甲子光年
微信公众号 2026-02-12 00:00:00
91. #阿里云Token消耗3个月飙升6倍#从“烧钱”到“印钞”,阿里开启“Token税”时代!全栈AI布局进入收割期2026年3月18日,阿里巴巴集团发布2026财年Q3财报,阿里云的表现堪称“大象起舞”:收入加速增长36%,AI相关产品收入连续10个季度三位数增长。最令业界震惊的数据是,百炼MaaS平台Token消耗量在短短3个月内疯狂飙升6倍。紧接着,阿里云宣布AI算力、存储等核心产品最高涨价34%。这一套“增量+提价”的组合拳,标志着阿里云已正式跨越AI投入期,进入高毛利的“Token经济”收获期。【评论】阿里云Token消耗飙升6倍,本质上是AI从“炫技工具”向“生产力燃料”转化的临界点突破。在2026年这个“龙虾热”(OpenClaw等AI Agent爆发)席卷全球的背景下,Token(字符点数)已成为数字世界的“原油”。阿里最硬核的底气在于其**“四层垂直整合”:平头哥自研GPU规模化量产(成本砍半)+ 阿里云算力底座 + 百炼MaaS平台 + 千问/悟空应用生态。当同行还在为大模型变现发愁时,阿里已经通过Alibaba Token Hub (ATH) 事业群**,把算力封印进了高溢价的Token里。34%的提价底气,源于其自研芯片带来的自主定价权。在这场全行业的“养龙虾”盛宴中,阿里不仅是提供饲料的人,还是修建池塘、制定规则的“生态之主”。
新浪微博 2026-03-19 00:00:00
92. AI 圈的“春晚”提前开了?MiniMax 的M2.5,10B 激活参数跑出旗舰水准! #人工智能 #科技改变生活 #玩个很新的东西 #MiniMax #Agent
抖音 2026-02-13 00:00:00
93. The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。
新浪微博 2026-04-04 00:00:00
94. 一站式生成大片,声画同步的AI视频模型来了
哔哩哔哩 2025-12-16 00:00:00
95. #阿里推出对标ChatGPT应用# 我觉得阿里在洞察用户需求这块的路径很清晰。之前一直在服务企业客户,做大云计算,做强大模型基础。于是投资大模型公司、把Qwen系列做到开源顶尖、让阿里云业绩加速增长...说实话,这些投入都扎实,但说到底,还是在给千行百业做技术供应商,自己离普通用户总差一步。这次再单独做了「千问」,单独面向C端市场,这也就意味着阿里想补上这一步。由通义app和夸克AI升级而来,接入Qwen 3-Max模型,对标ChatGPT 5.1版本,这些动作显示阿里不再满足于只做幕后。如果结合整个行业的现状来看,阿里必须这么做。美国巨头可以让ChatGPT、Claude接入自家产品矩阵,因为他们掌握核心入口。但在国内,微信、抖音、淘宝各占山头,每个巨头都必须有自己的流量入口。聊天助手是目前最直接的AI入口,字节有豆包,阿里自然不能缺席。目前我看千问的差异化在于深度嵌入阿里系服务。清购物车、叫外卖、查快递只是基础,项目团队还在联合淘宝、高德、闪购、支付宝等产品共同开发,目标是解决用户实际问题。只有当AI从对话工具变成能办事的助手,用户粘性才会真正形成。模型能力只是起点,能否转化为用户离不开的日常服务,才是中国AI竞争的关键。从企业客户到个人用户,从幕后到台前,阿里的这次转向是战略必然。千问能否成功,取决于它能否把技术优势转化为实实在在的便利。这一步走好了,阿里才能在AI时代真正掌握自己的命脉。
新浪微博 2025-11-17 00:00:00
96. GitNexus 是一个把代码库自动转成“知识图谱”的工具,并在此基础上提供 Graph-RAG 与 AI 对话能力,用于让人和 AI 更快理解大型代码库。特点:零服务器、浏览器本地运行、隐私优先。核心能力:1、代码 → 知识图谱项目通过 AST 分析构建图结构。这套流程采用四阶段分析:1)结构扫描2)AST 解析3)依赖解析4)调用图构建最终得到完整代码图。2、Graph-RAG 代码问答与传统 RAG 不同,GitNexus 的检索是图查询。AI 通过 Cypher 查询或图遍历获取上下文,比 embedding 检索更精确。3、零服务器隐私架构项目最突出的设计之一:1)所有分析在浏览器本地运行2)代码不上传服务器3)数据库为 WASM 版图数据库4)API key 本地保存适合企业代码安全场景。4、面向 AI Agent 的设计GitNexus 不只是可视化工具,而是 Agent 基础设施。它能提供:1)影响范围分析2)依赖追踪3)架构检查4)自动化审计目标是让 AI 编程助手具备“架构感知能力”。项目:github.com/abhigyanpatwari/GitNexus#HOW I AI# #程序员# 黄建同学的微博视频
新浪微博 2026-02-26 00:00:00
97. 50万级新答案!岚图泰山重塑华系旗舰全能标准#岚图泰山##最霸气的华系SUV##岚图泰山首搭鸿蒙座舱语音大模型# 车市红点的微博视频
新浪微博 2025-11-10 00:00:00
98. 说实话,以美股今天这种筹码集中程度,中芯国际 + deepseek + 阿里巴巴 + 华为 + 中国电力如果能搞定训练或者推理的高性能自研 10 万卡加速算力集群。。。亦或分布式训练推理,或者 SLM 性能有飞跃,或者端侧推理普及的同时,分布训练推理可以匹配。。。我估计对美国的打击效果,能顶 10 艘航母。。。
新浪微博 2025-10-29 00:00:00
99. 创业黑马公告,近日公司与上海信弘智能科技有限公司签署了《战略合作框架协议》。双方将围绕NVIDIA的人工智能技术体系能力,构建基于中小企业的人工智能应用服务平台,用普惠AI能力帮助中小企业成长。同时,双方将开展人工智能教育深度合作,通过设立合资公司等方式,为AI应用者提供全套培训架构。
新浪微博 2025-10-29 00:00:00
100. DeepSeek V4直接弃用英伟达CUDA,全栈迁移华为昇腾,推理性能干翻英伟达H20近3倍,速度狂飙35倍,这是国产AI摆脱卡脖子的关键一步,巨头纷纷入局适配,国产替代集群已然成型。过去国产AI全靠英伟达生态,囤芯片看脸色,迁移成本高到离谱,利润大量外流,创新被牢牢限制。如今终于有了更多的选择,国产AI可以甩开膀子加油干了!#一分钟精选视频扶持计划##专业视频创作季##AI创造营##科技先锋官# 种斌Marco的微博视频
新浪微博 2026-04-23 00:00:00
101. 我摸索出来了一套穷养虾的方案:申请阿里云的百炼,给送7000万Token,然后本地部署OpenClaw,不需要买服务器。然后把虾子和QQ集成起来,在QQ里面对话就可以了。目前一毛钱不花,百炼的Token还能撑一段时间。
新浪微博 2026-03-18 00:00:00
102. 2026 年 AI 全景对比
知乎 2026-04-07 00:00:00
103. 2026企业AI大模型选型决策指南
今日头条 2026-04-02 00:00:00
104. 【AI开发实践】2026 大模型选型指南|8 步选型流程||混合架构分层路由 |bechmark测评|工程适配评估|ROI全成本核算
知乎 2026-03-24 00:00:00
105. 全球3755个大模型,中国占40%
微信公众号 2026-04-13 00:00:00
106. 国产大模型哪家强?2026国产大模型选型参考
微信公众号 2026-04-21 00:00:00
107. [4]参数量越大越好?模型到底怎么选啊!
知乎 2026-03-28 00:00:00
108. 周开疆丨如何正确高效运用AI大模型——“三步走”操作流程
微信公众号 2025-12-05 00:00:00
109. 2026年开源大语言模型选型指南
今日头条 2026-04-13 00:00:00
110. 大模型硬件入门指南
微信公众号 2026-04-09 00:00:00
111. 大模型那么多,该如何选择,让AI告诉你
微信公众号 2026-03-26 00:00:00
112. 选错模型,项目必翻车?这份评测清单救你!
知乎 2026-01-10 00:00:00
113. 如何选择适合自己的大模型? | 小白入门AI产品经理的第五课
微信公众号 2026-04-01 00:00:00
114. 国产大模型怎么选
今日头条 2026-02-26 00:00:00
115. AI模型适配性评估
微信公众号 2026-01-29 00:00:00
116. 构建AI智能体
知乎 2026-01-31 00:00:00
117. 告别“跑分定优劣”
微信公众号 2025-11-07 00:00:00
118. 主流大模型常规对比
今日头条 2026-03-24 00:00:00
119. 2026 年大模型 API 横评
微信公众号
120. 2026 主流大模型横向对比
微信公众号
121. Gemini 3.1功能完整度评测
什么值得买
122. 全球大模型地图
哔哩哔哩
123. 大模型API价格战|四家横向对比
小红书
124. 当前全球最主流的三大通用大模型ChatGPT、Gemini、Claude
今日头条
125. 别再“用错”AI了!2026国内外大模型全场景选型终极指南
今日头条
126. 2026全球AI大模型TOP10深度评测
今日头条
127. 国内主要AI大模型的详细分析对比
微信公众号 2026-04-01 00:00:00
128. 阿里刚开源下一代RAG王炸框架,AI学会自己翻图、看视频、找资料了
微信公众号 2026-04-10 00:00:00
129. IPFLY全栈赋能 AI Skills 与 RAG 架构进化
微信公众号 2026-04-03 00:00:00
130. 收藏备用!一文搞懂RAG与Agentic RAG
知乎 2026-03-08 00:00:00
131. 第五章
知乎 2026-04-04 00:00:00
132. 图解 RAG(二)快速入门|范式演进
微信公众号 2026-04-16 00:00:00
133. 6.1K Star!AI工程师必收藏!22种RAG技术全实现,从入门到王者的开源宝典!
知乎 2025-12-16 00:00:00
134. RAG 已死?GraphRAG vs Agentic RAG vs 传统 RAG 三方对决
知乎 2026-04-22 00:00:00
135. Agentic RAG Benchmark 发展路线
小红书 2026-03-09 00:00:00
136. GLM-5.1会成为行业标准吗
今日头条 2026-04-08 00:00:00
137. GLM-5.1
微信公众号 2026-04-09 00:00:00
138. GLM-5.1 实测
微信公众号 2026-04-05 00:00:00
139. GLM-5.1 登顶 Code Arena
微信公众号 2026-04-11 00:00:00
140. GLM-5.1 正式发布
今日头条 2026-03-29 00:00:00
141. Kimi K2.6 正式开源
微信公众号 2026-04-21 00:00:00
142. Kimi K2.6 发布了,我把你最想知道的都翻了一遍
微信公众号 2026-04-21 00:00:00
143. Kimi K2.6 正式发布并开源
微信公众号 2026-04-22 00:00:00
144. Kimi K2.6
微信公众号 2026-04-22 00:00:00
145. Kimi K2.6 API 接入教程
知乎 2026-04-21 00:00:00
146. Kimi K2.6 别废话,把代码拿出来说话。
微信公众号 2026-04-21 00:00:00
147. DeepSeek V3.2 性价比之王!GPT-4 级别性能,价格只有 1/10
微信公众号 2026-03-29 00:00:00
148. DeepSeek V3.2来了,首个会"思考"的Agent模型,首个开源性能打平GPT-5的模型
知乎 2025-12-02 00:00:00
149. DeepSeek-V3.2
微信公众号 2025-12-04 00:00:00
150. DeepSeek-V3.2系列发布
今日头条 2025-12-02 00:00:00
151. DeepSeekV3.2正式版发布,比肩GPT-5
今日头条 2025-12-03 00:00:00
152. DeepSeek V3.2发布!实测效果惊艳,便宜是最大优势
今日头条 2025-12-03 00:00:00
153. 重磅!MiniMax M2.7 宣布开源,AiOffice 同步完成上线
今日头条 2026-04-13 00:00:00
154. 全行业都在忙着“吃虾”,MiniMax M2.7已经让虾自己拿起筷子了
知乎 2026-03-18 00:00:00
155. 上新|加速迭代
微信公众号 2026-03-22 00:00:00
156. 刚刚!MiniMax发布新一代大模型M2.7
今日头条 2026-03-18 00:00:00
157. 开源刚落地,芯片还没捂热,模型 already 能干活了。
今日头条 2026-04-13 00:00:00
158. MiniMax M2.7 测评
微信公众号 2026-03-19 00:00:00
159. 2026大模型选型与接入实战
知乎 2026-04-08 00:00:00
160. 【解决方案】中小企业AI解决方案系统化的选择指南及推荐方案
微信公众号 2026-04-08 00:00:00
161. 中小企业如何发现及利用 AI 工具/Agent 的详细指南
今日头条 2025-12-13 00:00:00
162. 轻松上手
今日头条 2025-11-27 00:00:00
163. 2026年中小企业AI外呼选型指南
微信公众号 2026-03-23 00:00:00
164. 中小型上市公司AI赋能平台选型指南
微信公众号 2025-12-14 00:00:00
165. 算力选型避坑指南
知乎 2025-11-10 00:00:00
166. 中小企业AI智能体平台怎么选?2025年四大平台横评+避坑指南
什么值得买 2025-12-17 00:00:00
167. 《中小企业AI转型系统课》第五篇|一套AI转型路线图
知乎 2026-03-04 00:00:00
168. 2026,中小企业如何轻装上阵搞“AI”?
今日头条 2026-03-18 00:00:00
169. 2026 AI 一体机选型指南
今日头条 2026-01-22 00:00:00
170. 从需求到部署
今日头条 2025-11-12 00:00:00
171. Ai大模型一体机的功能与特点
知乎 2025-11-02 00:00:00
172. Loongwise分享什么是大模型一体机及内置模块
知乎 2025-12-24 00:00:00
173. 如何选择适合学科的大模型?一看就懂,让本地部署不再为难!
微信公众号 2026-03-15 00:00:00
174. AI智算一体机选型导览
今日头条 2025-12-26 00:00:00
175. AI大模型选择全攻略:2025年企业如何精准选型不踩坑
今日头条 2025-10-28 00:00:00
176. 国内主流大模型编程能力深度对比:谁才是开发者的最佳拍档?
今日头条 2026-04-14 00:00:00
177. 2026年AI应用大模型选型终极指南:最值得关注的权威大模型排行榜与Benchmark榜单
知乎 2026-02-05 00:00:00
178. 大模型显卡选型全攻略:从参数量到硬件配置的硬核指南
今日头条 2026-03-27 00:00:00
179. 2026主流AI大模型全榜单:选型指南与实战导师盘点
知乎 2026-04-14 00:00:00
180. 2026 企业 AI 智能体选型指南:从需求到落地的全维度参考
今日头条 2025-12-30 00:00:00
181. Kimi K2.6 发布,跑分又追平 Opus 4.6,实测如何?
今日头条 2026-04-21 00:00:00
182. AI大模型有哪些?如何筛选适合自己的?
今日头条 2025-12-23 00:00:00
183. 大模型的私有化部署细节
微信公众号 2025-12-25 00:00:00
184. 模型选型:大模型 vs 小模型 vs 传统算法执行
微信公众号 2026-03-25 00:00:00
185. 2026年企业AI选型指南:哪些大模型支持全量搜索与复用? - 哔哩哔哩
哔哩哔哩 2026-04-13 00:00:00
186. 2026大模型价格与能力对比
知乎 2026-03-19 00:00:00
187. Kimi2.6的两大核心亮点及测试!
知乎 2026-04-21 00:00:00
188. Kimi K2.6深度扒皮,这5个升级让老用户集体高潮
微信公众号 2026-04-22 00:00:00
189. GLM-5.1来了:7540亿参数开源最强编程模型,8小时不间断自主工作
微信公众号 2026-04-09 00:00:00
190. AI翻车频现?选对大模型的3步法
今日头条 2025-11-30 00:00:00
191. 大模型进展|DeepSeek-V3.2:推动开源大语言模型的前沿
知乎 2026-04-20 00:00:00
192. 如何快速挑选合适的大模型?国内外系列、开发者平台与 API 获取方式
微信公众号 2026-03-29 00:00:00
193. 2026 年大模型服务平台选型指南:五大主流产品深度解析与选型攻略
今日头条 2026-01-27 00:00:00
194. 智谱GLM-5.1实测
微信公众号 2026-04-09 00:00:00
195. DeepSeek-V3.2 发布:能力逼近 Gemini-3.0,能力登顶模型之巅!
今日头条 2026-04-05 00:00:00
196. 全球主流通用大模型及其差异(GPT、Claude、DeepSeek、Gemini、LLaMA、DeepSeek等)
微信公众号 2026-02-04 00:00:00
197. MiniMax-M2.7 深度评测:媲美 Opus 4.6,价格仅 $0.30/MToken
知乎 2026-04-15 00:00:00
198. AI落地三部曲之二:大模型与解决方案评测 | 老板必看:如何科学选型,避免被供应商 “割韭菜”
哔哩哔哩 2026-03-04 00:00:00
199. 七款主流大模型参数对比:价格、上下文与选型指南
哔哩哔哩 2026-04-04 00:00:00
200. 企业级大模型API选型:如何守住稳定性第一道红线?
今日头条 2026-04-04 00:00:00
201. 智谱GLM-5和MiniMax M2.5,谁更适合企业私有化部署?
今日头条 2026-02-13 00:00:00
202. AI数字人一体机选购指南:把握四大关键点,让AI为企业赋能
知乎 2025-11-21 00:00:00
203. Context 不是免费的:解析长文档 agent 的性能天花板与架构优化
今日头条 2026-03-06 00:00:00
204. 科技巨头扎堆发布大模型,DeepSeek新模型成热点!详解国产大模型的机遇
今日头条 2026-02-13 00:00:00
205. DeepSeek V3.2:国产大模型的真实水位
知乎 2026-04-21 00:00:00
206. 找了个99米的GLM-5.1,测评一下
知乎 2026-04-10 00:00:00
207. 首月不到9块集齐国产顶级代码模型!火山方舟Coding Plan一口气接入GLM-5.1+MiniMax-M2.7
微信公众号 2026-04-23 00:00:00
208. 主流大模型能力测评 - 流程图绘制篇
今日头条 2026-04-17 00:00:00
209. 全球大模型调用量下滑22%:智能体时代的需求洗牌
微信公众号 2026-04-19 00:00:00
已收藏
去我的收藏夹