70B大模型已成中小企业陷阱:2026年选型关键在成本、微调与中文场景适配
04-16 16:37
精选参考来源
精选参考来源
1. 刚刚,阿里端出春节「硬菜」千问 3.5!我让它做了个拜年网页,结果出乎意料
微信公众号 2026-02-16 00:00:00
2. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型
抖音 2025-11-19 00:00:00
3. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格
哔哩哔哩 2026-02-17 00:00:00
4. AI春节档最强杀手锏来了!千问3.5除夕强势亮相,开源SOTA、性价比之王
微信公众号 2026-02-16 00:00:00
5. 开源大模型背后的架构
知乎 2026-03-03 00:00:00
6. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-17 00:00:00
7. 开源大模型与闭源大模型的差距是在缩小还是在扩大?关键因素是什么?
知乎 2025-12-02 00:00:00
8. 【2026年,开源编程模型将迎来爆发式增长】一个值得关注的信号:尽管过去几年开源大模型层出不穷,但真正投入到编程能力训练上的资源其实相当有限。这个局面正在改变——2026年,我们将见证一波专注于代码生成的开源模型密集发布,随之而来的是token成本的大幅下降。这背后的逻辑很清晰:当训练预算真正向编程领域倾斜,模型质量会快速跃升,而开源社区的竞争又会进一步压低使用成本。有人预测,未来六个月内,开源模型与顶级闭源模型之间的差距将显著缩小,到2026年底,两者可能趋于平衡。但更值得思考的是:当编程模型走向商品化,真正的护城河在哪里?答案可能不在模型本身,而在工作流层面。谁能围绕开源模型构建最好的工具链和使用体验,谁就能在这场竞争中胜出。价值正在向上游迁移——从模型能力,转向如何让模型无缝融入开发者的日常工作流。有个类比很精准:摄影变便宜不是关键,关键是相机变得“隐形”——当它融入手机,人们不再把它当作独立设备。编程模型也是如此,真正的转折点不是token便宜到什么程度,而是你开始忘记模型的存在,它只是你工作流中自然的一部分。当然,也有人提出冷静的视角:token从来不是真正的瓶颈,需求定义和结果验证才是。当token成本不再是问题,新的成本会浮现——测试、代码审查、还是线上故障?无论如何,对独立开发者和小团队来说,这是个好消息。一旦推理成本足够低,几乎所有应用创意都变得可行。2026年,或许是个人开发者的黄金时代真正开启的一年。x.com/thdxr/status/2011844073515073909
新浪微博 2026-01-16 00:00:00
9. 除夕迎「源神」?Qwen3.5以小胜大,捅破性价比天花板,大模型竞赛下半场开始了
微信公众号 2026-02-16 00:00:00
10. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴
抖音 2025-11-18 00:00:00
11. 一个视频带你快速盘点2025年GitHub热点项目
哔哩哔哩 2025-12-28 00:00:00
12. #千问Qwen3.5大模型发布#没想到今年除夕夜,阿里又整了一波超硬核的「AI年货」,直接开源新一代千问大模型 Qwen3.5! 这次直接在架构上玩出了新花样,用上混合注意力机制,还自带视觉理解能力,文字、图片全能搞定,妥妥的全能选手。 开源规格也够实在,既有2B参数的密集模型,还有35B-A3B MoE大模型,推理成本下降、效率拉满,摆明了就是让更多开发者能轻松上手、随便用。更贴心的是,Qwen3.5 代码已经提交到 HuggingFace Transformers,拉下来就能直接开干。 去年阿里就在除夕甩出 Qwen2.5-Max 放大招,今年继续把「春节AI爆款」的传统续上,这波操作直接把全球AI开源圈的存在感拉满了。
新浪微博 2026-02-16 00:00:00
13. #千问Qwen3.5大模型发布#千问 Qwen3.5 是采用极致稀疏 MoE 架构在保持超强性能的同时,显存占用降低 60%,推理效率大幅提升,部署成本显著下降。模型支持最高 256K 超长上下文,让长文本处理变的更加的轻松有效率了!原生多模态统一也是Qwen3.5的特点之一,也是目前国内外大模型的发展的主要趋势,模型在图文、视频理解能力全面升级,精准解析图表、文档与复杂视觉内容。实现了一个入口实现多种属性。Qwen3.5对于中小企业特别友好, 很大程度上降低了企业运营成本,可以让中小企业得到高效、普惠、全能的运营工具。不再因为高昂的费用而排斥企业去追逐AI。#过个有AI年##HOW I AI#
新浪微博 2026-02-16 00:00:00
14. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-16 00:00:00
15. 我以前认为算力和数据对于炼大模型非常重要,但是,DeepSeek教育了我,不用太多算力和数据也是可以做出优秀的模型。而且刘鹏老师也在直播间说过多次,美国大模型公司知道有更省算力的方法,可他们就不投资源优化这里。所以说美国炼大模型的反思是符合他们的情景,然而这不是最优解。所以算力多,数据多不代表就能推出更好的模型,还要有研究员去调模型,好的研究员年薪大几千万上亿,一百个三流研究员可能都不如一个一流研究员。
新浪微博 2025-11-19 00:00:00
16. #2025科技年度热问# 受@微博科技 邀请,参与年度话题,分享我对今年AI发展的几点思考:Q1:2025年推动AI进入下一阶段的关键突破是什么?我认为关键在于国产开源大模型的崛起,从年初 DeepSeek 引发的轰动,到 Qwen、GLM、Kimi 等国产开源模型轮番刷榜。站在未来尺度,开源大模型对AI发展的重要程度大于闭源模型。而在业界,越来越多看到 Qwen 取代 Llama,成为微调、研究的热门模型。这证明我们国家,在前沿 AI 研究中发挥越来越重要的价值。Q2:2025年有哪些AI产品真正让我感到眼前一亮?最让我眼前一亮的是 Gemini 3 Pro,他让我看到了百万级上下文结合出色的推理能力,所带来的巨大产能。尽管受限于成本,超长上下文还难以大规模应用。但是在我个人多个使用场景中,通过超长上下文推理,为我的生活、工作、自学都带来了很好的收益。Q3:展望2026哪个趋势是不可忽视的必然路径?2026年我认为是 AI 加速落地的一年。原因有二。第一是 25年 AI 的 Agent 能力大幅提升,却仅在编程等少数场景落地,在其它行业中还存在巨大的落地价值。第二是大模型的推理成本整体呈下降趋势。我比较看好的领域是 AI 教育,在 26 年是一个值得关注的趋势,比如 Google 最新推出的 Learn Your Way,将教科书变为 AI 私教。
新浪微博 2025-12-30 00:00:00
17. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌
抖音 2025-12-30 00:00:00
18. Hello AgentScope Java
知乎 2025-12-29 00:00:00
19. 这个模型有机会成为世界模型的Deepseek#AI #大模型 #世界模型 #北京人形机器人创新中心 #北京人形WoW具身世界模型
抖音 2025-10-17 00:00:00
20. #阿里将开源千问Qwen3.5模型# 阿里这波操作太秀了!除夕夜不整春晚,直接整大模型开源。去年Qwen2.5-Max,今年Qwen3.5,这是要把代码当年夜饭送啊!技术创新+开源精神,给开发者们最好的新年礼物,这格局真的绝了!#千问Qwen3.5大模型发布#
新浪微博 2026-02-16 00:00:00
21. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-16 00:00:00
22. 我觉得阿里这招挺有意思的,专挑除夕夜发新模型,去年Qwen2.5-Max是这样,今年Qwen3.5又是这样。摆明了就是想趁大家吃年夜饭的时候,让技术圈炸个锅。说实话AI系列一直是国内开源模型里口碑很能打的,这次在架构上又有创新,对开发者来说算是收到了最好的新年礼物。而且国外开源社区对Qwen的认可度也特别高,阿里这是铁了心要走“技术普惠”路线了。就是苦了加班的公关和工程师,估计这年夜饭是吃得不太踏实了。#阿里将开源千问Qwen3.5模型##千问Qwen3.5大模型发布#
新浪微博 2026-02-16 00:00:00
23. #小米新模型媲美DeepSeekV3.2##小米发布新模型#小米新发布的开源自研大模型是 MiMo-V2-Flash,有点儿强呀!MiMo-V2-Flash总参数3090亿,活跃参数150亿,采用专家混合架构(MoE),性能可与DeepSeek-V3.2和Kimi-K2等头部开源模型媲美。推理速度达到150 tokens/秒,每百万token输入成本0.1美元、输出0.3美元,性价比极高。采用5比1的激进比例,5层滑动窗口注意力搭配1层全局注意力交替使用,减少KV缓存存储量近6倍,支持256k上下文窗口。能并行预测多个token,推理速度提升2到2.6倍,训练阶段也能加速采样,减少GPU空转。通过后训练阶段的多教师在线策略蒸馏(MOPD),效率提升惊人,只需传统方法1/50的算力,学生模型即可达到教师性能峰值。在AIME 2025数学竞赛和GPQA-Diamond科学知识测试中排名开源模型前两名,编程能力出色,SWE-bench Verified得分73.4%。在τ²-Bench分类得分中表现优异,支持深度思考和联网搜索功能。与主流开发环境无缝配合,256k超长上下文窗口支持数百轮智能体交互与工具调用。#小米#
新浪微博 2025-12-17 00:00:00
24. 九坤投资至知研究院发布开源大语言模型,将给国内大模型开源生态带来哪些改变?
知乎 2026-01-01 00:00:00
25. 推特AI发展话题炸锅!2026年AI五大趋势:1️⃣ Agentic AI爆发 - AI自己就能干活,不需要人一直指挥2️⃣ 多模态模型崛起 - 能看能听能说全能型3️⃣ Edge AI普及 - 手机电脑就能跑大模型4️⃣ 开源模型爆发 - Llama、DeepSeek开源免费用5️⃣ 企业AI全面落地未来已来!你准备好了吗?
新浪微博 2026-04-11 00:00:00
26. 目前,阿里千问大模型已经彻底打败了美国的Llama,成为了全球下载量超6亿,衍生模型数量超17万的世界第一开源模型。在2月份HF公布的开源模型榜单排名中,基于千问进行二次开发的衍生模型直接横扫了榜单,霸占了前十的席位。7月份,千问实现一周N连发,一个星期时间发布了多款AI大模型,结果全部登顶全球开源阵营冠军。因为技术强大,就连苹果、亚马逊、微软这些美国的巨头企业,都纷纷和阿里达成技术合作,采用阿里的AI技术。毫不客气的说,在大模型这一块,特别是开源模型上,以阿里为代表的中国AI大模型已经赢了一局。#日方称向中方提抗议#
新浪微博 2025-11-18 00:00:00
27. 第二波DeepSeek冲击:V3.2 改写中国云生态与芯片生态
知乎 2025-12-06 00:00:00
28. RWS重磅测评:8大主流LLM同台竞技,多语言合成数据谁更能打?
微信公众号 2026-03-25 00:00:00
29. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC
抖音 2025-12-14 00:00:00
30. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#
新浪微博 2026-02-16 00:00:00
31. 在开源大模型领域,小米可能是领先华为的。#小米发布最新MiMo大模型#小米重磅开源新模型MiMo-V2-Flash!3090亿总参数+150亿活跃参数,性能媲美DeepSeek-V3.2,SWE-Bench编程得分73.4%超所有开源模型,256k超长上下文+150 tokens/秒推理速度,百万token成本低至0.1美元起~ 混合注意力+MTP+MOPD三大黑科技拉满效率,MIT协议开源可直接用,这波是小米AGI路线图的硬核第二步,全硬件生态AI底座稳了!#小米开源大模型##MiMo-V2-Flash#不过也许华为在闷声憋大招,余承东掌舵AI资源后,明年应该会有更多新动作
新浪微博 2025-12-17 00:00:00
32. 除夕夜,国产顶流压轴上线,QWEN3.5多模态开源!
微信公众号 2026-02-16 00:00:00
33. 新加坡用阿里云【通义千问】是应该反复衡量过的。新加坡最新的国家级模型“海狮”不再选择美国的Meta Llama技术,而是选择里阿里的通义千问Qwen3-32B。原因如下:(1)Llama太贵,新加坡中小企业居多,你动不动搞个GPU集群,人家用不起啊。(2)美国的AI技术对多语言定义不好,阿里的Qwen支持120种语言和方言,新加坡又追加了1000亿东南亚语言Tokens进行训练,数据量比Llama版本高出26倍。
新浪微博 2025-11-28 00:00:00
34. 2026年4月,AI模型大爆炸:当会思考变成标配,普通人该怎么选?
知乎 2026-04-15 00:00:00
35. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型
抖音 2025-12-14 00:00:00
36. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何
哔哩哔哩 2026-02-19 00:00:00
37. 没想到今年除夕夜,阿里又整了一波“AI年货”,直接开源新一代千问大模型 Qwen3.5!这次架构上玩了混合注意力机制,还自带视觉理解能力,等于是文本、图片一锅端。开源的规格也够狠,至少 2B 参数的密集模型,外加 35B-A3B MoE 大模型,推理成本下降、效率提升,感觉就是冲着让更多开发者随手用、用得起来的。更有意思的是,Qwen3.5 的代码已经提交到 HuggingFace Transformers,随时可以拉下开干。阿里去年的 Qwen2.5-Max 就是除夕放大招,今年继续延续“春节爆款”策略,这波真的把全球 AI 开源圈的存在感拉满了。#千问Qwen3.5大模型发布#
新浪微博 2026-02-16 00:00:00
38. 历史性时刻!M芯片Mac支持雷电外接GPU进行AI大模型计算!
哔哩哔哩 2026-04-10 00:00:00
39. 刚刚,「欧洲的DeepSeek」发布Mistral 3系列模型,全线回归Apache 2.0
微信公众号 2025-12-03 00:00:00
40. 华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」
微信公众号 2025-12-02 00:00:00
41. 12月开源模型汇总,2026你最期待哪个模型更新?
知乎 2025-12-31 00:00:00
42. 正面硬刚Gemini 3 Pro,阿里开源Qwen3.5-Plus|甲子光年
微信公众号 2026-02-16 00:00:00
43. #互联网技术[超话]##个重磅信号!#黄仁勋 #AI #人工智能#机器人 #自动驾驶 #CES2026 #英伟达#新年演讲# 黄仁勋在2026年CES展会上的新年首场演讲,以"物理AI"为核心主题,宣告人工智能正式迈入从理解数字世界到改造物理世界的新阶段。以下是演讲的核心内容整理: 一、时代定调:双重平台转移开启AI新纪元 黄仁勋指出,计算机行业正经历十年一遇的"平台重置",同时发生两大平台转移:一是应用程序全面构建于AI之上,软件开发从"编程"转向"训练",运行载体从CPU迁移至GPU;二是软件的开发与运行逻辑彻底革新,AI应用不再是预编译的固定程序,而是能理解上下文、实时生成内容的智能系统。这一变革正驱动全球价值约十万亿美元的计算机基础设施进行现代化改造。 二、物理AI的ChatGPT时刻已至 物理AI成为演讲的核心焦点。黄仁勋认为,AI的演进可以分为四步:感知AI、生成AI、代理AI、物理AI。当模型能够理解重力、摩擦、惯性、动量守恒等物理定律,AI才能真正走出屏幕,进入物理世界执行任务。 支撑物理AI战略的三大技术支柱已全面成型: Newton物理引擎:实现低于0.01秒的实时物理计算响应 Cosmos基础模型平台:以1000亿参数达成1毫秒级推理延迟,支持多模态物理世界理解 GPU+LPU混合架构:算力效率提升100倍,成本降低90% 三、Rubin计算架构全面量产 英伟达推出新一代Vera Rubin计算架构(简称Rubin架构),该平台已进入全面量产阶段。Rubin架构通过CPU与GPU协同设计,AI训练性能较前代Blackwell提升3.5倍,推理性能提升5倍,token生成成本最高降低10倍。该架构包含六款全新芯片:Vera CPU、Rubin GPU、NVLink 6 Switch、ConnectX-9 SuperNIC、BlueField-4 DPU和Spectrum-X以太网交换机。 四、自动驾驶与机器人突破 自动驾驶领域:英伟达发布全球首个开源端到端AI系统Alpamayo,这是业界首个具备思考推理能力的自动驾驶AI模型。2025款梅赛德斯-奔驰CLA将首发搭载该技术,计划2026年第一季度在美国上路,随后推广至欧洲和亚洲市场。 机器人领域:黄仁勋宣布"机器人领域的ChatGPT时刻已经到来"。英伟达发布了专为人形机器人设计的Isaac GR00T N1.6视觉语言行动模型等开源工具,同时推出Cosmos Reason 2推理型视觉语言模型。特斯拉Optimus人形机器人已通过Omniverse数字孪生平台完成90%以上的训练,自主运行比例达85%,2026年第一季度将实现5万台量产,成本降至2万美元以下。 五、开源生态战略加速 黄仁勋强调,开源模型与前沿闭源模型的差距已缩短至约6个月,且仍在持续缩小。英伟达不仅开源模型,还开源用于训练这些模型的数据,以建立真正的"系统信任"。现场展示的多款开源模型包括三家中国开源模型:Kimi K2、Qwen和DeepSeek V3.2。黄仁勋特别提到,DeepSeek R1的出现意外推动了整个行业的变革进程。 六、全栈AI体系构建 英伟达的角色已从芯片供应商转变为"全栈AI体系"的构建者。通过"三台计算机"的架构——训练(DGX超级计算机)、仿真(Omniverse与RTX)、推理(AGX系列边缘设备),英伟达构建了从云端训练到现实部署的完整闭环系统。同时,通过开源模型、数据及NeMo开发库,英伟达正推动技术民主化,让更多开发者和企业能够参与到物理AI的创新浪潮中。 黄仁勋在演讲结尾强调,物理AI的落地将重塑全球千万家工厂与数十万个仓库的运作逻辑,开启AI与实体经济深度融合的新时代。 http://t.cn/AXb9Z9MM
新浪微博 2026-01-07 00:00:00
44. 大厂P9直言:Java同质化太严重,想突围必须拿下RAG、Agent、微调这三项!“Java+AI”是拿百万年薪的重点方向!
知乎 2026-02-14 00:00:00
45. 千问3.5是阿里AI的“大一统”时刻
微信公众号 2026-02-17 00:00:00
46. 2026年AI全景预测:迈向百亿智能体时代的20个发展趋势。 #大咖观察 #人工智能 #红衣聊AI #智能体 #AI时代
抖音 2026-01-09 00:00:00
47. #谷歌发布gemma4开源大模型#谷歌终于把最强开源大模型放出来了等了这么久Gemma 4总算来了,采用Apache 2.0的同时,针对不同的硬件环境发布了四种规模的模型。整体来说,Gemma 4这次所有规模的模型都原生支持处理视频和图像了,在OCR和图表理解方面表现得相当不错 #谷歌发布gemma4开源大模型##how i ai#
新浪微博 2026-04-05 00:00:00
48. 除夕夜还没到,阿里先把牌亮了。新一代千问大模型 Qwen3.5 今晚开源,听说这次不是小修小补,是动了模型架构。#千问Qwen3.5大模型发布#去年同样是除夕深夜,阿里突然甩出 Qwen2.5-Max,把不少人看懵。今年又选这个时间点,意思很明确:年味可以慢慢过,技术牌必须先打。
新浪微博 2026-02-16 00:00:00
49. 阿里正式发布新一代基模千问3.5
微信公众号 2026-02-16 00:00:00
50. 如何评价 3 月 30 日发布的 Qwen3.5-Omni 的性能表现?
知乎 2026-03-31 00:00:00
51. #千问Qwen3.5大模型发布# 刚刚,千问正式官宣发布 Qwen3.5,并推出Qwen3.5系列的第一款模型 Qwen3.5-397B-A17B 的开放权重版本。作为原生视觉-语言模型,Qwen3.5-397B-A17B 在推理、编程、智能体能力与多模态理解等全方位基准评估中表现优异,助力开发者与企业显著提升生产力。该模型采用创新的混合架构,将线性注意力(Gated Delta Networks)与稀疏混合专家(MoE)相结合,实现出色的推理效率:总参数量达 3970 亿,每次前向传播仅激活 170 亿参数,在保持能力的同时优化速度与成本。我们还将语言与方言支持从 119 种扩展至 201 种,为全球用户提供更广泛的可用性与更完善的支持!#HOW I AI##过个有AI年#
新浪微博 2026-02-16 00:00:00
52. 如何评价 Google 发布的开源大模型 Gemma4?使用体验怎么样?
知乎 2026-04-03 00:00:00
53. 开源大模型与闭源大模型的差距是在缩小还是在扩大?关键因素是什么?
知乎 2025-12-23 00:00:00
54. AI圈最魔幻的一幕出现了。一边是:DeepSeek 刚发布 OCR 2,用的是阿里Qwen2-0.5B。小模型、旧模型,却把 OCR 成本直接打下来,还成了行业方案。另一边是:Llama 这个“开源精神图腾”,被曝偷偷蒸馏阿里的千问模型。讽刺的是DeepSeek光明正大用 Qwen,还写进论文。而Llama偷偷用 Qwen,还不敢认。能看出来,开源世界的底座,正在悄悄变成阿里Qwen。
新浪微博 2026-01-28 00:00:00
55. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?
知乎 2026-02-16 00:00:00
56. 阿里发布千问3.5,性能媲美Gemini 3, Token价格仅为其1/18
知乎 2026-02-16 00:00:00
57. 【0 元免费学】AgentScope Java 极客时间公开课上线!
知乎 2026-02-10 00:00:00
58. #阿里新一代模型Qwen3.5曝光#中国大模型“疯狂2月”的重要一环阿里新一代大模型Qwen3.5曝光了,看了一下,Qwen3.5采用全新架构,支持原生视觉理解能力,可直接处理图像等多模态输入,并且在逻辑推理、数学计算及代码编写能力上具有显著突破,这波是国产大模型全球竞争力再次迎来强化呀。
新浪微博 2026-02-09 00:00:00
59. #DeepSeek发布V3.2正式版# Open AI 再次迎来暴击!DeepSeekV3.2性能比肩GPT5 ,略低于 Gemini-3.0-Pro。V3.2-Speciale ,是全球首个“深度工具推理”开源模型,性能媲美 Gemini-3.0-Pro。此外,还把API 价格拉到前所未有的低谷:输入仅 0.28 美元/百万 tokens,输出 0.42 美元/百万tokens!相比 GPT-5 的 1.25–15 美元/百万,这简直是 1/5 到 1/50 的屠杀级折扣。
新浪微博 2025-12-01 00:00:00
60. 【华为昇腾 0 Day 适配阿里 Qwen3.5,MindSpeed MM 框架实现 " 开箱即用、快速迭代 "】阿里在 chat.qwen.ai 页面低调上线了 Qwen3.5-Plus 和 Qwen3.5-397B-A17B 两款新模型(均支持文本和多模态任务)。Qwen3.5 Plus 定位为 Qwen 3.5 系列最新大语言模型;Qwen3.5-397B-A17B 定位则是 Qwen3.5 开源系列旗舰大语言模型。华为计算官方昨晚宣布,Qwen3.5 模型一经开源发布,昇腾 0 day 实现基于 MindSpeed MM 在 Atlas 800 A3、Atlas 900 A3SuperPoD 上的训练复现,同时也支持基于 vLLM-Ascend 和 SGLang 在 Atlas 800 A2、Atlas 800 A3 上的高效推理部署。据介绍,基于 FSDP 训练后端的设计,MindSpeed MM 框架大幅缩短了新模型的适配周期,实现了 " 开箱即用、快速迭代 " 的开发体验,为多模态大模型的研究与应用提供了技术支撑。另据阿里云介绍,Qwen3.5 实现了底层模型架构的全面革新,其中,Qwen3.5-Plus 版本总参数为 3970 亿,激活仅 170 亿,性能超过万亿参数的 Qwen3-Max 模型,部署显存占用降低 60%,推理效率大幅提升,最大推理吞吐量可提升至 19 倍。Qwen3.5 在能力、效率与通用性三个维度上推进预训练:能力(Power):在更大规模的视觉-文本语料上训练,并加强中英文、多语言、STEM 与推理数据,采用更严格的过滤,实现跨代持平:Qwen3.5-397B-A17B 与参数量超过 1T 的 Qwen3-Max-Base 表现相当。效率(Efficiency):基于 Qwen3-Next 架构 —— 更高稀疏度的 MoE、Gated DeltaNet + Gated Attention 混合注意力、稳定性优化与多 token 预测。在 32k/256k 上下文长度下,Qwen3.5-397B-A17B 的解码吞吐量分别是 Qwen3-Max 的 8.6 倍 / 19.0 倍,且性能相当。Qwen3.5-397B-A17B 的解码吞吐量分别是 Qwen3-235B-A22B 的 3.5 倍 / 7.2 倍。通用性(Versatility):通过早期文本-视觉融合与扩展的视觉 / STEM / 视频数据实现原生多模态,在相近规模下优于 Qwen3-VL。多语言覆盖从 119 增至 201 种语言 / 方言;25 万词表(vs. 15 万)在多数语言上带来约 10–60% 的编码 / 解码效率提升。vllm 部署指导可参见魔乐社区和 gitcode 社区链接:网页链接网页链接SGLang 部署指导可参见 SGLang 社区链接:网页链接
新浪微博 2026-02-17 00:00:00
61. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
62. #阿里新一代模型Qwen3.5曝光#大的要来了,昨天在全球最大AI开源社区HuggingFace的开源项目页面中,最新出现Qwen3.5并入Transformers的新PR。事实上,在本月初,就有业内人士爆料,近期将有包括 DeepSeek v4、Qwen3.5、GLM-5 在内的众多新模型登场。千问点外卖是应用层的出圈,而作为底部支撑的大模型,感觉也越来越强了,这是要多点开花了。
新浪微博 2026-02-09 00:00:00
63. #微博声浪计划##听见微博# DeepSeek新模型曝光,其新一代旗舰模型V4核心架构MODEL1因GitHub代码更新意外公开。该架构在KV缓存、FP8量化等方面革新,支持百万Token上下文,推理成本仅为GPT-4 Turbo的1/70,预计2026年春节发布,或推动国产大模型效率革命。 铭科技的微博音频
新浪微博 2026-01-22 00:00:00
64. 上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
知乎 2026-03-02 00:00:00
65. 【阿里Qwen3.5-Plus/Qwen3.5-397B-A17B新模型上线】财联社2月16日电,阿里今天下午在chat.qwen.ai页面上线了Qwen3.5-Plus和Qwen3.5-397B-A17B两款新模型。Qwen3.5-Plus定位为Qwen3.5系列最新大语言模型,Qwen3.5-397B-A17B定位则是Qwen3.5开源系列旗舰大语言模型。两款模型均支持文本和多模态任务。
新浪微博 2026-02-16 00:00:00
66. 【#科研速递# | 清华团队提出“密度法则”揭示大模型高效化发展内在趋势】 近日,清华大学团队与大模型开源社区OpenBMB合作,提出大模型“密度法则”概念,指出大模型的最大“能力密度”随时间呈指数级增长:2023年2月至2025年4月,大模型最大“能力密度”约每3.5个月翻一番。为了量化“能力密度”,研究团队设计了相对“能力密度”的评估框架。该研究强调密度优化是大模型发展的关键路径,源于架构、算法和数据处理的进步。研究成果以“大模型密度法则”为题,于11月20日作为封面文章,发表于《自然·机器智能》。论文链接:网页链接 (来源:计算机系)清华大学
新浪微博 2025-11-23 00:00:00
67. Agent 越用越聪明?AgentScope Java 在线训练插件来了!
知乎 2026-02-26 00:00:00
68. 【#DeepSeek发布V3.2正式版#:#DeepSeekV3.2性能比肩GPT5# ,略低于 Gemini-3.0-Pro】继两个月前发布实验性的 DeepSeek-V3.2-Exp后,DeepSeek今日宣布同时发布两个正式版模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。目前,官方网页端、App 和 API 均已更新为正式版 DeepSeek-V3.2,供广大用户使用。Speciale 版本目前仅以临时 API 服务形式开放,主要供社区评测与研究。据悉,DeepSeek-V3.2 的目标是平衡推理能力与输出长度,适合日常使用,例如问答场景和通用 Agent 任务场景。在公开的推理类 Benchmark 测试中,DeepSeek-V3.2 达到了 GPT-5 的水平,仅略低于 Gemini-3.0-Pro;相比 Kimi-K2-Thinking,V3.2 的输出长度大幅降低,显著减少了计算开销与用户等待时间。DeepSeek-V3.2-Speciale 的目标是将开源模型的推理能力推向极致,探索模型能力的边界。V3.2-Speciale 是 DeepSeek-V3.2 的长思考增强版,同时结合了 DeepSeek-Math-V2 的定理证明能力。该模型具备出色的指令跟随、严谨的数学证明与逻辑验证能力,在主流推理基准测试上的性能媲美 Gemini-3.0-Pro。更令人瞩目的是,V3.2-Speciale 模型斩获 IMO 2025(国际数学奥林匹克)、CMO 2025(中国数学奥林匹克)、ICPC World Finals 2025(国际大学生程序设计竞赛全球总决赛)及 IOI 2025(国际信息学奥林匹克)金牌。其中,ICPC 与 IOI 成绩分别达到了人类选手第二名与第十名的水平。在高度复杂任务上,Speciale 模型大幅优于标准版本,但消耗的 Tokens 也显著更多,成本更高。目前,DeepSeek-V3.2-Speciale 仅供研究使用,不支持工具调用,暂未针对日常对话与写作任务进行专项优化。(新浪科技)
新浪微博 2025-12-01 00:00:00
69. 评估工程正成为下一轮 Agent 演进的重点
知乎 2025-11-06 00:00:00
70. 用 AgentScope Java 开家 AI 奶茶店
知乎 2026-02-02 00:00:00
71. 迟来,26年2月开源模型汇总!DeepSeek虚晃一枪,国内大模型狂卷~
知乎 2026-03-03 00:00:00
72. Qwen3.5小型模型全面剖析,揭秘其核心技术亮点
今日头条 2026-03-23 00:00:00
73. 端侧天花板!Qwen3.5家族强悍系列模型来袭
今日头条 2026-02-28 00:00:00
74. 上海超级计算中心成功部署Qwen3.5开源大模型
微信公众号 2026-04-01 00:00:00
75. Qwen3.5技术报告解读
知乎 2026-04-08 00:00:00
76. Qwen3.5模型学习
知乎 2026-02-28 00:00:00
77. 如何评价Qwen3.5的综合性能
今日头条 2026-02-16 00:00:00
78. 阿里除夕夜放大招!Qwen3.5 到底有多强?一篇看懂
微信公众号 2026-02-17 00:00:00
79. 2026年开源大语言模型选型指南
今日头条 2026-04-13 00:00:00
80. 5 分钟搞懂开源大模型选型核心维度,16G显卡也能选对
知乎 2026-01-28 00:00:00
81. 2026 开源大模型全景图
微信公众号 2026-03-31 00:00:00
82. 怎么测试我自己训练的模型
微信公众号 2026-04-03 00:00:00
83. 2026年9个最好的开源大模型
微信公众号 2026-03-12 00:00:00
84. LLM测试2026
微信公众号 2026-03-03 00:00:00
85. 2026年开源大模型爆发
今日头条 2026-03-29 00:00:00
86. 2026年大模型终极横评
微信公众号 2026-03-30 00:00:00
87. 2026年主流大语言模型分析
微信公众号 2026-02-25 00:00:00
88. 2026年AI大模型进入实用新纪元
知乎 2026-04-03 00:00:00
89. 开源大模型商业化爆发!2026企业零成本用AI,定制化模型千元起
今日头条 2026-04-04 00:00:00
90. 2026 年开源大模型 TOP10 完整榜单
知乎 2026-02-25 00:00:00
91. 中国开源大模型如何让AI Token成本降超50%?
今日头条 2026-03-24 00:00:00
92. 2026 年大模型 API 横评
微信公众号 2026-04-14 00:00:00
93. 本地LLM革命
微信公众号 2026-04-03 00:00:00
94. LLaMA行业报告
今日头条 2026-04-09 00:00:00
95. 谷歌Gemma4开源大模型引爆AI生态 Apache2.0协议或改写行业格局
微信公众号 2026-04-04 00:00:00
96. 谷歌全新Gemma4开源大模型重磅发布
今日头条 2026-04-04 00:00:00
97. 开源大模型三国争霸
今日头条 2026-04-05 00:00:00
98. 本地部署大模型的春天,真的来了!
今日头条 2026-04-05 00:00:00
99. MIT最新研究
微信公众号 2026-04-09 00:00:00
100. Liquid AI LFM2 技术报告
微信公众号 2025-12-04 00:00:00
101. LFM2技术报告
知乎 2026-02-09 00:00:00
102. 1-bit LLM,不是变小,而是AI开始“下沉”
抖音 2026-04-11 00:00:00
103. ACL25 | 解析面向边缘部署的小型语言模型
小红书 2026-02-01 00:00:00
104. 开源大模型微调对比
知乎 2026-02-14 00:00:00
105. 开源模型实战落地全指南
知乎 2026-03-24 00:00:00
106. 开源大模型选择指南
知乎 2026-01-18 00:00:00
107. 开源大模型微调对比
知乎 2026-02-11 00:00:00
108. 轻量可微调且开源的大语言模型家族
微信公众号 2025-11-14 00:00:00
109. 大模型微调太难太烧钱?这个开源神器让你训练快2倍,显存省70%
微信公众号 2026-02-13 00:00:00
110. 贪心-大模型微调实战营-精通+指令微调+开源大模型微调+对齐+垂直领域应用
知乎 2025-11-19 00:00:00
111. “AI赋能三板斧”
微信公众号 2025-10-18 00:00:00
112. MistralAI正式发布M3大模型
今日头条 2025-12-04 00:00:00
113. GitHub一巡!解决大模型端侧部署难题,MiniCPM-o轻量级模型实现高效推理与多任务支持
微信公众号 2026-02-09 00:00:00
114. AI小知识:普通人怎么选用AI模型?
https://blog.sciencenet.cn/blog-3302154-1526309.html
115. AI小知识:普通人怎么选用AI模型?-阎影的博文
https://wap.sciencenet.cn/blog-3302154-1526309.html?mobile=1
116. 半两财经|开源大模型榜单发布,前十名有8款来自中国
腾讯网
117. 比国产AI还卷:谷歌Gemma 4以小博大,端侧模型迎来分水岭
腾讯网
118. 周鸿祎说开源力量超闭源,未来开源模型能否追上 GPT-4?
今日头条
119. 鏖战2025年,大模型围着开源转
120. 给开源AI投喂敏感数据后
南京市数据局
121. 违规使用开源AI工具 敏感资料被泄露 案例解读
新浪财经
122. 违规使用开源AI工具 敏感资料被泄露 案例解读→
网易
123. 2月全球前十开源模型均源自中国
光明网
124. 全球中文大模型战力榜发布:前三被海外包揽 国产有惊喜
随心
125. 【百家民企说】开源中国徐勇:基础大模型研发头部效应会愈加明显
新浪财经
126. 鏖战2025年,大模型围着开源转
今日头条
127. 开源社区一个 “又强又便宜” 的大模型选择—DeepSeek-V3.2
人人都是产品经理
128. 开源大模型微调对比:选对模型,事半功倍
129. 2026 年主流大模型性能价格对比指南(openclaw系列之一)
今日头条 2026-03-23 00:00:00
130. Qwen3.5 再回顾
微信公众号 2026-03-05 00:00:00
131. Llama系列:从 Lama1 到 Llama 4 的演进——从纯文本到原生多模态智能体
微信公众号 2025-10-21 00:00:00
132. Llama系列模型迭代梳理
知乎 2026-01-21 00:00:00
133. 在GPU服务器上部署大模型推理服务,常用的开源框架(如vLLM, TensorRT-LLM)如何选择?
知乎 2026-04-13 00:00:00
134. Meta旗下的Llama系列大模型有哪些过人之处?
知乎 2026-01-18 00:00:00
135. 真实硬核测评:PinchBench 帮你挑出 OpenClaw 最强 LLM 模型
知乎 2026-03-27 00:00:00
136. 清华智谱开源GLM-5 全球评分最高的开源大模型
微信公众号 2026-03-04 00:00:00
137. 大模型在推理时代有哪些优势
今日头条 2026-03-28 00:00:00
138. 2024-2026年大模型架构都用啥?40个模型架构图、4大架构及4个趋势总结
微信公众号 2026-03-17 00:00:00
139. 【大模型推理部署】:开源大模型推理框架有哪些?
知乎 2025-11-04 00:00:00
140. 大模型推理成本与优化技术全景解析
今日头条 2026-02-22 00:00:00
141. Qwen3.5发布在即,来看看模型架构都更新了什么
知乎 2026-02-11 00:00:00
142. 大模型推理成本优化:开源模型如何降低AI商业化门槛
微信公众号 2026-04-09 00:00:00
143. DeepSeek V3.2发布!实测效果惊艳,便宜是最大优势
今日头条 2025-12-03 00:00:00
144. 深度解析LLM量化技术
微信公众号 2026-02-26 00:00:00
145. 阿里Qwen3.5-Flash实测
知乎 2026-02-27 00:00:00
146. 1毫秒算出最省钱集群:FleetOpt 把 LLM 推理 GPU 成本最高砍掉 82.4%
微信公众号 2026-04-04 00:00:00
147. DeepSeek v3.2 正式发布,对标 GPT-5
今日头条 2025-12-11 00:00:00
148. 大模型解剖图火了,30多个开源模型架构差异一目了然,还可接入AI
今日头条 2026-03-16 00:00:00
149. DeepSeek V3.2 正式版发布
今日头条 2025-12-02 00:00:00
150. Gemma4改用Apache2.0、千问3.6Plus迭代:2026年全球大模型开源战
今日头条 2026-04-06 00:00:00
151. Qwen3.5本地部署终极指南,Qwen3.5-27B
知乎 2026-02-26 00:00:00
152. Qwen3.5 模型结构分析
知乎 2026-02-16 00:00:00
153. 吃透 AI 模型天梯图:2026 大语言模型(LLM)16 项 Benchmark评估指标全解析
微信公众号 2026-01-28 00:00:00
154. 降低35%以上推理成本:一种支持企业快速部署的高可靠性LLM服务网关架构(一)
知乎 2025-10-28 00:00:00
155. DeepSeek-V3.2发布,让DeepSeek再次伟大!
今日头条 2025-12-04 00:00:00
156. DeepSeekV3.2正式版发布:比肩GPT-5
今日头条 2025-12-02 00:00:00
157. UltraLAB 高性能GPU工作站:大语言模型(LLM)私有化部署与微调一站式解决方案
微信公众号 2026-04-02 00:00:00
158. DeepSeek-V3.2 到底有多强?
今日头条 2025-12-02 00:00:00
159. 大模型十大高频问题之五:如何低成本部署大模型?有哪些开源框架推荐?
微信公众号 2025-12-05 00:00:00
160. 阿里开源Qwen3.5-Flash:35B反超235B
知乎 2026-02-26 00:00:00
161. LLM 评估框架全解析:从 mega 到生产级评测
微信公众号 2026-03-31 00:00:00
162. GitHub星标破万!Meta开源Llama全系列演进史:从Llama-1到Llama-3
微信公众号 2025-11-20 00:00:00
163. DeepSeekV3.2正式版发布,比肩GPT-5
今日头条 2025-12-03 00:00:00
164. DeepSeekV3.2正式版发布,包含保准版和增强版两类
今日头条 2025-12-03 00:00:00
165. 三大开源 LLM 评估工具:Deepeval、LM Evaluation Harness与OpenCompass 一文详解
知乎 2026-02-12 00:00:00
166. 本地LLM部署工具(写给小白的LLM工具选型系列:第一篇)
知乎 2026-04-04 00:00:00
167. llama_cpp 开源项目推荐
微信公众号 2026-03-24 00:00:00
168. DeepSeekV3.2正式版发布,媲美GPT
今日头条 2025-12-02 00:00:00
169. IEEE JSTSP:基于旁路网络迁移的端侧大模型微调方法
微信公众号 2026-03-27 00:00:00
170. 如何选择AI大模型?
微信公众号 2026-03-31 00:00:00
171. LLM Agent 成本居高不下?斯坦福最新研究!从业者必学的省钱大招 | Agentic Plan Caching:LLM 智能体应用的成本优化新方案
微信公众号 2026-01-14 00:00:00
172. Deepseek-v3.2 更新内容全解析,新功能3 步就能上手
今日头条 2025-12-02 00:00:00
173. 大模型推理框架大混战:2026 年谁才是性能王者?
微信公众号 2026-03-31 00:00:00
174. 昇腾 910B 安装 Qwen3.5-27B 大模型(实战)
微信公众号 2026-03-22 00:00:00
175. 开源语言模型详细微调教程
知乎 2025-12-14 00:00:00
176. DeepSeek-V3.2系列发布:平衡推理效率与极限能力,开源赋能行业
今日头条 2025-12-02 00:00:00
177. OpenClaw 个人部署的花费在哪些地方?
今日头条 2026-03-09 00:00:00
178. LLM大模型优化技术和边缘计算
微信公众号 2026-01-27 00:00:00
179. CJE 专栏征稿延期通知 | 边缘侧大语言模型
微信公众号 2026-04-01 00:00:00
180. 阿里Qwen3.5-27B实测
知乎 2026-02-27 00:00:00
181. 聊聊如何评估大模型
今日头条 2025-10-28 00:00:00
182. 边缘LLM推理:闪存如何突破显存与性能瓶颈?
微信公众号 2025-11-15 00:00:00
183. 图解大模型开源项目002:LlamaFactory,大语言模型高效微调框架
知乎 2026-01-10 00:00:00
184. OpenClaw Token 永久自由Ollama 本地部署完全指南
知乎 2026-03-24 00:00:00
185. AI大变局:拐点不在云端,而在边缘
微信公众号 2025-10-28 00:00:00
186. DeepSeek V3.2发布!超GPT-5,对标Gemini 3.0 Pro
今日头条 2025-12-02 00:00:00
187. 边缘计算环境下大型语言模型分布式协同推理 EdgeShard
知乎 2026-03-07 00:00:00
188. AAAI 2026|视频大语言模型到底可不可信?23款主流模型全面测评来了
知乎 2025-12-16 00:00:00
189. 看完这篇,你就懂大模型了
今日头条 2026-02-26 00:00:00
190. 在树莓派上运行本地 LLM 和 VLM
知乎 2025-10-20 00:00:00
191. 大模型最热门的7大框架介绍!
小红书 2025-10-28 00:00:00
已收藏
去我的收藏夹