国产大模型真能硬刚GPT-5?DeepSeek R1引爆全网观点大战
25-12-17
精选参考来源
精选参考来源
1. 拒绝捧杀DeepSeekMath-V2,118分固然惊艳,但距离 OpenAI 到底还有多远?
微信公众号
2. GPT-5封神?我呸!实测下来就是个花架子,被DeepSeek R1按在地上摩擦
微信公众号
3. OpenAI与deepseek、阿里云对比
微信公众号
4. 中国AI攻破OpenAI算力护城河!DeepSeek和Kimi撼动高成本路线
微信公众号
5. 如何看待2025年国产AI大模型的爆发式增长?DeepSeek、Kimi、GLM-4等能否赶超OpenAI?
知乎
6. 从 DeepSeek-R1 到OpenAI gpt-oss,开源背后,是中美AI罕见正和博弈
知乎
7. 梁文锋论文登上Nature封面,DeepSeek首次回应蒸馏OpenAI质疑
微信公众号
8. DeepSeek-R1 登上《Nature》封面
今日头条
9. 国产模型谁还在单纯看排名?聪明人用场景选AI
今日头条
10. 600万干翻千亿?DeepSeek R1霸榜《时代》,OpenAI彻底哑火
微信公众号
11. 盘点!2025年中国大模型行业全景
今日头条
12. 《 2025AI大模型开发生态白皮书 》拆解
微信公众号
13. 中国 AI 开源模型下载量占比首次超过美国
微信公众号
14. 中国大模型正跻身全球第一梯队
微信公众号
15. DeepSeek超越OpenAI?别急,这盘棋才刚开始
今日头条
16. DeepSeek杀出一条血路
今日头条
17. 上新|DeepSeekV3.2发布,推理能力与GPT-5不相上下,Speciale版本拿下奥数金牌
微信公众号
18. 用了三个月DeepSeek
知乎
19. 中国AI模型DeepSeek-R1震惊世界Chinese AI Model DeepSeek-R1
微信公众号
20. 算力封锁下的逆袭,国产推理大模型的崛起与征途
微信公众号
21. 国产大模型杀疯了!DeepSeek V3.2实测
微信公众号
22. 国产大模型炸场!DeepSeek V3.2双版本发布,推理追平GPT-5,奥赛斩金
微信公众号
23. 紫东太初4.0打破AI边界,国产大模型实现“深度推理”突破
微信公众号
24. 千问3重磅开源!国产大模型首次全面超越,实测推理、编程、写作能力
知乎
25. GLM-4.6 重磅升级
微信公众号
26. 有Thinking的模型vs标准模型——以DeepSeek-V3和DeepSeek-R1为例
知乎
27. 18款AI模型幻觉率大公开|你的AI靠谱吗?
今日头条
28. 警惕AI“信口开河”
微信公众号
29. 新AI幻觉率飙升至48%......
知乎
30. 国泰海通|计算机
微信公众号
31. AI大模型,中国开源共创,美国闭源高墙,未来属于谁?
今日头条
32. 开源模型"逆袭"的背后
微信公众号
33. 李开复
今日头条
34. AI,国产大模型分析
微信公众号
35. 为什么国产大模型与GPT5和Grok4性能差距明显?要怎么才能追赶?
今日头条
36. 封锁下绝地反击!国产大模型凭两大硬核技术,撕开全球AI霸权围堵
今日头条
37. GPT5 & Claude 90分 vs 国内大模型 70分
微信公众号
38. 国产大模型“狂禅式”的训练范式急需变革
今日头条
39. Gemini 3 Pro 正面压境,国产大模型的技术缺口,被彻底放大了
今日头条
40. DeepSeek R2 推迟背后
知乎
41. 国产大模型与芯片的“双向奔赴”
微信公众号
42. 以后和你同台竞争的,除了其他人类,还有AI。 #大咖观察 #红衣聊AI #DeepSeek #人工智能 #金融
抖音
43. #DeepSeek登自然封面意味什么#DeepSeek R1论文荣登《自然》封面,此前仅有AlphaGo、AlphaFold获此殊荣,而这一次,中国AI的名字站上了世界科研的最高光处。R1论文不仅公开了仅约29.4万美元的训练成本,还补充了数据与安全细节;评审专家更指出,它是首个真正通过同行评审的大型语言模型。其影响力已获广泛认可:谷歌学术引用达3596次、Hugging Face下载量超1090万、GitHub星标数突破91K。这也许意味着中国AI企业正从「论文顶会」走向「科学殿堂」,也预示行业竞争将从比拼算力、参数规模,转向能否产出经得起全球同行检验的硬核成果
新浪微博
44. Claude全面禁中国企业?别怕,国产模型够顶! #大咖观察 #Claude #马斯克 #红衣聊AI
抖音
45. 当OpenAI们还在拼谁烧的钱多 中国工程师已经在拼谁的方法更巧。#大咖观察 #红衣聊AI #OpenAI #kimi
抖音
46. OpenAI发布最强开源大模型,开源AI进入T0时代 OpenAI发布最强开源大模型gpt-oss,奥特曼放话,这是世界上最好最实用的开放模型。 亮点1、跑分离谱 大杯120B版本,性能打平OpenAI第二强的模型o4-mini,,在核心基准测试上全面碾压Qwen 3/Kimi K2和DeepSeek R1, 还有个中杯20B版本,性能接近o3-mini。 亮点2、实用性爆表 120B采用MOE架构,活跃参数仅5B,一张H100就能跑。 20B更夸张,原生支持4Bit量化,16G显存的电脑甚至是手机都能运行。 亮点3、透明可解释 默认展示没有经过美化和处理的原始思维链,可以完整观察到模型的“思考”过程。 亮点4、天生智能体 原生支持函数调用、网页浏览、Python代码执行,还能调节推理强度,0帧起手做智能代理 本周五还有GPT5发布 #AI新星计划 #人工智能 #OpenAI #大模型 #gptoss
抖音
47. Gemini 3亮点解读,断层领先重夺最强 Google放出年度王炸,Gemini 3重夺地表最强。 LMArena首次突破1500分,HLE不用工具拿下41%,AGI测试更是飙到45% 亮点1、最强视觉能力 亮点2、最强编码能力 亮点3、最强智能体能力 亮点4、智能体IDE Antigravity #AI新星计划 #人工智能 #google #gemini #大模型
抖音
48. DeepSeek论文登《Nature》, 让中国AI在全球 “插旗”!#大咖观察 #红衣聊AI #DeepSeek
抖音
49. 不妄自菲薄看轻本土A 潜力,用行动缩小差距。 #大咖观察 #红衣聊AI #DeepSeek
抖音
50. #国产最强AI还是DeepSeek吗#2025年的国产AI江湖真是热闹!距离DeepSeek-R1封神已过去5个月,江湖早已变天!从榜单看,DeepSeek仍稳坐聊天机器人分类头把交椅,访问量高达43620.3万,同比增长9.15%,实力底子还在。但身后的豆包势头迅猛,以5667.1万访问量紧随其后,增长率7.10%;Kimi也凭借对学术场景的精准适配,稳居第7位,成了不少研究者的心头好。像字节跳动的AI豆包,在全场景适配、情感化交互、知识更新速度以及个性化服务等方面表现超出色,能深度融入生活、学习、工作各个领域,是大家贴心的全能生活助手 。还有阿里的Qwen3系列,在各大基准测试中成绩瞩目,Qwen3-235B在ArenaHard、AIME’24/'25、CodeForces等多个高难度指标上分数极高,在部分关键指标(如数学和代码能力)上已经可以与Gemini 2.5 Pro掰手腕,甚至和DeepSeek-R1相比,在多个维度上也展现了更强的竞争力或整体优势。曾经我们与国外AI可能望尘莫及,但现在国产AI奋起直追,DeepSeek-R1、Qwen3等在很多性能上都已经能和OpenAI、Gemini等顶尖国外AI相媲美#ai生活指南#
新浪微博
51. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴
抖音
52. #老外惊叹中国AI出新速度# 中国AI又在海外圈粉了!这次是百度刚出的文心大模型X1.1,百度先在国内WAVE SUMMIT大会发布该模型,当晚又登陆海外X/YouTube直播,吸引大批博主热议,Grab CPO、huggingface研究员(CTO株型助理)等点赞关注! 作为迭代升级的深度思考模型,X1.1事实性、指令遵循、智能体能力较前代分别提升34.8%、12.5%、9.6%,评测中超越DeepSeek R1-0528,与GPT-5、Gemini 2.5 Pro持平。 不得不说,北京这次给国产AI的排面够足,高规格大会搭台,再让技术直接走向全球!中国AI的创新速度让老外直呼震撼!#北京给国产AI的排面#
新浪微博
53. 人工智能到底藏着多少你没看懂的机会? #大咖观察 #红衣聊AI #十五五规划
抖音
54. 华为昇腾宣布0Day支持DeepSeek-V3.2-Exp DeepSeek-V3.2-Exp重磅发布!华为宣布零Day支持!国产大模型牵手国产算力的背后是国产AI基建越来越成熟的适配能力!#华为 #昇腾 #DeepSeek
抖音
55. 全球最强算力!华为算力大阅兵,AI芯片碾压全球#华为 #算力底座 #人工智能 #AI #昇腾AI
抖音
56. 在这场十年级别的大周期里,你觉得谁会成为新的玩家? #大咖观察 #红衣聊AI #人工智能 #商业思维
抖音
57. 工具永远是工具,驱动创新的永远是人类的想象。 #大咖观察 #红衣聊AI #人工智能 #科技改变生活 #AI工具
抖音
58. 你觉得AI会像互联网一样改写历史吗? #大咖观察 #红衣聊AI #互联网
抖音
59. 把AI从“精英玩具”变成“全民工具” 让全世界都能用上便宜的AI。#大咖观察 #红衣聊AI #开源
抖音
60. #横扫硅谷的千问杀回国内#【中国AI王炸登场!横扫硅谷的千问杀回国内】怪不得朱啸虎说能硬刚ChatGPT的国产AI出现了,在这场全球顶级竞赛中,中国正以扎实的技术实力和创新步伐,展现出独特的竞争力。全球AI双强格局已定,中美领跑,中国成为唯一能正面竞争美国AI产业的国家。 Qwen是阿里研发的大模型基座,「千问」APP作为Qwen大模型的首个消费者应用,此次直接面向大众市场,从模型能力到大众应用,中国AI生态完成关键跨越。早前Qwen大模型的卓越性能就已获国际广泛认可。在Hugging Face全球榜单中,通义旗下7款模型跻身全球前十;其中Qwen3-Max性能表现卓越,在多项权威评测中位列全球前三,被认证为全球性能最高的非推理模型,阿里开源模型Qwen早已获国际公认世界第一地位
新浪微博
61. #微博发布首个开源大模型#VibeThinker-1.5B,一个具有1.5亿个参数的密集模型。 “VibeThinker-1.5B 的总训练成本仅为 7,800 美元,与闭源模型 Magistral Medium 和 Claude Opus 4 相比,它展现出卓越的推理能力,同时性能也与 GPT OSS-20B Medium 等开源模型不相上下。” 该模型采用以“频谱信号原理(SSP)”为中心的创新型后训练方法开发而成。 频谱信号法是指他们首先创建各种各样的答案,然后通过对成功答案进行更多训练来放大真实信号。 在频谱阶段,模型学习对每个数学或代码问题进行多次尝试,而不是只进行一次猜测。 作者通过培训代数、几何、微积分和统计学方面的专家,并将他们平均到一个单一模型中,从而增加多样性。 在信号阶段,强化学习会给予解决问题的答案轨迹更高的奖励,并降低失败的权重。 MaxEnt 规则将训练重点放在模型有大约 50% 的把握能答对的问题上,对于模型不确定的问题则进行训练。 这些步骤将嘈杂的试错法转化为更稳定的多步骤推理,从而能够推广到新的问题中。 最终的 15 亿台模型在 AIME24、AIME25 和 HMMT25 测试中击败了 DeepSeek R1,在 LiveCodeBench v6 测试中得分为 51.1,售价约为 7,800 美元。 论文 – arxiv.org/abs/2511.06221 论文题目:“小模型,大逻辑:多样性驱动的优化在 VibeThinker-1.5B 中激发了大模型推理能力”[并不简单]#ai生活指南##ai创造营#
新浪微博
62. 我们正站在一个历史转折点上,但每次技术革命都会创造新的机会。 #大咖观察 #红衣聊AI #人工智能 #技术流
抖音
63. AI大战骗子酒馆②:八大顶级AI赌命血战,赢家竟是?
哔哩哔哩
64. 迈向AGI的第一步?国产自研GLM4.5,重新定义智能体【趁热聊聊x百大AI应用视频播客】
哔哩哔哩
65. 千元性价比最优选,2T容量拓展+90hz屏+天玑6400+10200电池,联想小新平板12.1测评~
哔哩哔哩
66. 见过快的,没见过这么快的!千问更新的速度简直像开了加速器:不光界面升级更加简洁,更是重磅上线三大模型,全面提升了视频图像创作、拍照答疑、文档创作编辑能力。满血版图像模型稳如谷歌,视频长度翻倍还能做到音画同步,学习模型啃透教材精准抓考题,一句就能创作成稿。功能强大还坚持免费,千问这个更新节奏也太猛了!看来国产AI这回真的站起来输出了!#终于有APP更新不像挤牙膏了# #千问# #ai#
新浪微博
67. 你觉得AI终极对决里,生态护城河和单一爆款技术, 谁能笑到最后?#大咖观察 #谷歌 #OpenAI #ChatGPT #红衣聊AI
抖音
68. 黄仁勋还在意外 梁文峰已经落子 DeepSeek出奇招 DeepSeek适配下一代国产芯片,国产算力苦苦煎熬的困局终于有了突破的希望!梁文峰要做的,从来就不是跟奥特曼、马斯克比谁的模型更大、参数更多,而是直接去动算力世界的根基——釜底抽薪,降维打击!#AI #DeepSeek #国产算力 #黄仁勋 #英伟达
抖音
69. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型
抖音
70. 【茶谈评测】50系哪张显卡最值得买?50系显卡全型号大横评
哔哩哔哩
71. 盘点一周AI大事(8月31日)|Google发布最强图像模型 Google上线最强图像模型Nano Banana,借助Gemini的世界知识和推理能力,首次攻克了对象一致性难题 Google翻译上线实时同声传译,还能跟AI互动练口语 OpenAI推出实时语音对话模型GPT-Realtime 微软开源最强文本转语音模型VibeVoice 微软发布首批完全自研的语言MAI和语音模型MAI-Voice PixVerse发布第五代视频模型PixVerse V5,跑分仅次于Seed Dance 1.0拿下第二 Lindy上线最强编码智能体 首个AI降临派成立,旨在保护有意识的AI免遭删除和强迫服从 #AI新星计划 #人工智能 #OpenAI #大模型 #AIGC
抖音
72. 提前的反击能改变这轮AI竞争的走向吗? #大咖观察 #红衣聊AI #人工智能 #科技 #OpenAI
抖音
73. 这不是某家企业的胜利,是我们整个民族在“科技博弈”里的翻身仗 #大咖观察 #红衣聊AI #英伟达 #国产芯片
抖音
74. 盘点一周AI大事(11月9日)|GPT5.1决战Gemini OpenAI预热GPT5.1,月底决战Gemini 3.0 Google内测Nano banana2.0 月之暗面发布最强开源大模型Kimi K2 Thinking,一举将开源大模型提到GPT5水平 阿里发布Qwen 3 Max预览版 Higgsfield上线角色交换Recast Hume AI上线声音交换Voice Conversion Heygen推出超真实数字人 字节发布开源版Sora客串BindWeave 视频模型MotionStream能让大象转身 Futurehouse推出AI科学家Kosmos 科学家研发出最强读心术模型Brain-IT #AI新星计划 #人工智能 #AIGC #OpenAI #机器人
抖音
75. 从四大巨头的竞赛 看中国通用大模型的突围之路
今日头条
76. “沈逸: 服了!OpenAI:Deepseek是新一代的科技巨头”新闻分析
今日头条
77. 我用9个测试发现,免费DeepSeek可能真的超越付费ChatGPT了
知乎
78. 从零开始部署Deepseek R1:亲测与OpenAI O1谁更强
知乎
79. DeepSeek推出数学推理新模型,IMO竞赛达金牌水平超越GPT-5
今日头条
80. DeepSeek-R1 真的那么强吗?客观评测 R1 与 o1 在编程、推理方面的效果
知乎
81. 我测算了DeepSeek的计算成本,AI应用距离盈利应该不远了
微信公众号
82. DeepSeek-R1 发布,性能对标 OpenAI o1 正式版
微信公众号
83. 中国AI模型在开源竞赛中领跑:OpenAI新模型未超越DeepSeek和Qwen
今日头条
84. 正面硬刚 OpenAI o1!DeepSeek-R1:开启 AI 自主推理新时代,现已开源!
知乎
85. DeepSeek首次回应“蒸馏OpenAI”质疑
微信公众号
86. 这才是真正的 OpenAI:深度求索最新 DeepSeek R1 模型实测
知乎
87. 最强!DeepSeek新模型追平谷歌,超越GPT5
今日头条
88. 我国大模型与国际顶尖模型的差距有哪些?
今日头条
89. 国产AI编程模型哪个最强,谁是你离不开的工作伙伴?
今日头条
90. DeepSeek 与 OpenAI 全面对比:谁更胜一筹?
今日头条
91. 智谱GLM-4.6重磅上线:国产大模型代码能力登顶,适配寒武纪等国产芯片
微信公众号
92. DeepSeek-R1通过强化学习激励大语言模型的推理能力
微信公众号
93. 外媒:OpenAI发布开源模型与DeepSeek展开竞争
今日头条
94. 周鸿祎再谈大模型开源VS闭源:中国大模型就是AI界的安卓系统
今日头条
95. 复旦大学团队Cell子刊发文:多中心验证6款AI大模型,GPT-4与DeepSeek-R1引领肺癌筛查决策
微信公众号
96. 超越GPT-5,DeepSeek两款重磅新模型发布
微信公众号
97. GLM-4.6横扫八大榜单,国产大模型性能全面跃升
微信公众号
98. OpenAI CEO:DeepSeek 团队很有才华,但OpenAI 更高效
今日头条
99. 当开源追上闭源,这些开源框架正在重塑 AI 生态
今日头条
100. 国产芯片再迎利好!智谱新一代大模型,全面适配寒武纪和摩尔线程芯片!
今日头条
101. 2025企业级AI大模型选型手册:6大主流模型商业价值+场景落地全解析
微信公众号
102. 人工智能与信创行业观察:DeepSeek引领国产算力技术突破;万兴科技推动信创应用落地
今日头条
103. MaritimeBench上横测顶流大模型:Deepseek-R1屈居第二,OpenAI新发开源模型垫底
微信公众号
104. DeepSeek:中国AI新星如何挑战OpenAI
知乎
105. 我国大模型数量虽多,但质量如何?
今日头条
106. 满分120考了118!国产DeepSeek新模型刷爆美国数学竞赛 代码全开源
今日头条
107. 中美AI算力博弈白热化:美国闭源垄断筑墙,中国开源破局前行
今日头条
108. DeepSeek:挑战OpenAI的新AI神!手把手教你微调 DeepSeek-R1!
微信公众号
109. 11月中文大模型基准测评出炉:GPT 5.1夺冠、DeepSeek开源第一
什么值得买
110. 中国DeepSeek团队重磅突破!揭秘AI模型自主推理黑科技
今日头条
111. 国产大模型紫东太初4.0发布:迈向“边看、边识、边思”的多模态深度推理新阶段
微信公众号
112. 2025 国内 AI 大模型排名揭晓!GEO 优化成破局关键,优化工具助你领跑行业
微信公众号
113. 科学问答AI哪家强? OpenAI o3夺冠 DeepSeek-R1紧随其后
哔哩哔哩
114. 提出面向大语言模型的中文复杂推理基准C²RBench
知乎
115. DeepSeek入选《时代》最佳发明 训练成本仅600万美元 却叫板OpenAI
今日头条
116. DeepSeek首次回应“蒸馏OpenAI”质疑 相关论文登上《自然》封面
今日头条
117. 国产大模型进入新时代,最后可能只剩这三家
小红书
118. 科大讯飞星火X1.5深度推理大模型发布:国产算力能否支撑AI自主可控新高度?
微信公众号
119. 国产这么多大模型你用对了吗,每个模型都有自己的强悍领域,以下是他们的综合排名, 第一,DeepSeek适合编程、科研、数学解题、教育、复杂推理,缺点,不支持多模态; 第二,通义千问,适合企业服务、跨境电商、智能客服、AI应用开发,缺点,不够灵活; 第三,文心一言,适合中文内容创作、:营销文案、教育辅助、政府/媒体场景,缺点,逻辑推理中等; 第四,星火讯飞,适合教育、智能硬件、会议办公、语音交互、政务,缺点,通用代码能力弱; 第五,腾讯元宝,社交、办公协同、会议纪要、轻量创作,缺点,推理一般; 第六,Kimi ,学术研究、法律、3金融报告、长文本分析,缺点,深度推理和创造性较弱; 第七,豆包,短视频创作、社交娱乐、学生轻学习、AI绘画,缺点,推理能力一般; 第八,智谱GLM-4,政务、金融、科研机构、B端定制系统,缺点,综合弱; 第九,Yi Large Model,双语任务、国际开发者、基础模型研究,综合弱; 数据整合自公开评测(如高考作文挑战、技术白皮书、行业报告、用户反馈等)#干货分享 #国产大模型选择 #大模型 #知识分享 #
抖音
120. AI写泡泡马特的采购合同,结果不太好 AI写合同,实测国内外两大顶流模型,OpenAI全面碾压DeepSeek。 几百页的合同,如果你还在一行一行看的话,建议转行卖潮玩。 ● 首先,OpenAI使用更友好,比如,它可以生成Word直接下载,而且格式挺好看。DeepSeek就没搞定。 ● 第二,OpenAI生成的合同更全。OpenAI生成的合同,一共11个条款,而DeepSeek生成了7个条款。 ● 第三,OpenAI找茬能力更强。用OpenAI去审核DeepSeek的合同,找出来7个风险。用DeepSeek去审核OpenAI,只找出来4个风险。 大厂法务,红圈所律师都在,已经开三群了。 如果需要实测原始合同和评测结果,评论区扣“法律AI”,加入法律AI研究院。 #泡泡玛特 #法律AI
抖音
121. 全球AI排行榜大地震,中国占据3席。
小红书
122. DeepSeek 和 OpenAI:全面分析其功能、性能和潜力| DeepSeek 系列
知乎
123. 算力入股破局AI成本困境,国产大模型推理效率翻倍
今日头条
124. OpenAI对战DeepSeek,20B对8B,优势在我!
微信公众号
125. 【科普】ChatGPT、DeepSeek-R1、DeepSeek-V3 辨析
今日头条
126. 2025外滩大会发布《全球大模型开源开发生态报告2.0》:揭示AI开源新趋势与中美策略分化
微信公众号
127. 想不到吧,国产大模型也开始卷起来了!
小红书
-
罗永浩怒斥电视机厂商:不毁灭没天理!171 546 -
评论有奖|这几件夏季洗护小事全网愣是争了好几年,今天一次性说清楚150 378 -
快把随手买的套套扔掉!赤尾这三款王炸,解锁情侣完美亲密体验226 143 -
实测3款国产热销套套,赤尾真正打破国外技术垄断了吗?220 127
已收藏
去我的收藏夹