DeepSeek V4成本低37%但吞吐受限,中小开发者选去年底成熟型号更稳妥

源自170位全网作者

04-26 14:27

内容由AI生成

精选参考来源

1. DeepSeek V4 前瞻:华为寒武纪接棒,拆解中国 AI 大模型告别英伟达后的生存战 | DeepSeek V4 | 华为昇腾 | 寒武纪 | 国产算力 |

2. 为什么DeepSeek V4这么强?它到底更新了啥?

3. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型

4. #微博大模型数学能力超DeepSeekR1#微博发布的自研开源大模型VibeThinker,以15亿参数在数学竞赛基准测试中击败参数量超其数百倍的DeepSeek R1,这一成果堪称AI领域的“以小搏大”经典案例。传统认知中,大模型的推理能力与参数量直接挂钩,但VibeThinker通过创新“频谱到信号原理”训练方法,证明算法设计优化能突破规模限制。其单次后训练成本仅7800美元,较行业主流模型降低数十倍,不仅让前沿AI技术从巨头垄断走向普惠,更重新定义了技术评价标准——效率与成本效益同样关键。这一突破为中小企业、科研机构提供了低成本研发路径,或将推动AI产业从“规模竞赛”转向“效率革命”,让智能技术更广泛地服务于教育、金融等实时场景,真正实现技术普惠的价值。微博大模型数学能力超deepseekr1 #秒懂热点就用智搜##互联网资讯##微博兴趣创作计划#

5. DeepSeek V4这波价格战,把整个大模型行业的水温彻底打乱了。百万tokens输入0.2元,输出2元——不到GPT-5.5的1/70。国产化+MoE架构,直接脱离英伟达生态。有人说是赔本赚吆喝,但换个角度:DeepSeek在逼整个行业重新算账——堆算力的故事,还能讲多久?2026年下半年昇腾950量产,Pro版价格还要再降。到那时候,闭源厂商的利润空间还剩多少?价格屠夫背后,真正洗的是整个AI赛道。#DeepSeekV4 价格屠夫#

6. 市值近600亿,大模型公司上市了! #AI #智谱ai

7. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型

8. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何

9. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说

10. 外媒采访了五位知情人士,获得了 DeepSeek V4 的一些信息:- V4 将运行在华为最新 AI 芯片(昇腾 950PR)上,搭载全新昇腾950PR的Atlas 350,单卡算力达到了NV H20的2.87倍,是目前国内唯一支持FP4低精度的推理产品;HBM 容量是H20的1.16倍;- V4 还会有两个变体版本,分别针对不同能力做了优化,均基于国产芯片;- DeepSeek 花了数月时间与华为、寒武纪合作,重写了模型底层代码的部分模块,专门适配国产芯片,这次没有按照行业惯例,给NV和 AMD 任何早期访问权限;- 阿里、字节、腾讯已提前大批量采购华为新芯片,总量达数十万颗,华为昇腾 950PR 的价格因此上涨了 20%;- V3 和 R1 发布时引发了全球科技股抛售,市场质疑美国 AI 公司是否需要花数百亿美元采购算力,V4 发布窗口预计在未来几周内。

11. #DeepSeekV4 尺度#V4抛弃了cuda核心。国产芯片与模型改写成功:DeepSeek-V4 在昇腾芯片上完成全流程训练和推理验证核心代码已完成从英伟达 CUDA 架构向华为 CANN 架构的迁移模型在昇腾芯片上的推理速度得到了显著提升。V4-Flash版本的输出定价为每百万token 2元人民币,同期部分海外模型的定高达30 美元,成本差距显著。匹配国产,解构美产,助催美国泡沫破灭。

12. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

13. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴

14. 首个🦞龙虾大模型排行榜来了!两个国产 AI 杀进全球前三,养虾前必看

15. DeepSeek V4 直接掀桌:100% 脱离英伟达,全栈跑在华为昇腾,彻底抛弃 CUDA,底层迁移至 CANN 框架。更用 MoE 稀疏架构与 Engram 记忆技术,绕开高带宽显存壁垒,用低成本硬件实现顶级性能。不靠施舍、不看脸色、不被卡脖子,这才是国产 AI 真正的自主突围!想知道它如何打破技术封锁?视频里全是答案!#AI生活指南##微博超有用视频大赛##科普大作战##科技先锋官# 种斌Marco的微博视频

16. #横扫硅谷的千问杀回国内#【中国AI王炸登场!横扫硅谷的千问杀回国内】怪不得朱啸虎说能硬刚ChatGPT的国产AI出现了,在这场全球顶级竞赛中,中国正以扎实的技术实力和创新步伐,展现出独特的竞争力。全球AI双强格局已定,中美领跑,中国成为唯一能正面竞争美国AI产业的国家。 Qwen是阿里研发的大模型基座,「千问」APP作为Qwen大模型的首个消费者应用,此次直接面向大众市场,从模型能力到大众应用,中国AI生态完成关键跨越。早前Qwen大模型的卓越性能就已获国际广泛认可。在Hugging Face全球榜单中,通义旗下7款模型跻身全球前十;其中Qwen3-Max性能表现卓越,在多项权威评测中位列全球前三,被认证为全球性能最高的非推理模型,阿里开源模型Qwen早已获国际公认世界第一地位

17. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI

18. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen

19. 如何评价阿里千问大模型负责人林俊旸自宣卸任?会对通义千问造成什么影响?

20. #DeepSeekV4发布# DeepSeekV4终于发布了,简单总结下:1、双版本发布:推出 DeepSeek-V4-Pro(高性能)和 DeepSeek-V4-Flash(高性价比)两个版本,可按需选择。2、超长上下文:支持 1M token(约百万字) 的上下文长度,能一次性处理海量信息。3、核心能力领先:在 Agent能力、世界知识和推理性能 三方面均达到国内及开源模型的领先水平。4、具体任务表现:V4-Pro版本的代理编码能力接近顶尖闭源模型,在数学、编程等推理任务上超越所有已开源评测的模型。5、技术创新与迁移提醒:采用 DSA稀疏注意力机制 降低长上下文计算成本;原有 deepseek-chat 等模型名3个月后停止使用,需迁移到新名称。

21. DeepSeek V4 网页端《原神×我的世界》融合小游戏代码测试:拳打 ChatGPT,脚踢 Gemini,硬刚 Claude

22. 「Github一周热点112期」DeepSeek V4王者归来,一个项目玩转GPT-Image-2

23. 国产芯片这么强了?我在航展上发现中科海光“三重突破”:算力+安全+生态 #中科海光##国产芯片##微博兴趣创作计划# 科技Sexy的微博视频

24. 谷歌最狠一步棋,是否会带来AI竞争拐点? #大咖观察 #红衣聊AI #谷歌

25. 刚刚,英伟达CUDA迎来史上最大更新!

26. 从自动写代码到智能影音刮削:实测 OpenCode,这台“赛博管家”真的能干苦力活

27. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合

28. #DeepSeek新架构意味着什么#DeepSeek代号Model1的全新架构曝光,标志着其从参数堆砌向架构优化的关键转型,为大模型发展撕开全新赛道。此次架构级调整并非简单版本迭代,而是融合mHC训练框架、Engram条件记忆模块的全方位重构,直指大模型训练不稳定、记忆计算混同、长上下文处理难的行业痛点。mHC架构为训练加设“智能调节阀”,大幅提升规模化训练稳定性,Engram模块通过查算分离解耦记忆与推理,再搭配稀疏稠密并行计算、FP8混合精度设计,让Model1兼具百万级tokens超长上下文处理能力与高效推理性能,还实现了对英伟达下一代GPU的深度适配。这不仅让DeepSeek V4在编程领域的工程化能力实现突破,更降低了大模型研发的算力与门槛,推动大模型从实验室走向工业化落地。其探索的架构创新路径,也为行业摆脱算力内卷提供了新范式,引领大模型向更高效、更实用的方向演进。deepseek新架构意味着什么 川北小哥的微博视频

29. #deepseekv4发布#DeepSeek 发布新一代大模型 DeepSeek V4,本次更新主要围绕上下文能力、推理能力以及 Agent 场景进行优化。来看一看它的核心更新如下:🔻上下文能力大幅提升 支持最长 1M tokens(百万级上下文) 可处理完整代码库、长文档、多轮复杂对话🔻强化 Agent 场景能力 优化多步骤推理能力 支持更复杂任务执行 提升长流程稳定性🔻模型性能提升 多项 benchmark 表现提升 对标主流闭源大模型🔻提供双版本 Pro:高性能版本 Flash:高性价比版本(更快、更便宜)🔻 延续开源路线 持续推动开源大模型发展 强调低成本与高性能结合目前 DeepSeek V4 已开放相关能力与体验入口,可以在Hugging Face体验,具体应用场景仍在持续拓展deepseekv4发布

30. “源”神启动?实测日常高频场景中千问APP的表现

31. #用声音马住中国年##微博声浪计划# 2026除夕AI圈地震:阿里Qwen3.5-Plus以0.8元/百万Token价格引爆行业,成本仅为谷歌大模型5%。其混合架构实现算力效率跃升,多模态能力领先,推动AI平权,中小企业与大众皆受益。 牛丸科技的微博音频

32. #DeepSeekV4发布#,性能比肩顶级闭源模型100万上下文模型分为两档:deepseek-v4-flashdeepseek-v4-pro在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型...DeepSeek-V4-Pro 的 Agent 能力显著增强。在 Agentic Coding 评测中,V4-Pro 已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异。丰富的世界知识:DeepSeek-V4-Pro 在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1。百万 tokens 输入分别为 1元 和 12元百万 tokens 输出分别为 2元 和 24元DeepSeek-V4 模型开源链接:网页链接网页链接DeepSeek-V4 技术报告:网页链接

33. 午后,国产芯片直线爆发!DeepSeek、华为,大消息!

34. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】

35. #硬刚ChatGPT的千问国内可下载#阿里发布对标ChatGPT的AI助手App「千问」,朱啸虎说千问能硬刚ChatGPT!这底气是来源于阿里自家Qwen模型,它在多项全球榜单霸榜,其中旗舰模型Qwen3-235B-A22B登顶「全球开源模型冠军」,Qwen3-coder在WebDev Arena取得并列第一....连Airbnb和英伟达的老黄都出来盖章,说这快成了硅谷的根基,正是这样强大的实力支撑千问具备复杂决策能力,用户只需通过简洁的界面就能体验顶级大模型能力。我自己也上手体验了一下,问它装机配置需专业建议,千问的回答不仅逻辑严密、分点清晰,在专业度上媲美ChatGPT,而且更深耕中文生态,更符合国人的交互体验,朱啸虎的眼光果然毒辣,阿里这次是铁了心要下场卷全球了!

36. #横扫硅谷的千问杀回国内#横扫海外榜单的Qwen大模型第一入口来了,一经发布直接终结了比赛,国内人人都可以通过下载千问APP直接使用!不难发现,阿里这盘棋早在3年前就开始下了,如今Qwen大模型早已成为全球排名第一,在AI大模型实时投资比赛“Alpha Arena”中,Qwen同样凭借出色的策略和实操夺得第一,金融投资和风险控制能力遥遥领先!Qwen3-VL在 OpenRouter 图像处理榜单上以 48% 的市场份额跃升至全球第一,Qwen3-Coder 登顶开源LLM榜首!而搭载Qwen顶级模型的千问app,强悍的性能无需多言。就比如我问它“iphone17和 pro 以及promax 有多大区别”,它马上就能给我生成一份详细的报告,里面的内容非常贴近我的实际需求,可以说是一个非常可靠的生产力工具,每个人都值得拥有!

37. 「Github一周热点96期」Flux2绘图模型、腾讯的视频生成模型、AI记忆、开源Launchpad、笔记和知识库,Nginx可视化工具

38. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!

39. 「Github一周热点104期」智谱GLM-5发布,打响春节AI大战模型第一枪

40. 芯片大咖访谈:英伟达最怕的不是AMD,而是华为,中国是半导体供应链最全的国家#AI #芯片 #半导体 #英伟达 #黄仁勋

41. AI炒股能赚钱吗?开源项目daily_stock_ analysis部署体验

42. #deepseekv4要发布了吗#作为新一代旗舰模型,V4预计在代码能力、长文本理解、推理速度上全面升级,还深度优化国产算力协同,效率更高、成本更低。这次优先适配国产硬件,也意味着国产AI生态再进一步,正式版值得期待。#how i ai##过个有ai年#

43. 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看

44. 股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统

45. 财报需求和预期全面打开,英特尔突然大涨DeepSeekV4 MIMO也来了:拼谁把算力榨干 | 模型压缩 |CPU|GPU

46. 拆解CANN:当华为决定打开算力的「黑盒」

47. The Information 这篇独家又刷屏了,关于 DeepSeek-V4:- DeepSeek-V4 可以用华为最新的 Ascend 950PR 做推理,中国 AI 软硬一体的自主可控的新突破。- 为了在 V4 发布后提供推理服务,阿里、腾讯、字节已经向华为采购了几十万张 Ascend 950PR,需求暴涨导致这张卡的价格涨了 20%。- 除了 V4,DeepSeek 还研发了另外两个版本,都是跑在国产芯片上的。过去几个月,DeepSeek 一直在和华为、寒武纪合作,重新编写模型的底层代码,然后大量测试,以确保模型在国产芯片上实现最佳性能。- DeepSeek 没有向英伟达和 AMD 提供 V4 的早期访问权限以进行性能优化,但提供给了包括华为在内的国产芯片厂商。- 从华为公布的账面数据看,Ascend 950PR 的算力约为英伟达 H20 的 2.8 倍,当然比 H200 是比不上。怎么说呢,这篇的标题是「DeepSeek 新 AI 模型将成为华为的胜利」,其实无论 DeepSeek 还是华为,归根结底代表的是中国。另外自去年年底来 V4 的发布狼来了好几次,我想这里恐怕不是这些媒体空穴来风,软硬一体自主可控很难,实际推进起来可能比想象得还要更难一些。

48. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生

49. 潜行17年,阿里“通云哥”正式亮相,争霸谷歌!掌握科技自主权,这一刻,我们等了太久! #阿里 #千问 #阿里云 #通云哥 #人工智能

50. 「Github一周热点92期」智能机器人操作系统、语音转文本桌面应用、机械臂系统、虚拟音频工具、图片盲水印和多功能终端

51. 刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习

52. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

53. 用这套AI工作流,轻松搞定TVC广告片 #tvc #ai教程 #ai工具 #ai视频 #ai广告

54. The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。

55. #DeepSeekV4和GPT6谁更值得期待# 从用户需求看,两者面向不同人群。普通用户、内容创作者更期待GPT-6,主动对齐意图、长文档处理、多模态生成更省心。开发者、企业、国内用户更看好DeepSeek V4,开源可本地部署、成本极低、适配昇腾芯片,能落地私有化场景。更期待哪方还是要看谁更贴合使用场景。

56. Deepseek V4 两个版本均支持 1M 令牌上下文。这是相对于 DeepSeek V3.2 的重大飞跃!关键是1M 上下文,MIT 许可,以及让闭源模型看起来像奢侈税的价格。DeepSeek V4 刚刚为开源 AI 提高了标准。V4‑Pro 在 MMLU‑Pro 上达到 87.5%,在 LiveCodeBench 上达到 93.5% 。而且它是开源的。即使在某些方面“略微落后于 Claude Opus”,其成本性能比也令人疯狂。#deepseekv4 价格屠夫#deepseekv4 价格屠夫

57. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#

58. 火山引擎有了它自己的Token经济学

59. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具

60. 小米大模型刚推出就开启了主流编程工具上为期一周的免费使用,目前MiMo-V2-Pro 已在 MiMo Claw、WPS 灵犀、小米手机龙虾 miclaw、小米浏览器同步上线。 据官方介绍,Xiaomi MiMo-V2-Pro 为高强度 Agent 工作场景而打造。拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在全球大模型综合智能排行榜 Artificial Analysis 上,MiMo-V2-Pro 位列全球第八,国内第二,可以说相当亮眼了 #小米大模型##小米发布最新mimo大模型#

61. 「黑貓」银色 MacBook Pro M5 开箱 + 简单评测:AI 和游戏迎来大提升?

62. 揭秘GLM-5技术底牌:「异步强化学习框架Slime」成终极杀招

63. 千问是什么?答案正在风中飘荡

64. #DeepSeekV4会带来哪些惊喜#我个人的决定最大的惊喜就是在硬件环境上,有消息说DeepSeek V4 直接全栈脱离 CUDA,适配昇腾 950,CANN 框架代码兼容度超 95%!国产芯片迁移成本大降,硬件成本只要英伟达的 1/3,推理性能还能拉满,单卡算力碾压国际竞品。有了国产硬件的支撑,国内的大模型的发展环境会变的更加的自主,也能够让用户的使用成本降低,这样更有利AI应用落地,普惠更多的中小微企业。

65. DeepSeek V4直接弃用英伟达CUDA,全栈迁移华为昇腾,推理性能干翻英伟达H20近3倍,速度狂飙35倍,这是国产AI摆脱卡脖子的关键一步,巨头纷纷入局适配,国产替代集群已然成型。过去国产AI全靠英伟达生态,囤芯片看脸色,迁移成本高到离谱,利润大量外流,创新被牢牢限制。如今终于有了更多的选择,国产AI可以甩开膀子加油干了!#一分钟精选视频扶持计划##专业视频创作季##AI创造营##科技先锋官# 种斌Marco的微博视频

66. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司

67. 英伟达:业绩好只是其次,未来还有巨大空间#英伟达 #财报 #AI泡沫 #CUDA #AI

68. "今天,孟晚舟在华为年报致辞中表示,生态的繁荣是产业发展的基础。#孟晚舟称生态繁荣是产业发展基础# 2026年,华为将持续做强根生态。在AI领域,昇腾CANN异构计算架构,Mind系列软件,MindSpore AI框架全面开源开放。CANN已经支持和适配业界主流的开源社区和开源项目,如PyTorch、vLLM、SGLang、xLLM、VeRL、Triton、TileLang等,匹配开发者习惯,加速自主创新,推动计算产业的生态繁荣。#孟晚舟华为2025年报致辞# "

69. #2月DeepSeek还会发新模型吗#AI圈2月模型的发布和迭代处于一个高峰期!头部厂商扎堆上新大模型,DeepSeek的新模型动态目前其新模型已完成灰度测试,技术储备到位,大概率会在2月正式亮相。根据目前媒体的爆料来看,DeepSeek的新模型主要亮点应该在:1M Token超长上下文,可轻松处理完整长篇文档;Engram条件记忆架构,大幅降低推理成本;强化数学与代码能力三个方面。巩固开源领域优势,同时更新知识库,提升多模态文档理解能力。也是DeepSeek稳稳抓住关注的关键。因为“长上下文+低成本”的差异化优势,精准匹配法律、金融等专业场景,开源属性也贴合开发者与企业需求。#过个有AI年# #HOW I AI#

70. #春节AI大战#春节档成为大模型厂商的密集高发期:- 字节三模型齐发:Seedance 2.0(视频)、Seedream 5.0(图像)和豆包 2.0。- 阿里计划2月中旬推出Qwen 3.5,并配合30亿元的红包- 智谱2月11日发布GLM-5,参数规模从3550亿扩展至7440亿- MINIMAX 2月11日最新大模型M2.5上线Agent平台- DeepSeek 2月11日在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度每一个新模型背后都意味着新增海量token数的需求。

71. 哈哈,欢迎👏→_→//@刘彬:@庆丰 下午还说没来开号,愁用哪个通道管小龙虾~//@金山://@智谱:欢迎欢迎!🎉 顶级的开源 AI 助理框架,搭配为复杂Agent任务而生的GLM-5,丝滑无比!评论转发这条微博,讲讲GLM-5🐘 + OpenClaw🦞的妙用,抽送3个GLM Coding Plan Pro季卡!

72. DeepSeek V4震撼发布!实现全球开源领先

73. DeepSeekV4预览版本正式发布

74. DeepSeek V4即将问世,国产大模型再迎重磅升级

75. DeepSeekV4发布时间梳理和爆料。

76. 国产大模型吹响反攻号角

77. 国产大模型哪家强?2026国产大模型选型参考

78. AI“反攻”时刻

79. 千问登顶全球调用榜 国产大模型改写市场格局

80. 全球AI大模型格局生变,国产模型实力亮眼

81. 2026年中文大模型横向测评

82. 全球权威大模型盲测榜单公布,阿里千问3.6登顶中国最强编程模型

83. 通义千问 Qwen 3.6 Max 预览版上线,AA 指数 52 分登顶国产中文大模型

84. 太提气了!阿里通义千问杀进全球AI榜单前五!国产大模型拿下中国第一

85. 国产大模型强势突围!通义千问冲进全球第五,底牌曝光

86. 2026年AI工具终极对决

87. 2026国产AI大模型终极指南一文吃透国内AI江湖,选对工具不踩坑

88. 给阿里千问一个“客观估计”——围绕QWen3的大模型横评

89. 万亿参数、32项测评第一

90. 阿里通义千问开源 Qwen3.6-35B-A3B 模型 赋能智能体与多模态应用

91. 通义千问 Qwen3 震撼发布

92. Qwen 实力闪耀 LMArena 全新“专家榜”

93. 文心一言(文心5.0)深度解析

94. 【深度评测】文心一言

95. 大模型如何提高推理效率

96. 阿里RTP-LLM开源

97. 微软开源Phi-4|15B参数破解标注成本困局,数据闭环+混合推理实现降本增效

98. 刚刚,华为AI推理大招开源,时延降90%,吞吐提22倍,上下文10倍级扩展

99. DeepSeek V4实测

100. 大模型Infra新突破!腾讯混元开源LLM推理算子库,推理吞吐提升30%

101. 昆仑芯大规模 LLM 推理优化,实现秒级扩缩容

102. 小米大模型岗|推理加速底层逻辑+踩坑实录

103. 大模型推理成本与优化技术全景解析

104. 性能对标opus、1块钱百万token

105. 开源铁王座易主

106. 突发!DeepSeek V4 发布

107. 百万上下文上线!DeepSeek 专家模式发布,国产大模型专业能力再突破

108. DeepSeek V4来了:1M上下文、Agent能力、华为芯片,国产大模型打到新一局

109. 别再依赖 Gemini!国产 AI 工具 DS4 上线,1 步解决论文长文本分析难题

110. 花20美元用ChatGPT还是白嫖DeepSeek?实测对比后我劝你别选错了

111. 2026年最值得用的5个AI工具实测

112. 2026年AI写作工具推荐

113. 2026 文档 / 长文本信息 AI (App / 工具)

114. AI工具使用手册(2025版)

115. 一文看懂

116. DeepSeek-V4突然发布,百万文价格低至1块,开源模型天花板被捅破

117. DeepSeek V4 Pro实测

118. DeepSeek V4 预览版

119. DeepSeek-V4 预览版终于还是来了,百万上下文直接标配~

120. DeepSeek-V4重磅迭代,开源,国产大模型彻底卷出新高度

121. 重磅!万众瞩目的DeepSeek V4十分钟前开源了,曾经的王又回来了!

122. 快讯

123. DeepSeek-V4 发布!百万上下文价格战打响

124. DeepSeek V4 发布全解析

125. DeepSeek-V4预览版开源上线!百万上下文加持,硬刚全球顶级模型

126. 重磅!DeepSeek-V4 来了!国产开源大模型的效率革命!

127. DeepSeek V4正式上线!碾压一众大模型,普通人也能免费用上顶配AI

128. DeepSeek V4换装华为昇腾950PR 国产AI算力迎里程碑

129. 弃用英伟达

130. DeepSeek V4

131. 脱离CUDA,性能反超

132. DeepSeek V4旗舰模型完成与华为昇腾950PR芯片、CANN框架的全栈适配

133. DeepSeek 若选华为

134. 告别CUDA依赖

135. DeepSeek V4全面换芯华为CANN!国产AI生态彻底告别CUDA依赖

136. 华为昇腾950PR“杀疯了”:DeepSeek V4引爆抢芯大战!

137. 从CUDA到CANN:国产AI芯片适配到底意味着什么

138. DeepSeek V4即将发布,对个人及行业的影响

139. 深度解析:DeepSeek V4脱离CUDA,华为CANN Next如何接棒?

140. DeepSeek-V4 核心信息速览

141. DeepSeek V4 即将发布!!!聊聊背后的华为昇腾950PR

142. AI Infra:华为 CANN(Compute Architecture for Neural Networks)

143. DeepSeekV4即将在春节前后发布,有望超越OpenAI、GPT及Claude

144. 国产AI算力突围:从CUDA到CANN

145. Deepseek V4即将发布,国产算力深度适配

146. DeepSeek-V4将至!3大硬核突破,破解大模型3大痛点

147. DeepSeek V4 深度适配华为昇腾芯片,华为昇腾950PR芯片A股核心相关上市公司再梳理

148. DeepSeek上线支持1M上下文新模型,多项架构优化显著提升长文本处理能力

149. 等了半年!DeepSeek V4终于要来了

150. 2.87倍碾压H20!昇腾950PR+CANN,国产AI算力彻底突围

151. DeepSeek V4 vs 智谱 GLM-5:2026年国产大模型“价格战”与“性能战”全面解析

152. DeepSeek V4 震撼来袭!预计4月发布,四大突破性功能曝光

153. 对长上下文能力有不同要求,怎么选择合适的模型?

154. 国产芯片与AI大模型协同突围,海光信息携手紫东太初打造算力“新引擎”

155. 【财通计算机】国产大模型与国产算力共振:co-design时代

156. 调研解读|国产大模型与国产算力共振:co-design时代

157. 华为昇腾950PR AI芯片深度分析报告

158. 算力成本降至0.007元!揭秘“绿电制Token”重构全球AI基建竞争力的底层逻辑

159. 刚刚,DeepSeek 大升级,V4 真的不远了|附体验细节

160. CUDA 真的牢不可破?国产 GPU 的生态突围给出答案

161. DeepSeek悄悄干了一件大事,V4要来了?

162. DeepseekV4 vsGPT5.5 vsOpus4.7! 新发布的Deepseek V4 Pro 硬刚 GPT 5.5 和 Claude Opus 4.7 ! 最新Deepseek旗舰到底做到了什么程度? 从写代码做独立站,到全套后端APP开发,再到自媒体爆款文案撰写,真实硬核测评结果出炉! 看完你就知道Deepseek v4 pro真正的性能了! #ai新星计划 #deepseekv4 #deepseek #gpt5.5 #claudeopus

163. AI大模型行业专家交流纪要

164. 大语言模型如何突破百万 Token 上下文窗口?—— 解析上下文并行与环形注意力技术

165. 中英文阅读 | DeepSeek测试全新1M上下文长文本模型:技术突破与行业展望

166. DeepSeek V4轻量版内测,藏着哪些意外亮点?

167. 国产模型与芯片适配如何构建本土生态?

168. 国内主流AI大模型大盘点,一文读懂国产AI大模型格局

169. 斯坦福AI指数报告显示阿里通义千问入选全球重要大模型前三 斯坦福HAI研究所发布的《2025年AI指数报告》显示,阿里巴巴在全球重要大模型贡献中位列第三,仅次于谷歌和OpenAI,主要依据是2024年全球61个重要AI大模型中,阿里巴巴凭借通义千问系列有6个模型入选,成为入选数量最多的中国科技公司。通义千问系列表现优异,其中旗舰模型Qwen2-72B在训练数据量上创下行业纪录,采用了覆盖27种语言的庞大语料库,并支持128K tokens长上下文处理。 该模型在国际评测中表现亮眼,在斯坦福HELM MMLU测评中位列开源模型榜首,性能超越同期美国最强开源模型Llama3-70B,并在AI高考评测中以显著优势获得总分第一。 报告还显示,中美顶级AI大模型性能差距已由2023年的17.5%大幅缩小至0.3%,接近完全抹平。 目前,阿里通义实验室已开源200多款模型,千问在全球的衍生模型数突破10万,超越美国Llama成为世界第一开源大模型

170. SuperCLUE 3 月榜单出炉:中外大模型贴身肉搏,国产第一梯队正式成型

1
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章