DeepSeek V4成本低37%但吞吐受限,中小开发者选去年底成熟型号更稳妥
04-26 14:27
精选参考来源
精选参考来源
1. DeepSeek V4 前瞻:华为寒武纪接棒,拆解中国 AI 大模型告别英伟达后的生存战 | DeepSeek V4 | 华为昇腾 | 寒武纪 | 国产算力 |
哔哩哔哩 2026-04-07 00:00:00
2. 为什么DeepSeek V4这么强?它到底更新了啥?
哔哩哔哩 2026-04-25 00:00:00
3. 开源是战略,生态是王炸,阿里千问入局AItoC #千问 #大模型
抖音 2025-11-19 00:00:00
4. #微博大模型数学能力超DeepSeekR1#微博发布的自研开源大模型VibeThinker,以15亿参数在数学竞赛基准测试中击败参数量超其数百倍的DeepSeek R1,这一成果堪称AI领域的“以小搏大”经典案例。传统认知中,大模型的推理能力与参数量直接挂钩,但VibeThinker通过创新“频谱到信号原理”训练方法,证明算法设计优化能突破规模限制。其单次后训练成本仅7800美元,较行业主流模型降低数十倍,不仅让前沿AI技术从巨头垄断走向普惠,更重新定义了技术评价标准——效率与成本效益同样关键。这一突破为中小企业、科研机构提供了低成本研发路径,或将推动AI产业从“规模竞赛”转向“效率革命”,让智能技术更广泛地服务于教育、金融等实时场景,真正实现技术普惠的价值。微博大模型数学能力超deepseekr1 #秒懂热点就用智搜##互联网资讯##微博兴趣创作计划#
新浪微博 2025-11-18 00:00:00
5. DeepSeek V4这波价格战,把整个大模型行业的水温彻底打乱了。百万tokens输入0.2元,输出2元——不到GPT-5.5的1/70。国产化+MoE架构,直接脱离英伟达生态。有人说是赔本赚吆喝,但换个角度:DeepSeek在逼整个行业重新算账——堆算力的故事,还能讲多久?2026年下半年昇腾950量产,Pro版价格还要再降。到那时候,闭源厂商的利润空间还剩多少?价格屠夫背后,真正洗的是整个AI赛道。#DeepSeekV4 价格屠夫#
新浪微博 2026-04-24 00:00:00
6. 市值近600亿,大模型公司上市了! #AI #智谱ai
抖音 2026-01-10 00:00:00
7. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型
抖音 2025-12-14 00:00:00
8. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何
哔哩哔哩 2026-02-19 00:00:00
9. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说
哔哩哔哩 2026-04-24 00:00:00
10. 外媒采访了五位知情人士,获得了 DeepSeek V4 的一些信息:- V4 将运行在华为最新 AI 芯片(昇腾 950PR)上,搭载全新昇腾950PR的Atlas 350,单卡算力达到了NV H20的2.87倍,是目前国内唯一支持FP4低精度的推理产品;HBM 容量是H20的1.16倍;- V4 还会有两个变体版本,分别针对不同能力做了优化,均基于国产芯片;- DeepSeek 花了数月时间与华为、寒武纪合作,重写了模型底层代码的部分模块,专门适配国产芯片,这次没有按照行业惯例,给NV和 AMD 任何早期访问权限;- 阿里、字节、腾讯已提前大批量采购华为新芯片,总量达数十万颗,华为昇腾 950PR 的价格因此上涨了 20%;- V3 和 R1 发布时引发了全球科技股抛售,市场质疑美国 AI 公司是否需要花数百亿美元采购算力,V4 发布窗口预计在未来几周内。
新浪微博 2026-04-04 00:00:00
11. #DeepSeekV4 尺度#V4抛弃了cuda核心。国产芯片与模型改写成功:DeepSeek-V4 在昇腾芯片上完成全流程训练和推理验证核心代码已完成从英伟达 CUDA 架构向华为 CANN 架构的迁移模型在昇腾芯片上的推理速度得到了显著提升。V4-Flash版本的输出定价为每百万token 2元人民币,同期部分海外模型的定高达30 美元,成本差距显著。匹配国产,解构美产,助催美国泡沫破灭。
新浪微博 2026-04-25 00:00:00
12. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?
知乎 2026-03-04 00:00:00
13. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴
抖音 2025-11-18 00:00:00
14. 首个🦞龙虾大模型排行榜来了!两个国产 AI 杀进全球前三,养虾前必看
微信公众号 2026-03-08 00:00:00
15. DeepSeek V4 直接掀桌:100% 脱离英伟达,全栈跑在华为昇腾,彻底抛弃 CUDA,底层迁移至 CANN 框架。更用 MoE 稀疏架构与 Engram 记忆技术,绕开高带宽显存壁垒,用低成本硬件实现顶级性能。不靠施舍、不看脸色、不被卡脖子,这才是国产 AI 真正的自主突围!想知道它如何打破技术封锁?视频里全是答案!#AI生活指南##微博超有用视频大赛##科普大作战##科技先锋官# 种斌Marco的微博视频
新浪微博 2026-04-12 00:00:00
16. #横扫硅谷的千问杀回国内#【中国AI王炸登场!横扫硅谷的千问杀回国内】怪不得朱啸虎说能硬刚ChatGPT的国产AI出现了,在这场全球顶级竞赛中,中国正以扎实的技术实力和创新步伐,展现出独特的竞争力。全球AI双强格局已定,中美领跑,中国成为唯一能正面竞争美国AI产业的国家。 Qwen是阿里研发的大模型基座,「千问」APP作为Qwen大模型的首个消费者应用,此次直接面向大众市场,从模型能力到大众应用,中国AI生态完成关键跨越。早前Qwen大模型的卓越性能就已获国际广泛认可。在Hugging Face全球榜单中,通义旗下7款模型跻身全球前十;其中Qwen3-Max性能表现卓越,在多项权威评测中位列全球前三,被认证为全球性能最高的非推理模型,阿里开源模型Qwen早已获国际公认世界第一地位
新浪微博 2025-11-17 00:00:00
17. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI
抖音 2026-02-14 00:00:00
18. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen
抖音 2025-11-21 00:00:00
19. 如何评价阿里千问大模型负责人林俊旸自宣卸任?会对通义千问造成什么影响?
知乎 2026-03-04 00:00:00
20. #DeepSeekV4发布# DeepSeekV4终于发布了,简单总结下:1、双版本发布:推出 DeepSeek-V4-Pro(高性能)和 DeepSeek-V4-Flash(高性价比)两个版本,可按需选择。2、超长上下文:支持 1M token(约百万字) 的上下文长度,能一次性处理海量信息。3、核心能力领先:在 Agent能力、世界知识和推理性能 三方面均达到国内及开源模型的领先水平。4、具体任务表现:V4-Pro版本的代理编码能力接近顶尖闭源模型,在数学、编程等推理任务上超越所有已开源评测的模型。5、技术创新与迁移提醒:采用 DSA稀疏注意力机制 降低长上下文计算成本;原有 deepseek-chat 等模型名3个月后停止使用,需迁移到新名称。
新浪微博 2026-04-24 00:00:00
21. DeepSeek V4 网页端《原神×我的世界》融合小游戏代码测试:拳打 ChatGPT,脚踢 Gemini,硬刚 Claude
哔哩哔哩 2026-04-09 00:00:00
22. 「Github一周热点112期」DeepSeek V4王者归来,一个项目玩转GPT-Image-2
哔哩哔哩 2026-04-25 00:00:00
23. 国产芯片这么强了?我在航展上发现中科海光“三重突破”:算力+安全+生态 #中科海光##国产芯片##微博兴趣创作计划# 科技Sexy的微博视频
新浪微博 2025-10-29 00:00:00
24. 谷歌最狠一步棋,是否会带来AI竞争拐点? #大咖观察 #红衣聊AI #谷歌
抖音 2025-12-20 00:00:00
25. 刚刚,英伟达CUDA迎来史上最大更新!
微信公众号 2025-12-06 00:00:00
26. 从自动写代码到智能影音刮削:实测 OpenCode,这台“赛博管家”真的能干苦力活
哔哩哔哩 2026-01-30 00:00:00
27. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合
微信公众号 2026-04-24 00:00:00
28. #DeepSeek新架构意味着什么#DeepSeek代号Model1的全新架构曝光,标志着其从参数堆砌向架构优化的关键转型,为大模型发展撕开全新赛道。此次架构级调整并非简单版本迭代,而是融合mHC训练框架、Engram条件记忆模块的全方位重构,直指大模型训练不稳定、记忆计算混同、长上下文处理难的行业痛点。mHC架构为训练加设“智能调节阀”,大幅提升规模化训练稳定性,Engram模块通过查算分离解耦记忆与推理,再搭配稀疏稠密并行计算、FP8混合精度设计,让Model1兼具百万级tokens超长上下文处理能力与高效推理性能,还实现了对英伟达下一代GPU的深度适配。这不仅让DeepSeek V4在编程领域的工程化能力实现突破,更降低了大模型研发的算力与门槛,推动大模型从实验室走向工业化落地。其探索的架构创新路径,也为行业摆脱算力内卷提供了新范式,引领大模型向更高效、更实用的方向演进。deepseek新架构意味着什么 川北小哥的微博视频
新浪微博 2026-01-21 00:00:00
29. #deepseekv4发布#DeepSeek 发布新一代大模型 DeepSeek V4,本次更新主要围绕上下文能力、推理能力以及 Agent 场景进行优化。来看一看它的核心更新如下:🔻上下文能力大幅提升 支持最长 1M tokens(百万级上下文) 可处理完整代码库、长文档、多轮复杂对话🔻强化 Agent 场景能力 优化多步骤推理能力 支持更复杂任务执行 提升长流程稳定性🔻模型性能提升 多项 benchmark 表现提升 对标主流闭源大模型🔻提供双版本 Pro:高性能版本 Flash:高性价比版本(更快、更便宜)🔻 延续开源路线 持续推动开源大模型发展 强调低成本与高性能结合目前 DeepSeek V4 已开放相关能力与体验入口,可以在Hugging Face体验,具体应用场景仍在持续拓展deepseekv4发布
新浪微博 2026-04-24 00:00:00
30. “源”神启动?实测日常高频场景中千问APP的表现
哔哩哔哩 2025-12-12 00:00:00
31. #用声音马住中国年##微博声浪计划# 2026除夕AI圈地震:阿里Qwen3.5-Plus以0.8元/百万Token价格引爆行业,成本仅为谷歌大模型5%。其混合架构实现算力效率跃升,多模态能力领先,推动AI平权,中小企业与大众皆受益。 牛丸科技的微博音频
新浪微博 2026-02-17 00:00:00
32. #DeepSeekV4发布#,性能比肩顶级闭源模型100万上下文模型分为两档:deepseek-v4-flashdeepseek-v4-pro在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型...DeepSeek-V4-Pro 的 Agent 能力显著增强。在 Agentic Coding 评测中,V4-Pro 已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异。丰富的世界知识:DeepSeek-V4-Pro 在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1。百万 tokens 输入分别为 1元 和 12元百万 tokens 输出分别为 2元 和 24元DeepSeek-V4 模型开源链接:网页链接网页链接DeepSeek-V4 技术报告:网页链接
新浪微博 2026-04-24 00:00:00
33. 午后,国产芯片直线爆发!DeepSeek、华为,大消息!
微信公众号 2026-04-24 00:00:00
34. 阿里千问与“AI Layer”崛起:一场重塑互联网的“操作系统”生态战 【硅谷101】
哔哩哔哩 2025-12-17 00:00:00
35. #硬刚ChatGPT的千问国内可下载#阿里发布对标ChatGPT的AI助手App「千问」,朱啸虎说千问能硬刚ChatGPT!这底气是来源于阿里自家Qwen模型,它在多项全球榜单霸榜,其中旗舰模型Qwen3-235B-A22B登顶「全球开源模型冠军」,Qwen3-coder在WebDev Arena取得并列第一....连Airbnb和英伟达的老黄都出来盖章,说这快成了硅谷的根基,正是这样强大的实力支撑千问具备复杂决策能力,用户只需通过简洁的界面就能体验顶级大模型能力。我自己也上手体验了一下,问它装机配置需专业建议,千问的回答不仅逻辑严密、分点清晰,在专业度上媲美ChatGPT,而且更深耕中文生态,更符合国人的交互体验,朱啸虎的眼光果然毒辣,阿里这次是铁了心要下场卷全球了!
新浪微博 2025-11-17 00:00:00
36. #横扫硅谷的千问杀回国内#横扫海外榜单的Qwen大模型第一入口来了,一经发布直接终结了比赛,国内人人都可以通过下载千问APP直接使用!不难发现,阿里这盘棋早在3年前就开始下了,如今Qwen大模型早已成为全球排名第一,在AI大模型实时投资比赛“Alpha Arena”中,Qwen同样凭借出色的策略和实操夺得第一,金融投资和风险控制能力遥遥领先!Qwen3-VL在 OpenRouter 图像处理榜单上以 48% 的市场份额跃升至全球第一,Qwen3-Coder 登顶开源LLM榜首!而搭载Qwen顶级模型的千问app,强悍的性能无需多言。就比如我问它“iphone17和 pro 以及promax 有多大区别”,它马上就能给我生成一份详细的报告,里面的内容非常贴近我的实际需求,可以说是一个非常可靠的生产力工具,每个人都值得拥有!
新浪微博 2025-11-17 00:00:00
37. 「Github一周热点96期」Flux2绘图模型、腾讯的视频生成模型、AI记忆、开源Launchpad、笔记和知识库,Nginx可视化工具
哔哩哔哩 2025-12-06 00:00:00
38. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!
哔哩哔哩 2026-01-21 00:00:00
39. 「Github一周热点104期」智谱GLM-5发布,打响春节AI大战模型第一枪
哔哩哔哩 2026-02-15 00:00:00
40. 芯片大咖访谈:英伟达最怕的不是AMD,而是华为,中国是半导体供应链最全的国家#AI #芯片 #半导体 #英伟达 #黄仁勋
抖音 2026-03-09 00:00:00
41. AI炒股能赚钱吗?开源项目daily_stock_ analysis部署体验
哔哩哔哩 2026-03-10 00:00:00
42. #deepseekv4要发布了吗#作为新一代旗舰模型,V4预计在代码能力、长文本理解、推理速度上全面升级,还深度优化国产算力协同,效率更高、成本更低。这次优先适配国产硬件,也意味着国产AI生态再进一步,正式版值得期待。#how i ai##过个有ai年#
新浪微博 2026-02-26 00:00:00
43. 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看
新浪微博 2025-12-27 00:00:00
44. 股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统
知乎 2026-02-12 00:00:00
45. 财报需求和预期全面打开,英特尔突然大涨DeepSeekV4 MIMO也来了:拼谁把算力榨干 | 模型压缩 |CPU|GPU
哔哩哔哩 2026-04-25 00:00:00
46. 拆解CANN:当华为决定打开算力的「黑盒」
微信公众号 2025-12-19 00:00:00
47. The Information 这篇独家又刷屏了,关于 DeepSeek-V4:- DeepSeek-V4 可以用华为最新的 Ascend 950PR 做推理,中国 AI 软硬一体的自主可控的新突破。- 为了在 V4 发布后提供推理服务,阿里、腾讯、字节已经向华为采购了几十万张 Ascend 950PR,需求暴涨导致这张卡的价格涨了 20%。- 除了 V4,DeepSeek 还研发了另外两个版本,都是跑在国产芯片上的。过去几个月,DeepSeek 一直在和华为、寒武纪合作,重新编写模型的底层代码,然后大量测试,以确保模型在国产芯片上实现最佳性能。- DeepSeek 没有向英伟达和 AMD 提供 V4 的早期访问权限以进行性能优化,但提供给了包括华为在内的国产芯片厂商。- 从华为公布的账面数据看,Ascend 950PR 的算力约为英伟达 H20 的 2.8 倍,当然比 H200 是比不上。怎么说呢,这篇的标题是「DeepSeek 新 AI 模型将成为华为的胜利」,其实无论 DeepSeek 还是华为,归根结底代表的是中国。另外自去年年底来 V4 的发布狼来了好几次,我想这里恐怕不是这些媒体空穴来风,软硬一体自主可控很难,实际推进起来可能比想象得还要更难一些。
新浪微博 2026-04-04 00:00:00
48. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生
抖音 2026-01-08 00:00:00
49. 潜行17年,阿里“通云哥”正式亮相,争霸谷歌!掌握科技自主权,这一刻,我们等了太久! #阿里 #千问 #阿里云 #通云哥 #人工智能
抖音 2026-01-30 00:00:00
50. 「Github一周热点92期」智能机器人操作系统、语音转文本桌面应用、机械臂系统、虚拟音频工具、图片盲水印和多功能终端
哔哩哔哩 2025-11-02 00:00:00
51. 刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习
微信公众号 2026-02-03 00:00:00
52. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群
抖音 2025-12-22 00:00:00
53. 用这套AI工作流,轻松搞定TVC广告片 #tvc #ai教程 #ai工具 #ai视频 #ai广告
抖音 2026-04-02 00:00:00
54. The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。
新浪微博 2026-04-04 00:00:00
55. #DeepSeekV4和GPT6谁更值得期待# 从用户需求看,两者面向不同人群。普通用户、内容创作者更期待GPT-6,主动对齐意图、长文档处理、多模态生成更省心。开发者、企业、国内用户更看好DeepSeek V4,开源可本地部署、成本极低、适配昇腾芯片,能落地私有化场景。更期待哪方还是要看谁更贴合使用场景。
新浪微博 2026-04-07 00:00:00
56. Deepseek V4 两个版本均支持 1M 令牌上下文。这是相对于 DeepSeek V3.2 的重大飞跃!关键是1M 上下文,MIT 许可,以及让闭源模型看起来像奢侈税的价格。DeepSeek V4 刚刚为开源 AI 提高了标准。V4‑Pro 在 MMLU‑Pro 上达到 87.5%,在 LiveCodeBench 上达到 93.5% 。而且它是开源的。即使在某些方面“略微落后于 Claude Opus”,其成本性能比也令人疯狂。#deepseekv4 价格屠夫#deepseekv4 价格屠夫
新浪微博 2026-04-24 00:00:00
57. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#
新浪微博 2026-02-16 00:00:00
58. 火山引擎有了它自己的Token经济学
微信公众号 2025-12-19 00:00:00
59. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具
哔哩哔哩 2026-02-08 00:00:00
60. 小米大模型刚推出就开启了主流编程工具上为期一周的免费使用,目前MiMo-V2-Pro 已在 MiMo Claw、WPS 灵犀、小米手机龙虾 miclaw、小米浏览器同步上线。 据官方介绍,Xiaomi MiMo-V2-Pro 为高强度 Agent 工作场景而打造。拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在全球大模型综合智能排行榜 Artificial Analysis 上,MiMo-V2-Pro 位列全球第八,国内第二,可以说相当亮眼了 #小米大模型##小米发布最新mimo大模型#
新浪微博 2026-03-19 00:00:00
61. 「黑貓」银色 MacBook Pro M5 开箱 + 简单评测:AI 和游戏迎来大提升?
哔哩哔哩 2025-12-18 00:00:00
62. 揭秘GLM-5技术底牌:「异步强化学习框架Slime」成终极杀招
微信公众号 2026-02-23 00:00:00
63. 千问是什么?答案正在风中飘荡
微信公众号 2026-04-03 00:00:00
64. #DeepSeekV4会带来哪些惊喜#我个人的决定最大的惊喜就是在硬件环境上,有消息说DeepSeek V4 直接全栈脱离 CUDA,适配昇腾 950,CANN 框架代码兼容度超 95%!国产芯片迁移成本大降,硬件成本只要英伟达的 1/3,推理性能还能拉满,单卡算力碾压国际竞品。有了国产硬件的支撑,国内的大模型的发展环境会变的更加的自主,也能够让用户的使用成本降低,这样更有利AI应用落地,普惠更多的中小微企业。
新浪微博 2026-04-21 00:00:00
65. DeepSeek V4直接弃用英伟达CUDA,全栈迁移华为昇腾,推理性能干翻英伟达H20近3倍,速度狂飙35倍,这是国产AI摆脱卡脖子的关键一步,巨头纷纷入局适配,国产替代集群已然成型。过去国产AI全靠英伟达生态,囤芯片看脸色,迁移成本高到离谱,利润大量外流,创新被牢牢限制。如今终于有了更多的选择,国产AI可以甩开膀子加油干了!#一分钟精选视频扶持计划##专业视频创作季##AI创造营##科技先锋官# 种斌Marco的微博视频
新浪微博 2026-04-23 00:00:00
66. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司
哔哩哔哩 2026-03-17 00:00:00
67. 英伟达:业绩好只是其次,未来还有巨大空间#英伟达 #财报 #AI泡沫 #CUDA #AI
抖音 2025-11-21 00:00:00
68. "今天,孟晚舟在华为年报致辞中表示,生态的繁荣是产业发展的基础。#孟晚舟称生态繁荣是产业发展基础# 2026年,华为将持续做强根生态。在AI领域,昇腾CANN异构计算架构,Mind系列软件,MindSpore AI框架全面开源开放。CANN已经支持和适配业界主流的开源社区和开源项目,如PyTorch、vLLM、SGLang、xLLM、VeRL、Triton、TileLang等,匹配开发者习惯,加速自主创新,推动计算产业的生态繁荣。#孟晚舟华为2025年报致辞# "
新浪微博 2026-03-31 00:00:00
69. #2月DeepSeek还会发新模型吗#AI圈2月模型的发布和迭代处于一个高峰期!头部厂商扎堆上新大模型,DeepSeek的新模型动态目前其新模型已完成灰度测试,技术储备到位,大概率会在2月正式亮相。根据目前媒体的爆料来看,DeepSeek的新模型主要亮点应该在:1M Token超长上下文,可轻松处理完整长篇文档;Engram条件记忆架构,大幅降低推理成本;强化数学与代码能力三个方面。巩固开源领域优势,同时更新知识库,提升多模态文档理解能力。也是DeepSeek稳稳抓住关注的关键。因为“长上下文+低成本”的差异化优势,精准匹配法律、金融等专业场景,开源属性也贴合开发者与企业需求。#过个有AI年# #HOW I AI#
新浪微博 2026-02-24 00:00:00
70. #春节AI大战#春节档成为大模型厂商的密集高发期:- 字节三模型齐发:Seedance 2.0(视频)、Seedream 5.0(图像)和豆包 2.0。- 阿里计划2月中旬推出Qwen 3.5,并配合30亿元的红包- 智谱2月11日发布GLM-5,参数规模从3550亿扩展至7440亿- MINIMAX 2月11日最新大模型M2.5上线Agent平台- DeepSeek 2月11日在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度每一个新模型背后都意味着新增海量token数的需求。
新浪微博 2026-02-12 00:00:00
71. 哈哈,欢迎👏→_→//@刘彬:@庆丰 下午还说没来开号,愁用哪个通道管小龙虾~//@金山://@智谱:欢迎欢迎!🎉 顶级的开源 AI 助理框架,搭配为复杂Agent任务而生的GLM-5,丝滑无比!评论转发这条微博,讲讲GLM-5🐘 + OpenClaw🦞的妙用,抽送3个GLM Coding Plan Pro季卡!
新浪微博 2026-03-03 00:00:00
72. DeepSeek V4震撼发布!实现全球开源领先
今日头条
73. DeepSeekV4预览版本正式发布
今日头条
74. DeepSeek V4即将问世,国产大模型再迎重磅升级
今日头条
75. DeepSeekV4发布时间梳理和爆料。
抖音
76. 国产大模型吹响反攻号角
今日头条
77. 国产大模型哪家强?2026国产大模型选型参考
微信公众号 2026-04-21 00:00:00
78. AI“反攻”时刻
知乎 2026-04-23 00:00:00
79. 千问登顶全球调用榜 国产大模型改写市场格局
今日头条 2026-04-05 00:00:00
80. 全球AI大模型格局生变,国产模型实力亮眼
今日头条 2026-04-07 00:00:00
81. 2026年中文大模型横向测评
微信公众号 2026-04-09 00:00:00
82. 全球权威大模型盲测榜单公布,阿里千问3.6登顶中国最强编程模型
今日头条 2026-04-03 00:00:00
83. 通义千问 Qwen 3.6 Max 预览版上线,AA 指数 52 分登顶国产中文大模型
微信公众号 2026-04-21 00:00:00
84. 太提气了!阿里通义千问杀进全球AI榜单前五!国产大模型拿下中国第一
微信公众号 2026-03-30 00:00:00
85. 国产大模型强势突围!通义千问冲进全球第五,底牌曝光
今日头条 2026-03-23 00:00:00
86. 2026年AI工具终极对决
微信公众号 2026-03-30 00:00:00
87. 2026国产AI大模型终极指南一文吃透国内AI江湖,选对工具不踩坑
今日头条 2026-02-25 00:00:00
88. 给阿里千问一个“客观估计”——围绕QWen3的大模型横评
今日头条 2025-11-20 00:00:00
89. 万亿参数、32项测评第一
微信公众号 2025-11-19 00:00:00
90. 阿里通义千问开源 Qwen3.6-35B-A3B 模型 赋能智能体与多模态应用
今日头条 2026-04-17 00:00:00
91. 通义千问 Qwen3 震撼发布
微信公众号 2026-02-18 00:00:00
92. Qwen 实力闪耀 LMArena 全新“专家榜”
小红书 2025-11-07 00:00:00
93. 文心一言(文心5.0)深度解析
微信公众号 2026-03-29 00:00:00
94. 【深度评测】文心一言
今日头条 2026-04-19 00:00:00
95. 大模型如何提高推理效率
今日头条 2026-03-27 00:00:00
96. 阿里RTP-LLM开源
今日头条 2026-04-01 00:00:00
97. 微软开源Phi-4|15B参数破解标注成本困局,数据闭环+混合推理实现降本增效
微信公众号 2026-03-26 00:00:00
98. 刚刚,华为AI推理大招开源,时延降90%,吞吐提22倍,上下文10倍级扩展
今日头条 2025-11-05 00:00:00
99. DeepSeek V4实测
知乎 2026-04-25 00:00:00
100. 大模型Infra新突破!腾讯混元开源LLM推理算子库,推理吞吐提升30%
知乎 2026-01-27 00:00:00
101. 昆仑芯大规模 LLM 推理优化,实现秒级扩缩容
微信公众号 2026-03-31 00:00:00
102. 小米大模型岗|推理加速底层逻辑+踩坑实录
小红书 2026-01-26 00:00:00
103. 大模型推理成本与优化技术全景解析
今日头条 2026-02-22 00:00:00
104. 性能对标opus、1块钱百万token
微信公众号 2026-04-24 00:00:00
105. 开源铁王座易主
微信公众号 2026-04-24 00:00:00
106. 突发!DeepSeek V4 发布
微信公众号 2026-04-24 00:00:00
107. 百万上下文上线!DeepSeek 专家模式发布,国产大模型专业能力再突破
微信公众号 2026-04-10 00:00:00
108. DeepSeek V4来了:1M上下文、Agent能力、华为芯片,国产大模型打到新一局
微信公众号 2026-04-26 00:00:00
109. 别再依赖 Gemini!国产 AI 工具 DS4 上线,1 步解决论文长文本分析难题
今日头条 2026-02-15 00:00:00
110. 花20美元用ChatGPT还是白嫖DeepSeek?实测对比后我劝你别选错了
今日头条 2026-04-13 00:00:00
111. 2026年最值得用的5个AI工具实测
知乎 2026-04-04 00:00:00
112. 2026年AI写作工具推荐
知乎 2026-04-14 00:00:00
113. 2026 文档 / 长文本信息 AI (App / 工具)
微信公众号 2026-03-08 00:00:00
114. AI工具使用手册(2025版)
微信公众号 2026-01-10 00:00:00
115. 一文看懂
微信公众号 2026-04-24 00:00:00
116. DeepSeek-V4突然发布,百万文价格低至1块,开源模型天花板被捅破
今日头条 2026-04-24 00:00:00
117. DeepSeek V4 Pro实测
今日头条 2026-04-25 00:00:00
118. DeepSeek V4 预览版
知乎 2026-04-24 00:00:00
119. DeepSeek-V4 预览版终于还是来了,百万上下文直接标配~
微信公众号 2026-04-24 00:00:00
120. DeepSeek-V4重磅迭代,开源,国产大模型彻底卷出新高度
微信公众号 2026-04-24 00:00:00
121. 重磅!万众瞩目的DeepSeek V4十分钟前开源了,曾经的王又回来了!
知乎 2026-04-24 00:00:00
122. 快讯
微信公众号 2026-04-24 00:00:00
123. DeepSeek-V4 发布!百万上下文价格战打响
微信公众号 2026-04-24 00:00:00
124. DeepSeek V4 发布全解析
今日头条 2026-04-24 00:00:00
125. DeepSeek-V4预览版开源上线!百万上下文加持,硬刚全球顶级模型
今日头条 2026-04-24 00:00:00
126. 重磅!DeepSeek-V4 来了!国产开源大模型的效率革命!
微信公众号 2026-04-24 00:00:00
127. DeepSeek V4正式上线!碾压一众大模型,普通人也能免费用上顶配AI
今日头条 2026-04-24 00:00:00
128. DeepSeek V4换装华为昇腾950PR 国产AI算力迎里程碑
今日头条 2026-04-14 00:00:00
129. 弃用英伟达
微信公众号 2026-04-21 00:00:00
130. DeepSeek V4
微信公众号 2026-04-24 00:00:00
131. 脱离CUDA,性能反超
微信公众号 2026-04-21 00:00:00
132. DeepSeek V4旗舰模型完成与华为昇腾950PR芯片、CANN框架的全栈适配
微信公众号 2026-04-08 00:00:00
133. DeepSeek 若选华为
微信公众号 2026-04-26 00:00:00
134. 告别CUDA依赖
微信公众号 2026-04-25 00:00:00
135. DeepSeek V4全面换芯华为CANN!国产AI生态彻底告别CUDA依赖
今日头条 2026-04-22 00:00:00
136. 华为昇腾950PR“杀疯了”:DeepSeek V4引爆抢芯大战!
微信公众号 2026-04-05 00:00:00
137. 从CUDA到CANN:国产AI芯片适配到底意味着什么
微信公众号 2026-04-12 00:00:00
138. DeepSeek V4即将发布,对个人及行业的影响
今日头条 2026-03-03 00:00:00
139. 深度解析:DeepSeek V4脱离CUDA,华为CANN Next如何接棒?
今日头条 2026-04-18 00:00:00
140. DeepSeek-V4 核心信息速览
微信公众号 2026-04-24 00:00:00
141. DeepSeek V4 即将发布!!!聊聊背后的华为昇腾950PR
微信公众号 2026-04-12 00:00:00
142. AI Infra:华为 CANN(Compute Architecture for Neural Networks)
微信公众号 2025-11-09 00:00:00
143. DeepSeekV4即将在春节前后发布,有望超越OpenAI、GPT及Claude
今日头条 2026-01-10 00:00:00
144. 国产AI算力突围:从CUDA到CANN
什么值得买 2026-04-18 00:00:00
145. Deepseek V4即将发布,国产算力深度适配
今日头条 2026-03-03 00:00:00
146. DeepSeek-V4将至!3大硬核突破,破解大模型3大痛点
今日头条 2026-01-18 00:00:00
147. DeepSeek V4 深度适配华为昇腾芯片,华为昇腾950PR芯片A股核心相关上市公司再梳理
微信公众号 2026-04-25 00:00:00
148. DeepSeek上线支持1M上下文新模型,多项架构优化显著提升长文本处理能力
什么值得买 2026-02-12 00:00:00
149. 等了半年!DeepSeek V4终于要来了
今日头条 2026-04-14 00:00:00
150. 2.87倍碾压H20!昇腾950PR+CANN,国产AI算力彻底突围
今日头条 2026-04-22 00:00:00
151. DeepSeek V4 vs 智谱 GLM-5:2026年国产大模型“价格战”与“性能战”全面解析
知乎 2026-04-25 00:00:00
152. DeepSeek V4 震撼来袭!预计4月发布,四大突破性功能曝光
今日头条 2026-03-18 00:00:00
153. 对长上下文能力有不同要求,怎么选择合适的模型?
知乎 2025-12-17 00:00:00
154. 国产芯片与AI大模型协同突围,海光信息携手紫东太初打造算力“新引擎”
微信公众号 2025-10-28 00:00:00
155. 【财通计算机】国产大模型与国产算力共振:co-design时代
微信公众号 2026-04-01 00:00:00
156. 调研解读|国产大模型与国产算力共振:co-design时代
微信公众号 2026-04-01 00:00:00
157. 华为昇腾950PR AI芯片深度分析报告
微信公众号 2026-03-31 00:00:00
158. 算力成本降至0.007元!揭秘“绿电制Token”重构全球AI基建竞争力的底层逻辑
微信公众号 2026-04-06 00:00:00
159. 刚刚,DeepSeek 大升级,V4 真的不远了|附体验细节
今日头条 2026-04-08 00:00:00
160. CUDA 真的牢不可破?国产 GPU 的生态突围给出答案
微信公众号 2025-11-08 00:00:00
161. DeepSeek悄悄干了一件大事,V4要来了?
今日头条 2026-04-08 00:00:00
162. DeepseekV4 vsGPT5.5 vsOpus4.7! 新发布的Deepseek V4 Pro 硬刚 GPT 5.5 和 Claude Opus 4.7 ! 最新Deepseek旗舰到底做到了什么程度? 从写代码做独立站,到全套后端APP开发,再到自媒体爆款文案撰写,真实硬核测评结果出炉! 看完你就知道Deepseek v4 pro真正的性能了! #ai新星计划 #deepseekv4 #deepseek #gpt5.5 #claudeopus
抖音 2026-04-25 00:00:00
163. AI大模型行业专家交流纪要
微信公众号 2026-04-13 00:00:00
164. 大语言模型如何突破百万 Token 上下文窗口?—— 解析上下文并行与环形注意力技术
微信公众号 2026-01-27 00:00:00
165. 中英文阅读 | DeepSeek测试全新1M上下文长文本模型:技术突破与行业展望
微信公众号 2026-02-23 00:00:00
166. DeepSeek V4轻量版内测,藏着哪些意外亮点?
今日头条 2026-02-28 00:00:00
167. 国产模型与芯片适配如何构建本土生态?
今日头条 2026-02-14 00:00:00
168. 国内主流AI大模型大盘点,一文读懂国产AI大模型格局
今日头条 2026-02-13 00:00:00
169. 斯坦福AI指数报告显示阿里通义千问入选全球重要大模型前三 斯坦福HAI研究所发布的《2025年AI指数报告》显示,阿里巴巴在全球重要大模型贡献中位列第三,仅次于谷歌和OpenAI,主要依据是2024年全球61个重要AI大模型中,阿里巴巴凭借通义千问系列有6个模型入选,成为入选数量最多的中国科技公司。通义千问系列表现优异,其中旗舰模型Qwen2-72B在训练数据量上创下行业纪录,采用了覆盖27种语言的庞大语料库,并支持128K tokens长上下文处理。 该模型在国际评测中表现亮眼,在斯坦福HELM MMLU测评中位列开源模型榜首,性能超越同期美国最强开源模型Llama3-70B,并在AI高考评测中以显著优势获得总分第一。 报告还显示,中美顶级AI大模型性能差距已由2023年的17.5%大幅缩小至0.3%,接近完全抹平。 目前,阿里通义实验室已开源200多款模型,千问在全球的衍生模型数突破10万,超越美国Llama成为世界第一开源大模型
抖音 2026-02-23 00:00:00
170. SuperCLUE 3 月榜单出炉:中外大模型贴身肉搏,国产第一梯队正式成型
知乎 2026-04-08 00:00:00
已收藏
去我的收藏夹