张大妈

雷神T9000实测:3096 TFLOPS跑不动70B大模型?真相在这

源自23位全网作者

05-30 14:49

内容由AI生成

精选参考来源

1. 创新Transformer!面壁基于稀疏-线性混合架构SALA训练9B模型,端侧跑通百万上下文

2. 屏幕赢麻了!雷神猎刃S Ultra上手评测

3. 不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?

4. 单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s

5. 你的2025最终“游戏伙伴”会是他吗?雷神猎刃 超竞版评测

6. 中国自研智驾芯片排名:1️⃣ 【蔚来神玑NX9031】 5nm车规级,行业唯一546GB/s带宽,算力数据神秘(单颗算力顶到极限 再强就被制裁)。附带神玑安全影像并打通自研SkyOS天枢整车全域操作系统。2️⃣ 【理想马赫M100】 5nm车规级,273GB/s带宽,单颗稀疏算力1280TOPS(实际有效数据未知)。3️⃣ 【小鹏图灵芯片】 7nm车规级,273GB/s,单颗有效算力750TOPS(小鹏强调100%有效算力)。4️⃣ 【比亚迪璇玑A3】 4nm车规级,273GB/s,单颗算力超700TOPS(比亚迪也说100%有效算力),具体细节还需要挖挖。5️⃣ 【地平线星空】 5nm车规级,273GB/s,智舱融合650TOPS算力,预计得2~4颗才能支持L3级/L4级自动驾驶。6️⃣ 【华为麒麟MDC810】 制程神秘,带宽未知,400TOPS稠密算力,不确定是否支持L3级自动驾驶。非常期待华为用「滔」技术更新更强的智驾芯片!#殿车#

7. 下一个“AI卖铲人”:算力调度是推理盈利关键,向量数据库成刚需

8. 将 600 亿参数大模型装进手机的瓶颈,终于被中国 AI 公司突破了

9. #千问Qwen3.5大模型发布# 阿里“年夜饭”来了,开源全新一代大模型千问Qwen3.5-Plus。 总参数为3970亿,激活170亿,性能超过万亿参数的Qwen3-Max模型,部署显存占用降低60%,推理效率大幅提升,最大推理吞吐量可提升至19倍。 在推理、编程、Agent智能体等全方位基准评估中均表现优异,并在视觉理解能力的权威评测中斩获数项性能最佳。 支持长达2小时(1M token上下文)的视频直接输入,适用于长视频内容分析与摘要生成。#过个有AI年#

10. #阿里发布旗舰推理模型# 1月26日阿里正式推出通义千问旗舰推理模型Qwen3-Max-Thinking,这是其目前参数超万亿、综合能力最强的大模型,在19项权威基准测试中性能媲美GPT-5.2、Gemini 3 Pro等国际顶尖模型,标志国产大模型跻身全球第一梯队。该模型两大核心创新亮眼,自研测试时扩展技术通过迭代反思提升推理效率,同等Token消耗下多项指标超竞品;自适应工具调用能力可自主启用搜索、代码解释器等功能,大幅降低幻觉,实测中工具协同表现优于ChatGPT。目前模型已上线Qwen Chat开放体验,API同步开通,还将接入千问APP,同时阿里同步开源Qwen3-TTS全系列语音合成模型。依托“算力-模型-应用”全栈闭环,该模型已落地淘宝、支付宝等场景,其高效推理路径也为算力约束下的国产大模型创新提供了新方向。

11. 9999元起!雷神AI工作站是什么鬼?

12. 200W性释放,雷神猎刃 超竞版评测:畅玩TGA 2025年度最佳游戏《光与影:33号远征队》

13. #阿里发布旗舰推理模型# 阿里发布旗舰推理模型Qwen3-Max-Thinking,是目前阿里规模最大、能力最强的推理模型,总参数量超万亿(1T),预训练数据量高达36T Tokens。 经过大规模强化学习训练,该模型在涵盖事实知识、复杂推理、指令遵循、人类偏好对齐等19个公认的大模型基准测试中,刷新多项最佳表现纪录,整体性能可媲美 GPT-5.2-Thinking-xhigh、Claude Opus 4.5 和 Gemini 3 Pro。

14. 体验英伟达 AI 个人超算「核弹」DGX Spark,能微调出 DeepSeek R2 吗

15. 在开源大模型领域,小米可能是领先华为的。#小米发布最新MiMo大模型#小米重磅开源新模型MiMo-V2-Flash!3090亿总参数+150亿活跃参数,性能媲美DeepSeek-V3.2,SWE-Bench编程得分73.4%超所有开源模型,256k超长上下文+150 tokens/秒推理速度,百万token成本低至0.1美元起~ 混合注意力+MTP+MOPD三大黑科技拉满效率,MIT协议开源可直接用,这波是小米AGI路线图的硬核第二步,全硬件生态AI底座稳了!#小米开源大模型##MiMo-V2-Flash#不过也许华为在闷声憋大招,余承东掌舵AI资源后,明年应该会有更多新动作

16. 【#千问上线阿里最强推理模型##阿里发布旗舰推理模型#】阿里发布旗舰推理模型Qwen3-Max-Thinking,AI助手千问同步在PC端和网页端接入这一“AI大脑”,千问App也即将接入。用户只需在模型选择栏中一键切换,即可体验更为强大的推理能力。据悉,Qwen3-Max-Thinking是目前阿里规模最大、能力最强的推理模型,总参数量超万亿(1T),预训练数据量高达36T Tokens。经过大规模强化学习训练,该模型在涵盖事实知识、复杂推理、指令遵循、人类偏好对齐等19个公认的大模型基准测试中,刷新多项最佳表现纪录,整体性能可媲美 GPT-5.2-Thinking-xhigh、Claude Opus 4.5 和 Gemini 3 Pro。

17. #小米发布最新MiMo大模型#小米今天正式发布并开源了专为智能体场景设计的超高速大模型:MiMo-V2-Flash,3090亿总参数、150亿激活参数的稀疏架构,在推理、编码和长交互任务中实现性能与DeepSeek-V3.2对标。简单试了下反应速度可以,专业类知识回答的比较全面,目前还没有正式开放,只有开发者演示平台。

18. 蓝戟 Intel Arc Pro B70 TF评测:32 GB大显存,推理神卡?

19. 科氪 | 雷神联合AMD发布覆盖三大形态AI工作站产品矩阵

20. 雷神连发十款重磅AI PC,用上AMD全家桶,万元“龙虾本”仅1kg,猛攻Agent体验

21. 告别订阅费!雷神移动AI工作站三箭齐发:本地算力更安心更可靠?

22. AMD 发布 OpenClaw 部署方案:在 Ryzen AI Max+ 395 或 Radeon AI PRO R9700 平

23. 雷神水冷迷你AI工作站首发26999元:锐龙AI Max+ 395、128GB大内存

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章