2025–2026主流AI智能体本地部署硬件门槛:32GB内存成新基线,48GB+显存需求激增
02-20 09:04
精选参考来源
精选参考来源
1. 从零把装有MI50显卡的二手服务器打造成终极ALL IN ONE主机:ZFS+SMB+Docker+KVM+三卡AI推理!
哔哩哔哩 2025-09-25 00:00:00
2. 一年三轮融资,影目INMO将“下一代AI手机”装入眼镜!
微信公众号 2026-01-15 00:00:00
3. #科技先锋官# 当你在地下车库想调用AI实时翻译,却因没网陷入卡顿;当语音助手要等3秒才响应指令,端侧AI的不实用曾是很多安卓用户的痛点。谷歌Gemini Nano 3与安卓15的深度集成,正精准破解这些难题,让手机真正拥有本地思考的大脑。Gemini Nano 3集成安卓15解决了离线场景AI失灵的核心问题。此前端侧AI多依赖云端算力,无网络时翻译、摘要、语音交互等功能基本瘫痪。Gemini Nano 3依托安卓15的AICore系统服务,所有运算全在设备本地完成,无需数据上传云端,哪怕在山区、地铁等无信号区域,也能流畅实现实时翻译、离线文案生成等功能。Gemini Nano 3集成安卓15攻克了端侧推理延迟高、体验差的瓶颈。通过安卓15对NPU的深度优化,Gemini Nano 3离线推理速度提升2.5倍,语音指令响应、文本处理等操作几乎无延迟。这意味着,无论是整理会议纪要还是编辑图片,都能获得即呼即应的流畅体验,彻底告别等待卡顿。Gemini Nano 3集成安卓15还解决了隐私泄露与多终端适配难的问题。安卓15的私有计算核心架构,让Gemini Nano 3独立于其他应用运行,不存储操作数据,从根源上保障隐私安全。且适配Pixel、三星等多品牌终端,打破硬件壁垒,让更多安卓用户能享受到高质量端侧AI服务。Gemini Nano 3集成安卓15不仅让端侧AI从可用走向好用,更推动安卓生态迈入离线智能新时代,为后续车机协同、智能家居联动等场景打下基础。#AI创造营##AI创作热点##一条vlog回顾2025# 种斌Marco的微博视频
新浪微博 2025-12-25 00:00:00
4. 本地部署大模型?天选Air2026锐龙AI Max版简单开箱
哔哩哔哩 2026-01-22 00:00:00
5. 单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s
哔哩哔哩 2026-01-27 00:00:00
6. 双卡 48G 显存!最省钱的多卡大显存选择 Arc Pro B60
哔哩哔哩 2026-02-02 00:00:00
7. 两个教学项目:1️⃣从零开始构建 AI 智能体github.com/pguso/ai-agents-from-scratch本仓库教你从基本原理开始,使用本地 LLM 和 node-llama-cpp 构建 AI 代理。通过完成这些示例,你将理解:✨LLM 的基本工作原理✨智能体究竟是什么(LLM + 工具 + 模式)✨不同智能体架构的运作方式✨框架为何做出某些设计选择理念:通过构建学习。深入理解后,再明智地使用框架。2️⃣从零开始构建RAGgithub.com/pguso/rag-from-scratch通过一步步构建RAG(检索增强生成)来解密它的原理。没有黑箱。没有云API。只有清晰的解释、简单的示例和你完全理解的本地代码。这个项目遵循与《从零开始构建 AI 智能体》相同的理念:通过简洁、解释清楚的真实代码,使开发者能够理解先进的AI概念。你将学到:✨RAG到底是什么,以及它为何在知识检索中如此强大。✨嵌入(embeddings)如何工作,如何将文本转化为模型能理解的数字。✨如何构建本地向量数据库,高效地存储和查询文档。✨如何连接所有内容,检索上下文并将其输入到大语言模型(LLM)中以获得有依据的答案。✨如何重新排序和规范化,提高检索精度并减少噪声。✨一步步的代码演示,每个函数都有解释,毫不隐瞒。#科技先锋官#
新浪微博 2025-12-08 00:00:00
8. 涨疯了!买32GB内存就送锐龙7笔记本?
微信公众号 2026-01-26 00:00:00
9. 【硬核教程】教你搭建Mac AI集群!4台M3 Ultra,运行万亿参数大模型!
哔哩哔哩 2026-02-14 00:00:00
10. 64GB超大统一内存!华硕天选Air 2026锐龙AI Max版首发测评
哔哩哔哩 2026-01-22 00:00:00
11. 年底Arrow Lake黑马!惠普 战 66 酷睿 Ultra 版测评:真耐用真省心的真香办公AI PC
哔哩哔哩 2025-10-19 00:00:00
12. #荣耀Magic8新型饭搭子#从覆盖衣、食、住、行的 200 + 垂域场景,到 3000 + 通用场景的全场景适配,荣耀端侧智能体已通过信通院 L3 级权威认证,成为真正越用越懂你的个人智能中枢。这种以用户需求为核心的技术突破,不仅实现了 AI 范式的革新,更让普惠、安全、高效的智能体验触手可及。 从根源筑牢防线是荣耀端侧智能体的核心优势。用户的语音指令、私人照片、健康数据等敏感信息无需上传云端,全程在本地设备处理,从根本上杜绝传输过程中的泄露风险。搭配荣耀双 TEE 安全系统的硬件级加密,即便设备遭遇攻击,关键数据也难以被破解,再加上定期生成的隐私风险报告,让用户对数据安全了如指掌,真正实现数据不出本地,隐私尽在掌控。 荣耀端侧智能体的模型推理速度提升 15%,配合新一代向量化检索技术,检索性能更是飙升 400%。无论是一句话完成照片追色的影像创作,还是离线状态下的语音助手交互,无需等待网络传输,指令下达瞬间即可得到反馈,弱网或无网环境下也能流畅使用。 荣耀端侧智能体的模型功耗下降 20%,存储空间节省 30%,在释放强大 AI 能力的同时,有效降低设备能耗。而超融核架构实现了 Turbo X 性能引擎与芯片的深度融合,带来更低时延和更小画面抖动,玩游戏、处理视频时既流畅又省电,彻底摆脱高性能必高功耗的困境。 当 AI 还在依赖云端算力时,荣耀已率先开启端侧智能时代,让强大的人工智能直接扎根你的手机、平板等终端设备。不同于需要联网上传数据的云端 AI,荣耀端侧智能体将模型部署在本地,凭借底层技术突破,带来更安全、更快速、更实用的智能体验,重新定义人机交互边界。#秒懂热点就用智搜# 荣耀magic8新型饭搭子
新浪微博 2025-11-14 00:00:00
13. 华为最新报告:未来10年,AI智能体、算力、半导体、能源都有巨大的机会#智能世界2035 #AI智能体 #算力 #半导体 #华为
抖音 2025-09-19 00:00:00
14. AI智能体也卷起来了?又懂业务又不用搭工作流…
哔哩哔哩 2025-12-31 00:00:00
15. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#
新浪微博 2026-02-16 00:00:00
16. 当AI从工具进化为队友,个人超级智能体硬件来了
哔哩哔哩 2025-11-01 00:00:00
17. 只需三步!14G显存也能跑,腾讯混元video 1.5“小钢炮”本地部署实测
哔哩哔哩 2025-12-15 00:00:00
18. 4000价位高性能轻薄本!联想小新Pro14 2024酷睿Ultra版评测
哔哩哔哩 2025-10-03 00:00:00
19. 【拒绝性能焦虑!RTX5060显卡笔记本还能用多久?够用吗】#微博超有用视频大赛# 传奇学长的微博视频
新浪微博 2025-10-10 00:00:00
20. #千问Qwen3.5大模型发布#阿里在除夕夜甩出了个王炸——全新大模型千问Qwen3.5开源了,看完参数我直接好家伙: 用了Mamba混合注意力+MoE稀疏专家架构,总参数3970亿,但每次推理只激活170亿,相当于“小身材干大活”,显存占用直接砍半还多,长文本处理速度直接起飞。终于从纯文本模型进化成原生多模态,以后图文交互、复杂任务处理更丝滑。性能直接对标顶级开源产品,关键是部署门槛低了一大截,不管是企业还是个人开发者,都能轻松玩起来。 与其说是发布新模型,不如说是把大模型的“技术普惠”又往前推了一大步。
新浪微博 2026-02-16 00:00:00
21. 说起神舟战神这个名字,大家脑中的第一印象可能是一台黑色外观,高性价比的传统游戏本而这次它带来了全新的配色:青色,搭载NVIDIA GeForce RTX 5060 笔记本电脑 GPU,我们这就来看看这台“萌化”战神,究竟有着怎样强大的内芯#新机来了# #有点东西# #笔记本推荐# 搞机所的微博视频
新浪微博 2025-11-26 00:00:00
22. 今年骁龙峰会展示了的不仅是芯片,更是今年的需要技术方向:端侧AI,堆算力,让本地AI更好用!一起跟着潘达的镜头逛一逛吧~ 潘达PADA的微博视频
新浪微博 2025-09-29 00:00:00
23. 性能更强 功耗更低?体验Panther Lake处理器
小红书 2025-10-09 00:00:00
24. 【216GB显存的廉价显卡阵列,能否跑得动本地大模型?】最近,一位硬件玩家在社区分享了自己的实验项目:用二手Tesla显卡搭建一套总显存达216GB的本地推理服务器。这些二手数据中心显卡价格低廉,显存容量惊人,但问题来了:这些老旧设备并行起来,真能和现代显卡一较高下吗?这位玩家专门开发了一套GPU服务器基准测试工具,打算用数据说话。他的目标很明确:在800美元预算内找到性价比最优的硬件组合,能够流畅运行200亿参数的开源模型,同时兼顾视频处理和语音识别任务。社区里对此褒贬不一。有人泼冷水说,这些老卡推理速度可能连正常阅读速度都达不到。但也有实践派现身说法:用8张P40跑MiniMax M2.1这类MoE模型,每秒25个token,远超阅读速度,完全可用。真正的瓶颈往往不是显卡本身。一位资深玩家指出,很多人成绩不好是因为平台配置拉垮:双通道内存、普通SSD、孱弱的CPU都会严重拖后腿。他把双路X99平台换成单路EPYC后,推理速度直接翻倍。另一个现实问题是提示词处理速度。如果只是像聊天机器人那样对话,问题不大;但一旦用上Cline这类工具,系统提示动辄15000个token,光等待处理就要好几分钟。这时候老卡的短板就暴露无遗了。散热是个大麻烦。Tesla这类被动散热卡塞满机箱,噪音堪比喷气发动机。这位玩家自己设计了一套高静压风冷散热器,用RP2040微控制器根据负载动态调节风速,还在机架上做了专门的进风通道系统。硬件选型上,P40和P100是目前性价比较高的选择。MI50虽然更便宜、显存更大,但对Windows支持欠佳。欧洲地区这些卡价格偏高,一张P40要500美元左右。有玩家表示,用MoE模型配合纯GPU显存加载,推理效果相当不错,一旦调用CPU内存就会断崖式下降。主板方面,双路X99平台如Supermicro X10DRG-Q在二手市场只要200美元左右,提供充足的PCIe通道避免带宽瓶颈。如果升级到X11主板,IPMI还能自动根据GPU温度调节风扇转速。这个项目进展缓慢,作者坦言是因为日常工作占用了大量精力。但从他展示的散热方案、机架进风系统来看,这是一个工程功底扎实的玩家。他计划整合ik_llama.cpp的NCCL多卡并行测试,让基准更有参考价值。本地大模型推理的门槛正在不断降低,廉价硬件方案的可行性边界在哪里,值得持续关注。www.reddit.com/r/LocalLLaMA/comments/1qni356/216gb_vram_on_the_bench_time_to_see_which/
新浪微博 2026-01-27 00:00:00
25. 你爆过显存吗?爆显存的实际表现到底是怎样的呢,其中是什么原理
哔哩哔哩 2025-12-13 00:00:00
26. 90G超大显存轻薄本挑战70B大模型!联想小新Pro 14 2025能否战未来?【翼王】
哔哩哔哩 2025-09-19 00:00:00
27. 【移动端RTX50系显卡全解析:5050 5060 5070 5070Ti 5080 5090究竟怎么选?】距离RTX50系移动端显卡发布已经过去半年了,我们也测了很多笔记本,是时候给大家总结分析一下50系移动端显卡的区别、跑分、实测了,看看不同显卡它们之间的区别到底在哪,差距有多大,谁更适合你吧。还可以把视频分享给身边有需要的同学,点赞越多,更新越快哦~#数码好物种草计划# #微博超有用视频大赛# 传奇学长的微博视频
新浪微博 2025-09-03 00:00:00
28. #中国工程院院士点赞的AI长啥样# 新华网发布的关于中国AI的报道中,深度解读了荣耀YOYO智能体的技术优势,这份权威解读成为行业了解中国AI发展的重要参考。报道中特别提及荣耀Magic8系列新机,作为荣耀年度旗舰手机,以及同时发布的MagicOS10,在改变我们智慧生活的很多方面都做了很多新的尝试,并且YOYO的自进化功能,能让它就像生活中的“搭子”一样,陪伴消费者,就像荣耀自己说的:最伟大的自进化,是与用户共同完成的。凤凰网科技的微博视频#中国超算之父称中国智能体领先世界##荣耀AI终端生态大会##荣耀Magic8##万事找YOYO#
新浪微博 2025-10-23 00:00:00
29. #千问Qwen3.5大模型发布#真正的卷王出现了,就在刚刚,阿里正式发布全新一代大模型千问Qwen3.5-Plus。这次核心更新在于采用了Mamba混合注意力机制(SSM-Transformer) + 稀疏MoE架构,总参数3970亿但仅激活170亿参数,显存占用降低60%,推理吞吐量最高提升19倍。举个例子,传统大模型就像人工翻整墙档案,你每问一个新问题,都要把前面所有档案重新翻一遍核对关系,内容越长,翻得越慢,越到后面越卡。 纯Mamba机制则像只记档案摘要,翻得极快,但细节容易丢,关键信息可能漏看。 而Qwen3.5-Plus的混合注意力,就是摘要+精准抽查一起上:速度跟得上,细节不丢失,长文本、复杂推理又快又准。 这才是真·技术内卷,大模型体验又要上一个台阶了。#how i ai##过个有ai年# 千问qwen3.5大模型发布
新浪微博 2026-02-16 00:00:00
30. AI引爆内存荒:手机电脑不仅要涨价,还要减配
微信公众号 2025-12-29 00:00:00
31. 本地AI的未来长这样?铭凡新品体验北京会现场探访
哔哩哔哩 2025-12-16 00:00:00
32. 什么是 AI 智能体?
知乎 2025-10-31 00:00:00
33. 罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年
微信公众号 2025-12-17 00:00:00
34. 电脑 16G 内存升级成 32G 内存日常使用区别大么?
知乎 2025-10-23 00:00:00
35. Nvidia 预计在CES 2026上推出RTX 50 Super 系列~反正如果5070Ti Super 真的给到24GB 显存,那么真的可以说是真香穷人AI推理卡了。 反正5070Ti 之上的都是24GB,也跑不了更大的模型。 至于5070Ti Super 比 5090D2慢的问题,两张卡不就够了(数据并行推理,不需要交互)。
新浪微博 2025-09-11 00:00:00
36. CES上英伟达再放王炸,AI史诗升级 #AI #英伟达 #NVIDIA #CES2026 #AIPC
抖音 2026-01-08 00:00:00
37. 2026年智能体将会迎来快速增长期,会成各个企业的重点的投资和发展对象。国内将加速推动 “人工智能 +” 等重点领域的应用场景培育;旧金山的 Halper AI 正式成立,专注于简化 AI 部署流程,帮助面临资源和技术门槛的中小企业实现 AI 数字化转型;2025 首尔人工智能峰会,全球 70 余家企业顶级科技企业探共同探讨讨智能体在多领域的渗透。国内预计 2028 年企业软件中整合自主型 AI 的比例将从 2024 年的不足 1% 飙升至 33%,15% 的日常工作决策将由智能体自主完成。政策扶持将加速智能体在制造、医疗、金融等领域的渗透,形成通用智能体平台加行业专用解决方案的产业格局。#AI生活指南##AI创造营##一分钟视频创作季# 种斌Marco的微博视频
新浪微博 2025-11-11 00:00:00
38. 壹号本 OnexPlayer 游侠 X1 Air 三合一 PC 正式发布!采用可拆卸手柄设计,支持手柄掌机合体、分离使用及外接键鼠三种形态,灵活适配游戏、办公与创作场景。其10.95英寸2560×1600分辨率TCL华星OLED屏幕成亮点,120Hz高刷、540尼特亮度及高色域覆盖,带来细腻流畅的视觉体验。硬件配置上,搭载英特尔酷睿Ultra 7 258V处理器(4颗4.8GHz性能核),配合双液态轴承风扇与双铜管散热系统,实现30W性能释放。内存采用8533MHz LPDDR5X,全球首次引入Mini SSD存储扩展解决方案,突破传统空间限制,满足大容量需求。72.77Wh电池提供长效续航,搭配100W氮化镓快充,兼顾性能与便携。售价方面:Ultra 5-228V + 32GB RAM + 512GB 存储:6899 元Ultra 7-258V + 32GB RAM + 1TB 存储:7999 元Ultra 7-258V + 32GB RAM + 2TB 存储:8599 元
新浪微博 2025-09-08 00:00:00
39. 【白TV】2025-2026入门显卡PK,拒绝8GB显存——RX9060XT/RX9070GRE/RTX5060Ti/RTX5070,游戏玩家怎么选?
哔哩哔哩 2025-10-17 00:00:00
40. 图解 AI 智能体的上下文工程
知乎 2025-09-24 00:00:00
41. 这个Awesome-local-LLM不错,需要本地运行LLM的,可以收藏起来,是一个很好的起步索引。包括:1 运行平台收录了可以在本地运行 LLM 的平台,例如 LM Studio、LocalAI、jan 等,可用于下载和管理本地模型。2 推理引擎包括底层模型推理实现或高性能框架,例如 llama.cpp、vLLM、koboldcpp 等,可以作为实际模型计算的基础。3 用户界面列出了一些友好的本地聊天界面和前端项目,比如 Open WebUI、SillyTavern、Lobe Chat,为模型交互提供 UI 支持。4 LLM模型汇集了各种开源或社区权重的模型资源,从通用模型如 Qwen3、Gemma 3,到专业用途的代码模型、音频/图像模型等。5 工具与框架收录了用于构建、管理、增强 LLM 应用的工具,如 LangChain、AutoGPT、RAG 框架、代理系统、记忆管理框架等。6)教程与 硬件建议提供从基础模型推理到复杂代理系统的学习材料,同时还涵盖了本地运行 LLM 时的硬件配置说明。github.com/rafska/Awesome-local-LLM#ai创造营# #程序员#
新浪微博 2025-12-25 00:00:00
42. #英伟达发布新一代GPU# 英伟达CEO黄仁勋CES上带来了最新的Rubin平台,将芯片的竞争直接带入系统层面。GPU推理算力是Blackwell的5倍,推理成本降低90%。 Rubin平台的发布直接降低大模型落地门槛,今年AI行业要迎来全面爆发了。
新浪微博 2026-01-06 00:00:00
43. 天花板屏幕搭配天花板显卡,华硕ProArt创16 2025这把最轻薄的创作利刃,在图形与显示性能方面做到了笔记本能做的一切,助力用户在方寸之间把理想变为眼前的现实#新机来了# #笔记本推荐# 搞机所的微博视频
新浪微博 2025-11-06 00:00:00
44. 如果你想让大型语言模型(LLM)运行得更快、更省钱,这16项技术值得深入掌握:1. 量化(Quantization):通过降低参数精度,减少计算资源消耗和内存占用。2. KV-Cache量化:优化键值缓存的存储效率,提升推理速度。3. 闪存注意力(Flash Attention):高效实现注意力机制,节省显存和计算时间。4. 预测解码(Speculative Decoding):提前预测输出,减少生成延迟。5. LoRA(低秩适配):用低秩矩阵微调模型,降低训练和推理成本。6. 剪枝(Pruning):去除冗余参数,缩减模型规模。7. 知识蒸馏(Knowledge Distillation):用小模型学习大模型知识,实现轻量化。8. 权重共享(Weight Sharing):重复使用参数,减少模型存储需求。9. 稀疏注意力(Sparse Attention):只计算重要部分的注意力,提升效率。10. 批处理与动态批处理(Batching & Dynamic Batching):合理组织输入,最大化硬件利用率。11. 模型服务优化(Model Serving Optimization):提升部署效率,降低延迟。12. 张量并行(Tensor Parallelism):分布计算,支持更大模型推理。13. 流水线并行(Pipeline Parallelism):分阶段处理,提升吞吐量。14. 分页注意力(Paged Attention):分块处理长序列,节省资源。15. 混合精度推理(Mixed Precision Inference):结合高低精度计算,平衡速度与准确度。16. 早停/令牌级剪枝(Early Exit / Token-Level Pruning):动态终止计算,避免不必要的推理。掌握这些技巧,不仅能显著降低模型运行成本,还能提升响应速度,推动大型语言模型更广泛的应用。原文链接:x.com/athleticKoder/status/1979163202844754396
新浪微博 2025-10-18 00:00:00
45. #2025vivo开发者大会#一年一度 vivo 蓝科技开发者大会,这次重点当然就是 AI 战略、OriginOS 6、蓝河操作系统和开放生态。现在蓝心大模型的蓝心小V拥有更自然的对话效果,还可以记忆你的声音,调用之前的对话内容给出更具备个性化的回答。内存控制在 2GB 左右就能跑 3B 大模型,极限出词性能在 200 token/s,获得 L3 级信通院智能服务能力认证。行业首创端侧模型训练引擎,构建蓝心个人智能框架。重点是,这些个人数据都是在本地运行,让端侧 AI 更加强大。蓝心智能开发平台的上下文工程,涵盖了意图框架 2.0、蓝心智能体和端侧模型能力开放,总结而言基本就是在 AI 理解能力上有极大的提升,秒懂需求的同时也能更快调用大模型帮助用户实现直达操作。
新浪微博 2025-10-10 00:00:00
46. 合格的4K入门卡?映众RTX5070超级冰龙评测
哔哩哔哩 2025-09-13 00:00:00
47. 告别“云端依赖症”:AI为何要“锁”进本地硬件里?|甲子光年
微信公众号 2025-12-22 00:00:00
48. 双十一5K预算必入AI PC!靠谱且耐造,惠普战66 2025酷睿Ultra版体验
哔哩哔哩 2025-10-22 00:00:00
49. 笔记本电脑 2026 选购,3大主流品牌40台盘点
小红书 2026-01-27 00:00:00
50. DeepSeek 推出其最新实验性语言模型: DeepSeek-V3.2-Exp 大幅提升了推理效率并降低了计算成本性能方面,基准测试显示 V3.2-Exp 在整体表现上与 V3.1-Terminus 持平,但推理效率提高一倍左右...这导致其API价格大幅下降,降低了50%新技术:引入了 稀疏注意力 (DSA)机制普通大模型在处理长文本时,计算量会随着文本变长而快速增加,很慢也很耗资源。稀疏注意力的思路是:只关注文本里重要的部分,而不是所有内容,这样速度更快,显存占用更少,但输出质量基本不变。整体结果:速度:在长文本推理中,生成和输入阶段都快了一倍左右成本:整体 下降约 50%,特别适合处理 >32K tokens 的长文档/对话短文本场景:提升不大(甚至接近持平),优势主要体现在长上下文详细介绍:网页链接模型下载:网页链接技术报告:网页链接
新浪微博 2025-09-29 00:00:00
51. 从Steam硬件和软件调查看PC消费趋势(2025年9月版)
知乎 2025-10-14 00:00:00
52. 都在问泡沫何时破,老黄直接下了更大的赌注 #英伟达#黄仁勋#ces2026#GPU#AI新星计划
抖音 2026-01-06 00:00:00
53. 上手体验英特尔下一代芯片,还参观了晶圆厂!
哔哩哔哩 2025-10-11 00:00:00
54. DeepSeek新模型爆火,硅谷玩疯了 #DeepSeek团队开源新模型 DeepSeek新模型爆火,硅谷玩疯了!把文字变成图像,让AI一目十行读完一本书!这次,它真的在教AI们,怎么省算力、怎么学会“遗忘” #AI #DeepSeek
抖音 2025-10-22 00:00:00
55. 对于个人 AI 用户来说,玲珑星核 AI 超级电脑有其存在意义,AMD AI Max+ 395 足够强劲的 CPU、GPU、AI 性能,还有这样的集成度以及 13999 元的众筹优惠价。是目前个人用户进行本地大模型部署的最高性价比方案。并且预装的“智玲同学”,通过持续更新、图形化界面以及简化部署等一系列操作,让本地运行大模型这件事情本身,变得简单和直观,大大降低使用门槛和调优的时间。 玲珑星核 AI 电脑:叽里咕噜什么大模型部署调优?跟“智玲同学”说去 抽奖详情
新浪微博 2025-08-25 00:00:00
56. 华硕无畏Pro14 2026锐龙版,轻薄本【保姆级导购教程】锐龙AI 9 H 465笔记本推荐新品上手
哔哩哔哩 2026-02-06 00:00:00
57. 【摩尔线程发新芯片 称对AI大模型训练推理均强于英伟达上代产品】摩尔线程发新芯片 称对AI大模型训练推理均强于英伟达上代产品 在资本市场热捧中摩尔线程发布下一代产品。12月20日,摩尔线程(688795.SH)在北京召开了首届开发者大会,在会上发布了下一代的GPU架构“花港”和基于该架构开发的AI大模型训练、推理一体芯片“华山”和专用于图形渲染的芯片“庐山”。此外,摩尔线程还发布了万卡智算集群、端侧AI SoC(系统级)芯片“长江”等产品。 摩尔线程并未公布新一代AI芯片的具体参数或量产时间,称“华山”的浮点算力、访存带宽、高速互联带宽这三个指标能力介于英伟达量产的最新架构Blackwell和上一代架构Hopper之间,而访存容量优于前二者。
新浪微博 2025-12-21 00:00:00
58. #千问Qwen3.5大模型发布# 阿里“年夜饭”来了,开源全新一代大模型千问Qwen3.5-Plus。 总参数为3970亿,激活170亿,性能超过万亿参数的Qwen3-Max模型,部署显存占用降低60%,推理效率大幅提升,最大推理吞吐量可提升至19倍。 在推理、编程、Agent智能体等全方位基准评估中均表现优异,并在视觉理解能力的权威评测中斩获数项性能最佳。 支持长达2小时(1M token上下文)的视频直接输入,适用于长视频内容分析与摘要生成。#过个有AI年#
新浪微博 2026-02-16 00:00:00
59. 刚刚,英伟达祭出下一代GPU!狂飙百万token巨兽,投1亿爆赚50亿
知乎 2025-09-10 00:00:00
60. kcd2,4K DLAA 20G出头,当时还吐槽过这事,5080爆显存//@剑小张:想知道玩过的占用显存最高的游戏是啥,占用多少G?//@快乐肥宅庆先森:我遇到的游戏里24G内存不够的有,24G显存不够的真没有//@云载吾心__:还得考虑跑游戏着色器的体验,9950X3D肯定快的多,要是我选的话,我也不会玩24G显存都不够用的游戏,所以会选后者
新浪微博 2025-08-30 00:00:00
61. 下一代 RDNA 5 架构"Radeon"游戏显卡或将搭载超 1.2 万核心「超极氪」
哔哩哔哩 2025-09-05 00:00:00
62. 【人工智能】LocalAI本地AI部署终极指南
微信公众号 2026-02-07 00:00:00
63. 英伟达
微信公众号 2025-09-12 00:00:00
64. 《三年了,AI PC路在何方?》核心观点总结
知乎 2026-02-02 00:00:00
65. AI 智能体的本地化部署方案
微信公众号 2026-02-06 00:00:00
66. 2025本地部署大模型真实门槛
什么值得买 2026-02-13 00:00:00
67. 新电脑宣称是“AI PC”,这些AI功能提高工作效率还是只是噱头?
什么值得买 2026-01-27 00:00:00
68. DeepSeek如何本地化部署?
什么值得买 2026-02-17 00:00:00
69. 本地大语言模型(LLM)搭建完全指南
微信公众号 2025-09-08 00:00:00
70. 开源大模型的门槛被“明码标价”了
微信公众号 2026-02-06 00:00:00
71. 大模型到底要多少资源?——推理&训练硬件计算通俗指南
微信公众号 2025-09-16 00:00:00
72. AI算法面试题
微信公众号 2026-02-01 00:00:00
73. 通过 CPU-GPU 显存共享加速大规模 LLM 推理和 KV 缓存卸载
知乎 2025-11-13 00:00:00
74. 死磕性价比!AI 9 H 365笔记本坚持32GB大内存,价格依旧亲民
今日头条 2026-02-13 00:00:00
75. 警惕!2025年轻薄本最大“消费陷阱”
微信公众号 2025-09-20 00:00:00
76. AI 电脑多任务测试
微信公众号 2025-12-02 00:00:00
77. #酷睿UltraAI更强谁不爱。
抖音 2025-11-25 00:00:00
78. 坚持低价,坚持32GB内存!这款AI 9 H 365笔记本到手价4589元
今日头条 2026-02-13 00:00:00
79. 微软建议Win11核心玩家标配32GB内存
微信公众号 2026-02-18 00:00:00
80. 智能体 Agentic AI时代下内存架构正在发生的根本性变革-内存为中心的计算
微信公众号 2025-12-24 00:00:00
81. 【AI篇】NPU 5.0
知乎 2026-02-03 00:00:00
82. 不只快,更会思考!全新NPU5打造AI PC智能体核心引擎
微信公众号 2025-11-22 00:00:00
83. DevCon直播回顾
微信公众号 2025-11-18 00:00:00
84. AI NAS革命
微信公众号 2025-12-07 00:00:00
85. 在家搭建你自己的AI编程助手:一套完全开源的本地方案
腾讯网
86. Intel
网易
87. 至顶AI实验室硬核评测:联想推理加速引擎让AI PC解题快如闪电
网易
88. 挑战苹果及OpenAI,微软发布“有史以来速度最快的”AI PC
界面新闻
89. AI PC 挑战者来了 荣耀赵明:未来AI一定重构操作系统
新浪财经
90. 英特尔Panther Lake新品CES 2026抢先看,AI PC生态迈入智能体时代
今日头条
91. AI PC高性能芯片之争, Intel与AMD的最新AI处理器有何过人之处
51CTO
92. CES 2026别错过:Panther Lake加速AI PC迈入智能体新篇章
93. 从AI PC到超级智能体,联想如何交付个人AI体验
腾讯网
94. 决战AI智能体,华为、联想谁能成为中国最强代表?
95. 联想发布六款 AI PC,用上了智能体的电脑怎么就成了「AI 新物种」?
https://www.ifanr.com/1581826
96. 联想超级品牌日上线 AIPC等产品大幅降价
新浪财经
97. 杨元庆:AI时代不是一个集成商的游戏,而是创新者的竞争
腾讯网
98. 电脑“智变”有多难?
新浪财经
99. AI PC未免有些太过乐观了
100. 联想AI PC销量居首,“贸工技”再见成效?
腾讯网
101. 企业AI智能体官网哪家性价比高、哪家强?
102. 【行业研究100篇!】AI PC
微信公众号 2025-10-10 00:00:00
103. AI智能体走向终端,需要哪些芯片?
今日头条 2025-10-09 00:00:00
104. 我们部署了DeepSeek满血版
小红书 2025-09-11 00:00:00
105. 目前GPU推理训练的型号选型有哪些型号
今日头条 2025-09-24 00:00:00
106. 你的电脑能跑AI吗?DeepSeek硬件要求+配置清单,看完这篇就懂了!
微信公众号 2025-09-18 00:00:00
107. AI 智能体的本地化部署
微信公众号 2026-02-07 00:00:00
108. 如何在本地完整运行AI智能体:内存、工具与模型配置指南
微信公众号 2026-02-02 00:00:00
109. AI智能体建设2-操作系统环境搭建
微信公众号 2025-08-31 00:00:00
110. 零成本!Windows(Win10/Win11)本地部署DeepSeek全流程指南
微信公众号 2025-12-26 00:00:00
111. 大模型显存计算终极指南:从推理到训练,再到 24G 显存跑 7B 的秘密(附估算工具)
微信公众号 2025-09-25 00:00:00
112. AI 智能体本地化部署的流程
微信公众号 2026-02-07 00:00:00
113. 智能体AI推动内存技术革新:三星分层存储方案破解LLM性能瓶颈
微信公众号 2025-11-26 00:00:00
114. 如何配置私有人工智能
微信公众号 2025-11-11 00:00:00
115. 本地运行ComfyUI:主流AI底模配置要求与硬件选购全攻略
知乎 2025-09-12 00:00:00
116. 当前及未来AI PC对CPU、存储的需求
微信公众号 2025-12-16 00:00:00
117. 告别API焦虑!零代码本地部署:Dify.AI + Ollama + Qwen2,打造你的专属AI智能体
知乎 2026-02-15 00:00:00
118. 当理想撞上现实:2025年本地部署与智能体的败与补
微信公众号 2025-09-16 00:00:00
119. 运行本地 LLM 比您想象的更有用且更容易
知乎 2025-10-20 00:00:00
120. 2026四款AI 本地部署全流程通
今日头条 2026-01-30 00:00:00
121. 大模型推理精度与显存估算指南
知乎 2025-12-22 00:00:00
122. 浅谈大模型推理显存占用计算
知乎 2025-09-21 00:00:00
123. 新 NPU 硬件适配 AI 编译器与 ONNX 算子(猜想)
知乎 2026-02-17 00:00:00
124. 14 寸 AI 笔记本推荐:联想 YOGA Air 14 Aura AI 元启版的智慧革命
IT之家
125. Transformer模型显存占用
知乎 2025-11-20 00:00:00
126. AI 轻薄本新标杆:联想 YOGA Air 14 Aura AI 元启版体验
IT之家
127. 英特尔低功耗AI GPU揭秘:推出多款新品,瞄准推理市场新蓝海
今日头条 2025-09-27 00:00:00
128. 联想YOGA Air14 AI元启版上市:32GB+1TB,AI轻薄本新选择
今日头条 2026-02-03 00:00:00
129. 联想YOGA Air 14 Ultra Aura AI元启版发布:仅970g塞下75Wh大电池
网易
130. AI智能体搭建平台全景指南:从入门到选型的全面解析!
知乎 2025-08-30 00:00:00
131. L4级别AI智能体有多颠覆?三大特征重构企业数智生产力
知乎 2025-11-25 00:00:00
132. 联想小新 Pro / GT 2026 款锐龙笔记本电脑今日开售:全系 32GB 内存,60~99.9Wh 大电池 + SSR 星耀舒视屏
今日头条 2026-01-30 00:00:00
133. 华硕无畏Pro14162026酷睿版:32GB内存拉满,6999元起解锁AI全能体验
微信公众号 2026-01-28 00:00:00
134. 8GB显卡、6核心CPU:死亡倒计时!
微信公众号 2025-10-08 00:00:00
已收藏
去我的收藏夹
xlun
校验提示文案
xlun
校验提示文案