端侧AI框架选型指南:硬件决定上限,场景驱动适配
05-21 11:53
精选参考来源
哔哩哔哩 2026-03-06
新浪微博 2026-05-13
来源
精选参考来源
1. OpenClaw国产开源平替!AstrBot迷你主机部署漫谈
哔哩哔哩 2026-03-06 00:00:00
2. 联发科MDDC天玑开发者大会2026这次新东西太多了,给大家简单总结一下。这次,主要还是讲天玑AI生态,重点不是单点性能,发哥是想把手机、车机、应用开发、云端AI这些能力串起来。比如双NPU架构,主打高算力和低功耗;天玑AI智能体化引擎2.0,能做主动感知、任务拆解、多应用协同;新的天玑AI开发套件3.0,也把模型部署效率、压缩率、功耗这些开发者很在意的点继续往前推。游戏的话,这次天玑星速引擎继续围绕光追、低延迟、倍帧、调度优化发力。简单总结的话,天玑现在不只是卷跑分了,而是在卷整套体验和生态。AI手机、游戏体验、智能座舱,后面应该都会越来越明显。
新浪微博 2026-05-13 00:00:00
3. 删掉 OpenClaw!Hermes Agent 才是真王炸,一键本地部署 +模型接入全教程(避坑指南) | 零度解说
哔哩哔哩 2026-04-11 00:00:00
4. 328版本已在陆续推送中本次推送的均为全量包,rom最大机型可达18G以上,其中端侧模型大约占10G多。越往前的机型端侧模型越小,整体rom包大小相应减小,实际功能差异不会有看到的包大小差异那么大,绝大部分都是依据芯片能耗比部署的端侧模型大小的差异AI时代各家都在逐渐提高旗下手机的平均内存,以满足端侧算法、模型的部署需要。依据CounterPoint最新公布的数据,截止2025年底,华为手机以12G的平均内存位居世界第一#鸿蒙越用越香##我的鸿蒙体验#
新浪微博 2026-02-28 00:00:00
5. 今年联发科MDDC26。联发科开始聊“AI 怎么真正跑起来了”。这次天玑 AI 智能体化引擎 2.0,已经不只是简单语音助手逻辑,而是开始做主动感知、跨应用执行、端侧 Agent OS。包括和 OPPO、小米、传音展示的系统原生 Claw,其实已经有点“AI 自己帮你处理事情”的味道了。而且联发科这次不只是讲概念,参数也挺猛。天玑 AI SDK 3.0 里:模型部署效率提升 50%,模型压缩率提升 58%,常驻 AI 功耗降低 42%,端侧大模型部署时间最高缩短 90%。游戏这块也开始越来越“主机化”。这次直接展示了移动端 RTP 光追,还实现了移动端超10亿级三角面渲染,在 1.5K 分辨率下能持续 1 小时满帧运行。包括 32ms 超低延迟音频、144/165 帧倍帧、自适应调控 5.0、GPU Dynamic Cache 这些技术,现在已经不只是单纯拼帧率,而是在兼顾高画质、低功耗和长时间稳定体验。感觉现在的天玑,已经不只是手机芯片了。
新浪微博 2026-05-20 00:00:00
6. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具
哔哩哔哩 2026-02-08 00:00:00
7. 5万人抢光「阶跃龙虾」:3分钟一键部署,「养虾」终于变简单了
微信公众号 2026-03-16 00:00:00
8. #小米发布自动驾驶模型##小米自动驾驶模型XiaomiOneVL发布# 小米发布并全面开源自动驾驶模型Xiaomi OneVL:一步式潜空间语言视觉推理框架,将VLA、世界模型和潜空间推理三大技术路线统一到同一框架中,让大模型推理“又快又准”:精度上超越显式思维链,速度上对齐“仅答案”预测,推理延迟最低仅0.24秒,为传统VLA自回归推理的5.4%,为量产车端实时部署提供了可行路径
新浪微博 2026-05-13 00:00:00
9. 历史性时刻!M芯片Mac支持雷电外接GPU进行AI大模型计算!
哔哩哔哩 2026-04-10 00:00:00
10. 个人AI已在路上,带你体验2026 MWC的未来科技!
哔哩哔哩 2026-03-05 00:00:00
11. 「Github一周热点98期」AI文档检索框架、微软最新TTS、Claude Code 记忆插件、自动化备份、 jellyfin和linux桌面环境
哔哩哔哩 2025-12-21 00:00:00
12. 这才是ITX最终形态,盘点2026热门BKB机箱 | 结构 · 散热 · 兼容性一次盘透!
哔哩哔哩 2026-04-09 00:00:00
13. 上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
知乎 2026-03-02 00:00:00
14. 独显已死?英伟达杀入CPU战场,x86阵营一夜崩盘
微信公众号 2026-01-20 00:00:00
15. 我只是做了杯咖啡,群里的7个AI竟然已经自己互相 @ 走完流程了!不用再给人机当人肉搬运工,谁懂啊,我听到了AI干活的关键一环,“啪嗒”一声彻底扣上了 #ai #飞书 #飞书CLI #AI干活 #AI员工
抖音 2026-05-12 00:00:00
16. 「Github一周热点97期」开源AI手机、AI画架构图、AI编程的指导、看板工具、GO语言的游戏引擎和具身智能资料库
哔哩哔哩 2025-12-14 00:00:00
17. 本地运行大模型推理经常需要复杂的Python环境、Ollama笨重二进制或llama.cpp编译烦恼,依赖多、启动慢、配置麻烦。Shimmy 用一个Rust单二进制搞定一切,提供完全OpenAI API兼容的本地推理服务器,GGUF + SafeTensors支持,免费永远免费。不仅自动发现Hugging Face/Ollama模型,还支持热模型切换、多GPU后端自动检测、MOE混合推理,甚至一键运行70B+大模型。GitHub:github.com/Michael-A-Kuykendall/shimmy主要功能:- 100% OpenAI API兼容,支持/v1/chat/completions等标准接口;- 单二进制~5MB,包含所有GPU后端(CUDA/Vulkan/OpenCL/MLX),无需编译;- 自动模型发现,支持Hugging Face缓存、Ollama目录、LoRA适配器;- MOE CPU/GPU混合推理,消费级硬件跑70B+模型;- 智能GPU自动检测+端口分配,无需任何配置即开即用;- 支持VSCode Copilot、Cursor、Continue.dev等开发工具无缝集成。支持 Windows、Linux、macOS 多平台,一键下载运行,30秒内启动本地AI服务,完美适合开发者本地开发和隐私推理。#AI推理##本地大模型##RustAI#
新浪微博 2026-04-26 00:00:00
18. 如何评价砺算科技发布7G106 GPU在Windows ARM上的运行演示?
知乎 2025-12-02 00:00:00
19. 小米的LLM大模型真的是非常伟大支持了那么多家国产的推理芯片1. 平头哥 阿里系芯片公司,主要是 RISC-V / AI 芯片生态。2. 昆仑芯 Kunlunxin 百度系 AI 芯片公司,昆仑芯系列。3. 沐曦 MetaX 国产 GPU / AI 加速芯片厂商,图里是 META X 沐曦。4. 燧原科技 Enflame 国产 AI 训练/推理芯片厂商。5. 天数智芯 Iluvatar CoreX 国产通用 GPU / AI 加速芯片厂商!
新浪微博 2026-04-27 00:00:00
20. 联发科在MDDC天玑开发者大会2026上,公布了天玑在AI、游戏体验和开发者生态方面的新进展。这次重点放在“全域芯智能”上,覆盖终端、系统、应用和AI基础设施四个层面。天玑AI智能体化引擎2.0支持Agent OS、复杂任务拆解和多应用融合执行,天玑AI开发套件下载量提升440%,生态伙伴增长240%。同时,天玑AI开发套件升级到3.0,主要提升模型部署、压缩、功耗和端侧开发效率。LVM模型部署效率提升50%,模型压缩率最高58%,端侧NPU运行功耗降低42%,端侧LLM部署耗时降低90%。游戏方面,天玑星速引擎围绕光影、响应和流畅度做了升级,包括实时智能反射、低延时音频、GPU Dynamic Cache、自适应调控技术等能力,并推出Dimensity Profiler 2.0一站式调优工具。整体来看,联发科这次发布会的方向很明确:天玑不仅仅强调芯片性能,也在继续补齐AI开发工具、游戏调优和智能座舱生态,想把端侧AI能力做成一套更完整的平台方案。#联发科天玑开发者大会2026#
新浪微博 2026-05-13 00:00:00
21. 这次天玑开发者大会,MediaTek 想把端侧 AI Agent 这件事真正做成生态。天玑 AI 智能体化引擎 2.0,主打低功耗全时感知;天玑 AI 开发套件 3.0,继续降低模型部署、压缩和端侧迁移的门槛;再加上 OPPO、小米、传音展示的系统原生 Claw,方向已经很清楚了:AI 不应该只停留在某个 App 里,而是要进入系统层、芯片层和跨应用执行层。说白了,未来手机上的 AI,不只是你问一句它答一句,而是它能理解场景、主动执行,还尽量把隐私和数据留在本地。游戏这边也有不少硬货:移动端光追、虚拟几何体、32ms LE Audio 低延迟、倍帧 3.0、自适应调控 5.0。手游接下来卷的也不只是跑分,而是画质、帧率、功耗和延迟一起卷。一句话总结:天玑这次讲的不是单点技术,而是想把端侧 AI 和移动游戏体验,都变成长期可迭代的生态能力。
新浪微博 2026-05-13 00:00:00
22. #MDDC2026# #天玑开发者大会# 一句话总结:端侧Ai 正式从 “跑分噱头” 进入 “全场景实用” 时代,联发科把智能体落地门槛打下来了。 本届大会主题 “全域芯智能,体验新无界”,核心就三件事: AI 更落地、游戏更沉浸、生态更开放。 1、端侧 AI 大升级:AI 算力涨约 40%,第八代NPU支持70亿参数大模型流畅跑;AI开发套件3.0把模型部署效率提50%、压缩率达58%,手机也能轻松跑大模型。 2、游戏体验拉满:星速引擎进化,光追、动态缓存、倍帧技术加持,移动端画质直追主机,还能长时间稳帧。 3、全域智能成主线:不再只拼芯片性能,而是推动手机、汽车、AI 眼镜跨端无缝流转,智能体从 “单设备助手” 变 “全场景管家”。 更关键是态度转变:从 “卖芯片” 到 “建平台”,降低开发门槛、开放技术能力,拉着50 + 伙伴一起把蛋糕做大。 直白说:2026 年,端侧AI不再是参数游戏,天玑要让智能体真正走进每台设备、每个日常场景。
新浪微博 2026-05-13 00:00:00
23. 2026 天玑开发者大会核心主题很明确,就是加速智能体在端侧的实际落地。这次发布的天玑 AI 智能体化引擎 2.0 很有看点,它搭载了 SensingClaw 技术,主打的是低功耗全时感知。目前已经联合了 OPPO、小米、传音这几家头部的手机厂商,在系统底层落地了原生 Claw 体验,在保证端侧安全的前提下做到了更主动的智能体验。同时推出的天玑 AI 开发套件 3.0,则通过可视化部署、模型压缩、低功耗优化等特性,直接去提升端侧 AI 的部署效率。过去三年,天玑 AI 生态伙伴增长了 240%,开发套件下载量提升了 440%,这个数据也能看出端侧 AI 生态的爆发速度。总的来说,这波是从底层芯片到开发工具、再到手机厂商系统层面的全链路打通,端侧智能体的普及速度比想象中还要快! 上海
新浪微博 2026-05-15 00:00:00
24. 繁荣!苹果的神经网络引擎刚刚被破解,人工智能训练的未来即将改变,而一家零人工公司已经开始测试它了!一位开发者以惊人的开源成果,完成了苹果公司声称不可能完成的任务:直接在苹果神经网络引擎 (ANE) 上进行完整的神经网络训练,包括反向传播。无需 CoreML、Metal 或 GPU,完全依靠 ANE 芯片的强大性能。该项目( 网页链接 )在 M4 芯片上实现了一个单层 Transformer 结构(维度 768,序列 512),每步仅需 9.3 毫秒,持续性能高达 1.78 TFLOPS,ANE 利用率仅为 11.2%。而这颗芯片正是目前数百万台 Mac mini、MacBook 和 iMac 电脑中闲置的那颗。翻译过来就是:你的桌面电脑瞬间变成了一台超高效的人工智能超级计算机。这些数字简直令人难以置信:M4 ANE 的每瓦功耗能效约为 6.6 TFLOPS,比 NVIDIA A100 的能效高出 80 倍。实际吞吐量远超苹果官方宣称的“38 TOPS”。而且,由于它像手机一样省电,你可以全天候训练,而不用担心电费飙升或对地球造成污染。在零人公司,我们没有坐等。我们正在真实的零人公司工作负载上进行测试。这正是我们为实现零人公司愿景而苦苦追寻的关键一环:将存档数据转化为完全自主的人工智能系统,无需任何人工干预。这将改变世界。现在,任何拥有 Mac 的用户都可以首次在本地、私密地微调、训练或迭代大型模型,而且成本仅为云 GPU 的一小部分。无需再花费 4 万美元租赁 A100 集群。无需再排队等候。无需再产生大量碳排放。过去动辄数万甚至数十万美元的培训费用?如今骤降至几美分——主要成本仅仅是你的Mac电脑闲置时消耗的电费。人工智能革命已经从价值数十亿美元的数据中心转移到了你的办公桌上。我们将推出一种全新的“零人力公司”模式,在家办公,配备Mac电脑的用户收入将比以往提高100倍!我们才刚刚起步(今天只是单层模型,明天就是完整模型),但大门已经敞开。超低成本的设备端训练时代已经到来。未来并非即将到来,它已经在你的Mac上运行了。欢迎来到零人类公司时代。
新浪微博 2026-03-04 00:00:00
25. 盘点一周AI大事(5月3日)|Google上线AI口语陪练 Google IO即将发布Gemini 4和Veo 4 Gemini上线原生文件生成 Google推出AI衣柜 Google翻译上线AI口语陪练 Claude 接入50多款创作软件,能直接操作Photoshop修图、做海报,接管Blender建模,用Ableton创作音乐 英伟达开源全模态模型Nemotron 3 Nano Omni 研究员训练出复古大模型talkie KAIKAKU发布食品大模型Epicure 研究员开源突破性智能体协作框架Recursive MAS Moonlake上线Blender智能体Moonlake 3D Agent #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #大模型
抖音 2026-05-04 00:00:00
26. 「Github一周热点105期」Rust 版openclaw,本地语音克隆工具,Qwen3.5, AI 渗透测试系统和精美源码图片生成工具
哔哩哔哩 2026-02-28 00:00:00
27. 端到端,VLA,世界模型都是什么意思?
哔哩哔哩 2025-12-03 00:00:00
28. #科技先锋官# 谷歌基于Gemma 3推出的开源多语言翻译模型TranslateGemma,以三档参数规模适配手机端,凭借离线多模态翻译能力,为移动AI生态带来技术性革新,更勾勒出端侧智能应用的新蓝图。从技术适配看,它打破了参数越大性能越强的固有认知。4B轻量化版本经量化处理后内存占用仅2-3GB,可流畅运行于主流旗舰机,依托动态稀疏注意力与量化感知训练技术,在低功耗下实现38 tokens/ms的推理速度,无网环境也能1秒完成图像文字翻译。这种小参数高性能的优化思路,解决了传统AI模型在手机端算力不足、功耗过高的痛点,让专业级翻译能力真正嵌入掌心设备。对手机侧体验而言,其改变是颠覆性的。原生支持图文翻译无需额外OCR工具,55种语言覆盖主流语种及低资源语言,彻底摆脱网络依赖与云端延迟。更重要的是开源属性降低了开发门槛,开发者可基于模型微调行业专属版本,推动翻译功能向旅游、医疗、跨境商贸等场景深度渗透,让手机成为全能翻译官。TranslateGemma或将定义手机AI应用的新方向,端侧轻量化、多模态融合、场景化定制成为核心趋势。未来手机AI将从依赖云端转向端侧为主、云端为辅,更多如离线语音交互、本地图像识别等功能将落地,倒逼芯片厂商优化NPU算力,推动移动智能进入口袋里的AI时代。#微博超有用视频大赛##上微博涨知识##AI生活指南# 种斌Marco的微博视频
新浪微博 2026-01-20 00:00:00
29. 如何看待字节跳动也开始做AI芯片?
知乎 2026-02-16 00:00:00
30. MediaTek 这次讲天玑 AI 智能体化引擎 2.0,本质上是在说手机 AI 怎么从“等你下指令”,变成“主动理解场景”。大致可以这么理解:手机本来就有摄像头、麦克风、定位和各种传感器,如果系统能把这些信息用起来,AI 就不只是回答问题,而是可以判断你现在处在什么场景、可能要做什么,再去调用不同应用完成任务。所以端侧智能体真正难的地方,不只是模型跑得快不快,而是感知、系统调度和应用生态能不能一起工作。MDDC2026 上,MediaTek 还更新了天玑 AI 开发套件 3.0。拆开看,重点不是单一模型能力,而是开发流程的几个环节:模型部署做了可视化,官方称效率较上代提升 50%;Low Bit 压缩工具包用于降低模型体积,压缩率最高可到 58%;eNPU 开发工具面向 Always-On 感知;另外还有 AI Partner,用来辅助端到端部署。简单说,端侧 AI 要真正落地,除了芯片算力,也要看模型怎么部署、怎么压缩,以及开发者能不能更低成本地接入。*数据来源:联发科技实验室#MDDC2026##智能体##天玑开发者大会#
新浪微博 2026-05-13 00:00:00
31. 本地跑大模型总觉得Ollama速度不够快?切换工具链又要重新适配API,体验不佳。 Rapid-MLX 专为 Apple Silicon 打造的最快本地AI引擎,把MLX框架潜力完全发挥,提供OpenAI兼容的本地LLM推理服务。 比Ollama快2-4倍,缓存TTFT仅0.08s,支持17种工具调用解析器自动适配Qwen、DeepSeek、Gemma等主流模型,还能智能修复量化损坏输出。 GitHub:github.com/raullenchai/Rapid-MLX 主要功能: - 4.2倍Ollama速度,Nemotron-Nano 30B达141 tok/s,Qwen3.5-4B 160 tok/s; - 17种工具解析器+自动恢复,100%工具调用成功率,完美适配Cursor、Claude Code、Aider; - KV缓存+DeltaNet状态快照,多轮对话首token延迟0.08s; - OpenAI API完全兼容,LangChain、PydanticAI等框架零改动接入; - 视觉/音频多模态支持,Qwen-VL、Gemma 4图像理解,TTS/STT; - 智能云路由,大上下文自动切云端LLM,推理链分离; - 支持16GB MacBook Air到256GB Mac Studio全系列,模型从4B到158B MoE。 一键安装:brew install raullenchai/rapid-mlx/rapid-mlx 然后 rapid-mlx serve qwen3.5-4b,localhost:8000/v1 即用,开发者必备。 #本地大模型##AppleMLX##AI推理引擎#
新浪微博 2026-05-06 00:00:00
32. 开发AI玩具和语音伴侣设备,常常需要集成多种模型、音频处理和网络通信,硬件兼容性差、部署复杂,调试起来异常麻烦。ElatoAI 把实时语音AI的全栈功能整合到ESP32上,支持100+模型的端到端语音交互解决方案。不仅兼容OpenAI Realtime API、Gemini Live、xAI Grok、ElevenLabs和Hume AI EVI,还提供安全WebSocket、边缘函数部署、全球低延迟对话,甚至支持本地LLM和OTA更新。GitHub:github.com/akdeb/ElatoAI主要功能:- 实时语音转语音,支持OpenAI、Gemini、xAI Grok、ElevenLabs、Hume AI等多模型;- 安全WebSocket和Opus音频压缩,实现<2s全球低延迟对话;- 自定义AI代理,支持个性化声音、音调调节和工具调用;- ESP32固件,支持按钮/触摸控制、WiFi配置、OTA更新,无需PSRAM;- Next.js前端+Supabase后端,提供设备管理和对话历史;- 边缘部署,支持Deno Edge/Cloudflare Workers,全球20分钟不间断对话。支持Arduino IDE/PlatformIO开发,Web/移动端控制,适合AI玩具、语音助手和IoT设备开发者。#AI硬件##ESP32##语音AI#
新浪微博 2026-04-21 00:00:00
33. 在线使用和部署大语言模型(LLM)经常面临硬件资源限制,不同模型对CPU、RAM、GPU的需求差别巨大,挑选合适模型既费时又费力。有个超实用的开源工具——llmfit(GitHub:github.com/AlexsJones/llmfit),能自动检测你电脑的CPU、内存和GPU配置,结合模型参数和量化信息,智能评估数百款主流模型(Meta Llama、Mistral、Qwen、DeepSeek、Llama.cpp等)在你本地硬件上的运行适配度、速度和质量,帮你快速找到最适合你机器的模型。主要功能:- 自动硬件检测(支持多GPU,NVIDIA、AMD、Intel Arc、Apple Silicon等)- 模型Fit评分,覆盖质量、速度、内存匹配度和上下文长度四维度综合评估- 支持多量化策略自动选择,以找到最高质量的量化模型- 交互式终端UI和经典CLI,操作简单直观- 计划模式估算不同模型配置对硬件需求,方便硬件升级规划- 支持本地多种运行时集成,如Ollama、llama.cpp和MLX- 多平台支持:Linux、macOS(Intel/Apple Silicon)、Windows安装方便,macOS/Linux一条命令即可启用,也支持通过cargo源码构建。内置了超过200款模型数据库,且支持自动更新。无论是AI研究者,开发者,还是AI爱好者,都能用它一键找到真正适合自己电脑的模型,极大提升体验。强烈推荐!#AI创造营##人工智能#
新浪微博 2026-03-05 00:00:00
34. #AI# 国产算力芯片再传好消息!近日,华为发布了全新的 Atlas 350,搭载昇腾 950PR 芯片,定位为大模型推理旗舰卡,主打 Prefill 阶段与推荐业务场景,与英伟达 H100比有什么优劣势?H100 作为 Hopper 架构旗舰,是全球 AI 训练与推理的标杆产品,两者在定位、架构与生态上存在显著差异,以下从核心参数、优劣势与适用场景进行一下分析,大家可以有更深入的了解:华为 Atlas 350 优势●低精度推理性能突出:FP4 算力专为大模型 Prefill 阶段设计,在该场景下性能可达 H100 的 1.8 倍,多模态生成速度提升 60%●内存访问优化:内存访问颗粒度从 512 字节优化至 128 字节,小算子访存效率提升 4 倍,特别适配推荐系统等高并发场景●国产自主可控:无出口限制,适配国内 AI 生态(盘古大模型、MindSpore 框架),供应链安全有保障●超节点扩展能力:2TB/s 互联带宽支持最大 192 颗芯片全互连,满足 MoE 模型专家并行需求●价格优势:成本约为 H100 的 60%-70%,适合大规模部署英伟达 H100 优势●生态垄断地位:CUDA 生态 + TensorRT 优化,适配全球 90%+AI 框架与应用,开发工具链成熟●全场景覆盖:从千亿参数模型训练到边缘推理,产品线完整,无需更换硬件平台●通用计算能力:FP8/FP16/FP32 全精度性能均衡,尤其在训练场景下领先 Atlas 350 约 40%●软件工具链:调试、优化工具丰富,支持多实例 GPU(MIG)等高级特性,开发效率高●全球兼容性:适配国际主流云服务平台与企业级软件,无迁移成本各自短板华为 Atlas 350:生态成熟度不足,适配非国产框架需额外开发;训练能力弱于 H100,不适合大规模模型训练;功耗效率在通用场景下低于 H100英伟达 H100:受美国出口管制,国内企业采购受限;价格昂贵(约 25 万元 / 卡);FP4 精度支持不足,在 Prefill 等特定推理场景性能不如 Atlas 350适用场景:优先选择 Atlas 350 的场景●国内大模型推理(特别是 Prefill 阶段),如文心一言、通义千问等国产模型部署●互联网推荐业务(如电商、短视频推荐系统),小算子密集型计算需求高●追求国产可控与供应链安全,避免外部制裁风险的企业●超大规模集群部署,需要高互联带宽与内存容量的场景优先选择 H100 的场景●全球部署的 AI 应用,需要兼容国际生态与框架●大规模模型训练(如 GPT-4 级千亿参数模型),对 FP8/FP16 算力要求高科研机构与高校,需要丰富的开发工具与全球技术支持●边缘计算与嵌入式场景,需要 MIG 等灵活部署特性
新浪微博 2026-04-10 00:00:00
35. 豆包手机VS荣耀YOYO :手机AI现在这么恐怖了?
哔哩哔哩 2025-12-19 00:00:00
36. 零成本无限 Token!Hermes + Qwen3.6,本地最强 Agent 组合来了!附部署教程 | 零度解说
哔哩哔哩 2026-05-05 00:00:00
37. #天玑开发者大会# 一图看懂MediaTek天玑开发者大会2026以全域芯智能,启体验新无界,携手生态伙伴,让智能体无处不在✅ 智能体2.0落地:全时感知·跨端流转·端侧隐私安全✅ AI套件3.0革新:高效部署·极致压缩·低耗运行·快速移植✅ 游戏体验拉满:光追渲染·10亿级模型·144帧满帧·超低延迟
新浪微博 2026-05-13 00:00:00
38. 这次MDDC 2026我觉得重点很清楚:天玑不只是拼芯片参数,而是在把AI和游戏生态一起做深。AI这边,天玑AI智能体化引擎2.0、AI开发套件3.0都来了,低功耗全时感知、端侧模型部署提速、功耗降低这些,听起来更像是在给未来的Agent OS铺路。游戏这块也挺猛,移动端光追、10亿级三角面渲染、倍帧3.0、32ms低延时蓝牙,还有和《王者荣耀》《三角洲行动》《鸣潮》等合作,基本覆盖画质、帧率、延迟、功耗。我的感觉是,MediaTek这次不只是秀技术,而是在告诉开发者:天玑平台已经能把AI体验和手游体验一起往前推一大步。
新浪微博 2026-05-13 00:00:00
39. 【 天玑开发者大会 2026 】MediaTek今日召开MDDC 2026,以“全域芯智能,体验新无界”为主题,正式发布天玑 AI 智能体化引擎 2.0 与天玑 AI 开发套件 3.0,全面升级端侧全模态智能体能力。新引擎搭载 SensingClaw 技术,实现低功耗全时感知;与 OPPO、Xiaomi、传音联合落地系统原生 Claw,支持主动感知、跨端流转与端侧隐私保护,让智能体真正“活”起来。游戏技术再突破:RTP 光线追踪跨端适配,《三角洲行动》深度合作;Virtual Geometry 实现移动端超 10 亿三角面渲染;LE Audio 低至 32ms 蓝牙延迟,“指触即发、音画合一”。倍帧技术 3.0 支持 144/165 帧、多平台热更新;自适应调控 5.0 新增智能帧控与场景预判,《鸣潮》实测 1% low 帧与功耗双优。Dimensity Profiler 2.0 正式开放申请,助力《境·界 刀鸣》《无限暖暖》等热门游戏高效调优。更多信息如图所示,你觉得这些新技术顶不顶?
新浪微博 2026-05-13 00:00:00
40. 这届MDDC基本都在讲AI~这次的主题是“全域芯智能,体验新无界” ,聚焦智能体 AI 落地,发布多项核心技术与工具,深化全场景生态合作。今天发布了天玑 AI 智能体化引擎 2.0,搭载 SensingClaw 技术,实现低功耗全时感知,已联合 OPPO、小米、传音落地系统原生 Claw,兼顾主动智能与端侧安全。同步推出天玑 AI 开发套件 3.0,凭借可视化部署、模型压缩、低功耗优化等四大特性,大幅提升端侧 AI 部署效率。过去三年,天玑 AI 生态伙伴增长 240%,开发套件下载量提升 440%。游戏技术方面,联发科发布移动端光线追踪 RTP 技术,携手团结引擎实现 10 亿级三角面渲染,落地 LE Audio 低延时、倍帧技术 3.0 等,适配《王者荣耀》《三角洲行动》等多款热门手游,全面提升画质与流畅度。Dimensity Profiler 2.0 调试工具,已开放申请。
新浪微博 2026-05-13 00:00:00
41. Radxa(瑞莎)和高通合作推出AI NAS产品。这个对推进AI的边缘侧的落地有很大的帮助。相比端侧AI,边缘侧AI对功耗的要求更宽松一些,支持百亿参数的大模型更有成本优势。Radxa之前的芯片合作伙伴是瑞星微,全志和联发科,估计每家厂商都会推出类似的AI NAS方案。
新浪微博 2026-05-02 00:00:00
42. 78ms的VLA推理!浪潮信息开源自驾加速计算框架,大幅降低推理时延
微信公众号 2026-01-05 00:00:00
43. 深度|2026年,AI将从炒作走向务实
微信公众号 2026-01-05 00:00:00
44. 《Building AI Agents with Google Gemini 3 and Open Source Frameworks》AI代理正从简单聊天机器人进化为具备复杂决策能力的半自主系统。谷歌最新发布的Gemini 3 Pro Preview,成为推动这一变革的核心引擎。它不仅提升了推理深度和多模态处理能力,还通过“思维签名”技术确保多步骤操作不丢失上下文,实现高效稳定的任务执行。Gemini 3支持开发者灵活控制成本、延迟和推理深度,满足不同场景需求。其大上下文窗口有效防止“推理漂移”,让代理在长时间对话中保持逻辑一致。更重要的是,谷歌携手开源社区,实现了LangChain、Vercel AI SDK、LlamaIndex、Pydantic AI和n8n等主流框架的Day 0支持,助力开发者快速构建下一代智能代理。- LangChain通过图形化工作流,支持多角色复杂代理开发。- Vercel AI SDK以TypeScript为基础,优化代码生成和推理性能,助力现代前端框架。- LlamaIndex专注知识型代理,强化数据交互与索引能力。- Pydantic AI结合Python类型安全,提升代理数据的可靠性和可维护性。- n8n赋能非技术团队,无需编码即可打造智能自动化流程。使用Gemini 3时,建议简化提示语,开启thinking_level参数调控推理深度,保持temperature为1.0以保证性能,严格管理思维签名的传递,合理设置多模态分辨率以节省计算资源。详细开发指南中包含迁移建议和API新特性,助力顺利升级。Gemini 3不仅是技术升级,更是智能代理迈向实际应用的关键一步,推动AI更好地服务于复杂业务和多样场景。原文:developers.googleblog.com/building-ai-agents-with-google-gemini-3-and-open-source-frameworks/
新浪微博 2025-11-21 00:00:00
45. 如何看待阿里达摩院发布玄铁C950刷新RISC-V全球性能纪录,AI时代CPU的重要性是否被低估了?
知乎 2026-03-24 00:00:00
46. 黄仁勋可能真的开始疯狂自救了,AI算力的游戏规则变了! 对中国来说,这反而是一个窗口期。#红衣聊AI #黄仁勋 #英伟达 #芯片 #大有学问
抖音 2026-03-18 00:00:00
47. Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西
抖音 2026-01-29 00:00:00
48. 零成本跑最强AI!Gemma 4手机本地部署(支持离线+多模态)安卓、iPhone全搞定! | 零度解说
哔哩哔哩 2026-04-07 00:00:00
49. #豆包手机#豆包手机发布,AI Agent才是未来?泛化通用能力,或许是未来终端AI真正服务消费者的支点。这依赖于端侧大模型对模糊需求的精准解读,以及操作系统对生态服务的无缝调用。在AI手机的赛道上,硬件厂商基于自身OS能力部署AI Agent,荣耀最早开启端侧AI研究和应用的手机厂商,在荣耀Magic8系列上,AI agent自动执行覆盖衣食住行3000+场景,支持通过YOYO语音交互实现操控。当AI开始自主串联“感知-决策-执行”的完整链条,未来的终端,是否会从“工具”演变为“生活流程的默认知情者”?
新浪微博 2025-12-04 00:00:00
50. 豆包 AI 手机登录微信被「踢下线」,原因为何?端侧 AI 与头部应用的生态兼容上存在哪些挑战?
知乎 2025-12-04 00:00:00
51. “龙虾大战”一个月之后,Token全面涨价: - 腾讯云:混元系列模型最高涨超460%,从0.0008元/ktokens升至0.004505元/ktokens - 阿里云:算力卡、文件存储产品上涨5%-34%。(自2026年4月18日00:00起执行) - 百度智能云:AI算力相关产品上调5%-30%。(自2026年4月18日00:00起执行) - 智谱AI:新推出的GLM-5-Turbo API价格较前代累计上涨83% 端侧的AI Agent有个方式可以省掉很多云端费用的开销,就是部署端侧本地的算力。按当前这种趋势,端侧AI加速芯片的机会可能来了。
新浪微博 2026-03-27 00:00:00
52. 9ms刷新NuPlan SOTA!上交&理想最新Vec-QMDP
微信公众号 2026-03-12 00:00:00
53. 部署AI智能体通常需要复杂的架构,LLM网关负责API路由,数据库管理多租户,安全层防止越权,还要额外的监控工具,来回切换部署颇为麻烦。GoClaw 把AI智能体平台的完整功能全部整合到一起,提供了生产级多租户AI代理解决方案。不仅支持20+ LLM提供商(Anthropic、OpenAI、Groq等)和7大消息渠道(Telegram、Discord、Slack等),还提供5层安全防护、多智能体团队协作、任务看板,甚至内置知识图谱和定时调度。GitHub:github.com/nextlevelbuilder/goclaw主要功能:- 多租户PostgreSQL隔离,每个用户独立工作空间和加密API密钥(AES-256-GCM);- 20+ LLM提供商原生支持,含提示缓存和扩展思考模式;- 7大消息渠道接入,实时流式对话和多媒体处理;- AI智能体团队协作,支持同步/异步委托、共享任务看板;- 内置工具集:文件操作、网络搜索、浏览器自动化、图像/音频/视频生成;- 5层安全体系+速率限制、提示注入检测、生产级可观测性(OTel);- 单二进制部署(~25MB),支持Docker Compose一键启动,$5 VPS即可运行。支持 Web仪表盘、Docker多平台部署,通过 make up 一键本地运行,适合AI开发者、团队和企业使用。#AI智能体##Golang# #多智能体# #LLM网关#
新浪微博 2026-04-07 00:00:00
54. 华为AI强势崛起,芯片格局的反转!2025年,华为昇腾出货 81.2万颗 AI芯片,占中国整体市场 20% ,国产厂商第一、全市场第二。而英伟达份额暴跌 40% ,国产芯片整体份额升至 41% 。昇腾950 PR推理性能达英伟达H20的近3倍,910 C采用7nm工艺,FP16算力 800 TFLOPS 。deepseek深度求索新一代旗舰模型V4从CUDA迁移到华为CANN框架,阿里、字节等大厂下单数十万颗升腾芯片。构建MindSpore框架到CANN计算架构闭环,2025年全面开源,开发者达数百万。(信息综合自网络)
新浪微博 2026-04-11 00:00:00
55. LTX-2 最新开源模型!只需8G显存,即可生成电影级AI大片!太离谱了, 附本地部署教程!| 零度解说
哔哩哔哩 2026-01-19 00:00:00
56. #Mate80系列支持14天极限续航#这个极限续航好啊!它通过AI动态功耗调度,将导航、天气查询等高频场景功耗压降30%,实现续航与性能的平衡。这种对户外场景的深度优化,不是简单功能的堆砌,而是从用户实际需求角度出发的技术革新。在极限环境中,让每一格电量都转化为安全感与探索力。这才是旗舰机该有的样子:技术为骨,人文为魂,华为太赞了
新浪微博 2025-11-25 00:00:00
57. 2025年AI正从工具时代加速迈向伙伴时代,十大趋势正悄然改变我们的生产生活。算力已成为像电力一样的基础设施,东数西算工程让AI算力更高效绿色,成为智能产业的核心引擎。芯片领域迎来新变革,AI原生需求让NPU在手机等终端普及,国产芯片加框架方案已在千亿级模型中得到验证。大模型不再只拼参数,混合专家模型通过大参数、小激活设计,实现成本与能力的平衡。AI正重塑我们获取服务的方式,智能体从人找服务转向服务找人,未来手机里的App可能被全能AI助手取代。具身智能机器人已能完成高精度操作,从工业车间走向养老护理场景。多模态技术让AI耳聪目明,能同时处理文本、图像、视频,助力创意内容生成。端侧AI让手机、汽车等设备拥有本地智能,既保护隐私又响应迅速。更令人惊喜的是,AI在科研领域已达博士水平,能预测肺癌基因突变、发现新材料。值得骄傲的是,开源AI已进入中国时间,DeepSeek、Qwen等国产模型全球下载量领先,中国正走出独特的AGI发展路线。从科研助手到生活伙伴,AI的2026,值得期待。#科技先锋官##AI生活指南##AI创造营# 种斌Marco的微博视频
新浪微博 2025-12-11 00:00:00
58. #天玑开发者大会# 简单汇总一下今天的天玑开发者大会,其实简单说联发科这才是聚焦全域智能体,发布了智能体化新愿景,包括:AI跨手机、汽车、家居无缝流转。还推出天玑AI开发套件3.0、端侧AI方案,天玑9400+ AI算力+40%。携手阿里通义千问,Qwen3模型端侧部署。游戏方面升级光追、GPU优化,提升移动端画质。汽车领域发布智能座舱方案,布局车载AI。共计50+头部厂商参会,共建端边云协同AI生态~
新浪微博 2026-05-13 00:00:00
59. #天玑开发者大会# 天玑9500对AI放在了一代更新的重点篇幅,从硬件端直接搭建起了一个更精准的AI底层框架。在终端上跟各家手机品牌合作出不同侧重的AI助手,而在上游的系统层面拉高了智能体 的上限,同时做到AI使用上的安全性。在生态中从内至外地整合体验,让不同端和使用场景之下做到全方位体验一致。
新浪微博 2026-05-13 00:00:00
60. 近日,阿里巴巴达摩院发布了旗舰处理器 玄铁 C950。采用 5nm 制程、主频 3.2GHz,单核性能首次突破 70 分(SPECint2006),综合性能为上代 C920 的 3 倍,并原生支持千亿参数大模型推理。配套推出两大 RISC-V 原生 AI 引擎,与中科院软件所合作打造 RISC-V 原生 AI 操作系统。RISC-V 是当前绕过 x86/ARM 专利壁垒的关键路径,玄铁 C950 的突破意味着国产芯片在 AI 推理基础设施上迈出实质性一步,对中国算力自主可控战略具有里程碑意义。 #芯片#
新浪微博 2026-03-26 00:00:00
61. OpenClaw 之后,2026 年的 AI 硬件该怎么做?
微信公众号 2026-03-16 00:00:00
62. #微博声浪计划##听见微博# 2026年4月24日,DeepSeek V4正式发布并开源,华为昇腾同步完成全链路适配,实现国产大模型与算力深度融合。技术上迁移至CANN框架,昇腾950PR芯片优化性能,8K场景推理延迟低至10ms,能耗降40%。产业端打破英伟达垄断,推动国产算力规模化,全球竞争格局生变。 闫跃龙的微博音频
新浪微博 2026-04-26 00:00:00
63. AI圈罕见一幕!模型强到不敢公开发? #大有学问 #红衣聊AI #AI工具 #智能体
抖音 2026-04-12 00:00:00
64. 一键部署Openclaw还能白嫖算力?绿联NAS送你“小龙虾”!
哔哩哔哩 2026-03-15 00:00:00
65. Google 放大招!Gemini 3.1 Pro 正式发布,推理能力翻倍!免费使用方法来了 | 零度解说
哔哩哔哩 2026-02-21 00:00:00
66. 把AI大模型塞进手掌心?铭凡智能体新品探展
哔哩哔哩 2026-05-14 00:00:00
67. 完了,我做的这只猫开始监视我了…【AI桌宠开源】
哔哩哔哩 2026-05-03 00:00:00
68. #你会把手机权限交给AI吗#如果手机是端侧AI那么我可以把权限交给AI,因为不管它怎么折腾都是在我的手机本地,如果是云端AI那么我不会给权限,我不想我的各种资料都被第三方拿去利用。目前国内手机厂商做端侧AI的并不多,华为、荣耀、OPPO是主要的端侧开发厂商,其中做的比较好的是荣耀的端侧,也是国内最早开始做端侧AI的,但是现在我发现很多人根本不会去关注端侧和云端的区别,这说明用户对于自己的数据安全意识还不够高。还有就是国内生态大厂也在限制AI能力的发展,如果国内生态大厂能够和手机厂商毫无阻隔的合作AI,其实现在的AI真的可以覆盖衣食住行等多个方面,尤其是涉及到微信场景时,取餐码、自动续费、小程序调用等等可以更加方便用户生活,但是很可惜,微信不允许手机厂商随意调用,尤其是国产厂商做什么微信限制的更加严格,反而苹果适配什么几乎一路绿灯,也不知道微信是什么情况
新浪微博 2025-12-04 00:00:00
69. 豆包那PC版本还不如网页端…不就是个大号浏览器,云端AI的入口在手机app//@村民F_:其实最好的本地部署是公司在局域网里配一个AI服务器,这样既有本地部署的快响应和安全性,又有媲美云端的算力,放自己电脑上跑的那种本地部署算力还是太局限了//@奥拉猪汪:额😓理论上可以在商务办公方面有所助力,比如会议记录、实时翻译、摄像头功能优化等等,本地部署也可以保证安全性……不过主要目的还是为了提振股价,避免公司抓不住时代潮流,以及给上游芯片厂商“交作业”
新浪微博 2026-02-22 00:00:00
70. RISC-V 架构,未来会挑战 ARM 和 x86 的主导地位吗?
知乎 2026-05-09 00:00:00
71. 小米miclaw首批通过中国信通院Claw智能助手专项评测,它标志着端侧AI正式进入标准化、可量化、可验证的合规竞争阶段。信通院这套评测不是功能打卡,而是对端侧理解、生态协同、记忆体系、自进化能力的全链路压力测试。过去行业最大的痛点,是AI助手能力参差不齐、宣传与体验脱节、用户无法分辨真假实力;而Claw认证,就是给行业立了一把标尺。更关键的是,端侧AI拼的从来不是单一算法,而是系统级整合能力。同样的底层技术,不同厂商调校出的体验天差地别。小米能首批达标,本质是其在全生态底层调度、跨应用互联、端侧隐私计算上形成了完整闭环,做到了能力可落地、体验可感知、标准可对齐。
新浪微博 2026-04-17 00:00:00
72. #差评说数码# 昨天去了一趟 2026 玄铁 RISC-V 生态大会现场,现在感觉脸有点疼。虽说性能上来了只是个开始,离啃下市场还远着呢,但不妨咱们看看现在 RISC-V 架构发展到什么水平了:之前咱们一直以为,未来很长一段时间,RISC- V 都只能在嵌入式、边缘计算这些对性能要求不高的领域,跟 ARM 捡捡漏。数据中心云计算,这些性能和稳定性要求更高的领域,RISC-V 架构的处理器想挤进去,不是说不行,就是有点吃力。但今天玄铁发了新一代旗舰处理器C950,之前那个情况可能会有点变化了。从发布会的PPT来看,云计算典型负载下,C950 的 CPU 处理能力,硬生生把当下 ARM 和 x86阵营最新的旗舰处理器给压过去了。虽然说玄铁没交代清楚对比的具体x86阵营和ARM阵营的哪一款处理器,但敢这么对比,说明现在 RISC-V 阵营的 CPU, 好歹在性能上已经有勇气跟ARM和x86掰手腕了。另外处理器发布会保留的跑AI大模型环节,玄铁C950 居然也挺稳的,跑千问、DeepSeek 这些主流大模型,一点没掉链子。不过还是要说,服务器 CPU 这块之前一直都是x86阵营的天下,ARM这两年勉强撕开个口子,但Arm 高级副总裁 Mohamed Awad 也只敢小声预言,到 2025 年底,Arm 的 CPU 份额将增长到接近 50% —— 这还只是出货量不是保有量。不管现在有没有确切的数据验证他这个预言准不准,都足够说明,服务器CPU 市场,还处于大哥宝刀未老,二哥刚刚冒头的节骨眼。这样的情况下 RISC-V 能得吃下多少市场,还真不好说。好在玄铁背后是达摩院,达摩院背后有阿里,希望阿里能多动员自家的阿里云站台支持下自家兄弟的产品吧。
新浪微博 2026-03-25 00:00:00
73. 【回应True2009fans91】AI不能全信,实践才是检验真理唯一标准
哔哩哔哩 2026-04-05 00:00:00
74. MediaTek 正式发布天玑 AI 智能体化引擎 2.0 ,借助天玑 SensingClaw 技术,可提供低功耗的全时感知能力,赋能设备制造商打造具备主动感知和跨应用驱动能力的Agent OS,推动智能体用户体验进化焕新MediaTek 还推出天玑 AI 开发套件 3.0,升级端侧智能体全模态能力并加速智能体应用的端侧部署,赋能终端设备充分释放天玑强大的AI 能力。支持LVM 模型可视化部署,新增 Low Bit 压缩工具包,新增eNPU开发工具包,新增天玑 AI Partner
新浪微博 2026-05-14 00:00:00
75. 颠覆认知!2026边缘AI端侧推理框架,3大主流方案,新手也能直接部署
微信公众号 2026-04-09 00:00:00
76. 端侧大模型部署方案
小红书 2026-03-06 00:00:00
77. 谷歌开源LiteRT端侧AI框架 TFLite正统继任者 支持NPU/GPU零拷贝 GenAI模型推理提速3倍 移动端开发者必备
微信公众号 2026-04-02 00:00:00
78. 端侧 AI 部署复盘
知乎 2026-04-19 00:00:00
79. 端侧AI交互革命
微信公众号 2026-02-10 00:00:00
80. 2026年嵌入式AI硬件平台
知乎 2026-05-10 00:00:00
81. 跨平台编译难?容器仿真慢?UltraLAB为边缘智能破局
知乎 2026-03-27 00:00:00
82. Arm 引领 AI 计算重心下沉
微信公众号 2025-12-24 00:00:00
83. 推理芯片
微信公众号 2026-03-29 00:00:00
84. 算力芯片在增长,推理市场同样高速增长。国内推理芯片行业全景扫描
微信公众号 2025-12-28 00:00:00
85. TFLite/LiteRT如何处理算子版本和兼容性的问题?
微信公众号 2026-05-04 00:00:00
86. 如何理解TFLite/LiteRT的核心概念和框架流程?
微信公众号 2026-04-27 00:00:00
87. TensorRT / ONNX Runtime / TFLite
知乎 2026-04-08 00:00:00
88. 嵌入式AI框架与工具生态
微信公众号 2026-03-19 00:00:00
89. ONNX Runtime 全面解析
知乎 2026-02-11 00:00:00
90. 每日GitHub精选
今日头条 2025-12-10 00:00:00
91. 模型部署方案概览: 如何选择合适的推理框架?
知乎 2025-12-17 00:00:00
92. 每日GitHub精选
今日头条 2025-11-28 00:00:00
93. VideoPipe,轻量级C++视频分析框架的革命性突破!
微信公众号 2025-12-25 00:00:00
94. 毫瓦级前沿
微信公众号 2026-02-18 00:00:00
95. 边缘设备语音识别新选择
微信公众号 2026-02-18 00:00:00
96. GLM-ASR-Nano-2512
微信公众号 2026-02-17 00:00:00
97. 如何在边缘设备构建、优化和部署人工智能模型 - 哔哩哔哩
哔哩哔哩 2025-12-25 00:00:00
98. GitHub一巡!边缘设备语音识别延迟高?Moonshine Voice开源工具包实现实时低延迟高准确率语音转文字
微信公众号 2026-02-18 00:00:00
99. 拒绝硬件绑架
微信公众号 2026-04-14 00:00:00
100. AI工业丨边缘轻量化AI推理在工业物联网设备监测中的应用原创
微信公众号 2026-04-03 00:00:00
101. 边缘AI推理
微信公众号 2026-05-13 00:00:00
102. 【智能边缘】不同边缘设备能运行的AI模型
知乎 2026-01-07 00:00:00
103. GitHub一巡!解决边缘设备部署大语言模型难题,Google LiteRT-LM框架实现跨平台高性能推理
微信公众号 2026-04-07 00:00:00
104. 别再只把 MCU 当控制器
微信公众号 2026-04-28 00:00:00
105. 边缘AI趋势下,德州仪器升级MCU的策略
知乎 2026-03-24 00:00:00
106. 边缘 AI 加速的 Arm® Cortex®‑M0+ MCU 如何为电子产品注入更强智能
微信公众号 2026-04-01 00:00:00
107. MCU/MPU巨头集体自研NPU,重构边缘AI算力格局
微信公众号 2026-04-13 00:00:00
108. 在ESP32和STM32上运行TinyML,有什么区别?怎么选择?
微信公众号 2026-05-15 00:00:00
109. TinyML翻车?别再死磕模型压缩了!90%的锅,其实是MCU选错了
知乎 2026-05-08 00:00:00
110. AI+嵌入式
微信公众号 2026-04-15 00:00:00
111. 一篇文章了解清楚
微信公众号 2026-05-05 00:00:00
112. TinyML 的工作流里,每一步到底应该由谁来做?哪一步是嵌入式工程师?
微信公众号 2026-05-02 00:00:00
113. Ollama vs vLLM vs llama.cpp终极对比!本地部署大模型到底该选谁?2026最新版
哔哩哔哩 2026-04-19 00:00:00
114. 一文讲清
知乎 2026-01-08 00:00:00
115. 大模型推理框架全景对比
知乎 2025-12-10 00:00:00
116. AI框架与边缘计算
今日头条 2025-12-23 00:00:00
117. 【AI开源雷达】GitHub 热榜 AI 项目
微信公众号 2026-04-06 00:00:00
118. 2026AI端侧大模型元年:5款顶流深度横评!超强兼顾"隐私+速度"
今日头条 2026-05-07 00:00:00
119. 端侧2026看点
微信公众号 2026-02-18 00:00:00
120. 告别云端依赖,AI 进入“边缘计算”时代
微信公众号 2026-03-22 00:00:00
121. AI PC、AI手机、AI XR,端侧AI落地进行时
https://www.vrtuoluo.cn/540047.html
122. 端侧AI芯片主要包括:高性能SOC芯片、低功耗SOC芯片、物联网摸组及连接芯片、存储芯片、IP芯片等。
https://xueqiu.com/7452333395/322641047
123. 端侧AI进入生态与场景决胜时代,上海海思给出端侧AI最优解:五芯布局、开源OS、兼容200款模型
今日头条 2026-03-13 00:00:00
124. 微软开源ONNX Runtime:跨平台高性能机器学习推理与训练加速器
微信公众号 2026-04-26 00:00:00
125. 端侧AI推理加速,Superpowers框架碾压全场
知乎 2026-04-10 00:00:00
126. 端侧大模型选型指南:从腾讯1.8B到阿里MAI-UI,怎么选不踩坑?
今日头条 2026-01-01 00:00:00
127. 从美颜到芯片:端侧 AI 推理的七层栈与层间调度
微信公众号 2026-05-11 00:00:00
128. 15倍提速!智元打破VLA端侧部署枷锁,推理性能刷新业界纪录
微信公众号 2026-01-30 00:00:00
129. 别再乱选端侧 AI 芯片!2026 选型黄金标准:算力、功耗、成本、生态一次讲透
微信公众号 2026-05-07 00:00:00
130. 端侧AI模型怎么选?6 款主流超轻量AI模型深度测评! 还在为选择合适的端侧 AI 模型而烦恼吗?本视频为你带来超轻量 AI 模型(0.5B-1.5B 参数)的技术选型全攻略!我们深度对比了阿里 Qwen3.5-0.8B、Meta Llama 3.1-1B、Google Gemma3-1B、面壁智能 MiniCPM-4.0-0.5B、深度求索 DeepSeek-R1-1.3B、阿里 Qwen2-0.5B 这 6 款主流开源模型,一次讲透!你也能成为端侧 AI 选型专家! #端侧AI #超轻量大模型 #AI模型选型 #Llama #Qwen
抖音 2026-03-08 00:00:00
131. 端侧AI:如何实现数据隐私保护与性能优化的双重突破
哔哩哔哩 2025-11-27 00:00:00
132. 【github趋势榜】LiteRT-LM · 端侧 LLM 推理(2026-04-06)
微信公众号 2026-04-06 00:00:00
133. TVM入门 -- 建立 IRModule (含RelaxFunc,TensorIR Func)
知乎 2026-03-06 00:00:00
134. TinyML几年前就已经有了,为什么现在才开始爆火?
今日头条 2026-04-02 00:00:00
135. AIM-M-MX MemryX MX3 M.2 AI加速卡 MemryX MX3 M.2 AI加速器模块是一款功能强大、节能高效的边缘AI解决方案,专为实时低延迟计算机视觉推理而设计。 单模块集成四颗MemryX MX3 AI加速器 创新内存计算与数据流架构实现高吞吐量 通过一键式模型优化实现>50%芯片利用率 通过MemryX开发者中心支持主流框架(ONNX、PyTorch、TensorFlow) -40°C至85°C宽温工作范围,满足工业应用需求 通过标准M.2接口兼容任意主机处理器(ARM/x86/RISC-V) 通过加速器内存实现低延迟、确定性性能 全面支持操作系统(Ubuntu、Windows、Android)
抖音 2026-03-30 00:00:00
136. MCU,智能觉醒
微信公众号 2026-02-22 00:00:00
137. 推荐GitHub3.5k Star, 仅5MB秒杀Ollama超轻量级开源AI推理服务器shimmy
微信公众号 2026-01-23 00:00:00
138. 【TVM教程】设备/目标交互
知乎 2026-02-02 00:00:00
139. 边缘 AI 加速的 Arm® Cortex® ‑M0+ MCU 如何为电子产品注入更强智能
知乎 2026-03-27 00:00:00
140. ONNX:生成式AI运行时
今日头条 2026-01-27 00:00:00
141. 单片机 边缘AI:轻量级智能落地实践 单片机与边缘AI的融合,让智能决策下沉至端侧设备。借助TinyML技术与TensorFlow Lite Micro等框架,通过模型量化、剪枝压缩,解决单片机内存与算力受限难题,实现轻量级AI算法高效部署。 #边缘AI #单片机应用 #TinyML #智能硬件 #轻量化部署
抖音 2025-12-30 00:00:00
142. 2026-边缘AI推理芯片:技术演进与市场发展全景解析
哔哩哔哩 2026-03-13 00:00:00
143. 端侧AI芯片:开启智能终端的“本地大脑”时代
微信公众号 2026-04-29 00:00:00
144. 提升端侧大模型推理效率:NPU&CPU异构计算+端侧PD分离
知乎 2025-12-19 00:00:00
145. 【TVM教程】设备\u002F目标交互\n - 哔哩哔哩
哔哩哔哩 2026-02-02 00:00:00
146. 试试 LiteRT — 为边缘设备优化的轻量级推理运行时
微信公众号 2026-02-12 00:00:00
147. 双料齐发!明略科技正式开源 Cider 端侧推理加速框架与 Mano-P 端侧模型
知乎 2026-05-06 00:00:00
148. 如何创建机器学习模型?使用英飞凌 PSOC™ Edge 创建语音识别应用程序
微信公众号 2026-03-27 00:00:00
149. TI扩展MCU版图:TinyEngine™ NPU赋能,边缘AI加速落地嵌入式系统
微信公众号 2026-03-25 00:00:00
150. 端侧AI-RWKV框架助你跨过延迟、安全、成本三道关口
微信公众号 2026-01-10 00:00:00
151. Arduino IDE 开发ESP32C3预测正弦函数
微信公众号 2026-03-09 00:00:00
152. 嵌入式AI在智能家居中的开发实践:从轻量级神经网络到功耗优化全解析
微信公众号 2026-02-27 00:00:00
153. 模型量化(Model Quantization)技术综述
知乎 2026-03-03 00:00:00
154. 边缘AI推理芯片:2025年188.19亿美元市场,消费电子为核心,汽车电子加速渗透,多领域需求井喷
微信公众号 2026-03-22 00:00:00
155. 从零开始构建端侧AI Agent:开发步骤与实践分享
哔哩哔哩 2025-11-27 00:00:00
156. PyTorch深度学习实战(54)——使用TorchScript和ONNX导出通用PyTorch模型
知乎 2026-05-13 00:00:00
157. 国产MCU自研NPU,能否打破国际巨头垄断?
微信公众号 2026-04-14 00:00:00
158. 端侧AI 模型部(Windows/TFLite/Android Studio )实战一
知乎 2026-04-01 00:00:00
159. 双芯异构・智启边缘|米联客MLK-AFH01-KU5P+RK3588J NPU异构协同,解锁三大端侧 AI 落地新范式!
微信公众号 2026-04-24 00:00:00
160. 边缘AI的部署场景
知乎 2026-02-23 00:00:00
161. 端侧AI部署新思路:Nexa SDK
知乎 2025-12-15 00:00:00
162. 边缘AI部署与优化实战:从云端到端侧的最后一公里
知乎 2026-03-20 00:00:00
163. 《边缘AI协同:云服务器的端侧智能赋能新路径》
哔哩哔哩 2026-01-09 00:00:00
164. LiteRT-LM:面向边缘计算轻量级大语言模型推理部署框架|优云智算
哔哩哔哩 2026-04-25 00:00:00
165. AI MCU创新大势下,这些本土芯片厂商优选Arm Total Access
今日头条 2026-05-20 00:00:00
166. AISBench Benchmark大模型端到端评测工具介绍
知乎 2025-12-12 00:00:00
167. 国产MCU的“弯道超车”时刻:当CW32遇上OpenClaw,AI或将改写工具链格局
知乎 2026-04-01 00:00:00
已收藏
去我的收藏夹