Ollama跑Gemma虽快,但企业协作必须上Harbor,否则半夜被叫醒的是你
04-22 12:53
精选参考来源
1. 阿里正式发布新一代基模千问3.5
微信公众号 2026-02-16 00:00:00
2. 搭建 Ollama 本地模型,让 Hermes 拥有"备用大脑"
知乎 2026-04-21 00:00:00
3. 除夕夜,国产顶流压轴上线,QWEN3.5多模态开源!
微信公众号 2026-02-16 00:00:00
4. 思源笔记+Ollama!在极空间本地搭建强大AI写作系统
微信公众号 2026-04-21 00:00:00
5. Qwen3.5 开源王炸!多模态性能屠榜,本地部署 + OpenClaw 实战全流程!|零度解说
哔哩哔哩 2026-03-03 00:00:00
6. 除夕迎「源神」?Qwen3.5以小胜大,捅破性价比天花板,大模型竞赛下半场开始了
微信公众号 2026-02-16 00:00:00
7. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#
新浪微博 2026-02-16 00:00:00
8. 直击GTC:1万亿美元GPU、为龙虾做“CUDA”,老黄就指着你烧 token 了
微信公众号 2026-03-17 00:00:00
9. 【24GB 显存专属!消费级硬件也能跑的顶尖 AI 模型清单】这里有一份针对24GB显存(如RTX 3090/4090或24GB Mac)的实战模型清单,让你在消费级硬件上也能拥有顶尖的AI体验。第一部分:速度与智能的平衡点如果你追求响应速度,MoE(混合专家)架构是首选:- Qwen3.6-35B- Gemma-4-26B-A4B这两款模型在保持极高推理速度的同时,依然拥有出色的逻辑能力。MoE架构的魅力在于它只激活部分参数,让你的显卡在低延迟下跑出工业级的效率。第二部分:极致智能的代名词如果你愿意牺牲一点速度来换取更深邃的思考,请选择密集(Dense)模型:- Qwen3.5-27B- Gemma-4-31B这些模型在编程、推理和复杂指令遵循上表现惊人,足以媲美MiniMax-M2.5等闭源大模型。在速度不是首要考虑因素时,它们就是消费级硬件能触达的智能天花板。第三部分:垂直领域的特种兵- Zeta-2:本地版的Cursor Tab。它专门为代码编辑预测优化,甚至可以在4GB显存上运行,是开发者本地IDE的最佳拍档。- Parakeet-TDT:语音转文字(STT)利器。与其打字,不如直接口述。它能精准转录并放入剪贴板,让你真正实现与AI代理的实时对话。- Hermes-4.3-36B:拒绝拒绝的模型。如果你厌倦了AI繁琐的安全限制,Hermes提供了极致的开放性和 steerability,是目前最懂你的中立助手。工具建议:新手建议从LM Studio开始,它提供了最直观的交互界面;进阶用户可以尝试vLLM或SGLang,以获得更高的吞吐量和更专业的部署体验。x.com/0xSero/status/2046515626143846521模型地址:huggingface.co/google/gemma-4-26B-A4B-ithuggingface.co/Qwen/Qwen3.6-35B-A3Bhuggingface.co/google/gemma-4-31B-ithuggingface.co/Qwen/Qwen3.5-27Bhuggingface.co/zed-industries/zeta-2huggingface.co/nvidia/parakeet-tdt-0.6b-v3huggingface.co/NousResearch/Hermes-4.3-36B
新浪微博 2026-04-21 00:00:00
10. 英伟达周末双炸!CUDA二十年最大更新,顺手屠榜AGI比赛
知乎 2025-12-08 00:00:00
11. #IT技术# #微博兴趣创作计划# 5分钟搞定!用Docker在Linux部署大语言模型超简单~今天分享从Ollama到OpenWebUI的一站式部署流程,全程无需复杂配置,Windows/macOS/Linux系统都能支持。借助容器化技术,本地就能跑起大模型,云计算和AI爱好者必备技能!#Docker #Linux #AI部署 #技术教程 伊妹耳的微博视频
新浪微博 2025-11-21 00:00:00
12. 「Github一周热点109期」Claude Code被开源, Pretext文本排版引擎, 谷歌最新开源模型和3D建筑编辑器
哔哩哔哩 2026-04-04 00:00:00
13. 如何评价 3 月 30 日发布的 Qwen3.5-Omni 的性能表现?
知乎 2026-03-31 00:00:00
14. 正面硬刚Gemini 3 Pro,阿里开源Qwen3.5-Plus|甲子光年
微信公众号 2026-02-16 00:00:00
15. 给大家分享一个好东西,太绝了,就是这个终端神器:Wave Terminal。有了它,你就可以直接放弃 iTerm2 了。它为什么好呢?因为功能强大,颜值在线啊,我们现代开发经常要在终端和浏览器之间来回切换,查文档、预览文件、用 AI 工具。Wave 直接把这些功能全部塞进了终端里。功能特色如下,这几个功能,谁看谁不迷糊啊。1、内置 AI 聊天可以接入 OpenAI、Claude、Perplexity,甚至本地 Ollama 都行,直接在终端里问问题,不用切窗口了。2、拖拽式布局终端块、编辑器、网页浏览器可以随便拖放组合,类似 IDE 的分屏,但更灵活。3、远程文件预览连上服务器后,Markdown、图片、视频、PDF、CSV 都能直接预览,不用再 scp 下来看了。4、命令块每个命令都可以单独隔离监控,还能设置自动关闭,跑任务的时候特别好用。5、一键远程连接SSH 连接配置好后,一键就能拿到完整的终端和文件系统访问权限。支持 macOS、Linux、Windows 全平台,完全开源免费。最新版 v0.12.4 刚更新,GitHub 已经 13k+ stars 了,真的太香了。官网地址:www.waveterm.dev开源项目地址:github.com/wavetermdev/waveterm#AI工具##科技先锋官##AI创造营##微博兴趣创作计划#
新浪微博 2025-11-27 00:00:00
16. 线上微调大模型不想折腾环境配置、参数选型、代码编写?推荐大家试试 unsloth-buddy 这个零门槛的 LLM 微调技能工具。它支持 NVIDIA CUDA GPU 上的 Unsloth 和苹果 Apple Silicon 上的 mlx-tune,本地一站式自动完成环境搭建、LoRA微调(SFT、DPO、GRPO、视觉模型均支持)、效果评测和模型导出。主要特点:- 7步自动化工作流,包含任务调研、数据处理、环境检测、训练、评测、导出;- 智能访谈定制方案,帮你选对模型、训练方法和部署平台;- 支持 Qwen、Llama、Gemma 等主流模型,适配 Ollama、vLLM、HF Hub 等部署;- 苹果 M1~M4 机型友好,甚至能通过 Google Colab 免费云GPU扩展能力;- 可视化实时培训仪表盘,训练曲线一目了然;- 完整开源,MIT协议。不管你是有500条客服问答想做摘要微调,还是复杂多维度调参探索,unsloth-buddy都能带来极致顺滑体验。GitHub:github.com/TYH-labs/unsloth-buddy#AI开发# #大模型微调# #AppleSilicon# #NVIDIACUDA#
新浪微博 2026-03-21 00:00:00
17. 折腾了一晚上,终于让 AI Agent 拥有了跨会话"长期记忆"openClaw 2026.4 新增 Memory Search,原理是把记忆文件向量化做语义检索。配置过程一言难尽① 文档路径写错。加进去直接 config invalid,网关启动失败。翻源码才找到正确路径② 索引建好了但 Agent 不调用。tools 白名单里没加 memory_search,Agent 手握指令却无工具可用③ Ollama 的 embedding 模型 5 分钟自动卸载。得用 keep_alive=-1 常驻,重启后还得重新预热。最后写了个 LaunchAgent 开机自动加载三个坑踩完,效果:飞书群聊 A 的结论,群聊 B 的 Agent 能通过语义搜索自动找回来。Webchat、微博 DM 也全部共享同一套记忆目前索引的是记忆文件(MEMORY.md、memory/*.md),Agent 会把重要信息自动写入。还有个进阶功能叫 session transcript indexing,能把每轮对话原文也编进向量库,不过先用基础版跑通再说方案:ollama + bge-m3 + tools 白名单 + 开机预热。一劳永逸#openclaw##aiagent#
新浪微博 2026-04-08 00:00:00
18. 如何评价 Google 发布的开源大模型 Gemma4?使用体验怎么样?
知乎 2026-04-03 00:00:00
19. 【跑本地模型,换个工具性能提升30%】快速导读:一篇在技术圈引起热议的帖子,揭示了一个普遍的误解:很多人以为自己电脑跑本地大模型卡顿是硬件不行,但大量一线玩家的真实经验是,仅仅把启动器从流行的Ollama换成更底层的llama.cpp,性能就能白拿30%以上的提升。你以为的硬件瓶颈,很可能只是工具瓶颈。---一个用户说,他起初用Ollama跑模型,体验很差,让他一度确信“我的电脑根本带不动更大的模型”——直到他换用llama.cpp,发现性能暴涨,原来电脑完全跑得动。这几乎是每个折腾本地模型的玩家都会经历的“旅程”。你以为在自己的MacBook或Windows笔记本上跑个9B(90亿参数)的模型,速度慢、响应迟钝是正常的,毕竟硬件有限。其实,一个正在被越来越多资深玩家确认的事实是:Ollama为了提供极致的便利性,牺牲了部分性能。它像一个精装修的样板间,拎包入住,但承重墙不是最优的。而llama.cpp是那个毛坯房,需要自己动手,却能挖出硬件的全部潜力。讨论中,不止一位用户报告,从Ollama切换到llama.cpp后,同一个模型、同一台机器,性能直接提升了30%。这个差异的背后,是封装带来的开销。Ollama本质上是在llama.cpp外面套了一层壳,负责模型管理、API服务等。这层“中间商”在带来便利的同时,也吃掉了性能。对于那些只想快速体验的用户,Ollama依然是最佳选择。但如果你开始严肃地将本地模型用于实际工作流——比如像原帖作者那样,用它来驱动一个自动化Agent系统处理文件、调用工具——那30%的性能就不是小事了。它决定了你的Agent是“可用”还是“好用”。一个有趣的现象是,许多人正是在Ollama上碰壁,才最终转向llama.cpp,并惊讶地发现自己的机器原来这么能打。所以,如果你也觉得自己的电脑跑本地模型力不从心,甚至因此放弃了尝试更大、更强的模型。不妨先问自己一个问题:限制你的,真的是那块显卡或那点内存吗?还是那个你以为最方便的工具?---简评:这再次验证了一个反直觉的道理:在任何前沿领域,最流行、最易上手的工具,往往不是性能最好的那个。它为你降低了入门门槛,但也悄悄给你设置了认知天花板。真正的“信息差”优势,往往藏在那些需要你多折腾一步的选项里。---ref: www.reddit.com/r/LocalLLaMA/comments/1rll349/ran_qwen_35_9b_on_m1_pro_16gb_as_an_actual_agent#AI创造营##人工智能#
新浪微博 2026-03-06 00:00:00
20. Ollama 推出一指令安装OpenClaw,免费云端模型直接用,也支持本地模型
微信公众号 2026-03-16 00:00:00
21. LightRAG 是一个简单快速的检索增强生成(RAG)框架,能高效整合大语言模型和知识图谱,实现智能文档查询和多模态检索。LightRAG支持多种存储方案(PostgreSQL、Neo4j、Milvus、OpenSearch等),支持文本、图片、表格、公式等多种数据类型的端到端知识抽取和问答。还提供了丰富的示例代码、Web UI,以及支持OpenAI、Hugging Face、Ollama、Azure OpenAI等多家模型接口。项目亮点:- 灵活配置的多存储架构,适合大规模知识管理;- 深度集成知识图谱构建与编辑,支持实体关系管理、知识图谱可视化;- 支持强大的Reranker提升检索效果;- 新增RAG-Anything,打通多模态文档处理与检索能力;- 丰富文档导入格式、引用功能、缓存管理、Token使用统计;- 还支持Langfuse可观测性监控以及RAGAS自动评价指标。无论是科研研究、企业知识库、还是多模态智能问答应用,LightRAG都提供了极具扩展性且高性能的解决方案。GitHub:github.com/HKUDS/LightRAG#在线智能检索# #知识图谱# #大语言模型# #RAG# #开源项目#
新浪微博 2026-03-23 00:00:00
22. 本地部署方案深度对比
今日头条 2026-02-24 00:00:00
23. 本地部署 AI 大模型横评
今日头条 2026-04-09 00:00:00
24. 别乱装大模型部署工具!Ollama/llama.cpp/LMStudio不是一回事!
今日头条 2026-03-28 00:00:00
25. 大模型本地运行工具对比
今日头条 2026-03-27 00:00:00
26. Ollama
微信公众号 2026-04-20 00:00:00
27. 本地LLM部署工具(写给小白的LLM工具选型系列
知乎 2026-04-04 00:00:00
28. 【大模型本地部署工具横评】Ollama vs LM Studio|token/s 对比 + 推理性能 & 调度实测
哔哩哔哩 2026-03-20 00:00:00
29. 4月2日-谷歌 Gemma 4 深夜突袭!31B 模型击败大 20 倍对手,教你用 Ollama 本地部署并接入 OpenClaw
知乎 2026-04-03 00:00:00
30. 超强,如何在本地运行 Gemma 4!!
微信公众号 2026-04-09 00:00:00
31. Gemma 4本地部署教程!
微信公众号 2026-04-12 00:00:00
32. 谷歌最强开源模型Gemma 4发布!Ollama 本地部署指南与硬件选购指北
微信公众号 2026-04-12 00:00:00
33. ollama超强本地部署gemma4,保姆教学
微信公众号 2026-04-14 00:00:00
34. Ollama + Gemma 4 全面指南
微信公众号 2026-04-17 00:00:00
35. Gemma 4来了 普通人离真正好用的本地AI又近了一步
今日头条 2026-04-03 00:00:00
36. Google Gemma 4开源领跑
知乎 2026-04-09 00:00:00
37. Ollama v0.20.5 发布
微信公众号 2026-04-12 00:00:00
38. Gemma 4本地部署🔥零成本跑AI
小红书
39. 一键跑通Gemma 4全系模型!Ollama 直接拉满,Claude Code/Codex/OpenClaw 全部支持!
微信公众号
40. 谷歌正式发布 Gemma 4
今日头条
41. 谷歌最强开源大模型Gemma 4,支持多模态、离线运行
今日头条
42. 无需云服务器!Gemma 4+Ollama本地部署,免费解锁 multimodal
今日头条
43. HuggingFace|Gemma 4
微信公众号
44. Gemma 4 全系列本地部署指南
微信公众号
45. 最强多模态小模型 Gemma 4 开源,Mac Mini 成为最佳性价比的 AI 电脑
知乎
46. 手机都能部署的最新Gemma 4模型你还不会装?我给你四个安装方案!还不快来试试
微信公众号
47. Gemma 4深度解析
微信公众号 2026-04-05 00:00:00
48. 零成本使用Token!谷歌Gemma4「本地部署」保姆级教程
知乎 2026-04-08 00:00:00
49. 我把Gemma 4放进iPhone里跑了
小红书 2026-04-04 00:00:00
50. 谷歌 Gemma 4 本地实测|笔记本 + 台式机双平台
微信公众号 2026-04-05 00:00:00
51. Gemma 4 模型详解
微信公众号 2026-04-03 00:00:00
52. 我靠,手机上跑 Gemma 4 ?假的吧?
微信公众号 2026-04-07 00:00:00
53. 不用云端、不花一分钱!Ollama一键部署Gemma4 + Qwen3.5
微信公众号 2026-04-06 00:00:00
54. 手机远程操控Mac本地LLM!Ollama+OpenWebUI实操
今日头条 2026-04-11 00:00:00
55. Chrome 集成本地 AI 大模型 Gemma 4,最强开源模型塞进浏览器
今日头条 2026-04-06 00:00:00
56. Ollama+OpenWebUI 最佳组合
知乎 2026-04-13 00:00:00
57. Byte for Byte,谷歌开源最强模型Gemma 4 杀入手机端
今日头条 2026-04-03 00:00:00
58. 2B开源模型手机养虾,谷歌Gemini 3技术下放
小红书 2026-04-03 00:00:00
59. Gemma 4开源!整整一年,谷歌终于想明白了!!!
今日头条 2026-04-04 00:00:00
60. 只需 3 个步骤,即可通过 OpenClaw(龙虾) 在本地运行 Gemma 4
知乎 2026-04-07 00:00:00
61. Google Gemma 4发布,手机到工作站全覆盖,开源商用全面放开
今日头条 2026-04-03 00:00:00
62. 低成本养虾?Gemma 4 本地部署实测
微信公众号 2026-04-07 00:00:00
63. 生猛的Gemma 4,能配合OpenClaw一起玩么?我在mac mini试了,不太行
微信公众号 2026-04-09 00:00:00
64. 企业级Harbor镜像仓库部署指南
微信公众号 2026-04-08 00:00:00
65. Docker 容器化深度实践(第13篇)之私有镜像仓库 Harbor 部署
微信公众号 2026-04-17 00:00:00
66. Harbor
微信公众号 2026-04-14 00:00:00
67. 27.8k Star!Harbor 企业级镜像仓库,再也不用担心 Docker Hub 限速!
今日头条 2026-03-25 00:00:00
68. 01 | 在 K8S 上部署高可用 Harbor 集群
知乎 2025-11-08 00:00:00
69. Gemma4 vs Qwen3.5 本地实战部署全解析!谁才是平民硬件最优解?
今日头条 2026-04-07 00:00:00
70. Gemma-4 发布了!!!。2026年开源大模型圈炸了!
抖音 2026-04-04 00:00:00
71. 2026年本地部署大模型对决
微信公众号 2026-03-29 00:00:00
72. 手把手教你用Mac本地部署大模型!Ollama+Gemma4+Qwen3.5,新手也能秒上手
微信公众号 2026-04-18 00:00:00
73. 实测对决
今日头条 2026-04-04 00:00:00
74. Gemma4本地龙虾部署体验
哔哩哔哩 2026-04-05 00:00:00
75. 有人对比测试了Qwen3.5和Gemma4的工具调用能力,看看哪家强
微信公众号 2026-04-03 00:00:00
76. Gemma 4 vs Qwen 3.5
微信公众号 2026-04-10 00:00:00
77. Gemma 4三种部署实测对比,手机电脑Chrome全避坑
今日头条 2026-04-06 00:00:00
78. 零成本养虾!谷歌 Gemma 4「本地部署」保姆级教程,三步搞定
知乎 2026-04-04 00:00:00
79. Mac 安装 Gemma4 开源模型|2种方法(新手零失败,避坑指南)
知乎 2026-04-04 00:00:00
80. 本地部署 Gemma 4_10G 显存内最好用的多模态小模型
微信公众号 2026-04-13 00:00:00
81. openclaw本地部署大模型实战
今日头条 2026-03-20 00:00:00
82. 16G 显存本地部署大模型怎么选? Qwen3.5-35B还是Gemma-4-26b
今日头条 2026-04-16 00:00:00
83. 巅峰对决
今日头条 2026-04-05 00:00:00
84. Gemma 4 31B vs Qwen 3.5 27B实测
今日头条 2026-04-06 00:00:00
85. 我使用 Codex CLI 运行 Gemma 4 本地模型
知乎 2026-04-13 00:00:00
86. Google Gemma 4 正式发布:开源模型的又一次飞跃
微信公众号 2026-04-07 00:00:00
87. Gemma 4 本地部署保姆级教程
今日头条 2026-04-13 00:00:00
88. ollama v0.20.0 更新:Gemma 4 全家桶发布,音频、视觉、MoE、BPE 支
今日头条 2026-04-04 00:00:00
89. 【黑板风格】Gemma4 本地部署完全指南
微信公众号 2026-04-05 00:00:00
90. ollama v0.20.0 更新:Gemma 4 全家桶发布,音频、视觉、MoE、BPE 支持全面升级
微信公众号 2026-04-04 00:00:00
91. Ollama快速入门
今日头条 2026-03-15 00:00:00
92. 重磅突破!Gemma 4本地RL训练落地,仅需9GB VRAM
今日头条 2026-04-16 00:00:00
93. Llama 3/Qwen 2本地化部署: Ollama、vLLM、TensorRT-LLM性能与资源占用深度对比
微信公众号 2025-11-03 00:00:00
94. 原生的llama.cpp服务器简单部署指南(适用于Windows用户) - 哔哩哔哩
哔哩哔哩 2025-11-05 00:00:00
95. gemma4本地部署教程,对接openclaw、vscode、codex、Claude Code实现token自由,ollama一键部署
哔哩哔哩 2026-04-12 00:00:00
96. Gemma 4 E4B + OpenClaw 新版:本地大模型部署再升级!
微信公众号 2026-04-09 00:00:00
97. 谷歌Gemma 4开源杀疯!仅小体量,完胜13倍大的Qwen3.5
今日头条 2026-04-04 00:00:00
98. Ollama v0.20.6:Gemma 4 工具调用优化与集成生态扩展
今日头条 2026-04-14 00:00:00
99. 【保姆级教程】正确使用 Ollama + OpenWebUI:3 个真实任务 + 可复制模板
微信公众号 2026-02-28 00:00:00
100. Gemma 4首测!26B专家模型仅激活4B参数,低配电脑秒开,开源Top3!
哔哩哔哩 2026-04-07 00:00:00
101. 【本地部署api】吊打同参数规模?谷歌 Gemma 4 震撼发布,本地运行竟能如此丝滑!
知乎 2026-04-04 00:00:00
102. 保姆级教程:WSL 安装 Ollama,本地免费跑开源大模型
知乎 2026-04-01 00:00:00
103. Gemma4大模型开源!Google针对工作流优化,已是消费级本地部署最优选择
微信公众号 2026-04-03 00:00:00
104. ollama v0.17.5正式发布:新增Qwen3.5系列模
小红书 2026-03-04 00:00:00
105. ollamav0.14.2更新:新增Tr.ollama v0.14.2 更新:新增TranslateGemma翻译模型、支持55种语言、CLI优化与MLX构建指南发布! 一、全新模型:TranslateGemma开放多语言翻译支持 Ollama v0.14.2推出了全新TranslateGemma模型系列。这一系列翻译模型基于Gemma 3架构构建,支持55种语言互译,旨在帮助全球用户打破语言壁障,实现跨语言交流。 TranslateGemma是Ollama针对跨语言任务优化的一类开放模型,标志着Ollama在多语言理解和生成能力上的进一步扩展。 二、功能优化与改进 1. CLI交互优化 —— 支持多行输入 Ollama命令行(CLI)现在新增了更简洁直观的交互方式: • 按下 Shift + Enter 可换行输入; • 普通 Enter 键则用于发送消息; • 在交互模式中增加了新提示:“Press Enter to send”,让多行输入更自然。 这一改进使开发者编写长指令或复合Prompt更加方便,提升人机交互体验。 2. /v1/responses API优化 Ollama进一步改进了/v1/responses接口,使其更好地符合OpenResponses规范。该更新提升了API一致性与兼容性,对于使用Ollama搭建AI应用服务的开发者而言,这意味着更高的稳定性与标准化支持。 #福大大架构师每日一题 #大模型
抖音 2026-01-18 00:00:00
106. Ollama 命令操作手册
微信公众号 2026-04-03 00:00:00
107. OpenClaw使用Ollama部署本地向量
今日头条 2026-03-29 00:00:00
108. LM Studio vs Ollama:如何选择最适合的本地 AI 工具?
微信公众号 2026-01-18 00:00:00
109. Ollama v0.20.5 更新日志
微信公众号 2026-04-20 00:00:00
110. ollama v0.20.4 正式发布!MLX 性能大幅提升 , Gemma4 闪光注意力全面
今日头条 2026-04-10 00:00:00
111. [中配]Gemma 4 E4B + Ollama + OpenClaw:免费本地运行 - Fahd Mirza
哔哩哔哩 2026-04-03 00:00:00
112. 《人工智能基础》【工具篇5]:Ollama从入门到精通
知乎 2026-04-17 00:00:00
113. 谷歌Gemma 4模型如何安装到本地电脑操作教程
微信公众号 2026-04-06 00:00:00
114. 从 RTX 到 Spark:NVIDIA 为本地代理式 AI 加速 Gemma 4
知乎 2026-04-07 00:00:00
115. 【凑个热闹】hermes本地模型配置说明(不烧token的也可以玩)
微信公众号 2026-04-11 00:00:00
116. gemma4 for mac
微信公众号 2026-04-09 00:00:00
117. Gemma 4 26B 我先替大家本地跑了一遍~ 结论先放前面:真的快! 因为是MoE A4B 架构,每次启动只会加载4B的模型,所以装之前我知道应该比较快,但装完测试没想到这么快,而且还是多模态,有点东西的。 这次视频里我主要测了 3 件事。 第一件事是响应速度。 这个不用多解释,大家看画面基本就能感受到。对本地模型来说,快不快,几乎直接决定了你后面还愿不愿意继续用。 第二件事是逻辑理解。 我拿一个经典陷阱题去试它:1+1=3 为什么成立。 这个问题测的不是算术,而是它能不能理解提问背后的语境。结果看下来,它不是那种很机械的回答方式,而是会顺着问题去找成立条件,这一点加分。 第三件事是图片识别。 着重测了它的多模态能力。现在很多模型都在讲自己支持图像,但“支持”和“真能用”之间差别很大。Gemma 4 26B 至少说明了一点:它不只是个聊天模型,图片理解这块能力是真的能打的。 先发这条,给大家看第一轮真实体验,我后面还会继续测 31B,也会接进 OpenClaw 看看工具调用和多步骤任务表现怎么样。 #gemma4 #google #本地部署 #开源模型 #OpenClaw
抖音 2026-04-04 00:00:00
118. 告别 Docker Hub 依赖!从零部署高可用 Harbor 私有镜像仓库
知乎 2025-12-01 00:00:00
119. 本地部署离不开它们:本地部署的LLM推理平台
微信公众号 2025-11-05 00:00:00
120. Ollama安装
知乎 2026-02-25 00:00:00
121. M1 Max换M5 Max值吗?实测LLM运行差距,Qwen3.5比Gemma 4香太多
今日头条 2026-04-15 00:00:00
122. 企业级私有docker镜像仓库Harbor的搭建和使用
微信公众号 2025-12-04 00:00:00
123. ollama安装、模型安装
微信公众号 2026-04-08 00:00:00
124. 谷歌最强开源模型Gemma 4 被越狱 本地版部署教程+安装包下载
微信公众号 2026-04-18 00:00:00
125. ollama本地安装及使用
知乎 2026-01-08 00:00:00
126. 谁说 Mac 只能写代码?Google 官宣:M 芯片本地微调 Gemma 4 时代开启!
微信公众号 2026-04-09 00:00:00
127. Gemma4深度解析:Google最强开源大模型,架构、跑分与核心设计全览
知乎 2026-04-07 00:00:00
已收藏
去我的收藏夹