谷歌2026年4月3日发布Gemma 4开源模型,剑指中国快速增长的开源生态

源自40位全网作者

04-03 11:39

精选参考来源

1
盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人
2
刚才在HuggingFace上看到,Qwen3.5已经提交了并入Transformers的PR。这意味着阿里的新一代基座模型很快就要正式开源了。 这次的Qwen3.5有点意思: 1.混合注意力机制,据说是全新架构; 2.大概率是原生VLM,能看懂图像了; 3.开源包至少包含2B密集模型和35B-A3B的MoE版本。 值得关注的是,这是国内首个混合推理模型。简单说就是把快思考和慢思考结合起来,既有速度又有深度。这种设计在算力消耗上有明显优势,对开发者很友好。 其实从去年Qwen3登顶开源榜就能看出,阿里在模型架构上确实有一套。现在3.5版本继续这个势头,加上智谱唐老师之前预告的DeepSeek-v4、GLM-5也要来,今年二月中国大模型圈要热闹了。开源生态现在越来越重要。模型好不好,最后要看开发者用不用得起来。Qwen3.5这个开源策略很聪明,既展示了技术实力,又能快速建立生态。 不由感叹技术发展真快。去年这个时候大家还在讨论Qwen2.5,现在3.5都要来了。这种迭代速度,对行业是好事,对开发者也是机会。等Qwen3.5正式开源了,咱也上手试试效果。[挤眼]
全部
来源
内容由AI生成

精选参考来源

1. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

2. 刚才在HuggingFace上看到,Qwen3.5已经提交了并入Transformers的PR。这意味着阿里的新一代基座模型很快就要正式开源了。 这次的Qwen3.5有点意思: 1.混合注意力机制,据说是全新架构; 2.大概率是原生VLM,能看懂图像了; 3.开源包至少包含2B密集模型和35B-A3B的MoE版本。 值得关注的是,这是国内首个混合推理模型。简单说就是把快思考和慢思考结合起来,既有速度又有深度。这种设计在算力消耗上有明显优势,对开发者很友好。 其实从去年Qwen3登顶开源榜就能看出,阿里在模型架构上确实有一套。现在3.5版本继续这个势头,加上智谱唐老师之前预告的DeepSeek-v4、GLM-5也要来,今年二月中国大模型圈要热闹了。开源生态现在越来越重要。模型好不好,最后要看开发者用不用得起来。Qwen3.5这个开源策略很聪明,既展示了技术实力,又能快速建立生态。 不由感叹技术发展真快。去年这个时候大家还在讨论Qwen2.5,现在3.5都要来了。这种迭代速度,对行业是好事,对开发者也是机会。等Qwen3.5正式开源了,咱也上手试试效果。[挤眼]

3. 26年1月开源模型汇总,太卷了,这几个已经追平闭源了!

4. 谷歌最狠一步棋,是否会带来AI竞争拐点? #大咖观察 #红衣聊AI #谷歌

5. #千问Qwen3.5大模型发布#阿里巴巴春节AI大战再出一张王牌。今天,阿里巴巴正式开源并上线了新一代千问大模型Qwen3.5,以其原生多模态架构和极致效率设计,成为全球开源AI领域的新标杆。Qwen3.5首次实现原生多模态融合,直接支持文本、图像及视频输入,无需外部适配即可完成跨模态理解任务。推理吞吐量提升8.6倍至19倍,显存占用降低60%。实测性能超越自家万亿级前代模型Qwen3-Max,并在多项权威评测中领先。用户可通过千问APP、PC端一键切换至Qwen3.5模型,实时体验多模态交互。Qwen3.5的发布标志着国产大模型进入“效率+多能力”双轨竞争阶段。其发布节点直击春节技术窗口,与DeepSeek v4、字节豆包2.0等国产模型形成“春节AI大战”格局。#老张聊科技#

6. 谷歌Gemma的四个秘密:从海豚语到掌上AI

7. 谷歌发布 Gemini3Pro,其多模态理解和生成能力将如何影响 AI 发展?

8. 全球核能再次崛起!深度对比中美能源博弈,谁能赢到最后?

9. 木头姐给出的14个科技趋势(上):可回收火箭,英伟达,全球GDP增速,AI竞争格局,都聊到了#木头姐 #可回收火箭 #BIGIDEAS2026 #英伟达 #AI#AI泡沫

10. 国产模型开源封神,谷歌Genie3紧急开源?蚂蚁AGI撕开世界模型闭源防线

11. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

12. #科技先锋官# 谷歌基于Gemma 3推出的开源多语言翻译模型TranslateGemma,以三档参数规模适配手机端,凭借离线多模态翻译能力,为移动AI生态带来技术性革新,更勾勒出端侧智能应用的新蓝图。从技术适配看,它打破了参数越大性能越强的固有认知。4B轻量化版本经量化处理后内存占用仅2-3GB,可流畅运行于主流旗舰机,依托动态稀疏注意力与量化感知训练技术,在低功耗下实现38 tokens/ms的推理速度,无网环境也能1秒完成图像文字翻译。这种小参数高性能的优化思路,解决了传统AI模型在手机端算力不足、功耗过高的痛点,让专业级翻译能力真正嵌入掌心设备。对手机侧体验而言,其改变是颠覆性的。原生支持图文翻译无需额外OCR工具,55种语言覆盖主流语种及低资源语言,彻底摆脱网络依赖与云端延迟。更重要的是开源属性降低了开发门槛,开发者可基于模型微调行业专属版本,推动翻译功能向旅游、医疗、跨境商贸等场景深度渗透,让手机成为全能翻译官。TranslateGemma或将定义手机AI应用的新方向,端侧轻量化、多模态融合、场景化定制成为核心趋势。未来手机AI将从依赖云端转向端侧为主、云端为辅,更多如离线语音交互、本地图像识别等功能将落地,倒逼芯片厂商优化NPU算力,推动移动智能进入口袋里的AI时代。#微博超有用视频大赛##上微博涨知识##AI生活指南# 种斌Marco的微博视频

13. #从Deepseek到Seedance中国AI成了#kimi k2.5与字节的seedance2.0都充分说明,国产AI在缩短跟美国AI模型的差距,后者连马斯克都感叹中国大模型发展速度太快了。春节期间还有qwen,ds,glm模型要发布。我们b端和c端都在逐步赶上,未来我们通过大模型服务和AI产品性价比,对美帝大模型公司冲击会越来越强。

14. 谷歌发布「AlphaFold 4」,不再开源!性能碾压上一代

15. 谷歌闷声放大招:Gemini 3 Pro 的多模态杀手锏曝光

16. 谷歌再次伟大了吗?

17. 【直播回放】解析谷歌Gemini 3:“AI 全模态”时代与Scaling Law的极致执行

18. #小米大模型调用量升至全球第一#小米MiMo大模型调用量跃居全球第一?小米终于在AI领域实现逆袭!#中国大模型调用量连续三周超美国# 因为小米MiMo和Deepseek等国产大模型的成功,中国在大模型调用量方面连续三周超过美国。很高兴看到像小米公司这样的中国科技企业越来越强。

19. OpenAI 即将发布 GPT-5.2,知情人士称或有望弥补与谷歌 Gemini 3 差距,如何评价?

20. #阿里除夕夜开源千问Qwen3.5# 继Qwen2.5-Max后,阿里再以“开源”打响AI开年第一枪 🧨该模型实现了模型架构的创新 。据悉,Qwen3.5采用全新的混合注意力机制,极有可能是原生支持视觉理解的视觉语言模型(VLM),将开源至少2B密集模型及35B-A3B的MoE模型 。去年除夕,阿里曾抛出Qwen2.5-Max。【评论】阿里选择除夕夜开源,是以“技术春晚”卡位AI竞争新周期继去年除夕夜开源Qwen2.5-Max后,阿里再次选择在这个阖家团圆的时刻“放猛料”,其战略意图愈发清晰:用最高规格的开源动作,抢占全球开发者春节档的技术注意力。Qwen3.5的原生多模态能力与架构创新,直指2026年AI竞争的核心——从“对话”向“视觉理解、智能体执行”的全面升级。当同行忙于发红包、抢用户时,阿里选择用开源模型“围猎”开发者心智,这是一场关于生态根基的暗战。

21. 谷歌的AI布局:非常全面,野心很大,10年内实现AGI #谷歌 #AI #机器人 #Deepmind#世界模型

22. 谷歌突然发布 Gemini 3.0!强到离谱,Pro 版免费开放使用,附实测与开通教程!| 零度解说

23. #DeepSeekV4要发布了吗#传闻DeepSeek v4会是第一个在性能上不输闭源前沿模型的开源模型,有些能力甚至能反超。V4 如果真像传闻那样,那其他几家压力确实不小。不过国产大模型卷成这样,最后还是用户赚了。你们更看好谁?

24. 阿里「千问」成全球开源模型「新标杆」,Meta 被曝「蒸馏」千问,有何意义?

25. 开源证券发布研报称,国产AI算力正在崛起,通过提供高性价比的芯片方案,并结合自有软硬件生态,降低对海外厂商的依赖,重塑竞争格局。大模型方面,以Deepseek、通义千问、字节豆包、Kimi等国产大模型能力快速提升,并且成为全球大模型竞赛中的佼佼者。目前国产AI在算力、大模型和应用端都取得了长足进步,重塑全球竞争格局

26. 失衡的乌托邦:Meta的开源AI路线是如何遭遇滑铁卢的【硅谷101】

27. 以下是关于生产环境中微调大语言模型(LLM)的一些关键技术总结,适合技术爱好者和工程师参考:- LoRA 和 QLoRA:参数高效微调,节省计算资源 - PEFT 库:支持多种适配器方法,提升灵活性 - 指令微调(Instruction tuning):提升模型执行特定任务的能力 - 数据集格式处理(ChatML、Alpaca、ShareGPT):保证训练数据规范化 - DeepSpeed ZeRO:优化内存使用,支持更大模型训练 - Flash Attention 2:加速训练过程,提高效率(但部分观点认为稍显过时) - 梯度检查点(Gradient checkpointing):支持更长上下文的训练 - BitsAndBytes:实现4位/8位量化,显著减少显存占用 - RLHF 和 DPO:强化模型对齐,提升生成内容质量和安全性 - 分词器训练及词汇扩展:适应特定领域和新词汇 - 评估指标(困惑度Perplexity、ROUGE、人类评估):全面衡量模型性能 - Unsloth:提升微调速度,节约时间成本 - 多GPU训练策略(FSDP、DDP):充分利用硬件资源,实现高效分布式训练这些技术涵盖了从模型微调效率、训练资源优化到模型性能评估的方方面面,构成了现代LLM微调的完整技术栈。掌握它们,有助于在实际生产环境中实现高效且高质量的模型定制。原推文链接:x.com/athleticKoder/status/1982794780221542478

28. 2026年初的港股资本市场,被中国大模型企业的上市热潮点燃。智谱与MiniMax的IPO后很快被资金追捧,市值分别突破1000亿和1500亿港元,表现明显强于恒生科技指数和港股大盘,刷新了投资者对于中国大模型公司的估值上限区间。我发布了头条文章:《发布3天4倍增长,又一家国产AI掀起了硅谷的“倒戈”运动?》 发布3天4倍增长,又一家国产AI掀起了硅谷的“倒戈”运动?

29. Gemini3之后,Gemma 4将以开源核级力量引爆行业预期?AI产品生态或将迎来全面洗牌的关键时刻!

30. AI大模型 开源 vs 闭源 |扫盲

31. 中国 AI 开源 vs 美国 AI 闭源

32. 惊!谷歌版两门“小钢炮”开源,2.7亿参数直接碾压SOTA!

33. 英伟达优化Gemma 4本地运行,推动本地Agent AI落地

34. Open Models in 2025:中国全面领先,西方亟待觉醒

35. 不让中国公司独美 谷歌开源AI大模型Gemma 4即将问世:4倍参数量

36. 不让中国公司独美 谷歌开源AI大模型Gemma 4即将问世:4倍参数量

37. 谷歌即将开源Gemma 4?

38. 独家 | 谷歌开源大模型Gemma 4或于4月3日发布,中国内地所有开发者均可无障碍接入

39. 实锤,Google 降智 Gemini ! 谷歌开源模型 Gemma 4 即将发布!

40. 普通电脑也能当AI工作站:Google Gemma优化版让RTX 4060秒变算力神器

8
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 这也是AI文吧,没记错的话,Gemma4 也是可以任意使用了

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章