谷歌2026年4月3日发布Gemma 4开源模型,剑指中国快速增长的开源生态
源自40位全网作者
04-03 11:39
精选参考来源
1
盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线
OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3
DeepSeek开源最强推理模型DeepSeek V3.2
Mistral开源Mistral 3家族
OpenAGI发布最强电脑操作模型Lux
Runway发布最强视频模型Gen 4.5
阿里开源数字人直播模型Live Avatar
字节发布顶级图像模型Seedream 4.5
研究员推出3D空间音频模型ViSAudio
微软开源实时语音模型VibeVoice
Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题
#抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人
2
刚才在HuggingFace上看到,Qwen3.5已经提交了并入Transformers的PR。这意味着阿里的新一代基座模型很快就要正式开源了。
这次的Qwen3.5有点意思:
1.混合注意力机制,据说是全新架构;
2.大概率是原生VLM,能看懂图像了;
3.开源包至少包含2B密集模型和35B-A3B的MoE版本。
值得关注的是,这是国内首个混合推理模型。简单说就是把快思考和慢思考结合起来,既有速度又有深度。这种设计在算力消耗上有明显优势,对开发者很友好。
其实从去年Qwen3登顶开源榜就能看出,阿里在模型架构上确实有一套。现在3.5版本继续这个势头,加上智谱唐老师之前预告的DeepSeek-v4、GLM-5也要来,今年二月中国大模型圈要热闹了。开源生态现在越来越重要。模型好不好,最后要看开发者用不用得起来。Qwen3.5这个开源策略很聪明,既展示了技术实力,又能快速建立生态。
不由感叹技术发展真快。去年这个时候大家还在讨论Qwen2.5,现在3.5都要来了。这种迭代速度,对行业是好事,对开发者也是机会。等Qwen3.5正式开源了,咱也上手试试效果。[挤眼]
全部
来源
来源
内容由AI生成
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹
响当当的麦克斯
校验提示文案
响当当的麦克斯
校验提示文案