小红书开源280B全模态大模型 华为昇腾当日适配

源自209位全网作者

14:56

内容由AI生成

精选参考来源

1. 【华为MateBook Pro S上手测评:798g超轻薄,一杯奶茶换电脑?】我宣布:今年办公颜值担当来了!华为MateBook Pro S,仲夏紫配上轻薄机身,而且只有798g!带着它“逃离”办公室,外出办公一天,性能跟得上需求吗?续航顶得住吗?鸿蒙系统适配了吗?本期视频,欢迎来看! 且听Phone吟的微博视频

2. 【#阿里开源超大规模MoE模型#】8月13日,阿里巴巴开源超大规模MoE模型Qwen3.8-2.4T-A95B,智源研究院旗下众智Flag OS社区同步完成Day0多芯片适配。目前,该模型已在平头哥、英伟达、摩尔线程、华为昇腾、沐曦、昆仑芯、海光、清微智能、燧原等9家AI芯片上完成基于Flag OS统一开源技术栈的多芯适配、精度对齐与部署验证,并针对不同芯片提供多种精度版本。自今年2月首次开展Day0适配以来,Flag OS技术团队已在6个月内完成10余款大模型“首日多芯可用”实践。详见:网页链接

3. 盘点一周AI大事(8月9日)|AI矩阵模拟83亿人类 OpenAI 下一代模型「Astra」最快一周内发布 千问开源「Qwen3.8-Max」 研究员开源动作迁移视频模型「Wan-Animate 2」 Google开源天气预测模型「WeatherNext 2」 Prime Intellect开源能自己进化的智能体「Prime Agent」 研究员开源CAD智能体「MAC」 混元开源3D模型「Hunyuan3D-Buffalo」 科学家研发出AI矩阵「MatrAIx」 #AI新星计划 #抖音前沿科技首发计划 #vibecoding大赏 #AI #AIGC

4. 三款鸿蒙电脑新品今日开售,华为MateBook Pro S可以入手了

5. 中国搞大模型开源有必然性,中国没有那么好的群众收费基础(游戏除外),小企业玩大模型也出不了什么效果,自然也不愿意高投入。。所以只能搞大企业定制开发(大企业有数据保密需求,要本地部署,只能依靠开源),把开源生态搞好,弄好影响力,挣大企业的钱。。现在某港股上市大模型企业和牛云计算大厂在(大)企业级市场的竞争是异常激烈。。时不时有这些大企业的AI负责人找我咨询,哪家大模型好。。我还能怎么说,肯定是都好。还经常问我评价标准,我只能扯一扯我的理解,其实现在评测也是非常多,真是不好说哪家好,但是B300是真抢手,为了高并发,低延迟,大厂是舍得花钱的。

6. #DeepSeek发布V4Pro正式版# 终于等到了!DeepSeek V4-Pro 正式版来了,给大家划几个硬核看点:· 1.6万亿总参数,激活490亿,支持100万Token超长上下文· Agent编码能力开源模型最强,数学/STEM比肩GPT-5.4、Claude Opus 4.6· 混合注意力架构让长文本推理成本暴降,百万Token场景下计算量仅为前代V3.2的27%· 原生适配华为昇腾等国产算力,训练推理全流程不依赖CUDA更关键的是——Flash正式版已经公测,Pro正式版也官宣“尽快发布”。再加上DeepSeek最近预告API要涨价,业内普遍解读是为Pro正式版上线做准备。国产大模型这波,从参数到生态都在卷出新高度。你会第一时间接入V4-Pro吗?#DeepSeek#

7. 连续自回归的dots.tts:小红书开源语音合成模型「基座」

8. #微博视频号续航计划##Qwen3.827B发布#阿里千问把Qwen3.8‑27B正式开源出来了,27B这个规格一直是开源圈呼声很高的尺寸,兼顾部署成本和模型能力,对开发者特别友好。 这次是原生多模态稠密模型,原生支持262K上下文,借助技术还能拉到1M token,处理超长文档、大段代码都很够用。对比前代3.6‑27B,编程、办公能力提升明显,跑分甚至超过之前的Qwen3.7‑Plus。还有个很实用的新功能reasoning_effort,可以按照任务难度调节思考深度,简单任务少耗算力,硬件压力更小。 而且采用Apache2.0协议,个人、企业都能免费拿来部署商用,门槛直接拉低。千问整套开源家族累计已经放出460多个模型,全球下载量几十亿,衍生模型数量也非常可观。 不过也要客观说,跑分好看不等于现实场景百分百完美。基准测试成绩亮眼,但真实业务落地,还是要自己做实测调优。 对于普通玩家,本地跑27B对显卡依旧有一定要求,不是随便一台电脑就能轻松带动。但对于中小企业、独立开发者来说,相当于拿到一个能力很强、可以自由二次改造的底座。 现在开源大模型卷得越来越凶,你们觉得,这类20‑30B档位的开源模型,接下来会不会成为本地私有化部署的主流选择? IT九熙的微博视频

9. #Qwen3.827B发布#今天,阿里巴巴正式开源Qwen3.8-27B,所有开发者、科研机构和企业均可自由下载、部署和使用Qwen3.8模型。Qwen3.8-27B是原生多模态稠密(Dense)模型,部署便捷,量化后在“消费级”显卡上即可流畅运行,快且实用,图文视频全理解。模型支持262K 原生上下文,YaRN技术可轻松扩展至 1M tokens。跟Qwen3.6-27B相比,新模型在编程和办公场景的性能大幅提升,表现甚至超越了Qwen3.7-Plus。Qwen3.8-27B也拥有Qwen3.8系列模型的共性,可以端到端完成复杂任务,直接交付经得起检验的可靠成果。此前,旗舰模型Qwen3.8-Max也已开源模型权重。截至目前,千问已累计开源 460余个模型,Qwen的全球下载总量超 30 亿次,衍生模型数超30万个,成为全球AI社区最受欢迎的开源模型家族。#老张聊科技# #Qwen3.827B发布#

10. DeepSeek V4-Flash完成昇腾原生适配,百万上下文推理落地

11. 梁文锋密会华为昇腾,国产 AI 软硬协同迎来关键转折点

12. 2.4万亿参数模型发布当天,智源FlagOS让九大芯片同步“开箱即用”

13. 5050亿参数全程不碰英伟达!华为盘古一夜开源,国产卡训出大模型

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章