科大讯飞星火X2.5发布,293B参数全靠国产算力训推,手机端跑百万上下文

源自234位全网作者

09-07 17:15

精选参考来源

1
#8月大模型日均发布1.1个#内卷的风也刮到大模型行业了。8月大模型行业进入“日均发布1.1个”的高频迭代节奏,月内有30余个开源模型/项目更新。其中,国产模型占据主导地位。DeepSeek、千问、智谱、腾讯混元、商汤、蚂蚁等密集开源,覆盖端侧部署、多模态、视频生成、Agent等方向。Claude、ChatGPT、Gemini等海外模型同步迭代,但开源节奏明显不及国产阵营。另外,国产开源阵营集体换挡,竞争焦点正从“拼参数”转向“拼计算效率与场景落地”。多款MoE模型将总参数推至数百B,单次推理仅激活数B至数十B,以有限计算量承载更大能力容量,以降低成本提升效率。Agent、AI编程、具身智能持续升温,AI竞争走向产品能力与实际应用。截止到6月,我国日均token调用量已突破500万亿,OpenRouter上中国模型Token调用占比从去年4.5%飙升至50%以上,前五全为中国模型,算力需求爆发式增长。#老张聊科技# #8月大模型日均发布1.1个#
2
海光DCU又干了一件漂亮事——腾讯Hy4 preview发布当天,海光DCU就完成了推理全流程适配,发布即支持。 770B总参数、49B激活参数的MoE架构,Gated MLA、iHC、learnable sink这些新结构,腾讯前脚刚开源,海光后脚就适配上了。这不是简单的“能用”,是真刀真枪的“
全部
来源
内容由AI生成

精选参考来源

1. #8月大模型日均发布1.1个#内卷的风也刮到大模型行业了。8月大模型行业进入“日均发布1.1个”的高频迭代节奏,月内有30余个开源模型/项目更新。其中,国产模型占据主导地位。DeepSeek、千问、智谱、腾讯混元、商汤、蚂蚁等密集开源,覆盖端侧部署、多模态、视频生成、Agent等方向。Claude、ChatGPT、Gemini等海外模型同步迭代,但开源节奏明显不及国产阵营。另外,国产开源阵营集体换挡,竞争焦点正从“拼参数”转向“拼计算效率与场景落地”。多款MoE模型将总参数推至数百B,单次推理仅激活数B至数十B,以有限计算量承载更大能力容量,以降低成本提升效率。Agent、AI编程、具身智能持续升温,AI竞争走向产品能力与实际应用。截止到6月,我国日均token调用量已突破500万亿,OpenRouter上中国模型Token调用占比从去年4.5%飙升至50%以上,前五全为中国模型,算力需求爆发式增长。#老张聊科技# #8月大模型日均发布1.1个#

2. 海光DCU又干了一件漂亮事——腾讯Hy4 preview发布当天,海光DCU就完成了推理全流程适配,发布即支持。 770B总参数、49B激活参数的MoE架构,Gated MLA、iHC、learnable sink这些新结构,腾讯前脚刚开源,海光后脚就适配上了。这不是简单的“能用”,是真刀真枪的“

3. #科大讯飞 高管出轨#科大讯飞发生一起高管私德风波,原品牌市场中心副总经理韩煜尘被公司发文解除职务,官方通知未说明具体缘由,时间点恰好和网络实名举报重合。 网传一份举报PDF,来自公司女员工的丈夫,指控韩煜尘和身为下属的女方维持一年多不正当关系,附带大量聊天截图,对话亲昵露骨,还提及异地酒店约会等细节,网友比对头像指向韩煜尘本人。爆料流出到公司下发免职通知,前后不足12小时,处理节奏十分迅速。 韩煜尘是行业资深公关人,2018年加入科大讯飞,一手搭建集团公关体系,操盘星火大模型、1024开发者节等重要项目,也曾斩获行业品牌奖项。擅长帮企业应对舆情危机,最终却因个人私德问题,让自己陷入舆论漩涡。

4. 星火X2.5靠国产化壁垒中标23亿,但补贴退坡后怎么办?

5. 半年30亿研发!讯飞星火X2.5:一边开源抢生态,一边基座拼刺刀!

6. 100 万 token 塞进 4B 小模型!讯飞星火 X2.5 开源,端侧首个百万上下文

7. 科大讯飞端侧开源模型新突破,星火X2.5-4B&1.7B解锁百万长文本能力 科大讯飞全资子公司词元星火正式推出并开源星火X2.5‑4B和星火X2.5‑1.7B两款端侧大模型,这也是端侧领域首个原生支持最长100万Token上下文的开源模型。两款模型采用混合注意力架构,围绕智能体、代码、数学、指令遵循核心方向做专项优化,综合实测表现优于业界同尺寸一流开源模型。随着AI向手机、PC、汽车座舱、智能家居、机器人各类终端渗透,用户对端侧AI的需求已经不再局限于断网简单对话,而是希望本地设备直接处理几十页手册、批量项目文档这类复杂任务。过去端侧模型处理长内容只能切割文档分段提问,极易遗忘前文逻辑,出现信息遗漏、已读乱回的问题。该模型使用千亿Token级高质量数据完成训练,可一次性承载大规模文本信息。以产品售后场景为例,完整导入售后手册后,模型能够梳理不同场景规则并对应章节,面对多重条件叠加的咨询,可跨章节调取条款给出判断,新增变量后依旧维持上下文连贯输出建议。模型依托全国产算力完成全流程训练,预训练数据约20万亿Token,同时适配多硬件与推理框架,降低落地门槛,9月7日全新旗舰通用大模型星火X2.5也将正式发布。 #大模型国家队##全栈自主可控##认知智能全国重点实验室#

8. 昇腾原生支持星火开源模型X2.5-4B和1.7B训推全流程,探索端侧模型智能体能力上限

9. 告别简单对话 讯飞星火X2.5-4B&1.7B端侧模型让硬件能办事

10. 讯飞星火X2.5免费API上线:百万上下文端侧模型,普通人也能用了

11. 科大讯飞开源星火X2.5,端侧模型首支持100万Token,你怎么看? 科大讯飞这步棋,走得挺实。9月2日消息,其全资子公司词元星火正式开源星火X2.5-4B和星火X2.5-1.7B两款端侧通用大模型。 重点在哪儿?这是端侧模型里,第一个原生支持最长100万Token上下文的。采用混合注意力架构,还专门围绕智能体、代码、数学和指令遵循做了优化。 我做过电商、做过新媒体,深知“在线才能用”有多要命。直播间网络一抖,依赖云端的工具就歇菜。端侧模型的意义,是让AI真正长在设备里,离线也能跑、隐私也不出门。 科大讯飞这几年不追参数虚火,专啃能落地的硬骨头。从语音到教育,再到现在的端侧大模型,路子一直很稳。 端侧大模型一旦普及,你觉得第一个被颠覆的是哪个场景?是手机助手,还是车载交互?聊聊你的判断。

12. 【端侧AI革命:星火X2.5-4B让笔记本断网也能完成复杂任务,性能越级】 近日,科大讯飞旗下词元星火开源了星火X2.5-4B及1.7B两款端侧模型。评测显示,4B模型在智能体、工具调用等任务中表现超越同尺寸对手,如多轮工具调用测试得分30.4,MCP协议测试54.6分。该模型通过混合注意力机制支持100万Token上下文,显存占用仅为传统模型的四分之一,并采用多教师在线策略蒸馏技术。实测中,模型在断网笔记本上能精准比对合同条款、自动处理表格数据。模型基于国产算力训练,兼容英伟达、华为等主流硬件。此举精准瞄准信创市场,为无法联网的国产设备提供可本地部署的智能方案,目前模型权重已全面开源。 详情点击:https://mp.weixin.qq.com/s/5d7rxG8MAQAiJaaFEADX5g 注:本文为转载内容,仅供学习与交流,不代表本头条观点。如有侵权,请联系我们删除。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章