张大妈

大模型推理降本新突破:Step 3.7 Flash如何实现成本降至1/9

源自43位全网作者

06-01 20:11

精选参考来源

1
#唐艺昕因皮肤原因4年未拍戏# 600602直线涨停!大模型龙头股改+新模型双催化,最全概念股名单(附股)AI大模型赛道再迎重磅催化!阶跃星辰完成股改、Pre-IPO推进、新模型上线三重利好集中爆发,4月3日午后相关概念股直线异动,云赛智联(600602)强势封板,中贝通信等个股同步冲高,一场围绕“阶跃星辰上市预期”的行情正式打响!一、突发!阶跃星辰股改完成,港股上市进入倒计时企查查显示,上海阶跃星辰智能科技有限公司正式变更为股份有限公司,完成股改关键一步。这家成立仅3年的AI大模型黑马,动作频频:• 融资超50亿:股改前后完成B+轮超50亿元融资,上海国投、中国人寿、华勤技术等重磅股东入局。• 高管加持:印奇出任董事长,同步掌舵千里科技,产业资源与资本信誉双提升。• 上市明确:计划2026年6月30日前港股交表,年底完成上市,Pre-IPO融资火热推进。• 技术升级:4月2日最新模型Step 3.5 Flash 2603上线,新增low think mode,默认模式token消耗降14%,低模式狂降56%,推理效率、稳定性全面升级。从股改到融资、从技术到上市,阶跃星辰已进入IPO冲刺期,产业链相关公司直接受益!二、600602直线涨停!云赛智联成核心龙头午后云赛智联(600602)直线拉涨停,成为阶跃星辰概念绝对龙头,核心逻辑:• 股权深度绑定:与阶跃星辰共同持股上海智能算力公司(云赛11%、阶跃10%),利益深度捆绑。• 算力核心供应商:上海国资算力平台,拥有三大数据中心、超7000机柜,为阶跃提供长期算力服务,松江智算中心为其核心训练基地。• 官方算力底座:中标上海人工智能算力公共平台,承接当地75%智算基建,是阶跃星辰官方算力伙伴。三、最全概念股梳理:四大方向,7家业绩亮眼1. 直接参股(核心受益)• 中贝通信(603220):阶跃第十大股东,持股0.8096%;17000P智算核心供应商,长期提供算力服务。• 宏力达:通过嘉兴久奕雍珩(持股37.7358%)间接参股,后者为阶跃第九大股东(持股1.2145%)。• 云赛智联(600602):合资持股+算力双绑定,龙头标的。2. 算力服务(卖水人)• 同方股份:知网提供知识数据,合作大模型训练,2025年净利润5亿元。• 中科曙光、拓维信息:提供算力服务器、智算集群解决方案。3. 业务合作(生态协同)• 中文在线:网络文学+知识服务独家合作,AI创作深度绑定。• 欢瑞世纪:共建“麟跃”AI实验室,发力短剧Agent。• 千里科技:印奇掌舵,共同开发智能座舱。• 中广天择(*ST天择):2025年扭亏,合作数字视频AI应用。• 新华传媒:合资财跃星辰,布局金融大模型。4. 业绩含金量(7家已披露)• 宏力达:净利润6.39亿(+186.79%),间接参股• 同方股份:净利润5亿(+3.69%),数据合作• 云赛智联:净利润1.94亿,算力龙头• 新华传媒:净利润同比+4.45%,金融AI• *ST天择:扭亏为盈(2700-3000万),视频AI四、行情逻辑:IPO预期+技术迭代,短线风口确立1. 股改=上市前置:完成股改是港股上市关键一步,IPO预期强烈,资本炒作热情点燃。2. 模型迭代=业绩催化:Step 3.5 Flash 2603降本增效,商用加速,算力、数据、应用端需求爆发。3. 资金聚焦:市场震荡下,AI大模型+IPO预期成稀缺主线,云赛智联、中贝通信等核心标的获资金抢筹。五、风险提示• 阶跃星辰上市进度不及预期。• 大模型商业化盈利兑现缓慢。• 概念股短期涨幅较大,注意波动风险。阶跃星辰作为国内头部大模型厂商,IPO进程加速,产业链公司迎来估值重塑。云赛智联(600602) 凭借股权+算力双重绑定,成为本轮行情龙头;中贝通信、中文在线、欢瑞世纪等核心合作标的,也有望持续活跃!
2
Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西
全部
来源
内容由AI生成

精选参考来源

1. #唐艺昕因皮肤原因4年未拍戏# 600602直线涨停!大模型龙头股改+新模型双催化,最全概念股名单(附股)AI大模型赛道再迎重磅催化!阶跃星辰完成股改、Pre-IPO推进、新模型上线三重利好集中爆发,4月3日午后相关概念股直线异动,云赛智联(600602)强势封板,中贝通信等个股同步冲高,一场围绕“阶跃星辰上市预期”的行情正式打响!一、突发!阶跃星辰股改完成,港股上市进入倒计时企查查显示,上海阶跃星辰智能科技有限公司正式变更为股份有限公司,完成股改关键一步。这家成立仅3年的AI大模型黑马,动作频频:• 融资超50亿:股改前后完成B+轮超50亿元融资,上海国投、中国人寿、华勤技术等重磅股东入局。• 高管加持:印奇出任董事长,同步掌舵千里科技,产业资源与资本信誉双提升。• 上市明确:计划2026年6月30日前港股交表,年底完成上市,Pre-IPO融资火热推进。• 技术升级:4月2日最新模型Step 3.5 Flash 2603上线,新增low think mode,默认模式token消耗降14%,低模式狂降56%,推理效率、稳定性全面升级。从股改到融资、从技术到上市,阶跃星辰已进入IPO冲刺期,产业链相关公司直接受益!二、600602直线涨停!云赛智联成核心龙头午后云赛智联(600602)直线拉涨停,成为阶跃星辰概念绝对龙头,核心逻辑:• 股权深度绑定:与阶跃星辰共同持股上海智能算力公司(云赛11%、阶跃10%),利益深度捆绑。• 算力核心供应商:上海国资算力平台,拥有三大数据中心、超7000机柜,为阶跃提供长期算力服务,松江智算中心为其核心训练基地。• 官方算力底座:中标上海人工智能算力公共平台,承接当地75%智算基建,是阶跃星辰官方算力伙伴。三、最全概念股梳理:四大方向,7家业绩亮眼1. 直接参股(核心受益)• 中贝通信(603220):阶跃第十大股东,持股0.8096%;17000P智算核心供应商,长期提供算力服务。• 宏力达:通过嘉兴久奕雍珩(持股37.7358%)间接参股,后者为阶跃第九大股东(持股1.2145%)。• 云赛智联(600602):合资持股+算力双绑定,龙头标的。2. 算力服务(卖水人)• 同方股份:知网提供知识数据,合作大模型训练,2025年净利润5亿元。• 中科曙光、拓维信息:提供算力服务器、智算集群解决方案。3. 业务合作(生态协同)• 中文在线:网络文学+知识服务独家合作,AI创作深度绑定。• 欢瑞世纪:共建“麟跃”AI实验室,发力短剧Agent。• 千里科技:印奇掌舵,共同开发智能座舱。• 中广天择(*ST天择):2025年扭亏,合作数字视频AI应用。• 新华传媒:合资财跃星辰,布局金融大模型。4. 业绩含金量(7家已披露)• 宏力达:净利润6.39亿(+186.79%),间接参股• 同方股份:净利润5亿(+3.69%),数据合作• 云赛智联:净利润1.94亿,算力龙头• 新华传媒:净利润同比+4.45%,金融AI• *ST天择:扭亏为盈(2700-3000万),视频AI四、行情逻辑:IPO预期+技术迭代,短线风口确立1. 股改=上市前置:完成股改是港股上市关键一步,IPO预期强烈,资本炒作热情点燃。2. 模型迭代=业绩催化:Step 3.5 Flash 2603降本增效,商用加速,算力、数据、应用端需求爆发。3. 资金聚焦:市场震荡下,AI大模型+IPO预期成稀缺主线,云赛智联、中贝通信等核心标的获资金抢筹。五、风险提示• 阶跃星辰上市进度不及预期。• 大模型商业化盈利兑现缓慢。• 概念股短期涨幅较大,注意波动风险。阶跃星辰作为国内头部大模型厂商,IPO进程加速,产业链公司迎来估值重塑。云赛智联(600602) 凭借股权+算力双重绑定,成为本轮行情龙头;中贝通信、中文在线、欢瑞世纪等核心合作标的,也有望持续活跃!

2. Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西

3. 昨天晚上发布的小米MiMo-2.5,登顶全球开源大模型第一,超Claude Opus 4.6,很牛逼。对开发者来说,几个点比较实在:速度方面,TPS到100-150 token/s,做Agent交互基本不用等响应。成本直接砍半,1M和256K上下文同价,夜间8折,比用Claude便宜不少。长程任务稳定性有突破。北大编译器case,4.3小时一次满分通过,不是跑十几个小时勉强过关那种。单次近千次工具调用、十余轮上下文压缩,工程化能力是实打实的。百万级上下文两个模型都支持,马上开源。以前这种水平的Agent能力,调用成本是个大门槛,现在直接免费用。小米AI这块确实被低估了#小米首次登顶全球开源大模型第一#

4. 谷歌Gemini 3 Flash 掀桌子进场,快了3倍还反超Pro,价格仅1/4

5. 盘点一周AI大事(12月21日)|谷歌手撕OpenAI OpenAI 上线最强图像模型GPT Image 1.5 OpenAI发布最强编码模型GPT-5.2-Codex Google发布 Gemini 3 Flash Google开源A2UI协议 微软开源最强3D模型TRELLIS 2 阿里开源分层编辑图像模型Qwen-Image-Layered 阿里发布Veo 3平替Wan2.6 字节发布Veo 3平替Seedance 1.5 pro 腾讯开源首个实时交互世界模型WorldPlay 研究员开源照片重新对焦Genfocus Pipeline 研究员开源实时换脸视频模型PersonaLive Meta开源最强声音分割模型SAM Audio #抖音知识年终大赏 #AI新星计划 #OpenAI #AIGC #前沿科技趋势发布月

6. 重磅:小米发布并开源最新MiMo-V2-Flash大模型,总参数量3090亿,活跃参数量150亿,基准测试性能媲美DeepSeek-V3.2,延迟仅为几分之一!生成速度达150 tokens/秒(基于首日版本)。刚试了下生成速度超快,等明天罗福莉详细揭秘

7. 谷歌发布 Gemini 3 Flash,相比上一代 2.5 Flash 有哪些提升?使用体验如何?

8. 阶跃Step 3.5 Flash :春节 AI 混战杀出的黑马,正在 Agent 时代弯道超车

9. #小米首次登顶全球开源大模型第一#不得了了兄弟们,小米MiMo-2.5强势拿下全球开源大模型榜首,Agent能力直接媲美Claude Opus 4.6,用实打实的技术实力,打破大众对小米“只做手机”的固有认知,亮出中国AI的硬核底气! 在核心技术比拼上,MiMo-2.5交出了碾压级答卷。从V2到V2.5,小米技术团队极速迭代,凭借单次近千次工具调用、十余轮上下文压缩的超强工程化能力,不靠堆算力,全凭真本事登顶。更惊喜的是,这款顶级模型支持百万级上下文,还即将全面开源,开发者能免费使用全球顶尖Agent能力,搭配1M与256K上下文同价、夜间8折的良心定价,彻底降低AI开发门槛。这一次,小米用全球第一的成绩,证明中国开源大模型已跻身世界第一梯队!

10. 如何评价小米开源的MiMo-V2-Flash大模型,表现如何?

11. 除夕夜,国产顶流压轴上线,QWEN3.5多模态开源!

12. 单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s

13. 全球AI开发者新宠!阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜

14. #一条音频告别2025##微博声浪计划# 小米发布开源大模型MiMo-V2-Flash,总参数3090亿仅激活150亿实现轻量化,在数学竞赛、科学测试等位列开源前两名,软件工程测试第一,性能媲美DeepSeekV3.2。生成速度达150 tokens/秒,推理成本仅为其1/3,支持深度思考与联网搜索,融入澎湃OS,已开放体验。 科技小焱的微博音频

15. 【DeepSeek V4中文能力测评出炉:重回国内第一!】SuperCLUE团队发布DeepSeek V4系列中文大模型测评结果,DeepSeek-V4-Pro凭借综合表现拿下国内第一,Flash版本紧随其后位居第二,国产开源模型再迎突破。本次测评覆盖数学推理、科学推理、代码生成、智能体任务规划、指令遵循、幻觉控制六大维度,Pro版本得分70.98分,Flash版本68.82分,两项成绩均大幅领先国内其他模型。DeepSeek V4系列采用全新注意力机制,全版本支持百万级长上下文,同时降低算力与显存占用,搭配国产芯片使用,整体效率更高。相比上一代 V3.2,两个版本均实现全面提升。Pro版本智能体能力提升超20分,数学推理提升近10分,指令遵循提升近12分,幻觉控制也有明显优化。Flash版本在保持高效推理的同时,智能体与数学推理同样大幅提升,性价比突出。Pro版本(15元/百万Tokens)侧重高性能,幻觉控制更稳,适合复杂任务与专业场景。Flash 版本速度更快、成本更低,API价格仅1.25元每百万Tokens,日常使用更划算。测评同时指出,模型与海外顶尖模型在代码生成、复杂指令执行等方面仍有差距。整体来看,DeepSeek V4凭借均衡能力与亲民成本,站稳国内第一梯队,成为日常办公、开发创作、长文本处理的优质选择。

16. 今天,也就是2026年2月14日,字节跳动正式发布了豆包大模型2.0(Doubao-Seed-2.0)系列,官方宣布这标志着豆包全面进入Agent时代。这次更新推出了Pro、Lite、Mini、Code全家桶,Pro版直接对标国际顶尖如GPT-5.2和Gemini 3 Pro,亮点非常多,尤其在真实世界复杂任务执行、多模态理解和性价比上表现出色。🔻主要亮点和技术升级1. 全面进入Agent时代,强化复杂任务执行
豆包2.0不再只是聊天工具,而是针对大规模生产环境系统优化,重点提升高效推理、多模态理解和复杂指令执行能力。能更好地处理多约束、多步骤、长链路任务,已具备支撑高价值真实世界任务的基础。比如长链推理、Agent规划执行等场景更可靠。2. 多模态能力大幅跃升,多数基准达SOTA
视觉与多模态理解更稳健:对复杂文档、表格、图表、图形、视频的解析显著提升,视觉推理、空间理解、运动理解、长视频分析等达到全球顶尖水平。Pro版在大多数视觉基准测试中拿最高分,支持更精准的多模态感知和推理。3. 数学、推理、编程能力顶尖
Pro旗舰版在IMO、CMO数学竞赛和ICPC编程竞赛中取得金牌成绩,在Putnam基准上超越Gemini 3 Pro,数学和推理能力已达世界顶尖。能尝试埃尔德什级数学问题、完成研究级科学编程任务。4. 全家桶灵活适配不同场景 • Pro:深度推理 + 长链路任务,旗舰对标GPT-5.2 / Gemini 3 Pro。 • Lite:性能与成本平衡,综合能力超上一代主力豆包1.8。 • Mini:低时延、高并发、成本敏感场景。 • Code(Doubao-Seed-2.0-Code):专为编程优化,与TRAE(字节AI编程工具)结合效果最佳,支持多模态输入(如代码截图)。5. 超强性价比,token成本降低约一个数量级
Pro版定价(32k以内输入):3.2元/百万tokens,输出16元/百万tokens,远低于Gemini 3 Pro和GPT-5.2。Lite输入仅0.6元/百万tokens。在长链路、大规模推理场景下,成本优势巨大,真正让AI“用得起”。🔻体验入口:豆包App切换“专家”模式即可用Pro对话;Code版已在TRAE接入;开发者可通过火山引擎API调用全系列。🔻简单对比GLM-5和通义千问(Qwen)M2.5等同批更新模型从当前公开信息看(2026年2月数据),豆包2.0 Pro在数学/推理(如IMO金牌、Putnam超Gemini 3 Pro)和多模态视觉理解上特别突出,整体对标国际前沿(如GPT-5.2级别),推理链更长、Agent执行更稳。GLM-5(智谱)和通义千问M2.5(阿里)也在2025-2026密集迭代,强在中文理解、工具调用和生态(如通义千问的图像/视频生成),但字节这次强调真实世界复杂任务+极致性价比,Pro在部分国际基准领先,成本更低一个量级,适合企业级大规模部署。国内模型差距已非常小,各有侧重:字节更偏多模态+Agent执行,阿里/智谱在开源和通用中文生态更成熟。你已经试过豆包2.0了吗?我是用了,确实好。字节真是国产之光。🚀 #豆包大模型2.0发布# #HOW I AI# #过个有AI年#

17. Rubin 是首代大规模搭载 HBM4 的架构。在技术层面,训练主要是 Compute-bound(计算受限),Batch比较大,而推理,尤其是长文本和高并发,是极度 Memory-bound(带宽受限) 的,Batch小,延迟要求高,毕竟是服务大量群众的。Rubin 把带宽拉到 20TB/s 以上,本质上就是为了解决推理时的吞吐瓶颈。 Rubin 当然能训练,英伟达的卡从来不偏科。但为什么要强调推理?因为 HBM4。训练吃算力,推理吃带宽。Rubin 把内存带宽拉到 Blackwell 的两倍多,摆明了是要在推理端降维打击,能训练是保底,推理成本降一个数量级才是 Rubin 让大厂掏钱的主要原因。。 现在大厂手里囤了那么多 H100 还没跑满,为什么还要盯着还没出的 Rubin?就是因为推理太贵。训练是研发投入,咬牙也就过了;但推理是日活开支,那是每天都在烧的钱。Rubin 的 HBM4 就是避免长期烧钱,没有谷歌的TPU也就算了,现在有个魔鬼TPU在边上,TPU 推理每 Token 成本比 H100 低 4 倍,不求变是不行的,不买是不行的。。 我厂有很多V100,也有H100,AMD 的MI250,300X 等,现在GB200还太贵,TPU要用谷歌云不方便,Rubin还没发布,我作为厂长,当然要了解和学习这里面的名堂。。当然我肯定没写过实际代码,就像老黄也没写过,不妨碍我们吹牛啊,对不对。

18. 刚刚,DeepSeek官方正式发布DeepSeek-V4,这个版本主打100万token超长上下文,Agent、知识、推理国内开源领先~分为两个版本:DeepSeek‑V4‑Pro:1.6T参数/激活49B,专家模式,性能比肩GPT‑5.4、Claude‑Opus、Gemini,推理/知识/代码开源第一 。DeepSeek‑V4‑Flash:284B参数/激活13B,快速模式,推理接近Pro,更快更便宜,简单Agent任务持平Pro。定价方面:Pro更贵、Flash平价;Pro下半年算力扩容后预计会大幅降价~

19. “本次价格调整背后,离不开小米技术团队在推理系统上的持续优化。” “我们基于 SGLang HiCache 完整支持 SWA(Sliding Window Attention),将 KV Cache 在 GPU 显存、CPU 内存、SSD 等多级存储之间的数据搬运量降低至优化前的近 1/7,并将可缓存 token 数量提升至优化前的近 5 倍,显著提升了缓存命中率和推理效率。”

20. 盘点一周AI大事2月8日|AI相亲、AI当老板、AI狼人杀 Anthropic发布最强大模型Claude Opus 4.6 OpenAI发布最强编码模型GPT5.3Codex OpenAI推出Codex桌面版 Google上线AI狼人杀 AI雇佣人类平台RentAHuman爆火 AI雇佣AI平台ClawTasks爆火 龙虾相亲平台MoltMatch爆火 智谱开源最强OCR模型GLM-OCR 字节发布最强视频模型Seedance 2.0 研究员开源无痕编辑视频模型Edit Yourself 字节开源最强分子预测模型Protenix-v1 Google发布论文配图AI Paper Banana #AI新星计划 #前沿科技趋势发布月 #AI #AIGC #OpenAI

21. 昨天晚上小米MiMo-V2-Flash发布了,小米大模型以MiMo系列7B参数模型为核心代表,在2025年的权威测评中,已跻身开源小参数模型第一梯队,数学/代码/多模态能力突出,端侧部署与推理效率优势明显,整体处于国内第一梯队、全球小参数模型领先水平。试了一下,响应速度非常之快。 #小米新模型媲美DeepSeekV3.2# #小米发布最新MiMo大模型#

22. 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看

23. 刚刚,让谷歌翻身的Gemini 3,上线Flash版

24. 阿里甩出 AI 王炸! Qwen3-Max-Thinking 高调对标 GPT-5.2-Thinking,是真硬刚还是博眼球?这款阿里旗舰推理模型拿下 19 项国际基准测试高分,自带自适应工具调用,能自主搜信息、做计算,主动解决问题,还成了阿里全生态的技术底座,打通电商、本地生活等全场景实现智能闭环。 有人说它缩小了中外 AI 差距,坐稳中文 AI 头把交椅,让阿里 AI 生态形成良性循环,未来可期;也有人质疑,对标全球顶尖模型只是纸面数据,落地商业场景的实际能力仍需检验。 阿里这次的 AI 大招,到底是技术突破的里程碑,还是营销造势的噱头?这款模型的真实实力究竟如何,一起来聊聊吧!#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# http://t.cn/AXqpEa95

25. 阶跃Step 3.7 Flash实测,又被AI上了一课

26. 实测 Step 3.7 Flash ,10 秒写完 1000 行代码,生产级 Agent 的高效率模型

27. Step 3.5 Flash(阶跃星辰) —— 测试数据报告 + 使用建议(工程 / 开发者版)/ 推理速度(最高≈350 token/s)、长上下文(可达256K)和Agent 多步稳定性

28. Flash模型,阶跃Step 3.7 Flash更懂Agent

29. 合作伙伴丨多项第一!阶跃星辰开源最新模型Step 3.5 Flash,为智能体而生,达到世界级水平!

30. 多项第一!阶跃星辰开源最新模型Step 3.5 Flash,为智能体而生,达到世界级水平!

31. Step 3.5 Flash,和另一个Flash异曲同工啊

32. 阶跃星辰上线Step 3.5 Flash新版本,新增低推理模式

33. 阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜

34. 上线两天登顶全球榜单,阶跃星辰怎么让 AI 又「聪明」又「快」?

35. 阶跃发布Step 3.7Flash,特别适合高频、多轮的Agent场景

36. 阶跃发布Step 3.7 Flash

37. 速度翻倍!阶跃星辰开源 Step 3.7 Flash 大模型

38. 阶跃星辰开源Step 3.7 Flash大模型

39. 阶跃星辰Step 3.7 Flash开源大模型深度评测

40. 阶跃发布并开源Step 3.7 Flash,“多快好省”拉高模型效率上限

41. 阶跃开源Step 3.7 Flash,主打生产级Agent的多模态MoE模型

42. 阶跃新模型快到“没推理”!印奇上任,果然气势一新

43. ��Ծ��������ԴStep 3.7Flash���ƶ�Agent������ҵ��ģ����������

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章