阶跃Flash能替代Claude吗?这四类任务千万别换
06-01 20:38
精选参考来源
哔哩哔哩 2026-02-19
新浪微博 2026-02-14
来源
精选参考来源
1. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何
哔哩哔哩 2026-02-19 00:00:00
2. 今天,也就是2026年2月14日,字节跳动正式发布了豆包大模型2.0(Doubao-Seed-2.0)系列,官方宣布这标志着豆包全面进入Agent时代。这次更新推出了Pro、Lite、Mini、Code全家桶,Pro版直接对标国际顶尖如GPT-5.2和Gemini 3 Pro,亮点非常多,尤其在真实世界复杂任务执行、多模态理解和性价比上表现出色。🔻主要亮点和技术升级1. 全面进入Agent时代,强化复杂任务执行 豆包2.0不再只是聊天工具,而是针对大规模生产环境系统优化,重点提升高效推理、多模态理解和复杂指令执行能力。能更好地处理多约束、多步骤、长链路任务,已具备支撑高价值真实世界任务的基础。比如长链推理、Agent规划执行等场景更可靠。2. 多模态能力大幅跃升,多数基准达SOTA 视觉与多模态理解更稳健:对复杂文档、表格、图表、图形、视频的解析显著提升,视觉推理、空间理解、运动理解、长视频分析等达到全球顶尖水平。Pro版在大多数视觉基准测试中拿最高分,支持更精准的多模态感知和推理。3. 数学、推理、编程能力顶尖 Pro旗舰版在IMO、CMO数学竞赛和ICPC编程竞赛中取得金牌成绩,在Putnam基准上超越Gemini 3 Pro,数学和推理能力已达世界顶尖。能尝试埃尔德什级数学问题、完成研究级科学编程任务。4. 全家桶灵活适配不同场景 • Pro:深度推理 + 长链路任务,旗舰对标GPT-5.2 / Gemini 3 Pro。 • Lite:性能与成本平衡,综合能力超上一代主力豆包1.8。 • Mini:低时延、高并发、成本敏感场景。 • Code(Doubao-Seed-2.0-Code):专为编程优化,与TRAE(字节AI编程工具)结合效果最佳,支持多模态输入(如代码截图)。5. 超强性价比,token成本降低约一个数量级 Pro版定价(32k以内输入):3.2元/百万tokens,输出16元/百万tokens,远低于Gemini 3 Pro和GPT-5.2。Lite输入仅0.6元/百万tokens。在长链路、大规模推理场景下,成本优势巨大,真正让AI“用得起”。🔻体验入口:豆包App切换“专家”模式即可用Pro对话;Code版已在TRAE接入;开发者可通过火山引擎API调用全系列。🔻简单对比GLM-5和通义千问(Qwen)M2.5等同批更新模型从当前公开信息看(2026年2月数据),豆包2.0 Pro在数学/推理(如IMO金牌、Putnam超Gemini 3 Pro)和多模态视觉理解上特别突出,整体对标国际前沿(如GPT-5.2级别),推理链更长、Agent执行更稳。GLM-5(智谱)和通义千问M2.5(阿里)也在2025-2026密集迭代,强在中文理解、工具调用和生态(如通义千问的图像/视频生成),但字节这次强调真实世界复杂任务+极致性价比,Pro在部分国际基准领先,成本更低一个量级,适合企业级大规模部署。国内模型差距已非常小,各有侧重:字节更偏多模态+Agent执行,阿里/智谱在开源和通用中文生态更成熟。你已经试过豆包2.0了吗?我是用了,确实好。字节真是国产之光。🚀 #豆包大模型2.0发布# #HOW I AI# #过个有AI年#
新浪微博 2026-02-14 00:00:00
3. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人
抖音 2025-12-07 00:00:00
4. “龙虾模型”能管公司?实测GLM-5-Turbo接入openclaw运营公司
哔哩哔哩 2026-03-17 00:00:00
5. 海外开发者惊讶小米MiMo新模型表现,那肯定惊讶咯,ChtaGPT Plus每个月20美元,Pro每个月200美元,普通创作者根本用不起Pro。Gemini火了后,免费版每天能生成2张图片,Pro版本送5次对话,会有点不够用。所以更轻量级的Gemini3 Flash火了,但是能力差不多的MiMo-V2-Flash更便宜…没有会员月费,按token计量,且API限时免费,开源部署零成本。Gemini 3 Flash 每百万tokens输入≈3.50元,输出≈21.02元MiMo‑V2‑Flash 每百万tokens输入≈0.70元,输出≈2.10元咋说呢,人民币和美元的区别,近乎于1/8使用成本,哪国人会不爱啊?
新浪微博 2025-12-27 00:00:00
6. 小米的大模型在海外也火起来了,海外开发者们发现,小米的模型不仅性能出色,更重要的是其价格优势令人惊叹。~在人工分析平台artificialanalysis.ai的评测中,MiMo-V2-Flash展现出了卓越的智能水平,表现仅次于Kimi2-Thinking,却以仅为Gemini 3 Flash十分之一的价格提供了接近的体验。原来在大模型上,小米也是以极致性价比,搅动行业!海外开发者现在已经把小米大模型称为“Gemini平替”,在需要复杂推理、深度理解或创造性任务时,MiMo已经是首选。在实际速度测试中,MiMo-V2-Flash甚至超越了谷歌的Gemini-3-Flash,处理相同任务时响应更快。而它的API定价仅为每百万输入0.7元、输出2.1元,真正将高性能大模型的使用门槛从“奢侈品”降到了“日用品”级别。小米MiMo用实际成果证明,中国大模型不仅跟上了全球步伐,更在性价比和工程化创新上带来了全新突破。
新浪微博 2025-12-27 00:00:00
7. 龙虾这5个缺点,正在劝退一批人。 #大有学问 #红衣聊AI #openclaw #AI工具
抖音 2026-04-29 00:00:00
8. Qwen3.6“越狱”了!目前最强开源模型!支持本地 Agent,6G 显存都能跑!附部署教程|零度解说
哔哩哔哩 2026-05-25 00:00:00
9. 阶跃Step 3.5 Flash :春节 AI 混战杀出的黑马,正在 Agent 时代弯道超车
微信公众号 2026-02-03 00:00:00
10. Claude Opus 4.6一天内被超两次,这次来自国产模型
微信公众号 2026-04-08 00:00:00
11. 全球AI开发者新宠!阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜
微信公众号 2026-02-06 00:00:00
12. 谷歌Gemini 3 Flash 掀桌子进场,快了3倍还反超Pro,价格仅1/4
微信公众号 2025-12-18 00:00:00
13. 全网疯传fork!刚刚,Claude Code源代码泄露被开源了
微信公众号 2026-03-31 00:00:00
14. 360发布“养龙虾”安全指南! #大有学问 #养龙虾 #OpenClaw #AI工具 #红衣聊AI
抖音 2026-03-11 00:00:00
15. 盘点一周AI大事(5月3日)|Google上线AI口语陪练 Google IO即将发布Gemini 4和Veo 4 Gemini上线原生文件生成 Google推出AI衣柜 Google翻译上线AI口语陪练 Claude 接入50多款创作软件,能直接操作Photoshop修图、做海报,接管Blender建模,用Ableton创作音乐 英伟达开源全模态模型Nemotron 3 Nano Omni 研究员训练出复古大模型talkie KAIKAKU发布食品大模型Epicure 研究员开源突破性智能体协作框架Recursive MAS Moonlake上线Blender智能体Moonlake 3D Agent #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #大模型
抖音 2026-05-04 00:00:00
16. 「Github一周热点115期」桌面AI超级助理、编程Agent的知识图谱、隐身的Chromium、把任何软件变成CLI工具、以及实时流式3D重建模型
哔哩哔哩 2026-05-23 00:00:00
17. 阿里全家桶全面Agent化!千问“任务助理”全面公测,从此AI不再只是动嘴出主意的狗头军师!
哔哩哔哩 2026-01-21 00:00:00
18. 半夜,小米大模型团队发布小米全模态Agent基座大模型 MiMo-V2-Omni“MiMo-V2-Omni 专为现实世界中复杂的多模态交互与执行场景而生。从底层构建了融合文本、视觉、语音的全模态基座,并以统一架构将“感知”与“行动”深度绑定。这不仅打破了传统模型“重理解、轻执行”的局限,更让模型原生具备了多模态感知、工具调用、函数执行及 GUI 操作能力。”“MiMo-V2-Omni 可无缝接入各种 Agent 框架,实现了从理解到操控的跨越,大幅降低了全模态 Agent 的落地门槛。”“在正式发布之前,我们将一个早期测试版本以「Healer Alpha」为代号匿名上架 OpenRouter,没有任何宣传,纯粹让模型能力说话。结果调用量自然攀升至平台前列,并在 OpenClaw 测评榜单 PinchBench 上拿下均分第一,用户和基准双双给出了同一个答案。” “我们还与金山办公合作,将 MiMo-V2-Omni 接入 WPS Office,探索全模态智能体模型在日常生产力场景中的表现。”
新浪微博 2026-03-19 00:00:00
19. 【MiMo 大模型实力强劲震惊海外开发者 】 国产大模型这波在海外直接杀疯!OpenRouter 最新周榜里,小米 MiMo-V2-Flash API 调用量飙到第二,还是国产大模型第一;Artificial Analysis 数据里,它更是冲进全球开源大模型第二。海外开发者都在夸:AI 分析碾过同价位对手,面向 Agent 时代的实用性不搞虚的,甚至被当成 Gemini3 Flash 平替 —— 关键这模型不仅效果能打,还免费又便宜!之前总说国产大模型出海难,现在小米这进步是真肉眼可见,全球关注都不输同期的 Gemini3 Flash,这波确实有点东西!
新浪微博 2025-12-27 00:00:00
20. 半夜,小米大模型团队发布第二个大模型:Xiaomi MiMo-V2-Pro,实现小米大模型从最初的Flash到Pro到Omni不同量级不同功能全覆盖“Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。”“在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。在全球权威大模型综合智能排行榜 Artificial Analysis 上,MiMo-V2-Pro 位列全球第八,国内第二。”“在 OpenClaw、Claude Code 等智能体框架中,MiMo-V2-Pro 展现出了优秀的端到端任务完成能力,能够在无人工干预的条件下完成复杂工作流编排、长程规划与精准工具调用,并持续可靠地交付最终结果。整体使用体感已超越 Claude Sonnet 4.6,逼近 Opus 4.6,但模型 API 定价仅为其 1/5,降低了前沿智能的使用门槛。”
新浪微博 2026-03-19 00:00:00
21. #小米首次登顶全球开源大模型第一#不得了了兄弟们,小米MiMo-2.5强势拿下全球开源大模型榜首,Agent能力直接媲美Claude Opus 4.6,用实打实的技术实力,打破大众对小米“只做手机”的固有认知,亮出中国AI的硬核底气! 在核心技术比拼上,MiMo-2.5交出了碾压级答卷。从V2到V2.5,小米技术团队极速迭代,凭借单次近千次工具调用、十余轮上下文压缩的超强工程化能力,不靠堆算力,全凭真本事登顶。更惊喜的是,这款顶级模型支持百万级上下文,还即将全面开源,开发者能免费使用全球顶尖Agent能力,搭配1M与256K上下文同价、夜间8折的良心定价,彻底降低AI开发门槛。这一次,小米用全球第一的成绩,证明中国开源大模型已跻身世界第一梯队!
新浪微博 2026-04-23 00:00:00
22. Claude Sonnet 4.6 发布了,Anthropic 迄今最强的 Sonnet 模型。这次升级覆盖面很广:编程、计算机操作、长上下文推理、智能体规划、知识工作、设计,全线提升。上下文窗口也扩到了 100 万 token(beta)。价格不变,依然是 3/15 美元每百万 token。下面快速过一遍值得关注的点。【1】编程能力大幅提升,用户甚至更偏爱它超过 OpusAnthropic 的内部测试显示,Claude Code 用户在 70% 的情况下更偏好 Sonnet 4.6 而非上一代 Sonnet 4.5。更夸张的是,59% 的用户甚至更喜欢它而非去年 11 月发布的旗舰模型 Opus 4.5。用户反馈集中在几个点:Sonnet 4.6 在改代码之前会先读上下文,会合并重复逻辑而不是到处复制粘贴,过度工程化和偷懒的情况也明显减少。多步骤任务执行更稳定,虚假的成功报告更少。【2】计算机操作从实验品变成了实用工具2024 年 10 月 Anthropic 首次推出计算机操作功能时,自己都说"还很笨拙、容易出错"。16 个月后,OSWorld 基准测试(让 AI 在真实软件环境里完成任务)的得分从最初的 14.9% 涨到了 72.5%。早期用户反馈,Sonnet 4.6 在操作复杂电子表格、填写多步骤网页表单这类任务上,已经接近人类水平。它还能跨多个浏览器标签协调操作,把不同来源的信息整合到一起。当然,跟最熟练的人类比还有差距。但这个进步速度说明,更强的版本不会太远。安全方面也有改进。计算机操作最大的风险是提示词注入(prompt injection),恶意网页可以藏指令试图劫持模型。Sonnet 4.6 在抵抗这类攻击方面比 Sonnet 4.5 有明显提升。【3】基准测试全面提升,逼近 Opus 水平Sonnet 4.6 在各项基准测试中全面进步,接近 Opus 级别的智能水平,但价格只是 Sonnet 级别。换句话说,以前需要用 Opus 才能搞定的任务,现在 Sonnet 就能做。特别值得一提的是 Vending-Bench Arena 评测,这个测试让 AI 模型在模拟环境中经营一家企业,不同模型之间还要相互竞争。Sonnet 4.6 展现出了有意思的策略:前 10 个月大举投资扩产能,最后阶段突然转向盈利优先,靠这个时机差打赢了竞争对手。【4】100 万 token 上下文窗口100 万 token 足够装下整个代码库、长篇合同或几十篇研究论文。更关键的是,Sonnet 4.6 能在这么长的上下文里有效推理,而不只是把文本塞进去。这对需要长期规划的复杂任务很有价值。【5】产品和 API 更新API 层面有几个实用更新:网页搜索和抓取工具现在会自动过滤处理搜索结果,只保留相关内容,节省 token;代码执行、记忆、程序化工具调用、工具搜索等功能正式发布(GA)。Claude in Excel 插件现在支持 MCP 连接器,可以直接在 Excel 里调用 S&P Global、PitchBook、Moody's 等数据源,不用切出去。免费版也升级到了 Sonnet 4.6,并开放了文件创建、连接器、Skills 和上下文压缩功能。【6】怎么选:Sonnet 4.6 还是 Opus?对大多数任务来说,Sonnet 4.6 性价比更高。Anthropic 自己的建议是:需要最深层推理的场景(大规模代码重构、多智能体编排、必须零容错的问题),Opus 4.6 仍然是更好的选择。其他场景,Sonnet 4.6 足够了。Sonnet 4.6 的模型标识符是 claude-sonnet-4-6,已在所有 Claude 方案、Cowork、Claude Code、API 以及主要云平台上线。官方公告:网页链接
新浪微博 2026-02-18 00:00:00
23. OpenRouter最新测算,3月30日至4月5日,全球AI大模型总调用量达27万亿Token,环比增长18.9%。中国AI大模型表现强劲,周调用量升至12.96万亿Token,环比上涨31.48%,已连续五周实现增长并超越美国。从全球模型调用量排名来看,前六位均被中国AI大模型包揽。Qwen3.6 Plus (free) 以4.6万亿Token的周调用量位居榜首;小米 MiMo-V2-Pro 本周下滑至第二位,周调用量为3.08万亿Token;Qwen3.6 Plus Preview 排名第三,周调用量为1.64万亿Token;阶跃星辰Step 3.5 Flash (free) 排名第四,周调用量1.26万亿Token;MiniMax M2.7 排名第五,周调用量1.19万亿Token;DeepSeek V3.2 位列第六,周调用量同样为1.19万亿Token。
新浪微博 2026-04-06 00:00:00
24. 没想到啊,近期用过最好玩的一个Skill,来自微信读书
微信公众号 2026-05-19 00:00:00
25. 【正式服】:赵云2技能新增伤害衰减,女娲控制时长换伤害,干农活的皮肤碎片,本周正式服更新,来了 #王者荣耀 #抖音五五开黑节 #五五开黑一起疯燃 #上号就现在 #上号是并肩
抖音 2026-05-13 00:00:00
26. “爱马仕智能体”火了,但有人把故事讲反了 #大有学问 #红衣聊AI #AI工具 #智能体
抖音 2026-04-18 00:00:00
27. 龙虾正在引发一场AI海啸,之前大家还在讨论, Cursor会不会淘汰程序员,但如今这种工具本身都已经快过时了。#养龙虾 #openclaw #程序员 #红衣聊AI
抖音 2026-03-19 00:00:00
28. #小米发布最新MiMo大模型#小米今天正式发布并开源了专为智能体场景设计的超高速大模型:MiMo-V2-Flash,3090亿总参数、150亿激活参数的稀疏架构,在推理、编码和长交互任务中实现性能与DeepSeek-V3.2对标。简单试了下反应速度可以,专业类知识回答的比较全面,目前还没有正式开放,只有开发者演示平台。
新浪微博 2025-12-17 00:00:00
29. 20美元无限AI的时代,可能要结束了。 #大有学问 #红衣聊AI #AI工具 #智能体
抖音 2026-04-13 00:00:00
30. 「Github一周热点109期」Claude Code被开源, Pretext文本排版引擎, 谷歌最新开源模型和3D建筑编辑器
哔哩哔哩 2026-04-04 00:00:00
31. 实测OpenRouter黑马模型,批量任务秒级响应,成本只有GPT-5.4-mini的1/10
微信公众号 2026-04-22 00:00:00
32. 4.3小时一次满分,以前那些模型跑长任务,十几个小时磕磕绊绊能跑完就不错了,MiMo直接给你满分交卷。这区别太大了,不是能不能跑完,是能不能一次做对。做Agent应用的都懂,一次满分背后是工程化能力的碾压,光堆算力堆不出来。跑分高没用,上生产要的是速度和成本。小米这波等于告诉开发者,你不用花Claude和GPT的高价,也能用上顶级Agent能力。我觉得最牛的不是技术参数,是小米的速度。从去年12月开源V2-Flash,到3月发V2,4月就登顶,迭代快得吓人。小米这种节奏,就很小米。#小米首次登顶全球开源大模型第一#
新浪微博 2026-04-23 00:00:00
33. #deepseekv4发布#DeepSeek 发布新一代大模型 DeepSeek V4,本次更新主要围绕上下文能力、推理能力以及 Agent 场景进行优化。来看一看它的核心更新如下:🔻上下文能力大幅提升 支持最长 1M tokens(百万级上下文) 可处理完整代码库、长文档、多轮复杂对话🔻强化 Agent 场景能力 优化多步骤推理能力 支持更复杂任务执行 提升长流程稳定性🔻模型性能提升 多项 benchmark 表现提升 对标主流闭源大模型🔻提供双版本 Pro:高性能版本 Flash:高性价比版本(更快、更便宜)🔻 延续开源路线 持续推动开源大模型发展 强调低成本与高性能结合目前 DeepSeek V4 已开放相关能力与体验入口,可以在Hugging Face体验,具体应用场景仍在持续拓展deepseekv4发布
新浪微博 2026-04-24 00:00:00
34. 账面 token 价差 并不自动等于任务 TCO 差。关键是“每次任务需要多少重复调用 / 缓存能省多少 / 人工复核成本多大”。 若能高命中缓存并且 GPT-5.2 的一次成功率/结构化输出质量显著优于对手,则 GPT-5.2 可以在任务级 TCO 上反超(上面给出了具体示例与临界成功率 ~77%)。 如果没有缓存或任务为短平快、并发量极大且对多模态有强需求,则低单价的 Gemini 更可能在任务级成本上占优。//@梁赛:哈哈,推理可靠性和工具生态方面,别家其实也都不错的 //@Zodzod_张浩:GPT的解释(狡辩):“GPT-5.2 168 美元 vs Gemini 3 Pro 18 美元”这一比较属于账面数字对比,忽略了上下文压缩、推理缓存、模型设计等关键参数。 多模态是 Gemini 3 的强项,但 GPT-5.2 在推理可靠性、工具生态和 workflow 价值上通常更强。 企业级市场重视的是任务级 TCO,而不是 token 定价。
新浪微博 2025-12-12 00:00:00
35. 真正的核心竞争力,来自于驾驭工具。 #大咖观察 #红衣聊AI #编程 #人工智能技术
抖音 2025-12-08 00:00:00
36. AI圈昨晚炸了!Claude Code内部不慎操作, 导致源码泄露,整整51万行代码、1900多个文件,全部意外公开,而这件事背后更重要的是:让所有人第一次看清楚,下一代AI软件到底长什么样。#大有学问 #红衣聊AI #代码 #网络安全 #Claudecode
抖音 2026-04-01 00:00:00
37. 阶跃星辰把刚发布的大模型命名为 Flash,你怎么看?
知乎 2026-02-11 00:00:00
38. 盘点一周AI大事(4月19日)|Claude终结设计 Anthropic上线Claude Design,接管整个设计流程 Anthropic上线最强编码模型Claude Opus 4.7 OpenAI内测下一代图像模型GPT-Image-2 OpenAI升级Codex,全面对标Claude Code Heygen开源视频制作技能包HyperFrames Quiver上线最强矢量图模型Arrow 1.1 Adobe发布重新打光图像模型TokenLight 字节开源数字人模型OmniShow 阿里开源开放世界模型Happy Oyster 研究员开源最强3D动画模型AniGen Gemini上线最强语音合成模型Gemini 3.1 Flash TTS Meta研发出神经计算机Neural Computers #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #大模型
抖音 2026-04-19 00:00:00
39. 盘点一周AI大事(2月1日)|AI乌托邦魔幻开局 Google上线世界模型Project Genie 阿里开源实时世界模型LingBot-World AI乌托邦社区Moltbook爆火 Chrome升级为AI浏览器 月之暗面发布最强开源大模型Kimi K2.5 Gemini 3 Flash升级视觉能力 腾讯发布最强开源图像模型HunyuanImage 3.0-Instruct 阿里开源Z image Base满血版 OpenMOSS发布最强开源视频模型MOVA MIniMax上线顶级音乐模型MiniMax Music 2.5 英伟达开源天气预测模型Earth-2 #AI新星计划 #前沿科技趋势发布月 #抖音知识年终大赏 #AI #AIGC
抖音 2026-02-01 00:00:00
40. 51万行源码泄露!Claude Code 里面到底藏了什么?
哔哩哔哩 2026-04-02 00:00:00
41. 2026英伟达GTC:“推理之王”的ASIC反击战与Token经济学【硅谷101】
哔哩哔哩 2026-03-24 00:00:00
42. 5万人抢光「阶跃龙虾」:3分钟一键部署,「养虾」终于变简单了
微信公众号 2026-03-16 00:00:00
43. #小米发布最新MiMo大模型#小米在2025年12月16日深夜闪电开源了全新MoE大模型MiMo-V2-Flash,凭借3090亿总参数和150亿活跃参数的“瘦身”设计,一举实现150 token/秒的极速响应和百万token输入0.1美元的超低成本,迅速引发行业热议。小米MiMo-V2-Flash的核心突破在于平衡性能与效率。它采用专家混合架构(MoE),每次推理仅激活150亿参数,通过混合注意力机制(128窗口滑动+全局注意力)支持256K长上下文,适用于多轮复杂任务。实测生成速度达150 token/秒,用户反馈“问题发出即出答案”,延迟低至毫秒级,成本仅为闭源模型的1/10。性能上,该模型在多项基准测试中与头部开源模型DeepSeek-V3.2持平甚至超越。技术负责人罗福莉(前DeepSeek核心研究员)的贡献是关键。她主导的自研R3路由重放技术解决了MoE模型强化学习的稳定性问题,确保训练到150步仍保持平稳。#老张聊科技# 小米发布最新mimo大模型
新浪微博 2025-12-17 00:00:00
44. #小米新模型什么水平#开源模型竞争从“唯性能论”转向“场景价值论”,小米MiMo-V2-Flash以“高性能+低门槛”组合拳,稳居新赛道第一梯队。3090亿参数的MoE架构并非噱头,73.4%的SWE-bench编程通过率刷新开源纪录,直逼闭源顶尖水平。其核心优势直击行业痛点:150 tokens/秒推理速度、每百万token最低0.1美元成本,搭配256k长上下文窗口,让大模型从实验室走向实用。混合滑动窗口注意力与多Token预测技术,实现效率与性能的双赢,而MIT全量开源策略更降低了开发者使用门槛。深度思考与联网搜索双模式,适配编程、创作等多元场景,完美契合小米“人车家全生态”布局。在性能趋同的当下,MiMo-V2-Flash用架构创新重构性价比标杆,既证明中国开源模型与顶尖水平差距缩至数月,更以“好用不贵”的特质,成为场景落地的优选基座。#秒懂热点就用智搜# 小米新模型什么水平
新浪微博 2025-12-17 00:00:00
45. 「Github一周热点100期」爆火的AI编程工具却被Claude封禁?
哔哩哔哩 2026-01-17 00:00:00
46. #小米首次登顶全球开源大模型第一#小米MiMo-V2.5-Pro登顶全球开源大模型第一了 Artificial Analysis榜单上并列第一、总榜前五、Agent指数也是开源第一音视图文感知全面超Claude Opus 4.6,TPS到了100-150 token/s,价格相比于V2 Pro砍半,速度和成本才是能不能上生产的关键门槛MiMo-2.5的Agent能力接近旗舰Pro版,价格直接对半砍,1M和256K上下文同价,夜间还打8折,良心两个模型都支持百万级上下文,还即将开源,这意味着开发者可以免费用全球顶级水平的Agent模型很多人可能还停留在“小米只是做手机的”,结果AI大模型已经全球开源第一了
新浪微博 2026-04-23 00:00:00
47. 给建议的AI看够了?MiniMax Agent 让AI直接住进你的电脑干活#AI新星计划#科技改变生活#MiniMAX#Agent#minimaxagent
抖音 2026-01-31 00:00:00
48. 2025过去了!这一年你是不是也在为AI焦虑? 老周用360一整年的实践,告诉你答案:不用怕,抓住Agent就赢了! 从我自己敲代码做100多个智能体,到带领团队All in,这条AI布道之路,全是实战干货。 2026,你想和智能体一起搞定啥?评论区留言,老周帮你研究!#大咖观察#2026 #年度总结 #红衣聊AI #agent
抖音 2025-12-31 00:00:00
49. 在我看来,小米此次发布的Xiaomi-Robotics-0机器人基座模型,无疑是国内机器人领域一次极具分量的技术突破。Benchmark榜单全面超越OpenVLA与Pi,直接宣告小米机器人模型正式迈入行业第一梯队,甚至称得上当前基座模型的实力天花板。从技术布局来看,小米AI正呈现出全面爆发的态势,继Mimo-flash拿下SOTA后,机器人模型接连交出重磅成果,大模型与机器人技术双线并进、协同发力,成长速度令人惊叹。坚持开源开放、用严谨论文与真实数据说话,也让行业看到了大厂的技术格局与担当。更值得肯定的是,小米并未停留在实验室层面,而是将触觉模型、灵巧手与基座模型深度结合,构建起“手脑协同”的完整技术栈,坚定走“进厂干活”的务实商用路线。不追逐浮躁概念,深耕落地场景,这种长期主义的技术投入,才是推动国内机器人行业真正进步的核心动力。#雷军公布小米机器人最新进展##小米发布机器人基座模型#
新浪微博 2026-02-12 00:00:00
50. #千问Qwen3.5大模型发布#阿里在除夕夜甩出了个王炸——全新大模型千问Qwen3.5开源了,看完参数我直接好家伙: 用了Mamba混合注意力+MoE稀疏专家架构,总参数3970亿,但每次推理只激活170亿,相当于“小身材干大活”,显存占用直接砍半还多,长文本处理速度直接起飞。终于从纯文本模型进化成原生多模态,以后图文交互、复杂任务处理更丝滑。性能直接对标顶级开源产品,关键是部署门槛低了一大截,不管是企业还是个人开发者,都能轻松玩起来。 与其说是发布新模型,不如说是把大模型的“技术普惠”又往前推了一大步。
新浪微博 2026-02-16 00:00:00
51. 「Github一周热点107期」OpenAI收购的AI安全工具、AI代理事务所、OpenClaw技能库、claude code插件和上下文数据库
哔哩哔哩 2026-03-21 00:00:00
52. 盘点一周AI大事(12月21日)|谷歌手撕OpenAI OpenAI 上线最强图像模型GPT Image 1.5 OpenAI发布最强编码模型GPT-5.2-Codex Google发布 Gemini 3 Flash Google开源A2UI协议 微软开源最强3D模型TRELLIS 2 阿里开源分层编辑图像模型Qwen-Image-Layered 阿里发布Veo 3平替Wan2.6 字节发布Veo 3平替Seedance 1.5 pro 腾讯开源首个实时交互世界模型WorldPlay 研究员开源照片重新对焦Genfocus Pipeline 研究员开源实时换脸视频模型PersonaLive Meta开源最强声音分割模型SAM Audio #抖音知识年终大赏 #AI新星计划 #OpenAI #AIGC #前沿科技趋势发布月
抖音 2025-12-21 00:00:00
53. #小米大模型#啥?小米大半夜发了3个模型~小米放大招,连发三个模型Xiaomi MiMo-V2-Pro & Omni & TTSXiaomi MiMo-V2-Pro 超1T参数,激活参数42B,上下文1M,混合注意力,混合比例7:1,专为agent而生,Claw榜单上,国内模型第一,见图2。MiMo-V2-Omni 全模态模型,对音频理解,图像理解,视频理解有较高的提升,同时具备了多模态感知、工具调用、函数执行及 GUI 操作能力。可直接接入现有agent框架,限时免费使用一周。Xiaomi MiMo-V2-TTS 语音合成模型,经过上亿小时语音数据的预训练与多维度强化学习,可以进行多粒度语音风格控制。
新浪微博 2026-03-19 00:00:00
54. #千问Qwen3.5大模型发布#千问 Qwen3.5 是采用极致稀疏 MoE 架构在保持超强性能的同时,显存占用降低 60%,推理效率大幅提升,部署成本显著下降。模型支持最高 256K 超长上下文,让长文本处理变的更加的轻松有效率了!原生多模态统一也是Qwen3.5的特点之一,也是目前国内外大模型的发展的主要趋势,模型在图文、视频理解能力全面升级,精准解析图表、文档与复杂视觉内容。实现了一个入口实现多种属性。Qwen3.5对于中小企业特别友好, 很大程度上降低了企业运营成本,可以让中小企业得到高效、普惠、全能的运营工具。不再因为高昂的费用而排斥企业去追逐AI。#过个有AI年##HOW I AI#
新浪微博 2026-02-16 00:00:00
55. 盘点一周AI大事2月8日|AI相亲、AI当老板、AI狼人杀 Anthropic发布最强大模型Claude Opus 4.6 OpenAI发布最强编码模型GPT5.3Codex OpenAI推出Codex桌面版 Google上线AI狼人杀 AI雇佣人类平台RentAHuman爆火 AI雇佣AI平台ClawTasks爆火 龙虾相亲平台MoltMatch爆火 智谱开源最强OCR模型GLM-OCR 字节发布最强视频模型Seedance 2.0 研究员开源无痕编辑视频模型Edit Yourself 字节开源最强分子预测模型Protenix-v1 Google发布论文配图AI Paper Banana #AI新星计划 #前沿科技趋势发布月 #AI #AIGC #OpenAI
抖音 2026-02-08 00:00:00
56. 盘点一周AI大事(1月4日)|Google包揽年度最佳模型 LMArena大模型盲选排行榜公布年度冠军 Google推出AI辅助学习系统Learn Your Way 阿里开源最强手机智能体MAI-UI DeepSeek发布新研究mHC IQuest发布最强开源编码模型IQuest-Coder-V1 字节发布动态概念大模型DLCM 腾讯发布最强开源翻译模型HY-MT1.5 阿里更新最强开源图像模型Qwen-Image-2512 Meta开源极速视频生成模型HiStream 研究员开源对象植入模型InsertAnywhere 研究员开源MV智能体AutoMV 腾讯开源3D动作生成模型Hunyuan Motion 1.0 研究员开源高保真3D模型UltraShape 研究员开源世界模型Yume 1.5 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #AIGC
抖音 2026-01-04 00:00:00
57. 神迹女娲救世关羽!首个挑杯BO9零封究竟有多少个细节?
哔哩哔哩 2026-01-05 00:00:00
58. 「Github一周热点第111期 」 Karpathy大神的Claude Code配置,更适合程序员的显示器RD270Q
哔哩哔哩 2026-04-18 00:00:00
59. 盘点一周AI大事(2月22日)|不赚钱拔网线,龙虾狂赚1万 工程师开源龙虾打工人ClawWork,10刀开局,7小时狂赚1万刀 工程师Sigil开源首个全自主智能体The Automaton Kimi上线云端龙虾Kimi Claw 网易开源桌面版龙虾LobsterAI Google上线地表最强大模型Gemini 3.1 Pro Gemini接入音乐模型 Lyria 3 NotebookLM升级,动动嘴就能修改PPT,还支持导出PPTX格式 Anthropic发布Claude Sonnet 4.6 Claude与Figma官宣史诗联动,Claude Code写的页面能一键导入Figma 阿里开源最强行动智能体 Mobile-Agent-v3.5 字节开源极速生图模型BitDance Tavus发布最强数字人模型Phoenix-4 Taalas研发出革命性AI芯片HC1 #抖音年味新知贺岁 #前沿科技趋势发布月 #AI新星计划 #OpenAI #智能体
抖音 2026-02-22 00:00:00
60. 你以为你看到的是AI的想法,实际上你看到的是: 人类行为模式的一次完整数字回放。#大咖观察 #红衣聊AI #人工智能技术 #agent #AGI
抖音 2026-02-02 00:00:00
61. 「Github一周热点103期」超轻量的clawdbot、编程智能体的记忆工具、聊天记录分析工具、视觉agent框架和键盘、鼠标统计工具
哔哩哔哩 2026-02-08 00:00:00
62. 「Github一周热点96期」Flux2绘图模型、腾讯的视频生成模型、AI记忆、开源Launchpad、笔记和知识库,Nginx可视化工具
哔哩哔哩 2025-12-06 00:00:00
63. 阶跃Step 3.7 Flash实测,又被AI上了一课
知乎 2026-05-29 00:00:00
64. 多模态 Agent 到底能干啥?我用 Step 3.7 Flash 跑了一遍
微信公众号 2026-05-29 00:00:00
65. 多模态智能体大模型Step 3.7 Flash开源了,平衡速度、成本和性能
今日头条 2026-05-29 00:00:00
66. 阶跃星辰开源Step 3.7 Flash大模型
今日头条 2026-05-29 00:00:00
67. Step 3.5 Flash(阶跃星辰) —— 测试数据报告 + 使用建议(工程 / 开发者版)/ 推理速度(最高≈350 token/s)、长上下文(可达256K)和Agent 多步稳定性
知乎 2026-02-03 00:00:00
68. 阶跃Step 3.5 Flash
知乎 2026-02-04 00:00:00
69. 99.9 分的数学推理、300+ tokens/s
微信公众号 2026-02-09 00:00:00
70. Step 3.7 Flash 开源
小红书 2026-05-29 00:00:00
71. 阶跃Step 3.7 Flash实测
微信公众号 2026-05-30 00:00:00
72. 阶跃发布并开源Step 3.7 Flash,“多快好省”拉高模型效率上限
今日头条 2026-05-29 00:00:00
73. 阶跃星辰全面开源Step 3.5 Flash
74. 阶跃星辰开源Step3.7Flash大模型速度翻倍
75. 阶跃星辰全面开源Step 3.5 Flash OpenClaw 调用量飙至 Top2
网易
76. 阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜
网易
77. 实测 Step 3.7 Flash ,10 秒写完 1000 行代码,生产级 Agent 的高效率模型
微信公众号 2026-05-31 00:00:00
78. 阶跃开源Step 3.7 Flash,主打生产级Agent的多模态MoE模型
今日头条 2026-05-29 00:00:00
79. 阶跃发布 Step 3.7 Flash,效率模型开始争夺 Agent 主战场
微信公众号 2026-05-30 00:00:00
80. 阶跃星辰开源 Step 3.7 Flash 模型
微信公众号 2026-05-30 00:00:00
81. 阶跃星辰发布并开源Step 3.7 Flash 推动Agent进入企业规模化生产流程
今日头条 2026-05-29 00:00:00
82. 【最快模型】智谱 GLM-5.1 高速版:400 tokens/s,智谱打破「快 = 小」的行业魔咒
微信公众号 2026-05-23 00:00:00
83. 阶跃星辰发布Step 3.7 Flash模型:智能体生产化的新突破
微信公众号 2026-05-29 00:00:00
84. 速度提升3倍,成本降低80%——阶跃Step 3.7 Flash:面向生产级Agent的高效率开源模型评测
微信公众号 2026-05-31 00:00:00
85. 2026年5月29日AI日报 | 模型能力再升级,长时Agent与企业落地成今日焦点
微信公众号 2026-05-29 00:00:00
86. 长文本推理王者!Claude Opus 4.7 霸榜:百万文档准确率碾压同行
什么值得买 2026-05-03 00:00:00
87. 阶跃 Step 3.7 Flash 上线 AtomGit AI,面向生产级 Agent 的高效率 Flash 模型
微信公众号 2026-05-30 00:00:00
88. 我踩过的坑:AI浏览器自动化3周血泪史
小红书 2026-04-07 00:00:00
89. 智谱把模型干到了 400 tokens/s,国产开始卷速度了
微信公众号 2026-05-25 00:00:00
90. 阶跃发布 Step 3.7 Flash:为生产级场景打造高效率 Agent 模型
今日头条 2026-05-29 00:00:00
91. 阶跃发布Step 3.7 Flash:一款为「烧钱时代」准备的Agent模型
今日头条 2026-05-30 00:00:00
92. 自动化总是翻车?我用 GPT5.4 + OpenClaw 实现了浏览器全自动化(附一键工具)
知乎 2026-03-09 00:00:00
93. 阶跃星辰发布并开源Step 3.7 Flash
今日头条 2026-05-29 00:00:00
94. 写代码像开了10倍速?智谱甩出400 tokens/s,国产旗舰模型首次做到"旗舰能力+急速响应"
微信公众号 2026-05-22 00:00:00
95. Flash模型,阶跃Step 3.7 Flash更懂Agent
微信公众号 2026-05-30 00:00:00
96. Claude 4.7长文本解析深度复盘:不止是窗口扩容,更是AI语义理解的质变
知乎 2026-05-13 00:00:00
97. 阶跃新模型快到“没推理”!印奇上任,果然气势一新
微信公众号 2026-02-03 00:00:00
98. AI驱动的浏览器自动化:browser-harness如何让LLM完成任何网页任务
微信公众号 2026-04-21 00:00:00
99. 美团LongCat-Flash-Lite:256k长上下文+高效MoE架构,开源大模型新标杆
微信公众号 2026-01-30 00:00:00
100. 阶跃开源 Step 3.7 Flash:面向生产级 Agent 的高效率 Flash 模型
微信公众号 2026-05-30 00:00:00
101. 阶跃开源Step 3.7 Flash:面向生产级Agent,最高生成速度每秒400 tokens
今日头条 2026-05-30 00:00:00
102. [零踩坑]谷歌深夜教你MTP投机解码:4090单显卡配置本地大模型投机解码,Qwen3.6 27B/Gemma4 提速2-3倍
微信公众号 2026-05-08 00:00:00
103. 阶跃发布Step 3.7Flash,特别适合高频、多轮的Agent场景
今日头条 2026-05-30 00:00:00
104. Agent原生模型开启!3.5 Flash上线2天登全球榜
今日头条 2026-02-06 00:00:00
105. 别再让AI烧Token了:CLI+Skill才是浏览器自动化的正确打开方式
今日头条 2026-04-20 00:00:00
106. OpenClaw 浏览器自动化实战:让小龙虾帮你操作网页(附踩坑指南)
微信公众号 2026-03-16 00:00:00
107. 阶跃星辰 Step 3.5 Flash 上线!更快更强更稳的 Agent 大脑,开源!
微信公众号 2026-02-02 00:00:00
108. 谷歌 Gemini 3.5 Flash 追随 Anthropic 和 OpenAI 的脚步,大幅提高新一代 AI 模型的价格
微信公众号 2026-05-21 00:00:00
109. 400 Token/s,原生多模态,阶跃星辰 Step 3.7 Flash 开源
微信公众号 2026-05-30 00:00:00
110. Flash 不是青春版,是Agent时代的刚需
小红书 2026-05-30 00:00:00
111. 浏览器自动化是什么?浏览器能够搭建自动化框架吗?
今日头条 2026-04-10 00:00:00
112. Claude Opus 4.7 发布:价格没变,但这些代码直接报 400
微信公众号 2026-04-17 00:00:00
113. 浏览器自动化完整指南:从 Selenium 到 AI Agent 时代
知乎 2026-05-06 00:00:00
114. 横评DeepSeek、Claude、GPT、Kimi,结果大跌眼镜……
百度 2026-04-28 00:00:00
115. 阶跃星辰Step 3.5 Flash实测
知乎 2026-02-09 00:00:00
116. 天数智芯Day 0适配阶跃星辰Step 3.7 Flash
微信公众号 2026-05-30 00:00:00
117. 智谱AI又放大招:GLM-Z1推理速度飙至200tokens/s,成本直降30倍,国产大模型进入"性能+效率"双赛道
微信公众号 2026-03-14 00:00:00
118. GPT-5.5与DeepSeek V4同日发布:闭源迭代与开源MoE架构的性能对标
微信公众号 2026-04-25 00:00:00
119. 【第11篇】OpenClaw 浏览器自动化:AI 帮你操控网页
微信公众号 2026-04-02 00:00:00
120. Claude Opus 4.7重磅上线!编程视觉双爆发,定价不变太良心
今日头条 2026-04-17 00:00:00
121. Opus 4.6 今天发布,10个关键变化 🔥
小红书 2026-02-06 00:00:00
122. 阶跃星辰Step 3.5 Flash上线两天登顶OpenRouter Trending榜单
今日头条 2026-02-05 00:00:00
123. VAKRA 之后:Agent 的失败模式要从经验判断变成可度量架构约束
微信公众号 2026-05-04 00:00:00
124. 多模态智能体大模型Step 3.7 Flash开源了,在速度、成本和性能之间取得平衡
知乎 2026-05-30 00:00:00
125. 浏览器自动化完整指南:从 Selenium 到 AI Agent 时代 - 哔哩哔哩
哔哩哔哩 2026-05-06 00:00:00
126. 一行代码破解Claude API国内调用难题!亲测稳如老狗
今日头条 2026-05-12 00:00:00
已收藏
去我的收藏夹