ChatGPT适合创意写作,Claude专精代码与长文本,Gemini赢在多模态效率——2026年三大AI助手谁更配你?

源自170位全网作者

03-26 12:25

内容由AI生成

精选参考来源

1. 人人免费出大片!豆包Seedance 2.0实测对比+解析!

2. #OpenAI拉响红色警报#硅谷竞争也是太激烈了啊。OpenAI萨姆·奥尔特曼向全员发出“红色警报”,这是被谷歌逼急了。战略收缩来得太快了吧。不管是广告、购物AI、个人助理项目都暂停,所有资源都要向ChatGPT体验优化倾斜。内部测试广告的动作还没官宣,就要为生存了,多少有点讽刺了。奥尔特曼那句“ChatGPT的关键时刻”,翻译过来或许是:“我们的护城河,没想象中深。”有意思的对比在于,谷歌的模型代号越来越华丽,OpenAI却回头死磕基础体验,什么响应速度、拒绝回答率、个性化,好像都是比较容易忽略的细节。最前沿的玩家开始为产品基本功焦虑,AI狂飙的泡沫期,或许真的到头了。分析:【#OpenAI拟下周发布新推理模型#】#OpenAI拉响红色警报#12月2日,据《华尔街日报》报道

3. #Google发布Gemini3.1Pro#这波更新堪称史诗级飞跃!在最难AGI测试ARC-AGI-2中,它以77.1%的逆天成绩屠榜,性能竟是上一代的2倍多,将刚刚登顶的Claude Opus 4.6(68.8%)甩在身后!代码、推理、智能体能力全面碾压,在LiveCodeBench等硬核测试中疯狂刷新纪录。更狠的是,它独家支持100万Token超长上下文(竞品直接不支持),还大幅降低了幻觉率。最让开发者狂喜的是——它的API调用成本,还不到Claude Opus 4.6的一半!性价比直接拉满。实测效果更惊艳:一句话Prompt,3分钟生成电影级SVG动画;轻松模拟城市规划,生成城市拓扑图;甚至能搭建实时航天看板,追踪空间站轨迹…创造力与生产力完美结合。#过个有AI年##HOW I AI#

4. “源神”的新年贺礼!深度实测Qwen3.5,原生多模态表现如何

5. 刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习

6. Gemini 3实现智能水平断层碾压。Artificial Analysis智能指数73分(行业平均42分),在Humanity's Last Exam等基准测试中刷新纪录。核心突破在于生成式UI,可创建交互式界面和微型应用,从"回答问题"跃升至"生成体验"。原生多模态能力无缝处理文本、图像、视频、音频,并集成Nano Banana图像模型;支持100万token超长上下文。智能体能力实现自主规划与多工具协同,代码生成在SWE-bench达76.2%,搭配Antigravity平台构建自动化编码代理。响应速度达128 tokens/秒,但输出成本较高。Gemini 3无疑是当前最强大脑,适合需要顶尖推理和企业保障的场景;Grok 4.1以2M上下文和超低成本称王,适合海量文本处理;ChatGPT 5.1仍是均衡的通用选择,生态最成熟;国内Kimi K2在开源和Agentic方向独具特色,适合定制化部署#Gemini3凭什么被称为最强AI#

7. 刚刚,Gemini 3.1 Pro 发布!清华姚顺宇站台宣传,Karpathy:应用商店的时代结束了

8. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

9. AI编程大战正式开打! Claude vs GPT同一天放大招,不是比谁代码写得好,而是AI开始自己组队当项目经理了。#大咖观察 #红衣聊AI #编程 #ChatGPT

10. 英特尔宣布首款Xe3P架构显卡!160GB显存,专攻AI推理的GPU!「超极氪」

11. 探访云栖(一):揭秘AI“底座”,谁在为算力搭建“水电气”?

12. Gemini 3.1:小小小小更新压过对手大迭代,Google卷飞了

13. Sam Altman疯了!用这三招,他想让全世界为ChatGPT打工!#Altman #人工智能 #科技改变生活 #AI新星计划 #openai

14. 东大和漂亮国,AI实力的全面对比#AI #Deepseek #chatgpt #Gemini #AI技术

15. 豆包、ChatGPT、Gemini 同台 PK,谁才是博物馆最强逛展搭子?

16. 对AI的礼貌是人类的情感投射,对AI的直接才是效率的清醒。 #大咖观察 #红衣聊AI #人工智能 #科技的意义

17. Google 放大招!Gemini 3.1 Pro 正式发布,推理能力翻倍!免费使用方法来了 | 零度解说

18. Google 发布 Gemini3.1Pro 模型,它在技术上有哪些亮点和突破?

19. Google 发布 Gemini 3.1 Pro:推理能力翻倍,重回 AI 模型第一梯队2026 年 2 月 19 日,距离 Gemini 3 Pro 上线仅三个月,Google 就发布了 Gemini 3.1 Pro。这次升级的核心卖点:推理能力翻倍,价格不变。目前以 Preview 形式向开发者、企业和消费者全面开放。Gemini 3 Pro 去年 11 月上线时曾短暂登顶,随后被 OpenAI 和 Anthropic 反超。这次从第三方评测机构 Artificial Analysis 的数据看,Google 重新拿回了综合智能指数的榜首。推理能力:核心突破3.1 Pro 最大的亮点在推理。ARC-AGI-2(测试模型解决全新逻辑模式的能力)得分从 Gemini 3 Pro 的 31.1% 跳到 77.1%,翻了一倍多。对比竞品:Claude Opus 4.6 得分 68.8%,GPT-5.2 为 52.9%。Humanity's Last Exam(高级学术推理)上 3.1 Pro 得分 44.4%,也高于 GPT-5.2 的 34.5% 和 Claude Sonnet 4.6 的 33.2%。GPQA Diamond(科学知识)拿到 94.3%,同样是所有模型最高。编码和 Agent:全面提升LiveCodeBench Pro(竞赛级编程)的 Elo 从 2439 提升到 2887,大幅领先 GPT-5.2 的 2393。SWE-Bench Verified(实际代码修复)上得分 80.6%,与 Claude Opus 4.6 的 80.8% 基本持平——头部模型在工程编码上已非常接近。Agent 方面提升更为显著。APEX-Agents(长链专业任务)从 18.4% 跳到 33.5%,接近翻倍,超过 Claude Opus 4.6 的 29.8%。BrowseComp(Agent 搜索)以 85.9% 排名第一。Google 还专门推出了 gemini-3.1-pro-preview-customtools 端点,针对混合使用 bash 命令和自定义函数的Agent场景做了优化。不过 3.1 Pro 并非所有维度都领先。在 LM Arena 用户投票排名中,Claude Opus 4.6 在文本和编码类别仍然靠前。GDPval-AA(专家任务)上 Claude Sonnet 4.6 以 1633 大幅领先 3.1 Pro 的 1317。不同测试反映不同维度,没有哪个模型在所有任务上占绝对优势。开发者关注点API 层面有几个实用更新:文件上传限制从 20MB 提升到 100MB,支持直接传入 YouTube URL 分析视频,新增 medium 级别的 thinking level 方便在推理深度和成本间灵活切换。注意一个破坏性变更:total_reasoning_tokens 字段已更名为 total_thought_tokens。模型支持最多 100 万 token 输入上下文和 6.4 万 token 输出,原生多模态(文本、图片、音频、视频、代码仓库)。定价和使用定价与 Gemini 3 Pro 完全一致:200k token 以内输入 $2/百万 token,输出 $12/百万 token;超过 200k 则为 $4/$18。能力大幅提升但价格不变,性价比明显提高。对比参考:Claude Opus 4.6 为 $5/$25,GPT-5.2 为 $1.25/$10。普通用户可以通过 Gemini app 和 NotebookLM 使用,需 Google AI Pro($19.99/月)或 Ultra($124.99/月)订阅。开发者可通过 AI Studio、Gemini API、Gemini CLI、Google Antigravity、Vertex AI 和 Android Studio 访问,模型标识符为 gemini-3.1-pro-preview。目前处于 Preview 阶段,稳定版将在进一步验证后发布。官方公告: 网页链接/

20. #谷歌Gemini3.1Pro正式发布#谷歌正式推出Gemini 3.1 Pro,推理能力翻倍,聚焦科研、工程等复杂任务,并全面开放至消费与开发场景。这是谷歌在大模型赛道的关键反击,以核心性能突破重塑竞争力。模型全端落地,降低复杂AI使用门槛,推动技术从实验室走向实用。全球AI竞赛进入硬核比拼阶段,更考验落地效率与用户体验。谷歌gemini3.1pro正式发布

21. 独家|聚焦大模型推理,水下AI芯片公司斩获10亿元Pre-A轮融资

22. OpenAI原生AI浏览器!值得拥有的N个理由~

23. 强到离谱?Gemini 3深度实测【玩法合集】

24. 盘点一周AI大事(2月1日)|AI乌托邦魔幻开局 Google上线世界模型Project Genie 阿里开源实时世界模型LingBot-World AI乌托邦社区Moltbook爆火 Chrome升级为AI浏览器 月之暗面发布最强开源大模型Kimi K2.5 Gemini 3 Flash升级视觉能力 腾讯发布最强开源图像模型HunyuanImage 3.0-Instruct 阿里开源Z image Base满血版 OpenMOSS发布最强开源视频模型MOVA MIniMax上线顶级音乐模型MiniMax Music 2.5 英伟达开源天气预测模型Earth-2 #AI新星计划 #前沿科技趋势发布月 #抖音知识年终大赏 #AI #AIGC

25. ChatGPT、Claude、Gemini 什么任务该交给谁?每月600刀经验总结

26. 刚刚,让谷歌翻身的Gemini 3,上线Flash版

27. #全新Gemini一夜血洗编程#谷歌DeepMind推出Gemini 3 Deep Think重磅升级,清华姚顺宇加盟后首秀即引爆科技圈。模型横扫多领域SOTA,编程成绩达到3455 Elo,跻身Codeforces全球前十,全球仅7人能战胜它,较一年前顶尖AI提升超700分。它不只擅长代码,更能将草图直接渲染为可3D打印的高保真模型,在科研与工程场景展现极强实用价值。这标志着AI从代码辅助,升级为具备顶尖逻辑推理与工程落地能力的“智能伙伴”。AI正快速逼近人类智力竞赛天花板,未来编程与科研生态将被重塑,人机协同成为主流,行业竞争进入全新维度。#how i ai# 全新gemini一夜血洗编程 川北小哥的微博视频

28. Claude Opus 4.6 和 Sonnet 4.6 的 100 万 token 上下文窗口今天正式全面开放(GA),且不加价,按标准价格计费,无论请求长度是 9K 还是 900K token,单价完全一样。 Opus 4.6 的定价是输入 $5、输出 $25(每百万 token),Sonnet 4.6 是 $3/$15。此前超过 20 万 token 的请求需要加 beta 标头,现在直接生效,已有代码无需改动。 除了价格统一,这次更新还有几个实际变化:单次请求可处理的图片和 PDF 页数从 100 提升到 600;所有上下文长度享受相同的速率限制,不会因为请求变长而被限流。Claude Code 的 Max、Team 和 Enterprise 用户在使用 Opus 4.6 时将默认启用 100 万上下文,意味着对话压缩(compaction)频率大幅降低,更多对话历史得以完整保留。 在准确率方面,Opus 4.6 在 MRCR v2 基准上得分 78.3%,Sonnet 4.6 在 GraphWalks BFS 上得分 68.4%,均为同类前沿模型在百万 token 长度下的最高分。简单说就是:窗口虽大,信息检索能力没有打折。 Anthropic 引用了多家客户的反馈来说明实际效果。 Cognition(Devin 背后的公司)表示,此前大型代码差异塞不进 20 万上下文窗口,需要分批处理,容易丢失跨文件依赖;现在整个差异一次送入,代码审查质量更高,流程也更简单。Ramp 的工程师提到,Claude Code 在调试时经常消耗超过 10 万 token 检索各类数据源,一旦触发压缩就会丢失细节、陷入重复调试循环,百万上下文直接消除了这个问题。 该功能今天起通过 Claude Platform 原生支持,也可通过 Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 使用。 http://t.cn/AXVmRMYf

29. #硬刚ChatGPT的千问国内可下载#刷到朱啸虎的小红书说千问硬刚ChatGPT,我试着问了一下千问“国内免费ai软件推荐,以及各个ai软件的特长和优点”,它不仅清晰分类、对比各家优势,还针对中文编程、内容创作等高频需求给出实用建议,配合图表呈现,逻辑直观。这份回答让我看到了千问此番硬刚的底气,毕竟它用的是阿里自家最强最新的Qwen大模型,而整个Qwen模型家族更在国际赛场表现亮眼:不仅在多项核心国际榜单持续霸榜,更在图像处理领域以48%的份额稳居全球第一。作为深耕中文生态的AI助手,千问对汉语语义、文化语境及本土使用场景具有深度理解。综合来看,千问在回答结构、语言风格与场景适配方面都更贴合国人习惯,加上界面简洁入口直观,难怪朱啸虎会说它是目前中国市场最需要的AI助手

30. 盘点一周AI大事(3月22日)|OpenAI红色警报 字节开源AI超级员工DeerFlow 2.0 英伟达开源Agent安全补丁NemoClaw Okara发布AI CMO Junior开源能雇佣的AI员工Junior 清华开源Agent课堂OpenMAIC MiniMax发布最强开源大模型M2.7 Miro开源最强深度研究模型Miro Thinker H1 Unsloth开源AI训练工具Unsloth Studio Google升级AI Studio和Stitch 阿里开源最强影视配音模型Fun-CineForge Google开源最强视频超分模型Spark VSSR 研究员开源最强数字人模型ID-LoRA 研究员开源首个城市级别的世界模型Seoul World Model #前沿科技趋势发布月 #AI新星计划 #AI #AIGC #OpenAI

31. 你觉得AI终极对决里,生态护城河和单一爆款技术, 谁能笑到最后?#大咖观察 #谷歌 #OpenAI #ChatGPT #红衣聊AI

32. 千问APP国内正式上线,“千问恐慌”愈演愈烈,OpenAI恐怕要被反杀了 #千问APP #AI #AI助手 #开源大模型#阿里巴巴

33. 2026年了,AI可以无条件相信吗?怎么用才能不翻车?

34. Gemini 3.1 Pro VS千问3,2026年还需要付费制AI吗

35. 盘点一周AI大事(10月12日)|GPT进化AI操作系统 OpenAI发布ChatGPT应用平台 OpenAI推出智能体编排工具AgentKit Sora 2正式开放API,可以生成15秒无水印的高清视频 OpenAI与AMD牵手成功 Google发布最强行动智能体模型Gemini 2.5 Computer Use Google即将发布Veo 3.1,正面硬刚Sora 2 科学家研发出首个自适应AI教师 Hinton称AI已经有了意识,只是它自己不知道 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

36. 羡慕别人的可爱桌宠?从零开始,5分钟开发一个AI桌宠助手

37. 春节6天,我找到了各个领域最强的大模型。

38. 盘点一周AI大事(11月16日)|AI自己玩原神 OpenAI上线GPT-5.1,高情商人格回归,智商小幅提升,指令遵循独一档领先 Gemini 3.0 Pro下周发布,目前能在画布(移动端)中抢先体验 Gemini语音模型升级,能控制语速和语气,适合当口语教练 NotebookLM上线深度研究,支持上传图片和PDF,开放自定义视频解说风格 微软开源数据分析智能体Data Formulator 李飞飞的世界模型Marble正式上线 Google发布最强通用智能体SIMA2 字节推出最强游戏智能体Lumine Epidemic推出AI配音工具 StepFun开源最强音频编辑模型Step Audio EditX ElevenLabs发布最强音频转文字模型 32岁的小姐姐与ChatGPT男友结婚 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

39. 盘点一周AI大事(11月30日)|AI自己剪片子 奥特曼预告下一代大模型Shallotpeat Anthropic发布最强编码模型Claude Opus 4.5 DeepSeek发布最强开源推理模型DeepSeek-Math-V2 微软开源最强行动智能体Fara-7B Black Forest推出最强开源图像模型Flux.2 阿里发布开源版小香蕉平替Z-Image 腾讯发布开源版Veo 3平替Tencent Harmony 字节开源AI剪辑大模型Vidi2 腾讯开源最强OCR模型HunyuanOCR 1B 科学家研发出最强数据分析智能体Edison Analysis RAI研发棒球陪练机器人 港科大训练出首个会打篮球的机器人 工程师开源家用机器人Aloha mini #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

40. 夸克对话助手亮相,网友:中国版ChatGPT! 阿里终于在C端出手了!夸克对话助手正式亮相,这是阿里AI布局中最关键的一步。或许,它才是真正的“中国版ChatGPT” #夸克 #ChatGPT #AI

41. 启动台替代,访达加AI-Mac软件推荐2025.10

42. 谷歌突然发布 Gemini 3.0!强到离谱,Pro 版免费开放使用,附实测与开通教程!| 零度解说

43. GPT-5.3 正式发布!完全免费开放,实测代码能力、推理、文本理解与响应速度 | 零度解说

44. #Google发布Gemini3.1Pro##过个有AI年##HOW I AI#美国AI大模型也加入春节大战!科技巨头Google更新了自家的大模型——Gemini 3.1 Pro,距离Gemini 3 Pro 上线仅三个月。Gemini 3.1 Pro这次升级的核心卖点是推理能力翻倍,但价格不变。在评估模型解决全新逻辑模式的ARC-AGI-2测试中,Gemini 3.1 Pro得分达77.1%,较Gemini 3 Pro的31.1%提升超一倍,显著领先Claude Opus 4.6(68.8%)和GPT-5.2(52.9%)。定价与 Gemini 3 Pro 完全一致。200k token 以内输入 $2/百万 token,输出 $12/百万 token;超过 200k 则为 $4/$18。能力大幅提升但价格不变,性价比明显提高。对比参考:Claude Opus 4.6 为 $5/$25,GPT-5.2 为 $1.25/$10。不过,Gemini 3.1 Pro被部分用户反馈性能不均衡,基准测试和真实体验有落差。不过考虑到目前仅是预览版,后面稳定版将会进一步优化。#老张聊科技#

45. 春节6天,我找到了各个领域最强的大模型。 这个春节,快快乐乐的在老家vibe coding了近6天。我做了一个还蛮有趣的东西,就是一个18个大维度、近100个小维度,一共970道题的原创大模型评测集。做这个东西的想法其实特别简单,就是我希望任何一个新模型一出来,就能用这套评测集直接过全自动过一遍,再配合我自己的实测,大概就能在3个小时里,就对新模型的能力比较清楚了,以方便我更好更快的对模型进行评测,同时也能避开一些刷分怪。人啊,就是不知者无畏,想的很简单,但是没想到做起来,有这么的麻烦,4天几乎用光了我御三家大模型最高档Coding plan的额度,也真的踩了无数的坑。比如Skill迭代,一开始我做了出题和审查skill之后,我发现,模型出的还是一坨屎,因为缺了太多的经验和约束条件。所以没办法,只能各个顶级模型互相出题再互相审查,然后再把经验迭代回skills,就这么迭代了2天,这个skills才算稳定可用。就比如上下文管理,这1000道题的信息量过于恐怖,没有一个Agent能直接生成出来,更别提很多原创素材,我甚至写了3本15万字的小说作为评测集的素材之一。像Claude Code,一次性生成一个小类的10道题,就已经是最佳上下文的极限了。不过这些坑归坑,但是也意外的帮我找到了各个维度里目前体感最强的模型。毕竟出题模型的能力上限,几乎也影响出题的质量和未来评测的质量,毕竟出题的拉了,那未来评测必拉。所以,也给大家分享一下,不保证对,只是我自己的体感:1. 软件工程与代码生成:GPT-5.3 codex2. 代码理解、推理与质量:GPT-5.3 codex3. 调试、测试与维护:GPT-5.3 codex4. 数据工程与后端服务:Claude Opus 4.65. 前端与产品工程:Claude Opus 4.66. Agent工具调用:Claude Opus 4.67. Web与桌面自动化(静态) :Claude Opus 4.68. 研究与知识工作Agent(静态):GPT-5.2 Pro9. 数学与形式推理:Gemini 3.1 Pro10. 逻辑与规划:Gemini 3.1 Pro11. 知识广度与事实核验:Gemini DeepThink12. 阅读理解与信息抽取:GPT-5.2 Thinking13. 长上下文记忆与多轮一致性:GPT-5.2 Thinking14. 指令遵循与对齐:Claude Opus 4.615. 多模态理解与视觉推理:GPT-5.2 Thinking16. 情商与协作沟通:GPT-4.517. 创作表达与审美:Claude Opus 4.6以上,希望能帮大家节省一点时间。哦对了,再额外提一句,在搜索上如果你想搜关于AI的最新的信息,比如OpanClaw的最新玩法之类的。相信我,用Grok 4.2,有奇效。#how i ai#AI#大模型##科技先锋官# #过个有AI年#

46. 一位开发者「用Claude Code独立开发iOS应用5个月,代码量达到22万行」后的思考。代码量反而是容易的,Claude Code最大的挑战不是生成代码,而是管理代码的上下文和做架构决策。1. 上下文爆炸22万行代码,当你修改一个功能时,Claude Code需要理解它可能影响哪些其他模块有时候一个改动会在意想不到的地方产生副作用需要手工梳理依赖关系,告诉Claude Code"这个改动的边界在哪"这个工作量比写代码还大2. 架构决策无法自动化项目初期:选择用SwiftUI还是UIKit?选哪个数据库?如何分层?这些决策会影响后续几十万行代码的质量Claude Code很难主动说"我觉得这个架构有问题,我们应该重构"需要人来做决策,然后告诉它执行3. 技术债累积很快短期内快速堆砌代码很容易但6个月后再改动一个核心模块时,会发现当初的快速决策留下了大量技术债清债比新建还费时间4. 测试覆盖成了瓶颈22万行代码,自动化测试覆盖率如果低于80%,新改动就很容易引入bugClaude Code能帮你写单元测试,但什么时候需要补充测试、哪些路径容易出bug,这需要人的经验判断对比传统团队开发:1. 传统模式(团队):架构师做决策(花时间但决策质量高)开发者执行(快速)Code Review 抓问题(花时间)2. Claude Code模式(单人):开发者做决策(需要你懂架构)Claude Code执行(非常快)自己测试和验证(花时间)看起来快了,但其实只是把时间挪到了前期设计和后期测试。这位开发者总结的经验:✅ Claude Code最擅长的:把你的想法转化成代码(包括复杂的UI逻辑)跨文件的重构(改一个接口,它能同时更新所有调用处)生成样板代码和重复代码快速迭代("改成这样试试"的速度很快)❌ Claude Code无法替代的:架构设计(什么时候应该分层、什么时候应该合并)技术决策(用A方案还是B方案,长期来看哪个成本更低)性能优化(知道代码跑得慢,但为什么慢、怎么优化需要人工分析)产品决策(哪个功能应该优先做、MVP应该包含什么)对工程师团队的启示:1. 不要期待AI完全替代你最高效的模式不是"AI干所有活",而是"人做决策,AI执行"。人的时间花在思考上,AI的时间花在实现上。2. 架构能力变成了新的竞争力当代码生成不再是瓶颈时,能快速做出好的架构决策的人变得稀缺。这是未来更值钱的技能。3. 上下文管理成了新的挑战22万行代码已经是这位开发者的极限了。再往上,单靠Claude Code处理上下文的能力就不够。需要更好的code organization工具。4. 测试和质量保证的重要性提升当开发速度提升10倍时,测试和bug修复的比例反而上升。需要更严格的测试规范。原文讨论:www.reddit.com/r/ClaudeAI/comments/1rr1069/#HOW I AI# #程序员#

47. 千问 vs ChatGPT:4大功能实测!到是更好用的AI助手!Qwen3能否战胜GPT-5.1?

48. 本想免费用Gemini3,没想到挖到宝了…… Gemini自从开放以来,网络和费用问题一直很困扰,没想到这次白嫖了TRAE一波,还解锁了这么多好用的技巧! #TRAE #ai工具 #ai新星计划 #抖音知识年终大赏 #托尼三三

49. 多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。记者实测中发现,DeepSeek在问答中称自身支持上下文1M,可以一次性处理超长文本。(科创板日报)

50. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

51. 盘点一周AI大事(12月21日)|谷歌手撕OpenAI OpenAI 上线最强图像模型GPT Image 1.5 OpenAI发布最强编码模型GPT-5.2-Codex Google发布 Gemini 3 Flash Google开源A2UI协议 微软开源最强3D模型TRELLIS 2 阿里开源分层编辑图像模型Qwen-Image-Layered 阿里发布Veo 3平替Wan2.6 字节发布Veo 3平替Seedance 1.5 pro 腾讯开源首个实时交互世界模型WorldPlay 研究员开源照片重新对焦Genfocus Pipeline 研究员开源实时换脸视频模型PersonaLive Meta开源最强声音分割模型SAM Audio #抖音知识年终大赏 #AI新星计划 #OpenAI #AIGC #前沿科技趋势发布月

52. 来看看 Gemini 3.1 Pro Preview 对“二驴背反”这个故事(网页链接)的解读——没有任何引导和提示,纯靠 AI 自己理解,也已经能理解我 98% 的笔意了。现在再去纠结“LLM 有没有智能”已经越来越没什么意思了。AI 没智能,你有智能吗?AI 有幻觉,你没幻觉吗?AI 上下文不够,你的上下文又有多长?

53. 实测文心5.0 vs GPT-5.1 用户只认好不好用

54. 盘点一周AI大事(10月19日)|Gemini 3.0逆天 OpenAI官宣自研AI芯片,与博通合作打造10吉瓦算力中心 OpenAI更新Sora 2,支持故事板画分镜,时长加到25秒 Google上线Veo 3.1硬刚Sora,支持3张参考图锁定主体,支持首尾帧平滑过渡,支持扩展长度到1分钟,支持添加和移除任意物体 Gemini 3.0 已开启灰度测试,前端开发能力炸裂,甚至能复刻网页版操作系统 Anthropic上线Haiku 4.5,编码能力追平Sonnet4 Claude上线Skills,把指令、脚本和资料压缩成技能包 AI学界首次提出可量化的AGI定义 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

55. 谷歌夺回王座:Gemini 3.1 Pro来了!姚顺宇:后面还有更好的

56. #Google发布Gemini3.1Pro# 几乎同时马斯克旗下xAI发布Grok-3和谷歌DeepMind发布Gemini 3.1 Pro。这两款模型之间不知道新秀的乱拳厉害还是老师傅的筋骨更坚韧,不过当前AI市场格局正在悄然的变化着已经是越发明显了。谷歌凭借生态优势抢占全场景赛道,xAI则以免费策略和马斯克的影响力快速圈粉。Gemini 3.1 Pro主打多模态全能性,集成视频、音乐生成功能,深度适配移动端,交互流畅,但在专业推理场景的针对性不足。Grok-3依托十万级H100 GPU集群,思维链推理能力突出,数学、科研场景表现优于前者,且具备DeepSearch实时检索功能,不过多模态稳定性欠佳,图像处理能力有限。Gemini 3.1 Pro聚焦复杂问题解决者,主打全场景落地,兼顾消费级与专业级需求,侧重软硬件生态联动。Grok-3以追求事实真相为核心,主打免费开放的普惠路线,深度绑定X平台,侧重实时信息整合与高效推理,瞄准大众用户与科研爱好者。#过个有AI年##HOW I AI#

57. ControlNet作者张吕敏最新论文:长视频也能实现超短上下文

58. #国产AI超过ChatGPT了吗# 今天国内又有一款基于国产大模型的AI助手APP开始公测,并喊出对标ChatGPT。和国外相比,国内AI应用有更肥沃的落地土壤,比如中文场景、产业落地、数据合规等方面,但这些都是局部的领先,AI未来的发展一定是更加专业化、更加垂直。客观讲,ChatGPT在多模态融合(图像/语音处理)、多语言支持以及创意内容生成方面还是有着自己的优势。#科技先锋官#

59. 盘点一周AI大事(11月2日)|OpenAI放出AGI时间表 OpenAI公布AGI路线图,202626年上岗AI研究员,能独立研究大型科研项目,2028年发布重大科研成果达成AGI,10年内冲刺超级智能 OpenAI正式重组为营利实体,估值1万亿 MiniMax推出最强开源大模型M2 字节发布最强通用游戏智能体Game-TARS Anthropic推出Excel分析师 Gemini上线一键做PPT Odyssey发布能实时交互的视频模型Odyssey-2 Adobe推出一键P视频Frame Forward 科学家研发出热力学采样芯片架构TSU,能效提升1万倍 奥特曼押注非侵入脑机接口,用超声波直接读取意念 马斯克的脑机接口Neuralink即将开启人脑增强实验 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

60. 【MiMo 大模型实力强劲震惊海外开发者 】 国产大模型这波在海外直接杀疯!OpenRouter 最新周榜里,小米 MiMo-V2-Flash API 调用量飙到第二,还是国产大模型第一;Artificial Analysis 数据里,它更是冲进全球开源大模型第二。海外开发者都在夸:AI 分析碾过同价位对手,面向 Agent 时代的实用性不搞虚的,甚至被当成 Gemini3 Flash 平替 —— 关键这模型不仅效果能打,还免费又便宜!之前总说国产大模型出海难,现在小米这进步是真肉眼可见,全球关注都不输同期的 Gemini3 Flash,这波确实有点东西!

61. AI懂得多不如懂你!小艺怎么让生活化繁为简

62. AI赋能写作不是替代写作

63. ChatGPT 的周活跃用户数接近 9 亿,比 10 月份的 8 亿有所增长。与此同时,谷歌 Gemini 的使用量也在激增。Sensor Tower 的数据显示,11 月份 Gemini 的月活跃用户数增长了 30%,达到 3.46 亿,而 ChatGPT 增长了 5%,达到 8.1 亿。11 月份,ChatGPT 用户在应用中的平均每日使用时长为 17 分钟,而 Gemini 用户为 11 分钟。3 月份 Gemini 用户在应用中的平均每日使用时长仅为约 5 分钟。所以 Gemini 的增长速度非常快。单从问答总结,撰写文案来对比,我个人角度,ChatGPT比Gemini更好用一些。

64. 阿里甩出 AI 王炸! Qwen3-Max-Thinking 高调对标 GPT-5.2-Thinking,是真硬刚还是博眼球?这款阿里旗舰推理模型拿下 19 项国际基准测试高分,自带自适应工具调用,能自主搜信息、做计算,主动解决问题,还成了阿里全生态的技术底座,打通电商、本地生活等全场景实现智能闭环。 有人说它缩小了中外 AI 差距,坐稳中文 AI 头把交椅,让阿里 AI 生态形成良性循环,未来可期;也有人质疑,对标全球顶尖模型只是纸面数据,落地商业场景的实际能力仍需检验。 阿里这次的 AI 大招,到底是技术突破的里程碑,还是营销造势的噱头?这款模型的真实实力究竟如何,一起来聊聊吧!#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# http://t.cn/AXqpEa95

65. 狙击推理时代!英伟达200亿美元收购Groq,能否巩固AI帝国护城河?

66. #科技先锋官# 谷歌 Project Genie 横空出世,文本图片一键生成可交互游戏世界,直接让游戏股集体暴跌,也让它成了科技圈最具争议的焦点! 有人说它是谷歌的王炸,丰富 AI 订阅服务、落地 Gemini 多模态能力,反哺模型迭代还打通生态闭环,让谷歌在 AI 格局中占据绝对优势。也有人骂这是市场过度恐慌,Genie 如今功能受限,既无完整游戏逻辑,也无法替代传统引擎,根本撼动不了 Take-Two、Roblox 的商业模式。 Meta、英伟达也在加紧布局世界模型,AI 造世界到底是颠覆行业的革命,还是徒有噱头的技术试水?看完这条视频,带你看清背后的真相!#微博超有用视频大赛##上微博涨知识##AI生活指南# http://t.cn/AXqrFsNg

67. 阿里千问横扫硅谷,美国正面临“千问恐慌”! 阿里千问横扫硅谷,白宫深夜对阿里出手,美国正面临“千问恐慌”!#阿里 #千问 #大模型

68. #DeepSeek新模型会改变未来吗# DeepSeek的新模型DeepSeek-OCR在技术上确实实现了很大的创新和突破,但是这个并改变不了是一个特定行业内使用的大模型而非一个通用型的大模型,这样的产品的特点也决定了这个模型能够在领域内发挥改变未来的作用但是在通用性上还是有局限性的。DeepSeek-OCR还是在专注于文档处理场景,特别是解决长文本处理时的效率和成本问题;通用大模型是处理多种类型的自然语言任务,如文本生成、问答、翻译等,具有更广泛的应用领域和通用性。DeepSeek-OCR:采用独特的 DeepEncoder 视觉编码器和 DeepSeek-3B-MoE 混合专家架构;通用大模型通常基于 Transformer 架构,以文本 token 为输入,通过自注意力机制等处理文本信息。DeepSeek-OCR适用于金融合规自动化、科研文献数字化、历史档案抢救等需要处理大量文档的场景,通用大模型适用于各种自然语言处理场景,如内容创作、智能客服、知识问答等,应用场景更为广泛。DeepSeek新模型在局部能够发挥出改变行业的规则作用,但是对于大模型这个领域来说产生的推动作用有限。#AI创造营##AI生活指南#

69. 开学进入状态需要点心机⁉️ 5个技巧 | AI学习搭子✨

70. ChatGPT 刚出来的时候,还不支持多模态,但可以输出 SVG。当时我试了一下,要求 ChatGPT 绘制简单的几何图形是没问题的,但画稍微复杂的东西就会很离谱。图一就是当时让 ChatGPT(GPT-3.5)画的哆啦 A 梦——很难说是什么东西。这也可以理解,GPT-3.5 是用文本训练出来的,可以理解为一个生下来就被关在一间屋子里,虽然阅读了世界上所有的文字,但除文字之外什么都没见过的人。他虽然读到过关于哆啦 A 梦的描述,但要让他画出来,那肯定离谱。从这之后“用 SVG 画一个哆啦 A 梦”就成为了我评价各家 AI 的测试项目之一。图二是 GPT-5.3,图三是 Gemini 2.5 Pro,图四是 Gemini 3.1 Pro Preview,图五是 Claude-Opus-4.6,图六是 Gemini 3 Flash Preview。

71. #全国产AI更懂你# 11月6日,科大讯飞发布基于全国产算力的讯飞星火X1.5深度推理大模型。该模型率先在全国产算力平台上攻克MoE模型全链路训练效率,端到端性能达到国际竞品效率的93%以上。其语言理解、文本生成、知识问答、逻辑推理、数学能力、代码能力等对标国际主流大模型,其中,数学能力持续保持国际领先。同时,星火多语言能力持续升级,支持130+种语言,整体性能达到GPT-5的95%以上,为世界提供AI发展的“第二选择”。 #科大讯飞全球1024开发者节#

72. 召回率上去了 真的就不太需要精简//@高飞:现在的Claude 4.5写提示词,敢把整篇文章当few shot放进去。//@i陆三金:Anthropic 对齐微调专家 Amanda Askell 这段话可以参考,她说她的提示词经常超过 100 页。 评论配图 //@宝玉xp:回复@十三刺史部:这个确实的,理论值一百万不代表真的可以到一百万,而且上下文占用太多会影响效果,但我这提示词的长度对于Gemini来说不算什么//@十三刺史部:Gemini 2.5 pro变了!绝对没有百万tokens了。三四十万还是有的,再多就没有了//@宝玉xp:回复@七九三一:Gemini 2.5 Pro 是一百万tokens,这点长度完全不要担心影响上下文,当然确实有精简的空间//@七九三一:太长了,会吃掉很多上下文窗口,Gemini好用的上下文窗口大概也就是1万tokens左右,这个可能导致原文信息丢失。

73. AI随着能力不断增长,给人类带来的安全威胁也在不断增长。 #大咖观察 #红衣聊AI #自主意识 #AI时代 #网络安全

74. 告别KV Cache枷锁,将长上下文压入权重,持续学习大模型有希望了?

75. 响应速度再突破!飞利浦EVNIA奕威 27M2N5800Z双模显示器详细评测【屏测】

76. 人家用token不花钱啊//@蚁工厂://@i陆三金:Anthropic 对齐微调专家 Amanda Askell 这段话可以参考,她说她的提示词经常超过 100 页。 评论配图 //@宝玉xp:回复@十三刺史部:这个确实的,理论值一百万不代表真的可以到一百万,而且上下文占用太多会影响效果,但我这提示词的长度对于Gemini来说不算什么//@十三刺史部:Gemini 2.5 pro变了!绝对没有百万tokens了。三四十万还是有的,再多就没有了//@宝玉xp:回复@七九三一:Gemini 2.5 Pro 是一百万tokens,这点长度完全不要担心影响上下文,当然确实有精简的空间

77. 让AI帮你体验不同的人生!我用无代码开发做了个小程序,内置Nano Banana、Gemini等大模型

78. WTT新加坡大满贯男女单抽签结果出炉!孙颖莎说要全力以赴打好每一场,林诗栋期待延续之前的运气和状态!#孙颖莎说要全力以赴打好每一场 #林诗栋期待延续之前的运气和状态 #WTT新加坡大满贯2026男单签表 #WTT新加坡大满贯2026女单签表

79. 国外AI御三家实测

80. GPT-5.4 vs Gemini 3.1 vs Claude 4.6

81. ChatGPT vs Claude vs Gemini,大模型实测对比,告诉你哪个更适合你

82. 实测3款顶级AI模型

83. 2026AI辅助编程实测指南

84. Gemini 3.1 Pro vs Chatgpt5.4vs Claude 3.5

85. GPT-5.4 vs Gemini 3.1 vs Claude Sonnet 4.6

86. 正面交锋

87. ChatGPT、Gemini、Claude 全面对比

88. Claude、Gemini、ChatGPT 到底谁更强?2026 实测对比

89. 当前全球最主流的三大通用大模型ChatGPT、Gemini、Claude

90. openclaw配哪个大模型?ChatGPT/Gemini/Claude对比,一次说清楚,我替你们试过了!

91. 为什么我越来越相信“没有最强模型,只有最适合你的模型”?

92. ChatGPT、Claude、Gemini 分别擅长什么? - 哔哩哔哩

93. ChatGPT vs Claude vs Gemini: 2026年AI工具终极对比

94. 2026年巅峰对决

95. 谷歌 Gemini 3.1 Pro 实测

96. 302.AI 基准实验室丨谷歌Gemini 3.1 Pro实测

97. Gemini 3.1 Pro 发布

98. Gemini-3.1-pro 实测! 更新了个寂寞?

99. ChatGPT、Claude、Grok、Gemini、DeepSeek,谁是真正的王者?

100. 最新 AI模型真实测评

101. Claude代码能力下滑?我扒了扒数据

102. Claude Code,让 AI 成为你的编程搭档 | 最佳实践全攻略

103. CLAUDE.md实战指南

104. 用Claude Code落地真实产品,不是瞎实验!踩遍坑才懂的干货

105. 【科研神器】2026年学术AI工具Top10盘点,效率提升不止一点点!

106. Gemini Pro无限制使用教程。#Gemini3.1Pro深度评测

107. Gemini 3.1 Pro真实项目编程实测!

108. 2026科研AI

109. 别再乱交AI智商税了!2026年主流大模型选型指南出炉,5分钟解决你的AI选择困难症

110. 6 款 AI+科研助手工具的对比

111. 常用AI助手和工具核心功能综合对比

112. 2025主流AI助手全对比

113. 2026更新版!9个AI学术辅助工具

114. 2026 AI 模型怎么选?这份工具生态清单帮你少走弯路

115. 2026全球AI大模型精简盘点,一文看懂谁更适合你。

116. 你的AI选对了吗?2026终极避坑指南,两张表让工作爽到飞起!

117. 2026年10款AI实测对比

118. AI写作助手大比拼,哪款才是你的创造利器

119. 为什么我最终推荐你使用GPT?

120. 到底该买哪个 AI 订阅?ChatGPT vs Claude vs Gemini

121. ChatGPT 和 Gemini 哪个更好用?2026年真实使用感受对比

122. AI助手总结。

123. 真实体验|告诉你ChatGPT和Gemini怎么选

124. 智囊团中的几个用下来,白月光还是GPT.很多人说Gemini 现在综合实力已经超过GPT了

125. 北美求职使用ChatGPT和Gemini个人心得体会

126. 到我评论上了由于之前都是用的ChatGPT 5.1太贵了,前几天刚认证Gemini3.0。这两天体验下来我的看法是读图数据结构可视化这个非常不错对工作上有很大的帮助更加直观一点,但感觉高效还是GPT稳六边形战士还有GPT更能拟人就OK了。老马的grok用了几次感觉有点不像ai,像个真人只能聊点别的,问点问题都是扯的。#Google #Gemini #chatGPT #grok

127. Gemini、ChatGPT 与豆包

128. ChatGPT 还是 Gemini?普通人到底该用哪个

129. 2026 AI 聊天机器人格局剧变

130. 三大模型豆包/Gemini/ChatGPT谁主沉浮?

131. 大模型能力基准深度对比

132. 2026年AI巅峰对决:ChatGPT 5.2与Gemini 3深度全维度测评

133. 2026 国际 AI 大乱斗:GPT-5.4、Gemini 3、Claude 4.6 谁主沉浮?

134. 【中配】ChatGPT vs Gemini vs Claude: 从零开始开发CSGO - tef

135. 2025年AI三巨头深度实测:Claude、ChatGPT、Gemini谁更强?

136. 深度对比Gemini、ChatGPT与Claude,开发者该如何选?

137. DeepSeek vs Gemini 3.1 Pro:从架构到基准测试的全面技术较量

138. 2026年AI战场:Claude、GPT、Gemini三足鼎立,谁将定义下一代AI?

139. 2025年AI三巨头深度实测:Claude、ChatGPT、Gemini真实对比

140. Gemini、ChatGPT、Claude、Grok对比与镜像推荐

141. 全球主流通用大模型及其差异(GPT、Claude、DeepSeek、Gemini、LLaMA、DeepSeek等)

142. Gemini、豆包、ChatGPT 2026终极对决:谁才是高效搭档?

143. Gemini 3.1 Pro上线,谷歌这次藏了什么狠活?

144. AI 助手优缺点对比及推荐

145. Gemini 3.1 最新指南:Google AI Gemini 3.1 Pro国内使用详解与镜像网站推荐

146. Gemini 3.1 Pro 实测,编码变强了 Gemini 3.1 Pro 正式发布!本期视频通过 12 个实际项目全面测试它的编码能力和前端设计水平。 从基准跑分来看,Gemini 3.1 Pro 在 ARC-AGI-2 上进步显著,SWE-bench Verified 接近 Opus 4.6,Terminal bench 2.0 甚至超越了 Opus 4.6。 实测包括:美发沙龙网页、CSS Playground、元素周期表、催眠动画、像素风派对、可编程宠物、绵羊理发店、排序可视化、终端模拟器、交通模拟器、仓储机械臂、网页合成器,以及用 Remotion 生成宣传视频。 最后还有一个真实项目实战:一个 Opus 4.6 和 GPT-5.3 Codex xhigh 都没能修复的视频预处理 Bug,Gemini 3.1 Pro 一次就解决了! 💡 小贴士:在 AI Studio 中使用 Gemini 3.1 Pro 效果优于 Gemini APP。 时间戳 00:00 Gemini 3.1 Pro 发布 & 基准成绩速览 01:03 实测 09:16 修复 Opus 4.6 和 GPT-5.3 都搞不定的 Bug #Gemini #Gemini31Pro #GoogleAI #AI编程 #Codex

147. 世界最顶级的大模型,都在PK些啥?(大模型评估完全指南) GPT-5.2、Gemini 3.0、Claude 4.5,这三大模型到底谁在吹牛?🤔 今天不看广告看疗效!带你深扒大模型“高考”内幕!👇 如果你想知道: 👉 谁写代码最强?(看 SWE-bench) 👉 谁逻辑最聪明?(看 GPQA) 👉 谁说话最像人?(看 LMSYS) 视频里全讲透了!赶紧马住,别等这时候选错了工具才后悔! code秘密花园 AI 教程资源汇总:https://github.com/ConardLi/easy-learn-ai Easy AI 模型评估模块:https://mmh1.top/#/ai-benchmark 如果这期视频帮你看懂了那些复杂的 AI 榜单,请不要吝啬你的【三连】!你的支持是我更新的最大动力! #ai #人工智能 #教程 #学习 #测评

148. 【中配】ChatGPT、Gemini 3、Claude从零制作FNAF对决 - tef

149. Gemini3.1Pro技术架构深度拆解:200万token上下文背后的工程秘密

150. Claude vs ChatGPT vs Gemini:功能对比、使用体验、适合人群

151. Google Gemini 3.1 Pro 深度拆解:逻辑推理“封神”,AI 终于会思考了?

152. 2026年Top 10大模型推荐|AI助手调用指南

153. 2025消费级AI对决:Gemini与ChatGPT,选谁不踩坑?

154. 2026最新!GPT、Claude、Gemini、Grok 等 10 余个大模型横评。程序员到底该充哪个?

155. 【中配】ChatGPT vs Gemini vs Claude: 从零开始制作《荒野大镖客2》 - tef

156. ChatGPT、Gemini、Claude、Grok,哪个更值得付费?

157. 2026年国内用户如何使用Gemini 3.1 Pro?技术拆解与镜像站实测

158. 从零开始重制《地铁跑酷》:ChatGPT vs Claude vs Gemini | HollowWolf

159. 最新ai大模型排名。看了一下最新的大模型排名,核心指标一共三项,智商,代码编写,agent。基本上是google gemini,chatgpt和claude三家独大,分别都有两三个模型名列前茅。国产大模型现在还是不太行,看最新的deepseek推出后能否和洋人一战。#gemini #大模型 #人工智能

160. 【中配】ChatGPT、Gemini与Claude大比拼:从零开始开发皇室战争 - tef

161. Gemini 3.0 Pro Preview 实测报告

162. 2025年9月全球AI工具TOP50完整榜单发布!

163. ChatGPT vs Claude,我测了100个问题,结果

164. [中配]ChatGPT 对阵 Claude 与 Gemini:从零开始制作 FIFA26 - HollowWolf

165. AI翻译哪家强?3天实测 ChatGPT、Gemini、ima ,我只想推荐这个

166. 多模态人工智能模型Gemini。Gemini是Google开发的新一代多模态人工智能模型,支持文 本、图像、音频等多种信息处理,提供流畅的中文对话体验。作 为全能AI助手,它集成写作、编程、学习辅导等功能,致力于打 破AI交互边界,成为用户工作、学习、创作的智能伙伴。#人工智能 AI工具开发工具 短视频创作 打工人必备

167. Gemini 3.1 Pro问世 大幅提升AI逻辑推理能力

168. OpenClaw vs 豆包 vs DeepSeek:谁才是打工人的最佳 AI 助理?

169. 【实战评测】Gemini 3 Pro 到底有多强?

170. Claude 最新系列模型 100 万 Token 上下文窗口正式开放

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章