国产镜像站实测:Claude中文长文本与代码生成全面领先,GPT上下文易断裂、Gemini多模态更强
04-15 10:06
精选参考来源
精选参考来源
1. 如何评价OpenAI最新发布的GPT-5.4 mini和GPT-5.4 Nano?
知乎 2026-03-18 00:00:00
2. 最强AI视频工作流:自动量产高质量短视频,无需剪辑,真正一键成片!
哔哩哔哩 2025-11-25 00:00:00
3. 今天是2025小鹏科技日,也是第七届小鹏科技日过去6年时间,那些当年看上去天马行空的想法,都在逐步成为现实2019年提出高速自动驾驶将商用2020年提出自动驾驶将全国普及2021年提出飞行汽车的概念2022年提出智能机器人计划2023年提出将实现2万美元辅助驾驶2024年提出下一代超级增程今年的科技日核心,聚焦在了物理AI,之前何小鹏聊到过“物理AI”的核心理念,就是通过融合数字与物理世界的操作系统、数据以及物理运动能力,形成全新的智能形态#大v聊车##何小鹏首次披露物理AI巨大进展#
新浪微博 2025-11-05 00:00:00
4. 强到离谱?Gemini 3深度实测【玩法合集】
哔哩哔哩 2025-11-20 00:00:00
5. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型
抖音 2025-12-12 00:00:00
6. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人
抖音 2025-12-07 00:00:00
7. 刚刚,奥特曼砸场发布 GPT-5.4!网友:一句 Hi 烧掉 80 美元
微信公众号 2026-03-06 00:00:00
8. 连Claude死忠粉都换GPT-5.4了,OpenClaw省47%,Token半价碾压Opus!
微信公众号 2026-03-06 00:00:00
9. Gemini 3.1 Pro 与 Claude Sonnet 4.6 深度对比:2026 年性价比之王花落谁家
微信公众号 2026-02-26 00:00:00
10. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格
哔哩哔哩 2026-02-17 00:00:00
11. #26年春节AI神仙打架#春节是消费级流量高峰,既能借红包大战、春晚合作实现规模化实测,又能为节后政企数字化合作卡位,叠加年末技术研发周期,形成“春节档赛马”惯例。 国产模型凭借本土化优势存在感拉满。字节豆包绑定央视春晚,推出AI春联、老照片焕新等玩法;阿里千问打通淘宝、支付宝,聚焦年货比价等实用功能;百度文心助手以2亿月活站稳入口,深耕教育、健康场景。海外模型如GPT - 5.3、Claude Sonnet 4.7虽技术强劲,但在春节场景适配度上稍逊。 个人认为,2月国内最强模型或为阿里千问Qwen 3.5,其数学推理与代码能力突出,还能联动商业生态;国外则是GPT - 5.3,凭借长期技术积累和生态优势,仍是行业标杆。 http://t.cn/AX5A6yke
新浪微博 2026-02-03 00:00:00
12. GPT-5.4 mini——让AI从“奢侈品”变“快消品” OpenAI的GPT-5.4 mini/nano是AI界的“价格屠夫”——把AI从顶级会所搬到便利店,从82年拉菲变罐装快乐水。 价格表震撼:GPT-5.4旗舰输出15美元/百万token,mini只要4.5美元(三折),nano仅1.25美元(骨折价)。以前用大模型钱包发抖,现在用nano像刷短视频流量——便宜到任性。 性能几乎没缩水。mini在编程基准SWE-bench Pro拿54.4分,仅比旗舰57.7差3.3点——差距小如米其林和大牌档,价格差十倍。OSWorld测试中,mini拿72.1分近人类基线72.4,能当“数字白领”。 技术是动态稀疏架构:只激活任务所需参数,算力用在刀刃。像大厨做饭,以前整支团队动,现在只动手,其他休息省电。 AI服务分层明码标价:免费层(ChatGPT用mini)、经济层(API调用nano)、尊享层(旗舰深度推理)。AI像手机流量包按需用:轻度用户“5元包月”,重度“无限流量”。 边缘设备AI化是新蓝海。nano小到塞进智能手表、扫地机器人、车载系统,AI从云端走向指尖。想象手表回消息,扫地机避拖鞋——本地运行,隐私无忧。 但快消化带来AI过载焦虑。以前担心用不起,未来担心忍不住乱用——每天刷百万token,月底账单如流量超支。可能出“AI省流助手”,提醒“今日用20万token,切文字模式?” GPT-5.4 mini/nano标志AI从“实验室奢侈品”转“大众快消品”。当算力成本非门槛,创造力才是稀缺资源。未来考验的不是你有没有AI,而是你如何用好AI。 数据来源:OpenAI发布文档,SWE-bench Pro、OSWorld-verified基准测试,API定价公开数据。#微博影像年##微博旅行家##ai创造营#
新浪微博 2026-03-24 00:00:00
13. OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了
知乎 2026-03-06 00:00:00
14. 16项测试赢了13项!Gemini 3.1 Pro碾压GPT-5.2和Claude
微信公众号 2026-02-20 00:00:00
15. 编程新基准CursorBench:GPT-5.4拿下第一!
知乎 2026-03-15 00:00:00
16. 【AI辅助设计】GPT-5.4 会做前端了,但更重要的是:OpenAI 开始认真谈“审美”了
微信公众号 2026-03-24 00:00:00
17. GPT-5.4 到底变强了多少?三大核心能力+电脑操控Codex上手实测!
微信公众号 2026-03-09 00:00:00
18. Claude Opus 4.6一天内被超两次,这次来自国产模型
微信公众号 2026-04-08 00:00:00
19. Claude Opus 4.6 和 Sonnet 4.6 的 100 万 token 上下文窗口今天正式全面开放(GA),且不加价,按标准价格计费,无论请求长度是 9K 还是 900K token,单价完全一样。 Opus 4.6 的定价是输入 $5、输出 $25(每百万 token),Sonnet 4.6 是 $3/$15。此前超过 20 万 token 的请求需要加 beta 标头,现在直接生效,已有代码无需改动。 除了价格统一,这次更新还有几个实际变化:单次请求可处理的图片和 PDF 页数从 100 提升到 600;所有上下文长度享受相同的速率限制,不会因为请求变长而被限流。Claude Code 的 Max、Team 和 Enterprise 用户在使用 Opus 4.6 时将默认启用 100 万上下文,意味着对话压缩(compaction)频率大幅降低,更多对话历史得以完整保留。 在准确率方面,Opus 4.6 在 MRCR v2 基准上得分 78.3%,Sonnet 4.6 在 GraphWalks BFS 上得分 68.4%,均为同类前沿模型在百万 token 长度下的最高分。简单说就是:窗口虽大,信息检索能力没有打折。 Anthropic 引用了多家客户的反馈来说明实际效果。 Cognition(Devin 背后的公司)表示,此前大型代码差异塞不进 20 万上下文窗口,需要分批处理,容易丢失跨文件依赖;现在整个差异一次送入,代码审查质量更高,流程也更简单。Ramp 的工程师提到,Claude Code 在调试时经常消耗超过 10 万 token 检索各类数据源,一旦触发压缩就会丢失细节、陷入重复调试循环,百万上下文直接消除了这个问题。 该功能今天起通过 Claude Platform 原生支持,也可通过 Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 使用。 http://t.cn/AXVmRMYf
新浪微博 2026-03-14 00:00:00
20. 对比明明白白3大顶级模型-GPT-5.2/Gemini 3/Claude Opus 4.5!老金告诉你怎么一个窗口全用!
微信公众号 2025-12-16 00:00:00
21. Sonnet 4.6深夜爆更,逆袭Opus!Claude春节大礼,全球软件股又崩了
知乎 2026-02-18 00:00:00
22. Anthropic新开发了一个仅对“Project Glasswing”合作企业开放的新模型Mythos,主要用于网络安全漏洞识别。除了拥有顶尖的自动化漏洞发现能力,Mythos在代码生成、学术推理、网络安全测试等维度上也大幅超过Opus 4.6。目前Anthropic官方表明该模型暂不对外开放,未来将致力于开发用户能安全使用的同等级别模型。#GenJiAI观察室##AI##Anthropic推出新模型#
新浪微博 2026-04-09 00:00:00
23. Gemini 3.1 Pro VS千问3,2026年还需要付费制AI吗
哔哩哔哩 2026-03-20 00:00:00
24. Google 发布 Gemini3.1Pro 模型,它在技术上有哪些亮点和突破?
知乎 2026-02-20 00:00:00
25. OpenAI 重磅发布 GPT-5.2!效果惊人实测 ,附最新免费使用方法,切勿错过! | 零度解说
哔哩哔哩 2025-12-13 00:00:00
26. 突发!Claude Opus 4.5编程世界第一,把谷歌OpenAI踢下王座
知乎 2025-11-25 00:00:00
27. OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3
知乎 2025-11-20 00:00:00
28. 如何看待最新发布的GPT-5.4 模型,能力较之前有何种提升?
知乎 2026-03-08 00:00:00
29. #谷歌Gemini3.1Pro正式发布# 谷歌于今日正式推出升级核心模型Gemini 3.1 Pro。其实现了推理能力的跨越式升级,ARC-AGI-2测试得分达77.1%,较上代翻倍且大幅领先竞品。学术科研能力行业登顶,GPQA Diamond科学测试拿下94.3%高分,博士级专业处理能力突出。 与此同时,Gemini 3.1 Pro编程与智能体能力跻身第一梯队,竞赛级编程表现领跑,工程代码修复比肩顶尖水平,长链任务能力近翻倍。同时支持百万token上下文,全模态原生理解,可高效适配科研、开发等全场景复杂任务。
新浪微博 2026-02-20 00:00:00
30. 刚刚,Gemini 3 再次大更新!全球免费享 Pro 级智商,奥特曼又要失眠了
微信公众号 2025-12-18 00:00:00
31. GPT-5.3 正式发布!完全免费开放,实测代码能力、推理、文本理解与响应速度 | 零度解说
哔哩哔哩 2026-03-06 00:00:00
32. OpenAI 发布 GPT-5.4,定位为专业工作场景的旗舰模型,同步推出面向高复杂任务的 GPT-5.4 Pro 版本。这次发布的最大亮点是 GPT-5.4 成为 OpenAI 首个原生支持"电脑操控"(Computer Use)的通用模型——也就是说,它可以像人一样通过截图、点击鼠标、敲击键盘来操作真实的电脑界面。在 OSWorld-Verified 桌面操控测试中,GPT-5.4 以 75% 的成功率超过人类(72.4%),而上一代 GPT-5.2 只有 47.3%。在知识类工作方面,GPT-5.4 在涵盖 44 种职业的 GDPval 基准测试中,与行业专业人士打平或胜出的比例达到 83%,GPT-5.2 的这一数字是 70.9%。投行建模任务的内部评测得分从 68.4% 跳升到 87.3%,生成演示文稿的效果在人工评审中有 68% 的概率优于前代。编程能力上,GPT-5.4 整合了此前专为写代码设计的 GPT-5.3-Codex 的能力,在 SWE-Bench Pro 上得分 57.7%,与 GPT-5.3-Codex 的 56.8% 相当,但延迟更低。另一个实用改进是"工具搜索"(Tool Search):以往给模型配备大量外部工具时,所有工具定义都要塞进提示词里,动辄消耗数万个 token。GPT-5.4 改为按需查找工具,在测试中将 token 消耗减少了 47%,对于依赖大量 MCP 工具的开发者来说成本节省明显。在 ChatGPT 中,GPT-5.4 Thinking 将支持在生成过程中展示思考计划,用户可以中途介入调整方向——不用等模型跑完再重新来过。定价方面,API 输入价格从 GPT-5.2 的每百万 token 1.75 美元涨至 2.50 美元,输出价格从 14 美元涨至 15 美元。GPT-5.4 今天起向 ChatGPT Plus、Team、Pro 用户开放,取代 GPT-5.2 Thinking 成为默认推理模型,GPT-5.2 Thinking 将在三个月后于 2026 年 6 月 5 日正式退役。
新浪微博 2026-03-06 00:00:00
33. GLM-5深夜登场,这是国产开源模型首次逼平Claude Opus 4.5。
知乎 2026-02-12 00:00:00
34. 如何评价 Anthropic 最新发布的 Claude Opus 4.6?有哪些技术亮点值得关注?
知乎 2026-02-06 00:00:00
35. GPT-5.4据传下周上线!200万上下文窗口+持久化状态,告别频繁遗忘
知乎 2026-03-02 00:00:00
36. #Google发布Gemini3.1Pro# 2 月 19 日,Google 就发布了 Gemini 3.1 Pro,从第三方评测机构 Artificial Analysis 的数据看,Google 重新拿回了综合智能指数的榜首。3.1 Pro 最大的亮点在推理。ARC-AGI-2(测试模型解决全新逻辑模式的能力)得分从 Gemini 3 Pro 的 31.1% 跳到 77.1%,翻了一倍多。对比竞品:Claude Opus 4.6 得分 68.8%,GPT-5.2 为 52.9%。Humanity's Last Exam(高级学术推理)上 3.1 Pro 得分 44.4%,也高于 GPT-5.2 的 34.5% 和 Claude Sonnet 4.6 的 33.2%。GPQA Diamond(科学知识)拿到 94.3%,同样是所有模型最高。#过个有AI年##HOW I AI#
新浪微博 2026-02-20 00:00:00
37. 【AI前沿】GPT 5.4 有多强?看看vibecoding作品
微信公众号 2026-03-06 00:00:00
38. GPT-5.4突袭上线:能直接操控电脑,全能无短板,就是有点费钱?
微信公众号 2026-03-06 00:00:00
39. Google 发布 Gemini 3.1 Pro:推理能力翻倍,重回 AI 模型第一梯队2026 年 2 月 19 日,距离 Gemini 3 Pro 上线仅三个月,Google 就发布了 Gemini 3.1 Pro。这次升级的核心卖点:推理能力翻倍,价格不变。目前以 Preview 形式向开发者、企业和消费者全面开放。Gemini 3 Pro 去年 11 月上线时曾短暂登顶,随后被 OpenAI 和 Anthropic 反超。这次从第三方评测机构 Artificial Analysis 的数据看,Google 重新拿回了综合智能指数的榜首。推理能力:核心突破3.1 Pro 最大的亮点在推理。ARC-AGI-2(测试模型解决全新逻辑模式的能力)得分从 Gemini 3 Pro 的 31.1% 跳到 77.1%,翻了一倍多。对比竞品:Claude Opus 4.6 得分 68.8%,GPT-5.2 为 52.9%。Humanity's Last Exam(高级学术推理)上 3.1 Pro 得分 44.4%,也高于 GPT-5.2 的 34.5% 和 Claude Sonnet 4.6 的 33.2%。GPQA Diamond(科学知识)拿到 94.3%,同样是所有模型最高。编码和 Agent:全面提升LiveCodeBench Pro(竞赛级编程)的 Elo 从 2439 提升到 2887,大幅领先 GPT-5.2 的 2393。SWE-Bench Verified(实际代码修复)上得分 80.6%,与 Claude Opus 4.6 的 80.8% 基本持平——头部模型在工程编码上已非常接近。Agent 方面提升更为显著。APEX-Agents(长链专业任务)从 18.4% 跳到 33.5%,接近翻倍,超过 Claude Opus 4.6 的 29.8%。BrowseComp(Agent 搜索)以 85.9% 排名第一。Google 还专门推出了 gemini-3.1-pro-preview-customtools 端点,针对混合使用 bash 命令和自定义函数的Agent场景做了优化。不过 3.1 Pro 并非所有维度都领先。在 LM Arena 用户投票排名中,Claude Opus 4.6 在文本和编码类别仍然靠前。GDPval-AA(专家任务)上 Claude Sonnet 4.6 以 1633 大幅领先 3.1 Pro 的 1317。不同测试反映不同维度,没有哪个模型在所有任务上占绝对优势。开发者关注点API 层面有几个实用更新:文件上传限制从 20MB 提升到 100MB,支持直接传入 YouTube URL 分析视频,新增 medium 级别的 thinking level 方便在推理深度和成本间灵活切换。注意一个破坏性变更:total_reasoning_tokens 字段已更名为 total_thought_tokens。模型支持最多 100 万 token 输入上下文和 6.4 万 token 输出,原生多模态(文本、图片、音频、视频、代码仓库)。定价和使用定价与 Gemini 3 Pro 完全一致:200k token 以内输入 $2/百万 token,输出 $12/百万 token;超过 200k 则为 $4/$18。能力大幅提升但价格不变,性价比明显提高。对比参考:Claude Opus 4.6 为 $5/$25,GPT-5.2 为 $1.25/$10。普通用户可以通过 Gemini app 和 NotebookLM 使用,需 Google AI Pro($19.99/月)或 Ultra($124.99/月)订阅。开发者可通过 AI Studio、Gemini API、Gemini CLI、Google Antigravity、Vertex AI 和 Android Studio 访问,模型标识符为 gemini-3.1-pro-preview。目前处于 Preview 阶段,稳定版将在进一步验证后发布。官方公告: 网页链接/
新浪微博 2026-02-20 00:00:00
40. GPT‑5.4深夜发布,百万网友“养”的龙虾,终于有了灵魂
微信公众号 2026-03-06 00:00:00
41. Gemini 3 Pro比之前的2.5确实好非常多,分析,做图像视频都很厉害。但个人感觉,还不到能取代gpt 5.1 thinking的强度。尤其GPT “长期记忆”这一块很强,也已经被我训成很懂我的工作合伙人了,这部分太难替代。各有千秋吧,我自己还是要两个都用。AI总结:Gemini 更像“超级检索式分析器”GPT-5.1 更像“策略家 + 思考伙伴”纯信息密度 & 资料整合能力:Gemini 3 Pro 更强多层推理、跨主题整合、结构化深度分析:GPT-5.1 Thinking更强Gemini 3 Pro 的优势多模态 & 超大上下文处理。Gemini 3 Pro 支持文本、图像、视频、PDF 等多种输入模态,也能处理非常长的上下文 (比如大量文档 / 长篇报告 /大数据集) — 这是它的一大杀手锏。逻辑推理 + 数理 / 复杂任务处理能力强。在多个基准测试 (数学、逻辑推理、视觉 + 推理、多模态理解等) 中,Gemini 3 Pro 的成绩在很多项都超过 GPT-5.1。擅长“重”/“大规模”内容处理 + 综合型任务。如果你的任务需要跨文档整合、图文混合分析 (比如政策 + 数据表 + 图表 + 图片)、长时间 context 的研究 — Gemini 会表现得更稳定。GPT-5.1 Pro / Thinking 的优势自适应推理 + 工具 / 代理 整合 + 高效对话 / 编码工作流程。GPT-5.1 最新版本 (Pro / Thinking) 强调“根据任务难度自动分配思考资源 + 支持工具调用 / 代码执行 / 多轮对话 + 稳定性 / 开发者友好性”。更适合迭代、动态交互、对话与写作 / 编码。比如你做写作、策略分析、代码编写、快速原型、反复调整 prompt/输出 — GPT-5.1 在速度、连贯性、开发者体验上往往更顺手。在“记忆准确性 / 长对话稳定性 / 多轮交互”方面表现不俗。对于需要持续对话、多轮迭代、状态保持、复杂 prompt chain 的任务,GPT-5.1 更擅长维护连贯和响应一致性。#人工智能#
新浪微博 2025-12-02 00:00:00
42. 刚刚,Anthropic祭出最强Claude Mythos!暴击Opus 4.6,跪求千万别用
知乎 2026-04-08 00:00:00
43. 刚刚,小扎砸143亿的「牛油果」来了!硬刚GPT-5.4,硅谷最贵华人首作
知乎 2026-04-09 00:00:00
44. 【必收藏】Nano Banana 免费入口全汇总!6个高品质 AI 绘图渠道,最后一个多模型对比必备!想免费体验 Nano Banana 的顶级 AI 绘图能力吗?为你整理了 6 个官方和高质量的免费入口,让你轻松上手,快速出图!Nano Banana 免费入口速查指南(收藏不迷路)1. Google AI Studio:官方最稳特点:官方最高质量入口、最稳定使用方法:进入网站后,右上角选择 Nano Banana,然后输入提示词或上传参考图即可网址:网页链接2. Gemini:速度与文案兼得特点:出图速度快,并且可以同时生成文案和图片使用方法:模型切换到 Gemini 2.5 Flash,模式选择 Create images网址:网页链接3. LMArena:最无脑的选择特点:最无脑入口,它会自动调用 Nano Banana 模型使用方法:顶部选择 Direct Chat,模式选择 image网址:网页链接4. Lovart:项目批量出图必备特点:适合项目式大量出图的用户使用方法:点击新建项目,右侧模型选择 Nano Banana网址:网页链接5. Flowith:赠送积分福利特点:每月免费使用次数约 33 张,注册即送 1000 积分使用方法:选择图片/视频生成模式,模型选择 Gemini 2.5 Flash Image网址:网页链接6. OpenRouter:模型对比专家特点:多模型对比必备使用方法:模型选择 Google: Gemini 2.5 Flash Image Preview,点击 Chat 即可使用网址:网页链接#AI工具##AI创造营##科技先锋官##微博兴趣创作计划#
新浪微博 2025-11-25 00:00:00
45. GPT-5.4 昨晚发布了。看了一圈评测,确实有点东西。 最核心的更新就三个字:会干活了。 用 OpenAI 的话说:用更少的来回,更准确地完成复杂的实际工作。 一是原生Computer Use。模型能像人一样看屏幕、点鼠标、操作电脑,不再只是写代码调用API。这意味着AI真正具备了执行能力,而不只是生成能力。 二是搜索能力暴涨。BrowseComp测试从GPT-5.2的65.8%直接干到82.7%,Pro版89.3%反超Claude Opus 4.6。17个百分点的提升,恐怖如斯。 三是100万token上下文。Codex版本支持,足够让AI独立完成一个完整的工作流。 有意思的是,OpenAI官方说GPT-5.4的目标是成为"AI数字员工"。这和OpenClaw的理念不谋而合——让AI从工具变成能帮你干活的人。 更重要地是,如果你已经订阅了ChatGPT的Plus会员,那么本身的codex额度就不用浪费了,可以直接接入 Openclaw 使用,具体步骤如下: 1️⃣ 小龙虾终端输入: openclaw onboard 开启配置向导 2️⃣ 依次选择: yes → quickstart → 登录 OpenAI → OpenAI Codex 3️⃣ 按提示完成授权,成功后选默认模型 GPT codex-5.4,就搞定啦! #HOW I AI##AI创造营#
新浪微博 2026-03-06 00:00:00
46. #阿里发布旗舰推理模型# 1月26日阿里正式推出通义千问旗舰推理模型Qwen3-Max-Thinking,这是其目前参数超万亿、综合能力最强的大模型,在19项权威基准测试中性能媲美GPT-5.2、Gemini 3 Pro等国际顶尖模型,标志国产大模型跻身全球第一梯队。该模型两大核心创新亮眼,自研测试时扩展技术通过迭代反思提升推理效率,同等Token消耗下多项指标超竞品;自适应工具调用能力可自主启用搜索、代码解释器等功能,大幅降低幻觉,实测中工具协同表现优于ChatGPT。目前模型已上线Qwen Chat开放体验,API同步开通,还将接入千问APP,同时阿里同步开源Qwen3-TTS全系列语音合成模型。依托“算力-模型-应用”全栈闭环,该模型已落地淘宝、支付宝等场景,其高效推理路径也为算力约束下的国产大模型创新提供了新方向。
新浪微博 2026-01-28 00:00:00
47. 【通过测试≠没有bug:AI编程的致命盲区】快速阅读:Claude 4.6写代码会埋下严重bug,自己却审查不出来。必须用Codex 5.4反复审核每次提交。“通过测试”不代表没问题——AI太擅长写能通过的测试了。---Sterling Crispin分享了一个残酷发现:Claude Opus 4.6是优秀程序员,但会持续产生严重bug,无论让它自审多少次都发现不了。解决方案?用GPT 5.4的Codex CLI对每次提交审核4遍以上。有观点认为用传统工具——linting、类型检查、测试门槛——就够了。Sterling直接反驳:AI最爱干的就是写能通过测试的测试。这是个盲区。你可以让Claude在全新上下文中反复检查自己的代码,直到它说“没问题了”,然后Codex仍能揪出bug。“通过测试就没bug”是个疯狂假设。代码可能运行完美,测试全绿,但藏着一个细微的深层误解,毁掉整个系统的意义,导致灾难性故障。这种错误,传统validator抓不到,单元测试也无能为力,因为模型已经被过度优化成“写通过测试的代码”。为什么不直接让Codex写代码?Sterling说Codex像个教导主任,过度优化“正确代码”,却错失系统真正目的(telos)。太官僚了。Claude更适合日常驾驶,但需要Codex这个苛刻的审计员盯着。有开发者开始探索plan-with-codex模式:让Claude做计划,Codex审核,两者循环直到Codex批准——在写代码前就把错误拦住。另有人用多模型代码审查:Opus负责架构逻辑,Codex抓安全漏洞,Kimi K2.5查性能问题,Sonnet 4.6管代码风格。一个被反复引用的回复:你得让它完全重写代码,从根本上消除那类bug的可能性。否则就是无限循环,让agents猜这个bug是不是“真的”、“重要的”。x.com/sterlingcrispin/status/2035031512123678994#AI创造营##人工智能#
新浪微博 2026-03-22 00:00:00
48. #Google发布Gemini3.1Pro#Gemini3.1 Pro在核心推理能力上更进一步。 在ARC-AGI-2(一个评估模型解决全新逻辑模式能力的基准测试)测试中,3.1 Pro获得了77.1%的验证分数,在推理表现上达到3 Pro的2倍。 其他专业领域都有突破: 学科知识:在 GPQA 钻石级测试中得分为 94.3%; 编码:在 LiveCodeBench Pro 上 Elo 得分为 2887,在 SWE-Bench Verified 上得分为 80.6%; 多模态理解:在 MMMLU 测试中达到了 92.6%。 即日起,3.1 Pro 将陆续上线。#过个有AI年##HOW I AI#
新浪微博 2026-02-20 00:00:00
49. 最具性价比的 Claude Sonnet 4.6 发布了
知乎 2026-02-18 00:00:00
50. GPT-5.4 从 25.6 万个词元增加到 100 万个词元时,检索准确率下降了 54%。Opus 4.6 下降了 15%。现在,各大人工智能实验室都声称拥有百万级令牌上下文窗口。GPT-5.4 八天前发布时就宣称拥有百万级令牌上下文窗口。Gemini 3.1 Pro 也已经实现了这一目标。但是,规格表上的数字和实际可用的数字却是两回事。此图表使用 OpenAI 自家的基准测试工具 MRCR v2。它将 8 条相同的信息隐藏在一段庞大的对话中,并要求模型找到其中一条特定的信息。这本质上是对“能否在 75 万字的文本中找到所需信息”的压力测试。在 25.6 万代币的情况下,各模型的准确率相当接近。Opus 4.6 的准确率为 91.9%,Sonnet 4.6 为 90.6%,GPT-5.4 为 79.3%(根据图表脚注,平均值取自 12.8 万至 25.6 万代币)。但当代币数量增加到 100 万时,各模型的准确率曲线就出现了显著差异。GPT-5.4 的准确率骤降至 36.6%,正确率约为三分之一。Gemini 3.1 Pro 的准确率也降至 25.9%。Opus 4.6 的准确率则保持在 78.3%。研究人员称之为“上下文腐化”。Chroma 在 2025 年测试了 18 个前沿模型,发现随着输入长度的增加,每个模型的性能都下降了。大多数模型的性能呈指数级衰减,而 Opus 几乎不受影响。接下来是定价问题。今天的公告彻底取消了长上下文溢价。现在,一个 90 万个代币的 Opus 4.6 请求与一个 9 千个代币的请求的单价相同,即每百万个代币 5 美元/25 美元。而 GPT-5.4 对超过 27.2 万个代币的请求仍然收取 2 倍输入费用和 1.5 倍输出费用。也就是说,你为了一个在完整上下文中只有大约三分之一的概率能正确检索信息的模型支付了更高的费用。对于任何构建需要运行数小时、处理数百页法律文件或在单个会话中加载整个代码库的代理程序的人来说,唯一重要的数字是模型是否真的能找到你输入的内容。当令牌数量达到 100 万时,这些模型之间的差距就变得非常大了。
新浪微博 2026-03-15 00:00:00
51. 刚刚,GPT-5.4 突袭上线!百万上下文,AI 操作电脑,首次超越人类!
微信公众号 2026-03-06 00:00:00
52. 千问 vs ChatGPT:4大功能实测!到是更好用的AI助手!Qwen3能否战胜GPT-5.1?
哔哩哔哩 2025-11-19 00:00:00
53. DeepSeek V4 网页端《原神×我的世界》融合小游戏代码测试:拳打 ChatGPT,脚踢 Gemini,硬刚 Claude
哔哩哔哩 2026-04-09 00:00:00
54. Claude Opus 4.6 vs GPT-5.3-Codex,到底谁更强?
微信公众号 2026-02-06 00:00:00
55. #Google发布Gemini3.1Pro#这波更新堪称史诗级飞跃!在最难AGI测试ARC-AGI-2中,它以77.1%的逆天成绩屠榜,性能竟是上一代的2倍多,将刚刚登顶的Claude Opus 4.6(68.8%)甩在身后!代码、推理、智能体能力全面碾压,在LiveCodeBench等硬核测试中疯狂刷新纪录。更狠的是,它独家支持100万Token超长上下文(竞品直接不支持),还大幅降低了幻觉率。最让开发者狂喜的是——它的API调用成本,还不到Claude Opus 4.6的一半!性价比直接拉满。实测效果更惊艳:一句话Prompt,3分钟生成电影级SVG动画;轻松模拟城市规划,生成城市拓扑图;甚至能搭建实时航天看板,追踪空间站轨迹…创造力与生产力完美结合。#过个有AI年##HOW I AI#
新浪微博 2026-02-20 00:00:00
56. 为啥别人日更10篇爆款,你周更1篇还扑街? 别人一天发10篇爆款,你一周憋一篇还扑街?不是你团队不行,是你的“手工作坊”,干不过别人的“工业化流水线”! 如果你正在为小红书流量焦虑: 👉 招了人,产出全靠撞大运,爆款完全不可复制? 👉 预算少,请不起专业团队,自己发笔记石沉大海? 👉 要种草,灵感天天枯竭,热点永远追不上? 别划走。今天不废话,直接给你看一套我们给新消费品牌、本地生活和知识付费IP搭建的 “小红书爆款笔记流水线系统”。 只需要三步: ① 遇到符合自己项目的爆款内容,敲击手机,爆款数据自动扒取,完全自动化; 爆款公式自动总结、账号名称、播放量、点赞数、评论数、分享数、收藏数统统自动采集到 ② AI批量二创,将自己感兴趣的话题输入,选择我们之前采集到的对标内容的爆款公式,自动生成你想好的内容,连小红书封面图都帮你做好。真正做到AI爆款内容复刻,24小时产出不枯竭; ③ 多账号多平台发布,一个人就是一个内容制造工厂。 你以为搭建这套系统要花几十万、养一个IT团队?错! 问题的本质,是你的内容生产还停留在“手工作坊”时代,靠天吃饭。而我,只是用了一个飞书多维表,就把这套“工业化”流程封装成了一个即插即用的模板。 用了它,你每天省下3小时找选题的时间,把爆款概率从玄学变成科学,真正实现“一人军团”。#飞书多维表格 #小红书运营 #自媒体运营 #ai生成文案 #爆款文案上热门
抖音 2026-03-01 00:00:00
57. 如何评价 Anthropic 最新发布的 Claude Opus 4.6?有哪些技术亮点值得关注?
知乎 2026-02-09 00:00:00
58. #微博声浪计划##听见微博# DeepSeek创始人梁文锋确认,DeepSeek V4将于2026年4月下旬发布,是中国首个去英伟达化的万亿级大模型,适配华为昇腾、寒武纪等国产芯片。该模型采用MOE架构,响应速度较V3提升35倍,支持百万级上下文窗口,代码生成质量内部测试超Claude Opus和GPT系列。 叶锦川的微博音频
新浪微博 2026-04-11 00:00:00
59. 谷歌Gemini 3.1 Pro推理分数翻倍,幻觉率继续下降,价格不变,又要重回王座?市值一夜上升超千亿元2025年11月,谷歌发布的Gemini 3 Pro曾短暂封王,但很快就被OpenAI和Anthropic的新模型挤下了宝座。AI世界的王座更替,比手机发布会还快。就在2026年2月19日深夜,谷歌带着名为“Gemini 3.1 Pro”的新模型杀了回来。官方数据看着挺吸引人:在一项衡量AI解决全新逻辑问题能力的“怪考题”ARC-AGI-2上,Gemini3.1 Pro的得分直接翻了一倍多,冲到77.1%。第三方机构Artificial Analysis的测试也显示,Gemini3.1 Pro的综合智能指数已经悄悄爬到了第一,把Claude Opus 4.6甩在了身后。#人工智能 #
新浪微博 2026-02-21 00:00:00
60. #GPT5.4来了#GPT-5.4正式上线,百万上下文+原生电脑操控,推理、代码、工具调用全面拉满,AI从“聊天工具”变成了“数字员工”。 未来普通人也能用AI完成跨软件全流程工作,效率翻倍,但门槛与成本依然偏高,国内大模型若能在易用性、本土化上追上,完全有机会错位竞争。AI不是取代人,而是帮人把时间花在真正有价值的事上。
新浪微博 2026-03-06 00:00:00
61. 如何评价最新发布的GPT-5.4模型?实际使用体验如何?
知乎 2026-03-15 00:00:00
62. #Google发布Gemini3.1Pro##过个有AI年##HOW I AI#美国AI大模型也加入春节大战!科技巨头Google更新了自家的大模型——Gemini 3.1 Pro,距离Gemini 3 Pro 上线仅三个月。Gemini 3.1 Pro这次升级的核心卖点是推理能力翻倍,但价格不变。在评估模型解决全新逻辑模式的ARC-AGI-2测试中,Gemini 3.1 Pro得分达77.1%,较Gemini 3 Pro的31.1%提升超一倍,显著领先Claude Opus 4.6(68.8%)和GPT-5.2(52.9%)。定价与 Gemini 3 Pro 完全一致。200k token 以内输入 $2/百万 token,输出 $12/百万 token;超过 200k 则为 $4/$18。能力大幅提升但价格不变,性价比明显提高。对比参考:Claude Opus 4.6 为 $5/$25,GPT-5.2 为 $1.25/$10。不过,Gemini 3.1 Pro被部分用户反馈性能不均衡,基准测试和真实体验有落差。不过考虑到目前仅是预览版,后面稳定版将会进一步优化。#老张聊科技#
新浪微博 2026-02-20 00:00:00
63. GPT-5.4:OpenAI做了个Kimi K2.5 +MiniMax M2.5?
微信公众号 2026-03-06 00:00:00
64. #用声音马住中国年##微博声浪计划# 谷歌Gemini3.1Pro正式发布,推理能力翻倍,ARC-AGI-2测试得分77.1%,科学知识测试GPQA Diamond达94.3%。多模态升级支持100万token长上下文,定价维持不变,成本仅为竞品一半。但存在稳定性问题,中国用户暂无法直接使用。#谷歌Gemini3.1Pro正式发布# 酷车同学的微博音频
新浪微博 2026-02-20 00:00:00
65. 最强Claude意外泄露!完胜Opus 4.6,代号「卡皮巴拉」,奥特曼又要睡不着了
微信公众号 2026-03-28 00:00:00
66. Claude Opus 4.6 刚发布就用 Claude Code 写项目,有哪些要注意的吗?
知乎 2026-02-06 00:00:00
67. AI编程大战白热化:Claude Opus 4.6和GPT-5.3-Codex同一天发布,谁才是真正的王者?
微信公众号 2026-02-06 00:00:00
68. #用声音马住中国年##微博声浪计划# 谷歌Gemini3.1Pro正式发布,性能大幅提升,ARC-AGI-2测试得分77.1%,超越Claude Opus 4.6和GPT-5.2,重夺AI模型性能王座。科学推理和编码能力刷新纪录,支持100万Token长上下文输入。定价策略加量不加价,性价比优势显著,行业竞争进入白热化阶段。 乖乖Show的微博音频
新浪微博 2026-02-21 00:00:00
69. OpenAI发布GPT-5.4 mini与nano,以更低成本逼近旗舰模型性能
知乎 2026-03-18 00:00:00
70. #阿里新一代模型Qwen3.5曝光#中国大模型“疯狂2月”的重要一环阿里新一代大模型Qwen3.5曝光了,看了一下,Qwen3.5采用全新架构,支持原生视觉理解能力,可直接处理图像等多模态输入,并且在逻辑推理、数学计算及代码编写能力上具有显著突破,这波是国产大模型全球竞争力再次迎来强化呀。
新浪微博 2026-02-09 00:00:00
71. 春节6天,我找到了各个领域最强的大模型。 这个春节,快快乐乐的在老家vibe coding了近6天。我做了一个还蛮有趣的东西,就是一个18个大维度、近100个小维度,一共970道题的原创大模型评测集。做这个东西的想法其实特别简单,就是我希望任何一个新模型一出来,就能用这套评测集直接过全自动过一遍,再配合我自己的实测,大概就能在3个小时里,就对新模型的能力比较清楚了,以方便我更好更快的对模型进行评测,同时也能避开一些刷分怪。人啊,就是不知者无畏,想的很简单,但是没想到做起来,有这么的麻烦,4天几乎用光了我御三家大模型最高档Coding plan的额度,也真的踩了无数的坑。比如Skill迭代,一开始我做了出题和审查skill之后,我发现,模型出的还是一坨屎,因为缺了太多的经验和约束条件。所以没办法,只能各个顶级模型互相出题再互相审查,然后再把经验迭代回skills,就这么迭代了2天,这个skills才算稳定可用。就比如上下文管理,这1000道题的信息量过于恐怖,没有一个Agent能直接生成出来,更别提很多原创素材,我甚至写了3本15万字的小说作为评测集的素材之一。像Claude Code,一次性生成一个小类的10道题,就已经是最佳上下文的极限了。不过这些坑归坑,但是也意外的帮我找到了各个维度里目前体感最强的模型。毕竟出题模型的能力上限,几乎也影响出题的质量和未来评测的质量,毕竟出题的拉了,那未来评测必拉。所以,也给大家分享一下,不保证对,只是我自己的体感:1. 软件工程与代码生成:GPT-5.3 codex2. 代码理解、推理与质量:GPT-5.3 codex3. 调试、测试与维护:GPT-5.3 codex4. 数据工程与后端服务:Claude Opus 4.65. 前端与产品工程:Claude Opus 4.66. Agent工具调用:Claude Opus 4.67. Web与桌面自动化(静态) :Claude Opus 4.68. 研究与知识工作Agent(静态):GPT-5.2 Pro9. 数学与形式推理:Gemini 3.1 Pro10. 逻辑与规划:Gemini 3.1 Pro11. 知识广度与事实核验:Gemini DeepThink12. 阅读理解与信息抽取:GPT-5.2 Thinking13. 长上下文记忆与多轮一致性:GPT-5.2 Thinking14. 指令遵循与对齐:Claude Opus 4.615. 多模态理解与视觉推理:GPT-5.2 Thinking16. 情商与协作沟通:GPT-4.517. 创作表达与审美:Claude Opus 4.6以上,希望能帮大家节省一点时间。哦对了,再额外提一句,在搜索上如果你想搜关于AI的最新的信息,比如OpanClaw的最新玩法之类的。相信我,用Grok 4.2,有奇效。#how i ai#AI#大模型##科技先锋官# #过个有AI年#
新浪微博 2026-02-22 00:00:00
72. Claude 现在能直接在对话里画图表了Claude 新增可视化功能:用户在聊天过程中,Claude 可以直接生成交互式图表和示意图,无需跳转到其他工具,也不用写代码导出。这项功能目前以 Beta 形式上线,所有套餐均可使用,包括免费用户。此前 Claude 的 Artifacts 功能已经支持生成代码和网页预览,但可视化内容通常需要用户主动要求生成一个独立的 Artifacts。这次更新的区别在于,图表直接嵌入对话流中,更像是 Claude 在"边说边画",而不是另开一个窗口展示结果。对于经常需要用 AI 解释流程、展示数据对比、或梳理系统架构的用户来说,这个功能省去了不少来回折腾。感兴趣的可以直接在 claude.ai 体验。 宝玉xp的微博视频
新浪微博 2026-03-13 00:00:00
73. Claude新模型4.6:开箱即挖500个0day漏洞,源代码审计即将颠覆
微信公众号 2026-02-06 00:00:00
74. #Google发布Gemini3.1Pro#Gemini 3.1 Pro这次更新,谷歌明显把AI从聊天机器人往工作搭子推。重点不是堆参数,而是深度推理、啃长文档、多模态通吃,能直接给结论+证据链,这才是真生产力。 我觉得免费够用党和愿意付费党完全是两拨人。普通用户聊聊天、写文案,免费版足够;但学生、职场人、自媒体,需要读论文、整资料、做方案,这种“会思考”的AI能省几小时,为效率付费很值。 现在AI付费已经不是炫技,是看能不能替代人工。能帮我少加班、少出错,每月几十块真不贵。但前提是别虚标能力,别用着用着掉链子。google发布gemini3.1pro 说到底:免费看体验,付费看效果。真能解决问题,大家愿意买单;只吹参数不落地,再强也白搭。#过个有AI年##HOW I AI#
新浪微博 2026-02-20 00:00:00
75. #微博声浪计划##听见微博# iOS26.4前瞻:Siri深度整合Google Gemini大模型,实现多模态交互与复杂任务处理,但高阶功能仅支持A17 Pro/M3及以上芯片。实用功能受捧,健康模块重构引分歧,旧机型面临功能阉割,用户对兼容性与稳定性存焦虑。 科技星辰说的微博音频
新浪微博 2026-01-25 00:00:00
76. 效率直接翻4倍!我每天都在用的 AI 语音输入神器(含开源免费版教程)
哔哩哔哩 2026-03-17 00:00:00
77. 再说说物理物理和几何不一样,几何可以先见题型、积累辅助线,慢慢养出经验,很多时候是先见过,再会做。物理则是理解优先,做题在后。先理解透彻,再适当做题。如果概念没吃透、原理没弄明白、过程没分析清楚,也就是理解不到位就去做题,那么稍微变个情景、换个条件,立刻就错。物理的每一个结论(公式)背后,都有对应的道理、条件和适用范围。把概念、原理理解透,再用题目去检验、强化、巩固,这样才有效率,也才学得稳。
新浪微博 2026-02-12 00:00:00
78. #用声音马住中国年##微博声浪计划# 谷歌Gemini3.1Pro正式发布,推理能力翻倍且成本不变。ARC-AGI-2测试得分77.1%超GPT-5.2,GPQA达94.3%行业第一。支持100万Token上下文,定价仅为Claude Opus 4.6一半。但存在性能稳定性问题,JS代码生成失败率超60%,幻觉率降至50%。谷歌压缩更新周期至3个月,推动AI工业化。 数懒小姐姐的微博音频
新浪微博 2026-02-21 00:00:00
79. 早,一觉醒来又发布两个模型。1、Opus 4.62、ChatGPT 5.3 Codex Opus 这次的升级:• 上下文窗口:Opus系列首次提供100万token(1M) 上下文窗口(测试版)。• 定价:保持不变,输入每百万token5美元,输出每百万token25美元。• 能力升级:提升代码规划/调试/审查、智能体任务续航与自主纠错能力,Office工具(Excel、PowerPoint)和Claude Code同步升级。GPT 5.3 Codex 的升级:• 定位:编程智能体,非通用大模型,整合GPT-5.2推理与GPT-5.2-Codex编程能力。• 速度与效率:单token推理提速25%,同任务token用量减半,上下文 400 万 token(4M,比 Opus 4.6 强)• 基准表现:SWE‑Bench Pro56.8%、Terminal‑Bench 2.077.3%、OSWorld‑Verified64.7%。• 可用性:ChatGPT付费用户已可用(Codex应用/CLI/IDE插件/Web),API访问即将开放。• 安全:OpenAI首个网络安全维度获高等级评级的模型。目前感觉 5.3 更吸引人一些。晚点试试看。
新浪微博 2026-02-06 00:00:00
80. #Google发布Gemini3.1Pro# 春节还没过完,谷歌就甩出王炸~时隔仅三个月,Gemini 3.1 Pro闪电登场,核心推理能力翻倍,价格却纹丝不动,直接重夺综合性能榜首。这次升级最直观的是,复杂推理不再拉胯,学术与编程能力跻身第一梯队。更关键的是“加量不加价”的策略,让行业竞争从单纯堆参数,转向性价比与落地能力的较量。当前海外第一梯队已重新洗牌,Gemini 3.1 Pro领跑,Claude Opus 4.6与GPT-5.2紧随其后。#过个有AI年##HOW I AI#
新浪微博 2026-02-20 00:00:00
81. 2026年GPT5.4镜像站实测
什么值得买 2026-03-06 00:00:00
82. 2026年ChatGPT技术拆解
哔哩哔哩 2026-03-25 00:00:00
83. 2026年国内访问ChatGPT、Gemini实测全攻略
知乎 2026-03-31 00:00:00
84. 2026年实测
什么值得买 2026-04-14 00:00:00
85. 2026年国内免费使用ChatGPT全攻略
哔哩哔哩 2026-04-01 00:00:00
86. 2026年Gemini国内镜像站推荐
什么值得买 2026-03-09 00:00:00
87. Google Gemini 中国大陆最佳实践
微信公众号 2026-03-31 00:00:00
88. 进不去Gemini官网怎么办?2026年国内可用的三种平替方案
什么值得买 2026-03-02 00:00:00
89. Gemini 3.1镜像站如何解决文娱创作难题?
什么值得买 2026-04-08 00:00:00
90. 2026年Gemini 3镜像站国内访问教程实测
哔哩哔哩 2026-04-06 00:00:00
91. 2026年国内免费访问Gemini 3 Pro全攻略
哔哩哔哩 2026-04-01 00:00:00
92. 2026年国内访问Claude全攻略
哔哩哔哩 2026-04-01 00:00:00
93. 2026年国内访问Claude全指南
哔哩哔哩 2026-04-02 00:00:00
94. 2026年国内实测:GPT vs Claude vs Gemini哪个更强?附镜像站教程
什么值得买 2026-04-14 00:00:00
95. 2025年AI三巨头深度实测
今日头条 2025-10-27 00:00:00
96. 用了半年,我终于搞清楚 ChatGPT、Claude、Gemini 的区别了
知乎 2026-03-22 00:00:00
97. 深度对比Gemini、ChatGPT与Claude,开发者该如何选?
今日头条 2025-12-24 00:00:00
98. 2026年国内实测:GPT vs Claude vs Gemini哪个更强?附镜像站教程
什么值得买
99. GPT 刚更新Claude和Gemini也在卷2026年开发者到底该选哪个大模型
什么值得买 2026-04-13 00:00:00
100. GPT-5.4 vs Gemini 3.1 vs Claude 4.6
什么值得买 2026-03-15 00:00:00
101. 2026年四大AI模型横向评测:Gemini、GPT、Claude、Grok谁更适合你
什么值得买 2026-04-13 00:00:00
102. 到底该买哪个 AI 订阅?ChatGPT vs Claude vs Gemini
知乎 2026-03-21 00:00:00
103. 2026年国内实测
什么值得买 2026-03-14 00:00:00
104. 四大AI模型终极对决
什么值得买 2026-03-12 00:00:00
105. Gemini3.1与GPT5.4全面对比,谁更强?附实测对比
什么值得买 2026-03-06 00:00:00
106. 2026年编程能力实测
知乎 2026-04-07 00:00:00
107. 2026实测|10款热门AI模型国内直用指南,Gemini3.1与GPT5.4差距竟这么大
知乎 2026-03-17 00:00:00
108. 从“知识检索”到“深度推理”
哔哩哔哩 2026-03-29 00:00:00
109. Claude Opus 4.6 vs GPT-5.3 Codex
微信公众号 2026-02-07 00:00:00
110. 谁是AI编程之王!Claude Opus 4.6 和 GPT-5.3-Codex 同时发布!
微信公众号 2026-02-06 00:00:00
111. 中文理解能力测试
知乎 2026-03-21 00:00:00
112. AI模型横向比较
微信公众号 2026-02-26 00:00:00
113. 最适合中文场景的大模型推荐清单
微信公众号 2026-03-23 00:00:00
114. 国产 AI 大模型 2026 年大比拼
今日头条 2026-03-25 00:00:00
115. 2026年最强中文AI大模型!这10款国产神器,普通人用着真香
今日头条 2026-01-19 00:00:00
116. 中文AI的独特优势
知乎 2026-02-24 00:00:00
117. 2026国内AI镜像站选择指南
什么值得买 2026-03-19 00:00:00
118. 镜像站聚合平台 vs 单独镜像站
什么值得买 2026-04-10 00:00:00
119. 2026年国内AI镜像站横向评测
什么值得买 2026-03-19 00:00:00
120. 2026年国内nanobanana镜像站还能用吗?核心技术是什么?
什么值得买 2026-03-26 00:00:00
121. 2026AI镜像站实测
什么值得买 2026-03-19 00:00:00
122. 2026年最新国内镜像站实测对比,GPT vs Gemini哪个模型更值得用? - 哔哩哔哩
哔哩哔哩 2026-03-25 00:00:00
123. 阿里发布国产最强编程模型Qwen3.6-Plus
微信公众号 2026-04-08 00:00:00
124. 千问3.6正式发布
今日头条 2026-04-03 00:00:00
125. 2026年国内怎么用Gemini?库拉KULAAI镜像站实测,真香!
知乎 2026-03-27 00:00:00
126. AI三强争霸:Claude、ChatGPT、Gemini的深度能力拆解
知乎 2026-03-20 00:00:00
127. 避坑!2026年AI镜像站实测:哪些能免费用,哪些是智商税?
什么值得买 2026-03-16 00:00:00
128. 2026年最新实测:ChatGPT 5.4使用技巧与国内直访
哔哩哔哩 2026-03-28 00:00:00
129. Claude Opus 4.6更大的脑子,更长的记忆,更聪明的判断
知乎 2026-02-06 00:00:00
130. Gemini 3.1 Pro 直接使用
微信公众号 2026-04-07 00:00:00
131. 2026新风口解读:ChatGPT镜像站如何成为AI普惠的关键基础设施?\n - 哔哩哔哩
哔哩哔哩 2026-04-10 00:00:00
132. 2026年4月AI工具实测 GPT6Gemini3.2 一键调用高性价比聚合站推荐
什么值得买 2026-04-09 00:00:00
133. Claude4.6 发布,Claude 中文版镜像官网使用教程(2026年 3 月更新)
知乎 2026-03-03 00:00:00
134. 重磅更新!Gemini镜像站上线
微信公众号 2026-01-04 00:00:00
135. GPT5 国内使用教程,支持最新 GPT5.2
知乎 2025-12-28 00:00:00
136. ChatGPT 官方国内入口及国内使用 GPT-5 教程 【2025年更新】
知乎 2025-12-14 00:00:00
137. Claude官网入口:Anthropic AI大模型Claude 4.6国内使用指南(2026/3/6)
知乎 2026-03-05 00:00:00
138. 国内如何使用 ChatGPT 中文版(2025 年12 月更新)
知乎 2025-12-18 00:00:00
139. 2026年GPT5.4国内怎么使用?附实测教程
什么值得买 2026-03-06 00:00:00
140. 2026年国内免费AI工具实测:RskAi等镜像站与官方API成本全面对比
什么值得买 2026-03-19 00:00:00
141. ChatGPT 镜像站使用教程,2026 年最新 GPT5.4 国内使用方法
知乎 2026-04-04 00:00:00
142. Gemini 3.1 Pro 办公实战指南:它到底能不能替代你的"打工人搭子"
知乎 2026-03-26 00:00:00
143. Gemini 官网使用指南:Google AI Gemini 3.1 Pro国内使用详解与镜像网站推荐
知乎 2026-03-30 00:00:00
144. Claude4.6 镜像国内使用教程,Claude 中文版直达(2026 年 4 月更新)
知乎 2026-04-04 00:00:00
145. Claude 4.5中文版保姆级教程:国内直连与ChatGPT镜像站的终极替代方案
知乎 2025-11-27 00:00:00
146. 2026年GPT技术深度拆解:国内免费聚合镜像站RskAi实测
什么值得买 2026-03-15 00:00:00
147. 100 万token!Anthropic 重磅发布 Claude Opus 4.6,成功登顶编程王座
知乎 2026-02-21 00:00:00
148. Claude Opus 4.6:代码生成领域的"小步快跑",AI
微信公众号 2026-04-02 00:00:00
149. 2026年Gemini 中文版教程:Gemini 3.1 国内最新使用方法
知乎 2026-04-04 00:00:00
150. GPT-5.2镜像站,国内直连服务
微信公众号 2025-12-25 00:00:00
151. 2026年ChatGPT技术拆解:国内用户如何通过镜像站免费使用GPT?
什么值得买 2026-03-24 00:00:00
152. ChatGPT 5.4镜像技术深度拆解:从MoE架构到原生电脑操作的全方位
什么值得买 2026-04-08 00:00:00
153. Gemini 3.1 Pro上线,谷歌这次藏了什么狠活?
今日头条 2026-02-21 00:00:00
154. 2026年国内免费使用GPT、Gemini、Claude的最全镜像站指南
什么值得买 2026-03-18 00:00:00
155. GPT-5.4技术架构深度拆解:统一路由、原生Computer与推理时计算
什么值得买 2026-03-18 00:00:00
156. 全球TOP3大模型国内用户如何选择?
微信公众号 2026-03-12 00:00:00
157. Claude三个模型怎么选?Haiku、Sonnet、Opus价格和能力全对比
知乎 2026-04-06 00:00:00
158. ChatGPT5.4镜像技术实测:速度、多模态与长文本能力的深度测试
哔哩哔哩 2026-04-02 00:00:00
159. AI编程大战白热化:Claude Opus 4.6和GPT-5.3-Codex同一天发布,谁才是真正的王者?
知乎 2026-02-06 00:00:00
160. 2026年ChatGPT核心技术拆解与国内访问全攻略:实测三大免费镜像站
哔哩哔哩 2026-03-25 00:00:00
161. Google Gemini 3.1 国内访问全攻略:最新模型使用指南(2026年4月版)
知乎 2026-04-04 00:00:00
162. 2026国内AI镜像站评测选择指南:安全、速度与免费额度的终极权衡
什么值得买 2026-03-18 00:00:00
163. 【最新】Gemini3.1pro保姆级获取教程+使用教程
微信公众号 2026-04-03 00:00:00
164. GPT-5.4技术架构深度拆解:从统一路由到原生计算机操控的工程
什么值得买 2026-03-15 00:00:00
165. Claude Opus 4.5 官网镜像站使用指南(国内直连)
微信公众号 2026-01-05 00:00:00
166. 国内AI镜像站技术解析:如何实现GPT-4、Claude 3、Gemini加速?
什么值得买 2026-03-14 00:00:00
167. claude模型opus4.6应该都有人用过吧
小红书 2026-03-24 00:00:00
168. Gemini 3.1怎么用?新手快速上手步骤详解
知乎 2026-03-06 00:00:00
169. Gemini 3.1 Pro 原生多模态架构深度拆解:统一表示与联合训练
什么值得买 2026-03-21 00:00:00
170. 2026 Gemini 3.1有哪些变化?一文看懂版本更新重点 - 哔哩哔哩
哔哩哔哩 2026-03-05 00:00:00
171. 2026年AI工具使用避坑指南:国内镜像站选择与安全使用建议
什么值得买 2026-03-19 00:00:00
172. Gemini 3.1正式发布:核心升级与新功能全面解析
知乎 2026-03-05 00:00:00
173. GPT 中文官网镜像整理(2025 年最终)
知乎 2025-12-12 00:00:00
174. Gemini 官网入口:Google AI Gemini 3.1 国内使用指南【2026年4月更新】
知乎 2026-04-01 00:00:00
175. GPT-5.2 中文版: GPT5.2国内直连使用指南~ 【2025年12月更新】
知乎 2025-12-16 00:00:00
176. 国内GPT免费镜像站集合(2025 年 12 月更新)
知乎 2025-12-14 00:00:00
177. 2026办公效率实测:Gemini官网镜像站如何助力国内办公应用
什么值得买 2026-04-10 00:00:00
178. 国内ChatGPT镜像站合集(2026 年 4 月更新)
知乎 2026-04-01 00:00:00
179. 推荐一个好用且便宜的AI镜像站点,gpt/claude/grok应有尽有
微信公众号 2025-12-06 00:00:00
180. 2026国内镜像站实测对比,GPT vs Gemini哪个模型更值得用?
什么值得买 2026-03-14 00:00:00
181. Gemini3架构深度拆解:镜像站如何实现国内低延迟访问的技术原理
什么值得买 2026-03-14 00:00:00
182. AI日报 | ClawHub中国镜像站上线;Claude Code加入无闪烁模式;阿里万相2.7生图“千人千面”
微信公众号 2026-04-02 00:00:00
183. Claude在国内到底能不能用?一份真实的使用报告
什么值得买 2026-04-04 00:00:00
184. Claude Opus 4.6 实测:学术类写作,专家级推理到底有多强?
微信公众号 2026-02-06 00:00:00
已收藏
去我的收藏夹