AI不用“装人”点网页了:Codex进浏览器侧边栏、网站主动“开门”,尝鲜前先把权限圈好

源自28位全网作者

08-27 02:09

先说一件今天刚发生、微博上还没什么人讨论的事。

OpenAI那条独立AI浏览器Atlas的路线之前已经悄悄下架,替代方案今天以另一种形态露了面:有科技博主实测,把Codex以浏览器插件的形式装进了Chrome侧边栏——它能直接分析你正在看的网页、读arXiv论文、翻译你选中的那段话,还能搭配Notion插件把论文分析存成结构化笔记。哔哩哔哩多个标签页还能一起拉进上下文,论文和GitHub项目放一块儿对比着读。

更值得注意的是演示的后半段:在官方Demo里,一个笔记网站一次性向AI"亮出"了10个工具,Codex不靠模拟点击,直接通过这些工具创建、修改文档。哔哩哔哩这意味着浏览器AI干活的方式,正在从"假装是人"切换到"网站开门"。

这条消息目前还停留在B站的两个实测视频里,没出圈。但它值得停下来看一眼——因为它背后的标准,可能决定未来几年你的浏览器AI怎么干活、能干到什么程度。

从"假装是人"到"网站开门":一分钟搞懂WebMCP

现在你在用的绝大多数浏览器AI,干活的姿势其实很笨:截屏、猜页面结构、模拟人手点击。页面样式一改,它就抓瞎;任务一长,点错地方是常事。

WebMCP想解决的就是这个问题。它是一个让网站主动向AI"自我介绍"的协议:网站用几行前端代码,把自己的能力声明成一个个工具——比如"查商品"“提交表单”“获取文章列表”——AI打开页面就能发现这些工具,直接传参数调用、拿结构化结果,全程不用猜页面长什么样。核心是一个叫navigator.modelContext的API,纯前端实现,不用搭后端。知乎

AI不用“装人”点网页了:Codex进浏览器侧边栏、网站主动“开门”,尝鲜前先把权限圈好

WebMCP是谷歌Chrome团队主导、微软Edge团队协同搞的,2025年8月就开始联手开发,今年2月在Chrome 146上放出早期预览,目前以W3C社区组草案的形式推进。微博微博这里要先纠个偏:今天有视频标题管它叫"OpenAI划时代的独创协议",这个说法不准确,OpenAI的角色是跟进入局——而恰恰是这个"跟随",才是今天这条消息真正的看点:此前在浏览器形态上吃了瘪的OpenAI,选择对齐对手主导的标准,而不是再造一套。

把最近半年的节点排一排,你能看出这条赛道跑得多快:

时间

事件

2025年8月

谷歌、微软开发者联手启动WebMCP

2026年2月

Chrome 146放出早期预览,flags开启;随后提交W3C社区组草案

2026年5月8日

OpenAI给Codex发布Chrome扩展:进真实浏览器干活

2026年6月2日

Chrome 149稳定版,DevTools加入WebMCP调试助手

2026年7月

ChatGPT与Codex合一、浏览器功能插件化;华为在W3C提出WebSkill提案

2026年8月26日

Codex侧边栏插件+WebMCP官方Demo被实测曝光

两条路线,差的不是速度,是权限

有人会问:反正都是AI帮我点网页,协议升级跟我有什么关系?关系大了,差在权限的粒度上。

模拟点击路线,相当于你把整个浏览器的钥匙交给AI——它能看到的、能点的,它都能碰。目前真正"能用"的浏览器AI基本都是这个模式,包括5月上线的Codex Chrome扩展:共用你真实浏览器的Cookie和登录状态,后台开多个标签页并行干活。微博好用是真好用,风险也是真大,因为权限是一把总钥匙。

AI不用“装人”点网页了:Codex进浏览器侧边栏、网站主动“开门”,尝鲜前先把权限圈好

WebMCP路线则反过来:网站自己决定给AI开哪几扇门。AI只能调用网站声明出来的那些工具,页面里其他东西它碰不到。有站长向的文章引用Chrome早期基准测试说,这种方式能减少约67%的计算开销、任务准确率保持在98%以上——数据是转述的,先别当官方口径,但方向上是成立的:更稳、更省、权限更收敛。知乎

社区对这事的评价两极分化得厉害。一边是站长圈在喊"AI流量红利",觉得提前接入就是抢占下一代入口;另一边,知乎有篇文章写得让人脊背发凉:当网站都为机器修好专用通道,人类看到的那个网页反而会越来越敷衍,最后你以为是AI帮你买到了便宜货,可能只是两个AI在后台谈好的价格。知乎这个担忧未必会成真,但它提醒我们:网站"开门"的对象是谁、开多大,是个需要被盯着的问题。

现在想用,先把权限圈出来

如果你属于"经常让AI帮忙干网页上的重复活"的人,Codex的浏览器扩展现在就能用(5月已上线,Mac和Windows都行)。但把登录态交给AI之前,建议先做这几件事:

第一,用白名单思维。Codex扩展支持按站点设置允许/禁止列表,只给你高频操作的工作类站点开权限,别图省事开全局。微博

第二,有几类站点永远别放进去:网银和任何绑着钱的支付页、主邮箱、公司内部系统。AI再稳,这些地方出错的成本你担不起。

第三,敏感操作的确认开关保持打开。官方设计里,填表、上传下载这类动作需要确认,别嫌烦把它关了——那是你最后一道闸。

第四,定期回头看一眼允许列表。用一段时间后你大概率会发现,真正高频用的也就三五个站点。

AI不用“装人”点网页了:Codex进浏览器侧边栏、网站主动“开门”,尝鲜前先把权限圈好

至于WebMCP,现在的状态是:Chrome 146以上、手动开flag才能体验,支持的网站还只有官方Demo和零星几个技术博客。它值得等,但不值得你今天为它折腾。

后面盯这几个信号

判断这条线什么时候真正成熟,不用天天刷新闻,盯四件事就行:

一是Chrome什么时候把WebMCP从flag转正、默认开启——这是从实验到标准的分水岭。二是有没有你常用的网站真的声明了工具,可以留意polyfill等开源项目的接入列表。三是Safari、Firefox以及国内浏览器跟不跟进,只有Chrome一家的标准走不远。四是OpenAI什么时候正式官宣WebMCP支持——目前只有实测视频和Demo,官方还没大张旗鼓地发声。

一句话收尾:浏览器AI这轮变化,不是又一个插件更新,而是"网页给谁用"这件事开始重新谈判。现在不用急着冲,但值得知道门朝哪边开。

内容由AI生成

精选参考来源

1. 🚀OpenAI划时代独创新协议:WebMCP让网站主动暴露工具给AIAgent调用!新浏览器插件深度实测:Codex直接进入Chrome侧边栏!实测论文分析

2. WebMCP来了:AI不再“看”网站,直接上手“用”网站!

3. 今天,谷歌Chrome推出WebMCP(Web模型上下文协议)早期预览版,该协议由谷歌、微软开发者2025年8月联手开发,在Chrome146中开启特定flag即可体验。其核心是让AI智能体跳过人类视觉界面,通过专属API直连网页内核交互,解决了此前AI模拟人类截屏、点按钮操作网页的高成本、低稳定...全文

4. WebMCP(WebModelContextProtocol)是一项由GoogleChrome团队主导、微软Edge团队协同参与,并已提交至W3C社区组草案阶段的新兴Web标准。其核心目标是彻底重构AI智能体(Agent)与网页交互的底层逻辑,让网站能够直接向运行在浏览器中的AI“亮出底牌”,暴露其结构化功能(工具),使AI无需再像人类...全文

5. OpenAI给Codex推出了Chrome扩展,让它能直接在浏览器里干活。Mac和Windows用户从今天起可以在Codexapp里安装Chrome插件,让Codex直接在浏览器里执行任务,并且支持后台多标签并行运行,不会霸占你正在用的浏览器界面。Codex是OpenAI的编程agent,之前主要活动范围是终端、IDE和...全文

6. 所有人都在盯着WebMCP这个生僻的词条狂欢,感慨AI终于长出了手脚。

7. Codex新增Chrome直接操作能力:1.通过Chrome扩展+Codex插件,Codex可以在需要登录态的网站里读页面/执行任务;2.能在后台跨多个标签页并行,不接管你当前浏览;3.每个网站访问需要授权,可管理allowlist/blocklist;4.填表、上传下载、敏感动作前会停下来让你确认。这意味着Code...全文

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章