谷歌正将Chrome浏览器从被动工具转变为主动的智能助手。借助Gemini AI的Computer Use能力,它能直接理解并操控电脑界面,自动完成填表、网购等复杂任务,为人机交互带来了革命性的新可能。
智能速览
全新AI侧边栏实现即时问答与网页总结,无需切换标签。
Auto Browse 2.0可自动化完成预订机票、网购等复杂流程。
内置Nano Banana编辑器,一键修改网页图片背景与风格。
深度整合Google全家桶,实现跨应用智能调度。
Personal Intelligence功能会学习用户习惯,提供个性化服务。
精华内容
这项更新并非简单的功能叠加,而是对浏览器底层交互逻辑的重新定义,其核心在于几项关键技术的突破与整合。
智能体核心
此次更新的基石是Gemini 3 Flash模型的Computer Use能力。它不再是单纯的语言模型,而是能像人一样观察屏幕、理解界面布局,并模拟鼠标点击与键盘输入的智能体。
配合Agentic Vision视觉理解技术,Gemini能精准识别网页中的按钮、表格、图片等元素及其精确位置,为后续的自动化操作提供了坚实的基础。
交互新形态
为了降低使用门槛,Chrome内置了全新的AI侧边栏。用户无需切换标签页,即可随时呼出Gemini,对当前页面进行总结、翻译或提问,实现上下文自动理解,工作效率直接翻倍。
同时,自动填表功能极大提升了效率,当遇到注册或购物页面时,Gemini能一键填充所有已保存的字段信息。内置的Nano Banana图片编辑器,也允许用户直接选中网页图片进行背景替换或风格调整,无需借助外部工具。
自动化利器
Auto Browse 2.0是本次更新中最强大的功能,它将浏览器自动化提升到了新高度。用户只需用自然语言下达指令,如“预订下周末去上海的机票”,Gemini便会自动打开网站、搜索航班、比价、填写表单直至完成预订。
整个过程可视化,用户可以清晰地看到每一步操作,尤其适合处理网购下单、填写申请表格等多步骤的复杂任务。
生态与进化
Gemini与Google全家桶的深度整合释放了更大潜力。它能跨Gmail、日历、地图等应用进行智能调度,一句话就能完成创建日程并发送邀请等复杂工作流,实现真正的跨应用协同。
Personal Intelligence功能则会学习用户的使用习惯和个人偏好,让AI的推荐和回答越来越贴合个人需求,最终成为一个真正懂你的私人助理。
Gemini入驻Chrome标志着浏览器正式迈向智能体时代。它不仅能极大提升个人工作效率,更预示着未来人机交互的方向。尽管目前部分高级功能尚有区域和订阅限制,但这种主动式AI助手的普及,或许已不远。
值友3776265937
校验提示文案
值友3776265937
校验提示文案