Chrome迎来重大更新,Gemini不再是一个简单的聊天窗口,而是进化为能主动理解并操作屏幕内容的智能体。它将帮助用户自动化处理繁琐的网页任务,从填写表单到跨应用整合信息,让浏览器真正开始为用户工作。
智能速览
Gemini进化为浏览器内的主动智能体。
新增永久侧边栏,AI功能一键直达。
支持根据屏幕内容实时生成或修改图片。
能跨标签页阅读信息,并自动起草邮件。
可自动完成酒店搜索、房源筛选、填写表单等复杂操作。
能识别图片并自动完成购物清单。
精华内容
Gemini的角色正发生根本性转变,从一个被动等待指令的助手,升级为能主动理解屏幕、分析上下文并执行多步操作的智能体,将浏览器从阅读工具变为执行工具。
全新交互入口
此次更新的核心是全新的Gemini侧边栏。它被设计为浏览器内的永久性、高性能AI中心,用户无需打开新标签页即可随时调用AI能力。这个固定的入口让AI功能从“偶尔使用”变为“随时待命”,为更深度的功能集成奠定了基础。
理解并创造内容
Gemini现在能理解并操作用户正在查看的内容。在图像方面,借助NanoBanana模型,用户可以直接在网页图片上发出指令,例如“将房间家具换成现代风格”,Gemini会实时渲染出效果。
在文本处理上,它能深度整合Google Workspace。当用户阅读教学大纲时,可以要求Gemini在侧边栏起草一封邮件,并从大纲中提取三本指定书籍,以真人秀风格撰写简介,全程无需切换页面。
自动化繁琐任务
Gemini的核心价值在于自动化执行多步骤任务。在旅游规划演示中,它根据用户的复杂需求(如去加拿大某酒店住特定日期、查询周费用),自动打开多个标签页进行研究、比价,最终呈现结果。
对于找房者,它能遍历收藏列表,逐一点击进入详情页检查“允许宠物”的条款,自动筛选掉不符合条件的房源,并添加室友为协作者,将数小时的繁琐工作简化为一次指令。
从搜索到完成
最终,Gemini的目标是“搞定事情”,而非仅仅是“找到东西”。在一个演示中,用户提供一张派对照相亭的照片,要求Gemini在Etsy上找到复刻所需的所有物品,加入购物车,且总花费不超过75美元。它能分析图片中的冰箱、窗帘、气球等元素,搜索、比价并完成购买流程,标志着浏览器交互方式的革命性变化。
Chrome与Gemini的深度融合,预示着浏览器正从信息展示窗口进化为智能执行平台。它将繁琐的复制粘贴、切换页面和重复性操作自动化,极大地提升了工作效率。这项技术目前面向AI Pro和Ultra订阅用户推出,未来或将重塑我们与数字世界的交互方式。