谷歌将把AI助手Gemini内置到安卓版的Chrome浏览器中,并于6月底起分阶段提供。除了对正在浏览的页面进行总结、就页面内容作答之外,此次更新还加入了可在浏览器内直接编辑图片的"Nano Banana",以及让浏览器自动完成预订停车位等繁琐操作的"auto browse"。此前在桌面端率先登场的对话式浏览体验,终于扩展到了手边的设备上。

读懂页面并作答、常驻浏览器的AI助手

此次的功能以谷歌定位为性能最强的"Gemini 3.1"为基础。在安卓版Chrome工具栏右上方点击Gemini图标,Gemini便会在屏幕下方打开,可以结合你当前所看的页面进行交流。

能做的事情很广泛:总结长文、用通俗的语言解释复杂主题、回答与页面相关的问题等,都无需切换到其他应用即可在当前界面完成。由于Gemini会先读取页面内容再作答,因此不同于单纯的搜索,它会给出贴合眼前信息的答案。

Gemini还会与你日常使用的各类谷歌应用联动。你可以从浏览器出发,把日程添加到日历、把食谱的食材记到Keep,或从Gmail中查找所需信息。若开启"Personal Intelligence",它还能结合你的兴趣爱好,乃至家人和宠物等背景,给出更贴合你个人的回应。

用"Nano Banana"在网页上即时加工图片

在图片方面,谷歌的图像生成与编辑技术"Nano Banana"被整合进了Chrome。你可以加工在网上找到的图片,或从零创作新的视觉素材,整个过程都无需离开浏览器。

谷歌举的例子很好理解。在网页上为考试做准备时,你可以让它"把这个页面变成易懂的信息图";在浏览租房信息时,也可以指示它"把这个房间加工成摆上时下流行的客厅家具的样子",随即就能看到结果。在希望把文字信息进行可视化整理的场景中,这一功能似乎很有用。

替你分担繁琐网络操作的"auto browse"

此次的重头戏,是在安卓上首次可用的"auto browse"。这是一种让浏览器代替用户完成既定流程的网络操作的所谓智能体(agent)型功能。

比如,在出门去看演出前才发现忘了预订停车位时,只要拜托Chrome,它就会根据购票确认邮件中的时间和地点信息,通过停车预订服务SpotHero帮你找到空位。又比如,随着宠物长大、想把定期购买的内容从幼犬粮换成成犬粮时,也可以让Chrome在购物服务Chewy上更新订单。其优点在于,把过去需要自己点开一个又一个页面的操作,浓缩成一句简短的指示。

安全方面的考量与提供范围

在便利性提升的同时,让浏览器自动执行操作也难免令人担心。谷歌表示,将沿用与桌面端相同的安全防护,保护用户免受把恶意指令混入页面的"提示注入(prompt injection)"等新型威胁。此外,auto browse的设计是,在完成购买商品、向社交平台发布等需要慎重的操作前,必定会请求确认。

提供将于6月底起,面向在美国搭载安卓12及以上系统的对象设备分阶段开始。使用条件为内存4GB以上,且语言设置为英语(美国)。Gemini in Chrome和Nano Banana可在对象设备上广泛使用,而auto browse则面向美国的付费套餐"AI Pro""Ultra"的订阅用户。目前以英语圈为主,不过包括日本在内的地区扩展也将成为今后的看点。

总结

此次发布把页面总结、问答、用Nano Banana编辑图片,乃至用auto browse自动完成操作都汇聚到安卓版Chrome之中,让浏览器本身更接近AI的工作场所。即使在手机的小屏幕上,也能不在各应用间来回切换地完成查资料和日常操作。眼下是从美国的对象设备开始分阶段提供,且各功能的使用条件各不相同,但作为改变浏览器使用方式的动向,值得持续关注。