Google將把AI助手Gemini內建到Android版的Chrome瀏覽器中,並自6月底起分階段提供。除了為正在瀏覽的頁面製作摘要、針對頁面內容回答問題之外,這次更新還加入了可在瀏覽器內直接編輯圖片的「Nano Banana」,以及讓瀏覽器自動完成預訂停車位等繁瑣操作的「auto browse」。先前在桌面端率先登場的對話式瀏覽體驗,終於擴展到了手邊的裝置上。

讀懂頁面並回答、常駐瀏覽器的AI助手

這次的功能以Google定位為效能最強的「Gemini 3.1」為基礎。在Android版Chrome工具列右上方點擊Gemini圖示,Gemini便會在螢幕下方開啟,可結合你目前所看的頁面進行互動。

能做的事情相當廣泛:為長文製作摘要、用淺顯的說法解釋複雜主題、回答與頁面相關的問題等,全都不必切換到其他應用程式,即可在目前的畫面中完成。由於Gemini會先讀取頁面內容再回答,因此有別於單純的搜尋,它會給出貼合眼前資訊的答案。

Gemini也會與你日常使用的各種Google應用程式連動。你可以從瀏覽器出發,把行程加入日曆、把食譜的食材記到Keep,或從Gmail中找出所需資訊。若開啟「Personal Intelligence」,它還能結合你的興趣嗜好,乃至家人與寵物等脈絡,給出更貼近你個人的回應。

用「Nano Banana」即時加工網頁上的圖片

在圖片方面,Google的影像生成與編輯技術「Nano Banana」被整合進了Chrome。你可以加工在網路上找到的圖片,或從零創作新的視覺素材,整個過程都無須離開瀏覽器。

Google舉的例子很好理解。在網頁上為考試做準備時,你可以請它「把這個頁面變成淺顯易懂的資訊圖表」;在瀏覽租屋資訊時,也可以指示它「把這個房間加工成擺上時下流行的客廳家具的樣子」,隨即就能看到結果。在想把文字資訊加以視覺化整理的情境中,這項功能看來相當實用。

替你分擔繁瑣網路操作的「auto browse」

這次的重頭戲,是在Android上首度可用的「auto browse」。這是一種讓瀏覽器代替使用者完成既定流程之網路操作的所謂代理(agent)型功能。

舉例來說,在出門去看表演前才發現忘了預訂停車位時,只要拜託Chrome,它就會依據購票確認郵件中的時間與地點資訊,透過停車預訂服務SpotHero幫你找到空位。又或者,隨著寵物長大、想把定期購買的內容從幼犬糧換成成犬糧時,也可以讓Chrome在購物服務Chewy上更新訂單。它的優點在於,把過去得自己一頁頁點開的操作,濃縮成一句簡短的指示。

安全方面的考量與推出範圍

在便利性提升的同時,讓瀏覽器自動執行操作也難免令人擔心。Google表示,將沿用與桌面端相同的安全防護,保護使用者免於把惡意指令混入頁面的「提示注入(prompt injection)」等新型威脅。此外,auto browse的設計是,在完成購買商品、向社群平台發文等需要謹慎的操作前,必定會要求確認。

提供將自6月底起,面向在美國搭載Android 12以上系統的對象裝置分階段開始。使用條件為記憶體4GB以上,且語言設定為英語(美國)。Gemini in Chrome與Nano Banana可在對象裝置上廣泛使用,而auto browse則面向美國付費方案「AI Pro」「Ultra」的訂閱使用者。目前以英語圈為主,不過包括台灣、日本在內的地區擴展,也將成為今後的看點。

總結

這次發布把頁面摘要、問答、以Nano Banana編輯圖片,乃至以auto browse自動完成操作都匯聚到Android版Chrome之中,讓瀏覽器本身更接近AI的工作場域。即使在手機的小螢幕上,也能不必在各應用程式間來回切換,就完成查資料與日常操作。眼下是從美國的對象裝置開始分階段提供,且各功能的使用條件各異,但作為改變瀏覽器使用方式的動向,值得持續關注。