OpenAI 更新了 ChatGPT Work 的雲端瀏覽器,讓工作能在需要登入的網站上繼續進行。使用者透過專用表單自行輸入帳號,接著把後續操作交回給 ChatGPT。輸入的使用者名稱與密碼不會送到模型端,ChatGPT 也不會保存。會計軟體、水電瓦斯的帳戶頁面等過去卡在登入畫面的情境,因此被納入可自動化的範圍。
雲端瀏覽器跑在哪裡
雲端瀏覽器是 ChatGPT Work 專用的瀏覽器,執行在雲端另一台電腦上,而不是使用者手邊的裝置。它能讀取網頁、按下按鈕、在表單中填入資訊,並依序完成各個步驟。就算關掉對話視窗,任務仍會持續執行,只有在需要補充資訊、登入或確認時才會暫停。
可使用的範圍是付費方案,Free 與 Go 不在其中。能不能用還取決於所在地區、推送進度,以及工作區的權限設定。使用者不需要另外選擇雲端瀏覽器,ChatGPT 會依請求內容自行判斷是否動用;若已連接的應用程式能直接完成任務,則會優先採用。
登入資訊不會進入模型的視野
這次更新的重點在於登入的處理方式。當 ChatGPT 走到登入頁面時會先暫停,並提供一個安全的登入表單。使用者在其中填入使用者名稱與密碼,網站若有要求,也可以輸入雙重驗證或安全驗證碼。
在該表單輸入的憑證會直接送往遠端瀏覽器。模型看不到內容,ChatGPT 也不會保存這些憑證。在表單出現之前,另有一個審查模型會檢查這項請求以及資訊的輸入目的地是否有網路釣魚或偽裝的跡象。使用者本人也能確認網址、預覽登入表單,並在繼續之前檢視實際網站。
登入完成後,該登入狀態會維持到工作階段過期為止。下次遇到同一個網站的任務時,不必重新登入就能直接開始作業。
網站存取與關鍵操作各有一道關卡
預設狀態下,開啟新網站之前一定會先徵求使用者許可。設定中的 Cloud browser 提供 3 種方針可選:每次都由本人確認的「一律詢問」、由 ChatGPT 檢查網址並僅在可疑時暫停的「自動核准」,以及允許所有網站的方針,最後一項並不建議採用。針對個別網站的允許與封鎖,優先權高於上述預設方針。
網站存取權限與行為本身的核准是兩回事。像是確認訂位、完成付款這類難以回復,或是會產生金錢、法律、帳戶層面承諾的操作,ChatGPT 會在執行前於對話中要求確認。允許了某個網站,並不代表站內的重要操作也會自動放行。
任務卡住時,ChatGPT 會請使用者接手瀏覽器。使用者也可以主動要求接手,屆時會取得一個能直接操作雲端瀏覽器的連結。
與手邊的瀏覽器完全分開
雲端瀏覽器與裝置上安裝的瀏覽器是完全不同的兩套環境。它擁有自己的 Cookie、瀏覽器資料與登入工作階段,不會讀取使用者開啟的分頁、瀏覽紀錄、已儲存的密碼、擴充功能或既有的登入狀態。就算平常使用的瀏覽器已經登入,雲端瀏覽器這一側仍需重新登入。
想清除已儲存的資料時,可進入設定中的 Cloud browser,在 Browser data 依全部網站或個別網站刪除。清除後會從該網站登出,下次相關任務會再次要求登入。
另外,也有網站限制來自自動化瀏覽器代理的存取。手邊的瀏覽器能正常開啟的頁面,在雲端瀏覽器這邊被擋下的情況是有可能發生的。這屬於網站經營者的判斷,OpenAI 為希望放行的經營者提供了加入允許清單的操作說明。
官方設想的使用情境
OpenAI 舉出的例子包括:查詢餐廳空位、向業者索取報價、尋找符合行程的機票、比較商品供貨狀況與在地庫存、結合已連接的電子郵件與追蹤網站查詢包裹、準備行政窗口的預約、登入水電瓦斯帳戶比較方案、尋找並收藏符合條件的租屋資訊,以及在會計軟體中核對發票並更新紀錄。
任務能推進到哪一步,取決於網站的做法、本人的權限以及流程的複雜度。也存在最後一步必須由使用者親自完成的情形。
風險並未消失
OpenAI 表示已針對提示注入、網路釣魚與非預期操作進行測試,同時明確指出這些防護並無法消除所有風險。使用時值得養成的習慣是:不要把密碼、驗證碼、付款資訊直接貼到對話欄;憑證一律透過安全的登入流程輸入;一旦發現 ChatGPT 開啟了錯誤的網站或開始使用錯誤的資訊,就當場中止任務。
請求的寫法同樣會左右結果。把「在哪個網站、做什麼、做到什麼程度」寫得越具體,確認的往返就越少,出現非預期操作的空間也越小。
總結
雲端瀏覽器能夠跨過登入畫面之後,可以交給 ChatGPT Work 的工作範圍延伸到了企業實際運作的系統內部。讓憑證不進入模型,以及把網站許可與操作核准分成兩層確認,正是支撐這項延伸的前提。先把存取權限維持在「一律詢問」,從出錯也無妨的小事開始嘗試,是比較務實的做法。
