
▲Google Gemini。(圖/Google)
記者吳立言/綜合報導
Google 近期開始向 Chrome 用戶推出全新的 「Select from screen(選取畫面)」 功能,讓使用者能直接選取目前網頁上的文字或圖片,並將內容附加到 Gemini 對話中,大幅減少手動複製、截圖或描述畫面的步驟,讓 AI 更容易理解使用者真正想詢問的內容。
Chrome 內建畫面選取工具
這項功能位於 Chrome 內 Gemini 的「+」選單中,操作方式類似內建截圖工具。啟用後,使用者可直接框選目前分頁上的文字或圖片,所選內容會自動加入 Gemini 提示詞,AI 可立即針對指定內容回答問題,而不需要使用者自行描述網頁資訊。新功能已隨 Chrome 149 陸續推送,不過部分用戶可能需要重新啟動或更新瀏覽器後才會看到新選項。
▼Gemini 可直接讀取、理解 Chrome 畫面內容。

Gemini 朝情境感知助理發展
此次更新也代表 Google 持續將 Gemini 從傳統聊天機器人,逐步發展成更了解使用者操作情境的 AI 助理。透過直接取得使用者目前瀏覽的內容,Gemini 能更精準掌握提問背景,提供更符合需求的回答與建議。
Gemini 3.5 Flash 同步加入 Computer Use
除了 Chrome 新功能外,Google 同日也宣布,開發者現已可透過 Gemini 3.5 Flash 使用 Computer Us(電腦使用)能力,讓 AI 代理能直接查看並操作瀏覽器、手機 App 與桌面環境,不需額外切換其他模型。這項能力可協助完成軟體測試、企業工作流程,以及其他需要多步驟操作的自動化任務,進一步提升 AI Agent 在實際工作場景中的應用能力。
AI 助理朝「理解畫面」邁進
相較於新增單一功能,這次更新更大的意義在於降低人機互動門檻。使用者無須再花時間描述螢幕上的內容,只要直接指定畫面,Gemini 即可根據實際情境理解問題,協助完成資訊整理、內容解讀與後續操作,也反映 Google 正持續推動 AI 助理朝更具情境理解能力的方向發展。
