GitHub Copilot browser tools GA:coding agent 開始真正操作瀏覽器

GitHub 在 2026 年 7 月 1 日宣布 VS Code 內的 Copilot browser tools 正式可用,讓 agent 可以開頁、點擊、輸入、讀取 console error 和截圖,同時保留使用者權限控制。

GitHub 在 2026 年 7 月 1 日宣布,VS Code 內的 GitHub Copilot browser tools 已經一般可用。這個更新的重點不是多一個瀏覽器視窗,而是 AI coding agent 終於可以在開發環境內操作真實網頁,直接檢查 live web app 的狀態。

官方說明列出的能力很具體:agent 可以開頁、導航、點擊、輸入、hover、拖拉、處理 dialog、讀取頁面內容、捕捉 console error、截圖,亦可以在步驟較多時執行 scripted flow。對前端和全端開發來說,這代表 agent 不再只是在 codebase 裏猜測問題,而是可以接近人手測試流程。

這種能力會改變 AI coding workflow 的分工。過去 agent 可以改檔案和跑測試,但很多 UI 問題仍然需要人打開 browser 驗證。現在 agent 可以在 VS Code 裏直接打開頁面、嘗試流程、回傳觀察,再把修正建議放回 chat。它未必取代 E2E 測試,但會令 debug loop 更短。

GitHub 亦把控制權講得很清楚。使用者自己開的 tabs 預設是 private,agent 只有在使用者選擇分享時才可以讀取或互動;agent 自己開的 tabs 亦在隔離 session 裏運作,不會接觸日常瀏覽的 cookies 和 storage。camera、microphone、location、notifications 和 clipboard read 等敏感權限仍要逐項批准。

企業控制亦是這次 GA 的重要部分。管理員可以用專用開關管理 browser tools,並透過 existing network domain controls 限制 agent 和內置 browser 可到達哪些網站。對企業來說,browser-capable agent 的價值和風險都比純文字 agent 高,domain allow/deny list 會變成基本治理層。

這條新聞最值得留意的地方,是 agentic coding 正由「改 code」走向「觀察、操作、驗證」。當 agent 能同時讀 repo、改檔案、開 browser、看 console、截圖和回報結果,developer 對 AI 的使用會更接近委派一段工程任務,而不是問一條程式問題。

MODULE.002 //

更多 Insights

分享網站、AI automation、數碼營銷、AI news 和 VMTS 公司新聞。