Google June AI roundup:Gemini 3.5 Flash computer use 把 custom agent 推向真实界面

Google 在 2026 年 7 月 1 日整理 6 月 AI 更新,其中 Gemini 3.5 Flash computer use preview 显示 custom agent 正走向 desktop、mobile 和 browser 操作。

Google 在 2026 年 7 月 1 日发布 6 月 AI 更新整理,涵盖 Gemini、Gemma、Veo、NotebookLM、AI Mode、Google Cloud、Android 以及开发者工具。当中最值得企业留意的,是 Gemini 3.5 Flash computer use model preview。

Google 把这个 preview 描述为让开发者建立 custom agents,可在 desktop、mobile 和 browser environment 中看见、推理和采取行动。这代表 agent 的能力正在由「读文字和调用 API」走向「操作实际界面」。对很多企业流程来说,这是关键一步,因为现实工作往往仍然存在于网页后台、SaaS 界面、表格、PDF 和手机流程之间。

文章同时提到 Gemini 3.5 Flash-Lite、Veo 4、Gemma 4、Android Studio agent mode、Firebase Studio、Google AI Edge Gallery 等更新。这些产品线看似分散,但共同方向很清楚:Google 正把 AI 放进模型、内容生成、开发工具、边缘装置和云端工作流。

Computer use 对 agent workflow 特别重要。很多企业并没有干净 API,也没有完全结构化的资料流。若 agent 可以可靠地看见界面、判断下一步、填写表单、读取状态和等待回应,就可以把旧系统、浏览器工具和新 AI pipeline 接起来。

不过这类能力也带来安全要求。Agent 进入 browser 或 mobile 操作层后,权限、登入状态、资料遮蔽、操作审批和 audit log 都必须明确。否则,企业很容易把「自动化」变成难以追踪的黑箱操作。

对开发者而言,Google 这轮更新也显示 AI product stack 正分层成形。Gemini 提供核心模型能力,Gemma 面向可部署或可微调场景,Firebase Studio 和 Android Studio agent mode 把 AI 放进建置流程,AI Edge Gallery 则让 on-device AI 更容易测试。

这篇 roundup 的重点不是单一功能,而是 agent-ready ecosystem 正在成形。当模型能处理多模态输入、开发工具能交给 agent 操作、云端和边缘都有部署路径,企业就会更容易把 AI 由内容生成带入可执行的 workflow automation。

MODULE.002 //

更多 Insights

分享网站、AI automation、数码营销、AI news 和 VMTS 公司新闻。