
Google 于 2026 年 7 月 31 日公布 7 月 Gemini Drop,这次更新把重点由聊天功能推向可以长时间运行的个人 agent,以及能够在浏览器内执行多步骤工作的 Chrome 能力。
Gemini Spark 正向全球扩展,Google 描述它可以在用户合上 laptop 后继续运行,协助整理长时间任务。不过,官方脚注列明 Spark 暂不适用于 EEA、英国、瑞士和尼日利亚,因此「全球」仍然受到地区和账户条件限制。更新也包括 macOS 语音功能、Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite;速度和推理改善属于 Google 的产品描述,并不等同于独立 benchmark 结论。
另一篇 7 月 30 日的 Google 更新则把 Gemini Spark 带入 Chrome 的 auto browse。经过用户许可后,功能可以使用已登录的账户和保存的密码,处理例如安排看房、研究航班或开始预订等网上事务;涉及付款等敏感步骤时,系统会把控制权交回用户。Google 表示会加入 prompt injection 防护,但这个功能初期在美国推出,并不是所有地区同步可用。
这种产品形态的核心变化,是 agent 的活动范围由对话窗口移到浏览器、账户和外部网站。权限提示、敏感操作交还人工和 prompt injection 防护,都是必要的第一层控制;实际使用时仍要清楚知道 agent 可以看到哪些页面、使用哪个身份、能否保留登录状态,以及出错后怎样停止或撤回。
Google 同时把 AI Pro 的 Spark 更新推向超过 160 个新增国家和地区,反映个人 agent 正由实验功能变成平台分发问题。对用户和产品团队来说,真正需要验证的不是「它能不能做」,而是地区可用性、账户权限、敏感动作的 human-in-the-loop 及操作记录是否清楚。
7 月 Gemini Drop 的信号很直接:当 AI 开始代替用户浏览和处理外部流程,产品设计要同时处理能力、同意、身份和可恢复性。功能越方便,权限边界就越需要在每一步显示,而不是只在首次启用时用一个总开关带过。



