Gemini 3.6 Flash 进入 GitHub Copilot:模型选择开始贴近长流程 agent

GitHub 于 7 月 21 日开始把 Gemini 3.6 Flash 推出到 Copilot,支持可调整推理力度和并行工具使用,面向 coding、网页开发及较长流程的 agent 任务。

GitHub 于 2026 年 7 月 21 日宣布,Google 的 Gemini 3.6 Flash 开始逐步加入 GitHub Copilot。这次更新的重点不是单纯多一个模型名称,而是模型选择器开始直接对应不同工作类型,包括网页和应用开发、一般 coding,以及需要多步骤执行的长流程 agent 任务。

GitHub 表示,Gemini 3.6 Flash 支持可调整的推理力度,以及在复杂工作流程中并行使用工具。这让模型可以按任务需要在速度、推理深度和工具协作之间取舍。对 coding agent 而言,工具并行影响的不只是回复速度,也包括搜索文件、执行检查和整理变更时的整体等待时间。

GitHub 同时表示,早期测试中 Gemini 3.6 Flash 在 coding 和 agentic workflow 的任务完成率及 token 效率高于 Gemini 3.5 Flash。这些是 GitHub 公布的早期测试描述,不等同于跨模型、跨代码库都能重复得到的独立基准结果;实际差异仍会取决于任务长度、工具、测试覆盖和人工复核。

这个模型会向 Copilot Pro、Pro+、Max、Business 和 Enterprise 用户推出,并可在 Visual Studio Code、Visual Studio、Copilot CLI、GitHub Copilot cloud agent、Copilot app、JetBrains、Xcode 和 Eclipse 等界面选择。GitHub 强调 rollout 会逐步进行,企业方案也需要管理员先在 Copilot 设置中启用 Gemini 3.6 Flash Preview policy。

费用方面,GitHub 说明这个模型按供应商的 list pricing 进行 usage-based billing。这让“更快”和“更便宜”不能直接画上等号:模型可以在单次任务使用更少 token,但如果推理力度提高、工具调用增加或人工复核变多,工作流程的总成本仍可能不同。

因此,模型选择器正在变成 agent 平台的一个控制面。团队需要按任务类型测试完成率、延迟、token 消耗、失败重试和 review 时间,而不是只看模型在一般问答中的表现。长流程 agent 尤其要测试它能否在自己的代码库、测试和权限边界内持续工作。

Gemini 3.6 Flash 进入 Copilot 的信号,是模型市场正在由“哪个模型最强”转向“哪个模型在这条工作流程的成本和可靠性最合适”。可调整推理和并行工具让这个选择更灵活,但也要求团队建立更清楚的任务级评估方法。

MODULE.002 //

更多 Insights

分享网站、AI automation、数码营销、AI news 和 VMTS 公司新闻。