
GitHub 于 2026 年 7 月 28 日宣布,xAI 的 Grok 4.5 开始逐步加入 GitHub Copilot。GitHub 将它描述为面向快速 agentic coding 和复杂 multi-step workflow 的 reasoning model,并列出最多 500,000 tokens 的 context window、文字及图像输入,以及 low、medium、high 三种 reasoning effort。
可用范围是这次更新的另一个重点。Grok 4.5 会在 Visual Studio Code、Visual Studio、Copilot CLI、Copilot cloud agent、Copilot app、JetBrains、Xcode 和 Eclipse 的 model picker 中陆续出现,适用于 Copilot Pro、Pro+、Max、Business 和 Enterprise。GitHub 明确提醒 rollout 会逐步进行,因此不同账户未必会同时看到这个模型。
GitHub 也表示,内部测试中 Grok 4.5 在 Visual Studio Code 和 Copilot CLI 的 terminal coding tasks 有良好表现,尤其适合并行 dispatch tools、直接采取行动、探索和处理复杂任务。这是 GitHub 对内部测试的描述,不是公开、可重现的独立 benchmark;实际结果仍会受 repo 结构、工具权限、提示和验证流程影响。
对 Business 和 Enterprise 管理员来说,模型的可用性不等于立即开放。GitHub 指出管理员必须在 Copilot settings 启用 Grok 4.5 policy,而且该 policy 默认关闭。这种设计把模型选择放进企业治理范围,让团队可以先考虑数据、合规、成本和 agent 行为,再决定是否加入 model picker。
费用也不能忽略。GitHub 指出 Grok 4.5 按 provider list pricing 进行 usage-based billing。对长时间或大量并行 agent session,500,000 tokens 的 context 上限可能有助于减少重复交代背景,但不代表每次任务都会更便宜或更准确。成本应按真实 token、工具调用、重试和人工复核时间衡量。
这次更新显示,模型竞争正通过受治理的 coding platform 落地,而不只是把模型放在独立聊天界面。真正要评估的不是 model picker 中多了一个名字,而是模型能否在限定权限下完成任务、能否留下可检查的工作记录,以及失败时能否停在人工批准点。
Grok 4.5 的 rollout、企业 policy 和 usage-based billing 都代表「可用」是有条件的。开发团队若要采用,应自行测试代码质量、工具使用、数据边界、成本和回滚流程,再把 provider 或 GitHub 的内部测试结果放进更完整的证据链。



