
xAI 在 2026 年 8 月 28 日的 developer release notes 更新 Imagine image API。这次不是新模型公告,而是针对 grok-imagine-image-2.0 的输入、画面比例和质量控制:image editing 每次最多可以接收五张 source image,比之前的三张增加;生成和编辑新增 21:9 cinematic widescreen 及 5:2 wide banner;quality 参数则接受 auto。
质量默认值也有实际成本含义。xAI 表示,当用户不传 quality 时,默认由 medium 改为 auto;目前 auto 对 image generation 使用 low,对 image editing 使用 medium,费用按实际服务的质量计算。如果需要可预测的成本和输出设置,应明确传入 low 或 medium,而不是把「省略参数」当成固定配置。
对于内容团队而言,多参考图和新比例把 API 更贴近 production creative workflow。可以把产品主图、材质、包装角度、品牌色和构图参考拆成不同输入,再为横幅、社交平台或网站 hero 产生对应画面。这是工作流层面的可能性,不代表五张图一定会被模型同等理解,也不代表新比例会自动带来更好的点击或转化结果。
较稳妥的做法,是为每张 reference image 定义清楚角色,并固定一组代表性素材做回归测试:主体是否保留、文字是否需要后期处理、产品比例是否失真、画面是否符合渠道安全规则,以及一次生成所消耗的成本。如果工作流追求预算稳定,应在应用层记录 quality、输入张数、比例和实际用量,避免由 auto 带来不可见的成本变化。
这次更新也把「参考图」从创作选项变成 API 设计问题。多张输入可以提高可控性,但同时增加素材权利、版本管理和错误诊断的要求。团队要保留每次生成的 prompt、reference image id、quality 和输出版本,才可以知道问题来自素材、指令、比例,还是模型本身。
截至 xAI release notes 的 8 月 28 日记录,公告只描述 API 功能和计费规则,没有提供跨比例的质量 benchmark 或 marketing performance 数据。开发者在切换前应先确认 SDK、账户权限和实际 endpoint 行为,再以自己的图片资产做小规模验证。



