产品Google AI Developers·原文 2026年9月2日本站收录 2026年9月7日

Google Antigravity智能体新增generate_image工具:可按开发规范生成一致产品图片

Google发布《Elevating Antigravity Agent Skills》系列第二部分,详解如何在agent skill中使用generate_image工具,结合结构化提示词生成符合开发规范的商品图,并指出三条避免视觉资产混乱的反模式。

AI解读:Google的Antigravity智能体框架新增了generate_image工具,让开发者可以给AI智能体配上图像生成能力。这套教程的核心是:不要直接把用户输入扔给模型,而是把灯光、镜头、场景等拍摄参数写进技能指令里,让智能体按模板生成图片。这样做的好处是,同一类商品(比如白百合、茉莉、彩色玫瑰)每次生成的图片风格都一致,像专业影棚拍出来的产品图,而不是随机图片。图片会自动存入对话的工件目录,开发者可以用Markdown直接预览,同时支持最多三张参考图做合成。如果你在搭电商网站或开发组件库,需要大量占位图,这个功能能省掉你等人画图或自己PS的等待时间。教程还提醒了三件要避免的事:别把用户原文直接传给生成器,别把图片存在临时目录以防链接失效,别重复生成已经存在的图片浪费算力。目前这套方法主要适用于能创建Antigravity agent的开发者,需要按官方SKILL.md格式编写技能。对普通用户来说,这属于开发者工具更新,不必立即行动,但可以留意后续系列中其他工具的出现。

Google AI Developers于 2025 年 4 月 22 日发布《Elevating Antigravity Agent Skills》系列第二部分,作者James O'Reilly展示了如何在Antigravity智能体技能(agent skills)中使用generate_image工具,让智能体从文本生成器转变为图片工作室,生成符合开发者规范、干净一致的图片。

generate_image工具的工作流程

当Antigravity智能体执行generate_image时,它会将文本提示与视觉参数合成图片,并直接保存到对话工件存储中。工具返回文件的绝对路径,技能可使用标准Markdown语法在聊天响应中渲染图片。

文章以一个植物和花卉电商店的示例技能(generating-mock-images skill)说明了完整流程:智能体将用户提供的商品主题与硬编码的摄影参数(场景、相机、灯光)组合成最终提示,调用generate_image生成图片,然后通过ask_question工具询问开发者是保留、重新生成还是退出。若开发者批准,智能体将文件从临时工件存储复制到 /public/images/目录并返回可点击的链接;若选择删除或重新生成,智能体清除临时工件。

  • generate_image的调用参数包括Prompt、ImageName、AspectRatio以及可选的ImagePaths(可传入最多三个绝对文件路径,用于混合现有徽标、背景纹理或参考线框图)。
  • 文中示例技能的文件结构为 .agents/skills/generating-mock-images/SKILL.md。

视觉资产生成的三个反模式

  • 避免原始提示注入:不要将未经处理的用户输入直接传递给generate_image,应在技能中构建提示生成器,注入场景、灯光、相机等特定参数,以保证输出的一致性。
  • 避免链接失效:使用generate_image返回的绝对工件路径,并将批准的图片移动到永久位置。将资产存储在临时目录(如 /tmp)会导致上下文窗口清除或工作区会话重启时链接失效。
  • 避免冗余调用:在触发generate_image之前,技能应检查是否已存在目标ImageName的有效资产。在没有参数变化的情况下重复生成会浪费计算预算并减慢工作流。

信息来源