3. Imagine 智能体(Agent)
Imagine 智能体(Agent)是 Grok 于 2026 年 5 月推出的创作模式(目前为 Beta 阶段),仅在网页端开放,需 SuperGrok 或更高级别的付费订阅。与「图片」「视频」的单次「描述—生成」不同,Agent 模式会把一句话目标自动拆解为「规划 → 生成 → 编辑」的多步流程,并将多张图片与多段短视频片段整合为更完整的成品,适合制作系列概念图、短片、产品故事等。
进入方式

进入 Imagine 页面后,在底部输入框工具栏点击「Agent」,即可从「图片」「视频」切换至智能体模式。
开始创作

切换后,输入框上方会展开参考图区域:可点击「上传或丢弃图像」上传本地图片,或直接将图片拖入;此前用过的图片会显示在右侧,方便复用。随后在「您想要创建什么?」中用一句话描述想要的成品并提交,智能体会先规划再依次产出画面,可在结果基础上继续追加指令、逐步迭代。点击输入框左侧的「✕」可退出智能体模式。
提示词技巧
Agent 模式更接近「下达创作目标」而非「描述单张画面」。一句话指令宜包含:成品形式 + 主题与风格 + 关键场景或分镜 + 风格基调。先用一句话说清整体目标,再针对产出结果逐步追加细节,往往比一次性写满所有要求更高效;若已上传参考图,则只需说明希望在此基础上发生的变化。
提示:Agent 模式目前最高输出 720p(暂不支持 1080p/4K);得益于 Imagine Video 1.5,视频可一并生成同步音频。跨多段画面时,人物形象仍可能出现细微漂移,可借助参考图或在指令中为角色命名来保持一致性。
示例一:世界观概念
示例二:产品短片
示例三:品牌视觉

评论
0 条