精准遵循指令
细致执行包含布局和排版的复杂提示词,让多元素的密集画面保持完整。
Grok Imagine Image 2.0 是 xAI 的新一代图像模型,面向真正的创意生产,而不是一次性的噱头。它能够细致遵循指令,并像设计师一样规划排版和布局。Muapi 将它提供为两个相互衔接的端点:grok-imagine-image-2 用于文本转图像生成,grok-imagine-image-2-edit 用于对之前的生成结果进行定向后续编辑;两者都采用所有模型通用的异步提交与轮询模式。
Grok Imagine Image 2.0 API 已在 Muapi 上线
创建 Muapi API 密钥,提交生成请求,然后轮询返回的 request ID 获取最终图像。
xAI 将 Image 2.0 的编辑能力作为核心能力打造,而不是简单附加在生成功能之上,同时也进一步增强了模型对生成指令的遵循能力。
细致执行包含布局和排版的复杂提示词,让多元素的密集画面保持完整。
通过 request ID 编辑之前的 Grok Imagine Image 2.0 生成结果,无需重新描述整个场景。
只修改提示词描述的区域(也可以使用 mask_indexs 指定范围),同时保留图像的其余部分。
支持 1:1、2:3、3:2、16:9 和 9:16,适配不同发布位置。
小字号文字和密集排版也清晰可读,适合海报、信息图和 UI 原型。
在连续的链式编辑中保持主体、风格和构图一致。
xAI 表示,截至 2026 年 8 月,Image 2.0 在公开 Arena 排行榜的文本转图像和图像编辑两个项目中均位列全球第二,并针对摄影、设计和插画场景进行了高保真训练。
Grok Imagine Image 2.0 使用 Muapi 统一的认证、任务生命周期、文件上传和计费基础设施,与 Grok Imagine 模型采用相同的模式。
| 端点 | 用途 | 输入 | 输出 | 价格 |
|---|---|---|---|---|
| grok-imagine-image-2 | 文本转图像生成 | prompt、aspect_ratio | 新图像 + request_id | $0.05/次调用 |
| grok-imagine-image-2-edit | 链式后续编辑 | prompt、request_id、可选 mask_indexs | 优化后的图像 + request_id | $0.05/次调用 |
制作需要保持小字号文字、层级和布局清晰的密集构图。
生成精致的创意概念,并在无需重做整个场景的情况下优化指定区域。
在连续创意编辑中保持主体、风格和构图的一致性。
两个端点使用相同的 Muapi REST 合约。通过 x-api-key 请求头提交 JSON,然后轮询标准预测端点。编辑会基于之前生成结果的 request_id 链接执行。
curl -X POST https://api.muapi.ai/api/v1/grok-imagine-image-2 \
-H "x-api-key: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"prompt":"A high-contrast halftone portrait in fine white dots on black", "aspect_ratio":"1:1"}'返回 request_id。轮询 /predictions/{request_id}/result,直到任务完成。
curl -X POST https://api.muapi.ai/api/v1/grok-imagine-image-2-edit \
-H "x-api-key: YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"prompt":"Change the jacket to a teal windbreaker", "request_id":"REQUEST_ID"}'传入第 1 步或之前编辑返回的 request_id,继续完善同一图像。也可以添加 mask_indexs。
Image 2.0 专注于精准遵循指令、为密集视觉内容渲染清晰的排版与布局,并提供专用的后续编辑端点,支持迭代完善。
可以,通过独立的 grok-imagine-image-2-edit 端点进行。传入之前 Grok Imagine Image 2.0 生成结果的 request_id 和描述编辑内容的提示词,模型会在保留其余图像内容的同时应用定向修改。
不可以。编辑必须基于之前 Grok Imagine Image 2.0(或编辑端点)生成结果的 request_id,而不是任意上传的图像。
这是一个可选的片段索引数组,来自源生成结果,可以将编辑范围限制在特定区域,而不是整张图像。
文本转图像生成支持 1:1、2:3、3:2、16:9 和 9:16。
创建 Muapi API 密钥,在 x-api-key 请求头中传入密钥,然后调用 grok-imagine-image-2 端点;需要后续编辑时调用 grok-imagine-image-2-edit。
每次生成和每次后续编辑均按 $0.05/次调用计费,与 Grok Imagine 阵容中的其他模型相同。
创建 API 密钥,通过两个相互衔接的端点开始生成或优化图像。