
grok-imagine-image-2Grok Imagine Image 2.0 是 xAI 的图像模型,目标只有一个:做出能直接投入工作的图。它像设计师那样规划排版与版面 —— 我们用一张 2K 海报实测过:指定的标题、日期行和底部小字网址,三处全部逐字正确、清晰可读。它一次调用最多融合 3 张参考图,并且认得清哪个主体该放在哪儿(三个不同物体的融合实测下来,三个都各自可辨,不是照着文字重画的);第 4 张会被明确报错拒绝,而不是静默丢掉 —— 静默丢弃会让你误以为融合成功了。编辑时它保主体也保场景:一张红色茶壶要求改成藏青,壶型、木桌纹理、窗光、窗台植物、背景木椅全部留住,只有颜色变了。 一条实测得出、而非假设的提醒:它是在同一场景下重绘,不是在原图上逐像素修改,所以每次输出的机位、裁切和主体大小都会变。换色、换材质、加减物件、多图融合都很合适;如果你的要求是「只动这一处、其余像素一个都不许变」,那该用 GPT Image 2 或 Nano Banana Pro 那条线。另一条限制同样要说清楚:它做不了透明背景 —— 要求 alpha 通道时,它会把那种灰白棋盘格当成普通像素画出来,返回的 PNG 是 RGB、根本没有 alpha,缩略图上看着像抠好的图,其实不是(2K 编辑和 2K 文生图两条路径我们都试过,结果一样)。需要去背请另接一个专门的抠图步骤。 价格按分辨率 × 质量分四档:1K low $0.03、2K low $0.04、1K medium $0.045、2K medium $0.06(每张)。quality 只有 low 和 medium 两个值、省略即 medium —— 所以不显式传 quality 就是在买 medium 档。四档相对 xAI 官方标价都便宜 25%,其中 2K low 便宜 33%。参考图不额外收费(xAI 按每张输入图 $0.01 加收,我们不转嫁),所以图生图和文生图同价。画幅 14 种,含 19.5:9、9:19.5、20:9、9:20 四种超宽 —— 这四种是逐个实调验过的(19.5:9 实测出 1248×576),不是抄规格表,我们另一条 Grok 渠道恰恰就拒收它们。一个 API Key 直接调,无需单独的 xAI 账号,国内可直连,失败不扣费。
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
Asked for an exact headline, a date line and a small-print URL on a 2K poster, all three came back legible and character-for-character correct — checked against the live model, not quoted from a launch post.
Send up to three reference images and say which goes where; the model keeps each subject identifiable rather than redrawing them from the text. A fourth is rejected outright instead of being silently dropped.
Recolour a product and the object, the surface, the lighting and the surrounding props all carry over. What does not carry over is the framing — see the next point.
Composition and crop shift between passes: the subject may sit closer, the camera angle may change. Ideal for recolouring, restyling, adding or removing elements. The wrong tool when the brief is "change this one thing and nothing else".
Ask for a transparent background and it paints the grey-and-white checkerboard as ordinary pixels; the PNG carries no alpha channel. The result looks like a cutout in a thumbnail and is not one. Use a dedicated background-removal step instead.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — 25% under xAI list on three tiers and 33% under on 2K Low. Reference images cost nothing extra here, though xAI bills $0.01 each. Fourteen aspect ratios including 19.5:9 and 20:9.
Grok Imagine Image 2.0 是由 xAI 提供的图片生成 API。Grok Imagine Image 2.0 是 xAI 的图像模型,目标只有一个:做出能直接投入工作的图。它像设计师那样规划排版与版面 —— 我们用一张 2K 海报实测过:指定的标题、日期行和底部小字网址,三处全部逐字正确、清晰可读。它一次调用最多融合 3 张参考图,并且认得清哪个主体该放在哪儿(三个不同物体的融合实测下来,三个都各自可辨,不是照着文字重画的);第 4 张会被明确报错拒绝,而不是静默丢掉 —— 静默丢弃会让你误以为融合成功了。编辑时它保主体也保场景:一张红色茶壶要求改成藏青,壶型、木桌纹理、窗光、窗台植物、背景木椅全部留住,只有颜色变了。 一条实测得出、而非假设的提醒:它是在同一场景下重绘,不是在原图上逐像素修改,所以每次输出的机位、裁切和主体大小都会变。换色、换材质、加减物件、多图融合都很合适;如果你的要求是「只动这一处、其余像素一个都不许变」,那该用 GPT Image 2 或 Nano Banana Pro 那条线。另一条限制同样要说清楚:它做不了透明背景 —— 要求 alpha 通道时,它会把那种灰白棋盘格当成普通像素画出来,返回的 PNG 是 RGB、根本没有 alpha,缩略图上看着像抠好的图,其实不是(2K 编辑和 2K 文生图两条路径我们都试过,结果一样)。需要去背请另接一个专门的抠图步骤。 价格按分辨率 × 质量分四档:1K low $0.03、2K low $0.04、1K medium $0.045、2K medium $0.06(每张)。quality 只有 low 和 medium 两个值、省略即 medium —— 所以不显式传 quality 就是在买 medium 档。四档相对 xAI 官方标价都便宜 25%,其中 2K low 便宜 33%。参考图不额外收费(xAI 按每张输入图 $0.01 加收,我们不转嫁),所以图生图和文生图同价。画幅 14 种,含 19.5:9、9:19.5、20:9、9:20 四种超宽 —— 这四种是逐个实调验过的(19.5:9 实测出 1248×576),不是抄规格表,我们另一条 Grok 渠道恰恰就拒收它们。一个 API Key 直接调,无需单独的 xAI 账号,国内可直连,失败不扣费。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06。





快速生成高质量产品展示图,适用于电商平台、广告素材等场景。
为社交平台创建吸引眼球的视觉内容,提升互动率和品牌曝光。
生成游戏角色、场景、道具等概念设计图,加速游戏开发流程。
制作海报、Banner、宣传图等营销物料,降低设计成本。
Grok Imagine Image 2.0 通过 APIMODELS 平台调用,当前定价:1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Grok Imagine Image 2.0 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
档位 = resolution × quality:1K low $0.03、2K low $0.04、1K medium $0.045、2K medium $0.06(每张)。quality 只有 low 和 medium 两个值,省略即 medium——**所以不显式传 quality 就是在买 medium 档**。低成本批量草稿用 1K low;要投放的成品用 2K medium。参考图不额外收费:xAI 按每张输入图 $0.01 加收,我们不转嫁,所以图生图和文生图同价。四档相对 xAI 官方标价都便宜 25%,其中 2K low 便宜 33%。
最多 3 张。单张用 image_url(或 image_base64),多张用 image_urls 传数组,在 prompt 里用 <IMAGE_0>、<IMAGE_1> 指代。第 4 张会被明确报错拒绝,而不是静默丢掉——这点很重要,静默丢弃会让你以为融合成功了。参考图一律不额外收费。编辑时若不传 aspect_ratio,输出比例跟随第一张输入图;传了则以传的为准。实测三张不同物体的融合,三个主体都各自可辨,不是照着文字重画的。
14 种:1:1、16:9、9:16、4:3、3:4、3:2、2:3、2:1、1:2,加上四种超宽 19.5:9、9:19.5、20:9、9:20,以及 auto。超宽这四种是逐个实调验过的(19.5:9 实测出 1248×576),不是抄规格表——我们另一条 Grok 渠道就拒收这四种,所以这份表按渠道分别核过。图改图时不传 aspect_ratio 会跟随第一张输入图的比例。
它保主体和场景,但**会重新构图**。实测:给一张红色茶壶的照片、要求改成藏青色,壶的器型、木桌纹理、窗光、窗台植物、背景木椅全部保留,只有颜色变了;要求在旁边加一只白瓷杯,杯子加上了而茶壶颜色没被顺手改动。但每一次输出的机位、裁切和主体大小都会变——它是在同一场景下重绘,不是在原图上逐像素修改。所以换色、换材质、加减物件、多图融合都很合适;如果你的要求是「只动这一处、其余像素一个都不许变」,那该用 GPT Image 2 或 Nano Banana Pro 那条线。
不能。要求「透明背景、alpha 通道」时,它会把那种灰白棋盘格当成普通像素画出来,返回的 PNG 是 RGB、根本没有 alpha 通道——缩略图上看着像抠好的图,其实不是。2K 编辑和 2K 文生图两条路径我们都试过,结果一样。需要去背请另接一个专门的抠图步骤,别指望这个模型的提示词能做到。
2.0 是新一代,强在排版与多图融合:我们用 2K 海报实测过,指定的标题、日期行和底部小字网址全部逐字正确、清晰可读;一次调用最多融合 3 张参考图,第 4 张会被明确拒绝而不是静默丢掉。价格也更低,$0.03 起,而 Pro 是 $0.08(1K)/ $0.12(2K)。Pro 仍然是 1.0 引擎的高细节档,适合已经按它调好的存量流程。两者在 apimodels.app 是同一套接口、同一把 Key,切换只改 model 这一个字符串。
在 APIMODELS,Grok Imagine Image 2.0 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 Text to Image、Multi-Image Editing (up to 3)、Typography & Layout、14 Aspect Ratios、1K/2K × Low/Medium、From $0.03,你可以在价格和能力上把它和其它图片生成模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有图片生成模型与实时价格见 apimodels.app/models。
Grok Imagine Image 2.0 支持:Text to Image、Multi-Image Editing (up to 3)、Typography & Layout、14 Aspect Ratios、1K/2K × Low/Medium、From $0.03。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Grok Imagine Image 2.0,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。
社区作者公开的提示词,可直接复制修改。每条都标注作者并回链原帖。

老水手与渔船纪实摄影
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
作者 OpenAI

自动咖啡机工作流程信息图
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
作者 OpenAI

Thread 街头服饰广告
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
作者 OpenAI