
grok-imagine-image-2Grok Imagine Image 2.0 is xAI's image model built for work you ship rather than pictures you look at. It plans typography and layout the way a designer would — on a 2K poster we asked for an exact headline, a date line and a small-print URL, and all three came back legible and character-for-character correct. It fuses up to three reference images in a single call, honouring which subject goes where. And across edits it holds the subject and the scene: change a product's colour and the object, the surface, the light and the surrounding props all carry over. One honest caveat, measured rather than assumed — it re-renders the frame rather than editing pixels in place, so composition and crop shift between passes. That makes it excellent for recolouring, restyling, adding or removing elements and multi-reference composites, and the wrong tool when a brief demands every other pixel stay untouched. Four price tiers from $0.03: 1K or 2K, low or medium quality.
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
Asked for an exact headline, a date line and a small-print URL on a 2K poster, all three came back legible and character-for-character correct — checked against the live model, not quoted from a launch post.
Send up to three reference images and say which goes where; the model keeps each subject identifiable rather than redrawing them from the text. A fourth is rejected outright instead of being silently dropped.
Recolour a product and the object, the surface, the lighting and the surrounding props all carry over. What does not carry over is the framing — see the next point.
Composition and crop shift between passes: the subject may sit closer, the camera angle may change. Ideal for recolouring, restyling, adding or removing elements. The wrong tool when the brief is "change this one thing and nothing else".
Ask for a transparent background and it paints the grey-and-white checkerboard as ordinary pixels; the PNG carries no alpha channel. The result looks like a cutout in a thumbnail and is not one. Use a dedicated background-removal step instead.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — 25% under xAI list on three tiers and 33% under on 2K Low. Reference images cost nothing extra here, though xAI bills $0.01 each. Fourteen aspect ratios including 19.5:9 and 20:9.
Grok Imagine Image 2.0 — это API категории «генерация изображений» от xAI. Grok Imagine Image 2.0 is xAI's image model built for work you ship rather than pictures you look at. It plans typography and layout the way a designer would — on a 2K poster we asked for an exact headline, a date line and a small-print URL, and all three came back legible and character-for-character correct. It fuses up to three reference images in a single call, honouring which subject goes where. And across edits it holds the subject and the scene: change a product's colour and the object, the surface, the light and the surrounding props all carry over. One honest caveat, measured rather than assumed — it re-renders the frame rather than editing pixels in place, so composition and crop shift between passes. That makes it excellent for recolouring, restyling, adding or removing elements and multi-reference composites, and the wrong tool when a brief demands every other pixel stay untouched. Four price tiers from $0.03: 1K or 2K, low or medium quality. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06.





Качественные изображения товаров для интернет-магазинов, рекламы и маркетинговых материалов.
Заметные визуалы для соцсетей, которые повышают вовлечённость и узнаваемость бренда.
Концепт-арт персонажей, локаций и предметов, чтобы ускорить разработку игры.
Постеры, баннеры и промо-графика за долю стоимости обычного дизайна.
Grok Imagine Image 2.0 доступна через APIMODELS по цене: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Grok Imagine Image 2.0 через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
Уровень определяется сочетанием resolution × quality: 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06 за изображение. quality принимает только low или medium, по умолчанию medium — то есть если поле вообще не передать, спишется цена уровня medium. Берите 1K low для черновиков в больших объёмах и 2K medium для того, что пойдёт в публикацию. Референсные изображения ничего не стоят дополнительно: xAI берёт $0.01 за каждое входное изображение, мы это не перекладываем на клиента. Все четыре уровня на 25% дешевле прайса xAI, а 2K low — на 33%.
До трёх. Одно передаётся как image_url (или image_base64); для нескольких используйте массив image_urls и ссылайтесь на них в промпте как <IMAGE_0>, <IMAGE_1>. Четвёртое изображение будет явно отклонено с ошибкой, а не молча проигнорировано — это важно, потому что молчаливый сброс заставил бы вас думать, что композиция удалась. Референсы никогда не тарифицируются отдельно. При редактировании, если не передать aspect_ratio, результат наследует пропорции первого входного изображения. Проверено на трёх разных объектах: все три остались узнаваемыми по отдельности, а не были перерисованы заново по тексту.
Четырнадцать: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, четыре сверхширокие 19.5:9, 9:19.5, 20:9 и 9:20, плюс auto. Сверхширокие четыре проверены по одному на живом канале (19.5:9 вернул 1248×576), а не переписаны из спецификации — другой наш канал Grok как раз отклоняет именно эти четыре, так что список сверен отдельно для каждого канала. При редактировании отсутствие aspect_ratio означает, что вывод следует пропорциям первого входного изображения.
Модель сохраняет объект и сцену, но перерисовывает кадр заново. Измерено: на фото красного чайника попросили сделать его тёмно-синим — форма чайника, текстура дерева, свет из окна, растение на подоконнике и стул позади остались, изменился только цвет; попросили добавить рядом белую чашку — чашка появилась, а чайник остался красным, как и было указано. Что меняется каждый раз — это кадрирование: угол камеры, обрезка и размер объекта плавают, потому что модель перерисовывает сцену заново, а не редактирует пиксели на месте. Отлично подходит для перекраски, смены стиля, добавления или удаления элементов и композиций из нескольких референсов; не тот инструмент, когда задача — «поменяй вот это одно и не трогай больше ни одного пикселя», там лучше подойдут GPT Image 2 или Nano Banana Pro.
Нет. Если попросить прозрачный фон с альфа-каналом, модель нарисует привычную серо-белую шахматную клетку обычными пикселями; возвращаемый PNG — это RGB без какого-либо альфа-канала. На миниатюре результат выглядит как готовая вырезка, но ею не является. Мы проверили и путь 2K-редактирования, и путь 2K-генерации по тексту — результат одинаковый. Если нужно удаление фона, используйте для этого отдельный шаг, а не пытайтесь добиться этого промптом.
2.0 — новое поколение, сильнее в типографике и работе с несколькими референсами: на постере 2K мы попросили точный заголовок, строку с датой и мелкую надпись-URL, и все три вышли читаемыми и совпадающими посимвольно, а один вызов объединяет до трёх референсных изображений, причём четвёртое явно отклоняется, а не отбрасывается молча. К тому же он дешевле — от $0.03 против $0.08 (1K) / $0.12 (2K) у Pro. Pro остаётся высокодетализированным уровнем движка 1.0 и подходит для пайплайнов, уже настроенных под него. Обе модели работают через один и тот же эндпоинт и ключ на apimodels.app, поэтому переключение — это одна строка в поле model.
В APIMODELS Grok Imagine Image 2.0 соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03; вы можете сравнить её по цене и возможностям с другими моделями категории «генерация изображений» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «генерация изображений» с актуальными ценами — на apimodels.app/models.
Grok Imagine Image 2.0 поддерживает: Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Grok Imagine Image 2.0 через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.