
grok-imagine-image-2Grok Imagine Image 2.0 — модель изображений xAI, сделанная не для того, чтобы на картинку смотрели, а для того, чтобы её пускали в работу. Типографику и вёрстку она планирует так, как это сделал бы дизайнер: на постере 2K мы заказали точный заголовок, строку с датой и URL мелким шрифтом — все три вышли читаемыми и посимвольно верными. За один вызов она сводит до трёх референсных изображений и не путает, какой объект куда идёт; четвёртый отклоняется явной ошибкой, а не выбрасывается молча — молчаливая потеря заставила бы вас поверить, что склейка удалась. При редактировании держится и объект, и сцена: красный чайник просили перекрасить в тёмно-синий — форма чайника, фактура деревянного стола, свет из окна, растение на подоконнике и стул на заднем плане остались на местах, изменился только цвет. Одно честное замечание, полученное замером, а не предположением: она перерисовывает кадр заново, а не правит пиксели на месте, поэтому ракурс, кадрирование и масштаб объекта от прохода к проходу смещаются. Для перекраски, смены материала, добавления и удаления объектов и сборки из нескольких референсов это отлично; если задача звучит как «поменять только здесь, остальные пиксели не трогать», берите линию GPT Image 2 или Nano Banana Pro. Второе ограничение стоит знать заранее: прозрачный фон она не делает — на просьбу про альфа-канал она рисует серо-белую шахматку обычными пикселями, а возвращаемый PNG оказывается RGB вовсе без альфы (проверено и на 2K-редактировании, и на 2K text-to-image). Под вырезание фона ставьте отдельный шаг. Цена — четыре тарифа по разрешению и качеству: 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06 за изображение. У quality всего два значения, low и medium, а по умолчанию подставляется medium — то есть, не передав quality явно, вы покупаете medium. Все четыре тарифа на 25% ниже официального прайса xAI, а 2K low — на 33% ниже. Референсные изображения не тарифицируются отдельно (xAI берёт $0.01 за каждое входное изображение, мы это не перекладываем), поэтому image-to-image стоит ровно столько же, сколько text-to-image. Соотношений сторон 14, включая четыре сверхширокие — 19.5:9, 9:19.5, 20:9 и 9:20; они проверены реальными вызовами по одному (19.5:9 дал 1248×576), а не переписаны из таблицы спецификаций: другой наш канал Grok как раз их не принимает. Один API-ключ без отдельного аккаунта xAI, прямой доступ из Китая, неудачные запросы не тарифицируются.
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
Мы задали точный заголовок, строку с датой и URL мелким шрифтом на плакате 2K — все три вышли читаемыми и посимвольно верными. Проверено на живой модели, а не переписано из анонса.
Передавайте до трёх референсных изображений и указывайте, что где; модель сохраняет узнаваемость каждого объекта, а не перерисовывает его по описанию. Четвёртый она честно отклонит с ошибкой, а не отбросит молча.
Перекрасьте товар — сам предмет, фактура поверхности, свет и окружающие детали останутся на месте. Не останется кадрирование: об этом следующий пункт.
Композиция и кадрирование меняются от прогона к прогону: объект может оказаться ближе, ракурс — другим. Отлично для перекраски, смены стиля, добавления и удаления объектов. Не тот инструмент, когда задача — «поменять только это и больше ничего».
Попросите прозрачный фон — и он нарисует серо-белую шахматку обычными пикселями; в PNG нет альфа-канала. В превью похоже на вырезанный объект, но это не он. Убирайте фон отдельным специализированным шагом.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — на 25% ниже прайса xAI в трёх тарифах и на 33% ниже в 2K Low. Референсные изображения у нас не тарифицируются, хотя xAI берёт по $0.01 за каждое. Четырнадцать соотношений сторон, включая 19.5:9 и 20:9.
Grok Imagine Image 2.0 — это API категории «генерация изображений» от xAI. Grok Imagine Image 2.0 — модель изображений xAI, сделанная не для того, чтобы на картинку смотрели, а для того, чтобы её пускали в работу. Типографику и вёрстку она планирует так, как это сделал бы дизайнер: на постере 2K мы заказали точный заголовок, строку с датой и URL мелким шрифтом — все три вышли читаемыми и посимвольно верными. За один вызов она сводит до трёх референсных изображений и не путает, какой объект куда идёт; четвёртый отклоняется явной ошибкой, а не выбрасывается молча — молчаливая потеря заставила бы вас поверить, что склейка удалась. При редактировании держится и объект, и сцена: красный чайник просили перекрасить в тёмно-синий — форма чайника, фактура деревянного стола, свет из окна, растение на подоконнике и стул на заднем плане остались на местах, изменился только цвет. Одно честное замечание, полученное замером, а не предположением: она перерисовывает кадр заново, а не правит пиксели на месте, поэтому ракурс, кадрирование и масштаб объекта от прохода к проходу смещаются. Для перекраски, смены материала, добавления и удаления объектов и сборки из нескольких референсов это отлично; если задача звучит как «поменять только здесь, остальные пиксели не трогать», берите линию GPT Image 2 или Nano Banana Pro. Второе ограничение стоит знать заранее: прозрачный фон она не делает — на просьбу про альфа-канал она рисует серо-белую шахматку обычными пикселями, а возвращаемый PNG оказывается RGB вовсе без альфы (проверено и на 2K-редактировании, и на 2K text-to-image). Под вырезание фона ставьте отдельный шаг. Цена — четыре тарифа по разрешению и качеству: 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06 за изображение. У quality всего два значения, low и medium, а по умолчанию подставляется medium — то есть, не передав quality явно, вы покупаете medium. Все четыре тарифа на 25% ниже официального прайса xAI, а 2K low — на 33% ниже. Референсные изображения не тарифицируются отдельно (xAI берёт $0.01 за каждое входное изображение, мы это не перекладываем), поэтому image-to-image стоит ровно столько же, сколько text-to-image. Соотношений сторон 14, включая четыре сверхширокие — 19.5:9, 9:19.5, 20:9 и 9:20; они проверены реальными вызовами по одному (19.5:9 дал 1248×576), а не переписаны из таблицы спецификаций: другой наш канал Grok как раз их не принимает. Один API-ключ без отдельного аккаунта xAI, прямой доступ из Китая, неудачные запросы не тарифицируются. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06.





Качественные изображения товаров для интернет-магазинов, рекламы и маркетинговых материалов.
Заметные визуалы для соцсетей, которые повышают вовлечённость и узнаваемость бренда.
Концепт-арт персонажей, локаций и предметов, чтобы ускорить разработку игры.
Постеры, баннеры и промо-графика за долю стоимости обычного дизайна.
Grok Imagine Image 2.0 доступна через APIMODELS по цене: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Grok Imagine Image 2.0 через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
Уровень определяется сочетанием resolution × quality: 1K low $0.03, 2K low $0.04, 1K medium $0.045, 2K medium $0.06 за изображение. quality принимает только low или medium, по умолчанию medium — то есть если поле вообще не передать, спишется цена уровня medium. Берите 1K low для черновиков в больших объёмах и 2K medium для того, что пойдёт в публикацию. Референсные изображения ничего не стоят дополнительно: xAI берёт $0.01 за каждое входное изображение, мы это не перекладываем на клиента. Все четыре уровня на 25% дешевле прайса xAI, а 2K low — на 33%.
До трёх. Одно передаётся как image_url (или image_base64); для нескольких используйте массив image_urls и ссылайтесь на них в промпте как <IMAGE_0>, <IMAGE_1>. Четвёртое изображение будет явно отклонено с ошибкой, а не молча проигнорировано — это важно, потому что молчаливый сброс заставил бы вас думать, что композиция удалась. Референсы никогда не тарифицируются отдельно. При редактировании, если не передать aspect_ratio, результат наследует пропорции первого входного изображения. Проверено на трёх разных объектах: все три остались узнаваемыми по отдельности, а не были перерисованы заново по тексту.
Четырнадцать: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, четыре сверхширокие 19.5:9, 9:19.5, 20:9 и 9:20, плюс auto. Сверхширокие четыре проверены по одному на живом канале (19.5:9 вернул 1248×576), а не переписаны из спецификации — другой наш канал Grok как раз отклоняет именно эти четыре, так что список сверен отдельно для каждого канала. При редактировании отсутствие aspect_ratio означает, что вывод следует пропорциям первого входного изображения.
Модель сохраняет объект и сцену, но перерисовывает кадр заново. Измерено: на фото красного чайника попросили сделать его тёмно-синим — форма чайника, текстура дерева, свет из окна, растение на подоконнике и стул позади остались, изменился только цвет; попросили добавить рядом белую чашку — чашка появилась, а чайник остался красным, как и было указано. Что меняется каждый раз — это кадрирование: угол камеры, обрезка и размер объекта плавают, потому что модель перерисовывает сцену заново, а не редактирует пиксели на месте. Отлично подходит для перекраски, смены стиля, добавления или удаления элементов и композиций из нескольких референсов; не тот инструмент, когда задача — «поменяй вот это одно и не трогай больше ни одного пикселя», там лучше подойдут GPT Image 2 или Nano Banana Pro.
Нет. Если попросить прозрачный фон с альфа-каналом, модель нарисует привычную серо-белую шахматную клетку обычными пикселями; возвращаемый PNG — это RGB без какого-либо альфа-канала. На миниатюре результат выглядит как готовая вырезка, но ею не является. Мы проверили и путь 2K-редактирования, и путь 2K-генерации по тексту — результат одинаковый. Если нужно удаление фона, используйте для этого отдельный шаг, а не пытайтесь добиться этого промптом.
2.0 — новое поколение, сильнее в типографике и работе с несколькими референсами: на постере 2K мы попросили точный заголовок, строку с датой и мелкую надпись-URL, и все три вышли читаемыми и совпадающими посимвольно, а один вызов объединяет до трёх референсных изображений, причём четвёртое явно отклоняется, а не отбрасывается молча. К тому же он дешевле — от $0.03 против $0.08 (1K) / $0.12 (2K) у Pro. Pro остаётся высокодетализированным уровнем движка 1.0 и подходит для пайплайнов, уже настроенных под него. Обе модели работают через один и тот же эндпоинт и ключ на apimodels.app, поэтому переключение — это одна строка в поле model.
В APIMODELS Grok Imagine Image 2.0 соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03; вы можете сравнить её по цене и возможностям с другими моделями категории «генерация изображений» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «генерация изображений» с актуальными ценами — на apimodels.app/models.
Grok Imagine Image 2.0 поддерживает: Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Grok Imagine Image 2.0 через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.