
grok-imagine-image-2O Grok Imagine Image 2.0 é o modelo de imagem da xAI feito para material que se publica, não apenas para olhar. Ele planeia tipografia e composição como um designer faria: num pôster 2K pedimos um título exato, uma linha de data e uma URL em letra miúda, e os três saíram legíveis e corretos caractere a caractere. Funde até três imagens de referência numa única chamada, respeitando qual sujeito vai onde, e ao editar preserva o sujeito e a cena: mude a cor de um produto e o objeto, a superfície, a luz e os adereços à volta permanecem. Uma ressalva honesta, medida e não presumida: ele volta a renderizar o enquadramento em vez de editar píxeis, por isso a composição e o corte deslocam-se entre passagens. Excelente para recolorir, mudar estilo, acrescentar ou remover elementos e compor várias referências; não serve quando o pedido exige que nenhum outro píxel se mexa. Também não gera fundos transparentes: peça alfa e ele pintará o xadrez como píxeis normais. Quatro faixas a partir de $0.03: 1K ou 2K, qualidade low ou medium.
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
Asked for an exact headline, a date line and a small-print URL on a 2K poster, all three came back legible and character-for-character correct — checked against the live model, not quoted from a launch post.
Send up to three reference images and say which goes where; the model keeps each subject identifiable rather than redrawing them from the text. A fourth is rejected outright instead of being silently dropped.
Recolour a product and the object, the surface, the lighting and the surrounding props all carry over. What does not carry over is the framing — see the next point.
Composition and crop shift between passes: the subject may sit closer, the camera angle may change. Ideal for recolouring, restyling, adding or removing elements. The wrong tool when the brief is "change this one thing and nothing else".
Ask for a transparent background and it paints the grey-and-white checkerboard as ordinary pixels; the PNG carries no alpha channel. The result looks like a cutout in a thumbnail and is not one. Use a dedicated background-removal step instead.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — 25% under xAI list on three tiers and 33% under on 2K Low. Reference images cost nothing extra here, though xAI bills $0.01 each. Fourteen aspect ratios including 19.5:9 and 20:9.
Grok Imagine Image 2.0 é uma API de geração de imagens da xAI. O Grok Imagine Image 2.0 é o modelo de imagem da xAI feito para material que se publica, não apenas para olhar. Ele planeia tipografia e composição como um designer faria: num pôster 2K pedimos um título exato, uma linha de data e uma URL em letra miúda, e os três saíram legíveis e corretos caractere a caractere. Funde até três imagens de referência numa única chamada, respeitando qual sujeito vai onde, e ao editar preserva o sujeito e a cena: mude a cor de um produto e o objeto, a superfície, a luz e os adereços à volta permanecem. Uma ressalva honesta, medida e não presumida: ele volta a renderizar o enquadramento em vez de editar píxeis, por isso a composição e o corte deslocam-se entre passagens. Excelente para recolorir, mudar estilo, acrescentar ou remover elementos e compor várias referências; não serve quando o pedido exige que nenhum outro píxel se mexa. Também não gera fundos transparentes: peça alfa e ele pintará o xadrez como píxeis normais. Quatro faixas a partir de $0.03: 1K ou 2K, qualidade low ou medium. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06.





Gere imagens de produto de alta qualidade para lojas online, anúncios e material de marketing.
Crie conteúdo visual atraente para redes sociais e aumente o engajamento e a visibilidade da marca.
Produza arte conceitual de personagens, cenários e objetos para acelerar o desenvolvimento de jogos.
Crie pôsteres, banners e peças promocionais por uma fração do custo tradicional.
O Grok Imagine Image 2.0 está disponível pela APIMODELS a: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Grok Imagine Image 2.0 pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
A faixa é resolution × quality: 1K low $0.03, 2K low $0.04, 1K medium $0.045 e 2K medium $0.06 por imagem. quality aceita apenas low ou medium e, se omitido, aplica-se medium — ou seja, não enviar o campo significa comprar a faixa medium. Use 1K low para rascunhos em volume e 2K medium para material que vai publicar. Imagens de referência não custam nada a mais: a xAI cobra $0.01 por imagem de entrada e nós não repassamos. As quatro faixas ficam 25% abaixo da tabela da xAI, e a 2K low 33%.
Até três. Para uma só use image_url (ou image_base64); para várias, image_urls como array, referindo-se a elas como <IMAGE_0>, <IMAGE_1> no prompt. A quarta é recusada com erro explícito em vez de descartada em silêncio, o que importa: um descarte silencioso faria você achar que a fusão deu certo. Referências nunca custam extra. Ao editar, omitir aspect_ratio faz a saída seguir a proporção da primeira imagem. Testado com três objetos diferentes: os três ficaram identificáveis, não redesenhados a partir do texto.
Catorze: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, as quatro ultralargas 19.5:9, 9:19.5, 20:9 e 9:20, mais auto. As quatro ultralargas foram verificadas uma a uma no canal ao vivo (19.5:9 devolveu 1248×576), não copiadas de uma ficha técnica. Em edição, omitir aspect_ratio faz a saída seguir a proporção da primeira imagem enviada.
Ele preserva o sujeito e a cena, mas recompõe o enquadramento. Medido: com a foto de um bule vermelho e o pedido de azul-marinho, mantiveram-se o formato, os veios da madeira, a luz da janela, a planta e a cadeira ao fundo, e só a cor mudou. O que muda a cada passagem é o enquadramento — ângulo, corte e tamanho do sujeito se deslocam, porque ele redesenha a cena em vez de editar pixels. Ótimo para recolorir, mudar estilo, acrescentar ou remover elementos e compor várias referências; não serve quando o pedido é «mude só isto e não toque em mais nenhum pixel».
Não. Ao pedir fundo transparente com canal alfa, ele pinta o xadrez cinza e branco como pixels comuns: o PNG devolvido é RGB e não tem canal alfa. Na miniatura parece um recorte pronto, mas não é. Testamos tanto na edição 2K quanto no texto para imagem 2K, com o mesmo resultado. Para remover fundo, use uma etapa dedicada.
O 2.0 é a geração nova e se sai melhor em tipografia e trabalho com várias referências: num pôster 2K pedimos um título exato, uma linha de data e uma URL em letra miúda, e os três voltaram legíveis e corretos caractere a caractere; uma única chamada funde até três imagens de referência e recusa a quarta em vez de descartá-la em silêncio. E é mais barato, a partir de $0.03 contra $0.08 (1K) / $0.12 (2K) do Pro. O Pro continua sendo a faixa de alto detalhe do motor 1.0. Ambos usam o mesmo endpoint e a mesma chave na apimodels.app: trocar é mudar uma string.
Na APIMODELS, o Grok Imagine Image 2.0 roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03 e você pode avaliá-lo em preço e capacidade frente a outros modelos de geração de imagens, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de geração de imagens com preços ao vivo em apimodels.app/models.
O Grok Imagine Image 2.0 suporta: Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Grok Imagine Image 2.0 por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.