
grok-imagine-image-2Grok Imagine Image 2.0 es el modelo de imagen de xAI pensado para material que se publica, no solo para mirar. Planifica tipografía y composición como lo haría un diseñador: en un póster 2K pedimos un titular exacto, una línea de fecha y una URL en letra pequeña, y los tres salieron legibles y correctos carácter por carácter. Fusiona hasta tres imágenes de referencia en una sola llamada respetando qué sujeto va dónde, y al editar conserva el sujeto y la escena: cambia el color de un producto y el objeto, la superficie, la luz y los elementos alrededor se mantienen. Una advertencia honesta, medida y no supuesta: vuelve a renderizar el encuadre en lugar de editar píxeles, así que la composición y el recorte se desplazan entre pasadas. Excelente para recolorear, cambiar estilo, añadir o quitar elementos y componer varias referencias; no es la herramienta cuando el encargo exige que ningún otro píxel se mueva. Tampoco genera fondos transparentes: pide alfa y pintará el damero como píxeles normales. Cuatro tramos desde $0.03: 1K o 2K, calidad low o medium.
Omitting quality in the API defaults to medium. Reference images are not charged extra.
Generated image will appear here
Enter a prompt and click Generate
Asked for an exact headline, a date line and a small-print URL on a 2K poster, all three came back legible and character-for-character correct — checked against the live model, not quoted from a launch post.
Send up to three reference images and say which goes where; the model keeps each subject identifiable rather than redrawing them from the text. A fourth is rejected outright instead of being silently dropped.
Recolour a product and the object, the surface, the lighting and the surrounding props all carry over. What does not carry over is the framing — see the next point.
Composition and crop shift between passes: the subject may sit closer, the camera angle may change. Ideal for recolouring, restyling, adding or removing elements. The wrong tool when the brief is "change this one thing and nothing else".
Ask for a transparent background and it paints the grey-and-white checkerboard as ordinary pixels; the PNG carries no alpha channel. The result looks like a cutout in a thumbnail and is not one. Use a dedicated background-removal step instead.
1K Low $0.03, 2K Low $0.04, 1K Medium $0.045, 2K Medium $0.06 — 25% under xAI list on three tiers and 33% under on 2K Low. Reference images cost nothing extra here, though xAI bills $0.01 each. Fourteen aspect ratios including 19.5:9 and 20:9.
Grok Imagine Image 2.0 es una API de generación de imágenes de xAI. Grok Imagine Image 2.0 es el modelo de imagen de xAI pensado para material que se publica, no solo para mirar. Planifica tipografía y composición como lo haría un diseñador: en un póster 2K pedimos un titular exacto, una línea de fecha y una URL en letra pequeña, y los tres salieron legibles y correctos carácter por carácter. Fusiona hasta tres imágenes de referencia en una sola llamada respetando qué sujeto va dónde, y al editar conserva el sujeto y la escena: cambia el color de un producto y el objeto, la superficie, la luz y los elementos alrededor se mantienen. Una advertencia honesta, medida y no supuesta: vuelve a renderizar el encuadre en lugar de editar píxeles, así que la composición y el recorte se desplazan entre pasadas. Excelente para recolorear, cambiar estilo, añadir o quitar elementos y componer varias referencias; no es la herramienta cuando el encargo exige que ningún otro píxel se mueva. Tampoco genera fondos transparentes: pide alfa y pintará el damero como píxeles normales. Cuatro tramos desde $0.03: 1K o 2K, calidad low o medium. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06.





Genera imágenes de producto de alta calidad para tiendas online, anuncios y material de marketing.
Crea contenido visual llamativo para redes sociales y aumenta la interacción y la visibilidad de marca.
Produce arte conceptual de personajes, escenarios y objetos para acelerar el desarrollo de juegos.
Diseña carteles, banners y gráficos promocionales a una fracción del coste tradicional.
Grok Imagine Image 2.0 está disponible a través de APIMODELS a: 1K Low: $0.03, 2K Low: $0.04, 1K Medium: $0.045, 2K Medium: $0.06. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo Grok Imagine Image 2.0 a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
El tramo es resolution × quality: 1K low $0.03, 2K low $0.04, 1K medium $0.045 y 2K medium $0.06 por imagen. quality solo admite low o medium y, si lo omites, se aplica medium — es decir, no enviarlo significa comprar el tramo medium. Usa 1K low para borradores en volumen y 2K medium para material que vas a publicar. Las imágenes de referencia no cuestan nada extra: xAI cobra $0.01 por imagen de entrada y nosotros no lo repercutimos. Los cuatro tramos están un 25% por debajo de la tarifa de xAI, y el 2K low un 33%.
Hasta tres. Para una sola usa image_url (o image_base64); para varias, image_urls como array, y refiérete a ellas como <IMAGE_0>, <IMAGE_1> en el prompt. La cuarta se rechaza con un error explícito en lugar de descartarse en silencio, lo cual importa: un descarte silencioso te haría creer que la fusión salió bien. Las referencias nunca cuestan extra. Al editar, si omites aspect_ratio la salida sigue la proporción de la primera imagen. Probado con tres objetos distintos: los tres quedaron identificables, no redibujados a partir del texto.
Catorce: 1:1, 16:9, 9:16, 4:3, 3:4, 3:2, 2:3, 2:1, 1:2, las cuatro ultrapanorámicas 19.5:9, 9:19.5, 20:9 y 9:20, más auto. Las cuatro ultrapanorámicas se comprobaron una a una contra el canal en vivo (19.5:9 devolvió 1248×576), no se copiaron de una ficha técnica. Al editar, si omites aspect_ratio la salida sigue la proporción de la primera imagen de entrada.
Conserva el sujeto y la escena, pero vuelve a componer el encuadre. Medido: con la foto de una tetera roja y la instrucción de pasarla a azul marino, se mantuvieron la forma, la veta de la madera, la luz de la ventana, la planta y la silla del fondo, y solo cambió el color. Lo que cambia en cada pasada es el encuadre: ángulo, recorte y tamaño del sujeto se mueven, porque redibuja la escena en lugar de editar píxeles. Ideal para recolorear, cambiar estilo, añadir o quitar elementos y componer varias referencias; no es la herramienta cuando el encargo es «cambia esto y no toques ni un píxel más».
No. Si pides fondo transparente con canal alfa, pinta el clásico damero gris y blanco como píxeles normales: el PNG que devuelve es RGB y no lleva canal alfa. En una miniatura parece un recorte terminado, pero no lo es. Lo probamos tanto en edición 2K como en texto a imagen 2K, con el mismo resultado. Si necesitas quitar el fondo, usa un paso dedicado a ello.
2.0 es la generación nueva y destaca en tipografía y trabajo con varias referencias: en un póster 2K pedimos un titular exacto, una línea de fecha y una URL en letra pequeña, y los tres salieron legibles y carácter por carácter correctos; una sola llamada fusiona hasta tres imágenes de referencia y rechaza la cuarta en lugar de descartarla en silencio. Además es más barato, desde $0.03 frente a los $0.08 (1K) / $0.12 (2K) de Pro. Pro sigue siendo el nivel de alto detalle del motor 1.0. Ambos comparten endpoint y clave en apimodels.app: cambiar es modificar una sola cadena.
En APIMODELS, Grok Imagine Image 2.0 convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03 y puedes valorarlo en precio y capacidad frente a otros modelos de generación de imágenes, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de generación de imágenes con precios en vivo en apimodels.app/models.
Grok Imagine Image 2.0 admite: Text to Image, Multi-Image Editing (up to 3), Typography & Layout, 14 Aspect Ratios, 1K/2K × Low/Medium, From $0.03. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone Grok Imagine Image 2.0 mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.