
qwen3-imageQwen Image 3.0 es el modelo de imagen de Alibaba en el que generar y editar son el mismo modelo: sin imágenes de referencia dibuja desde cero y, con ellas (hasta 3, de 10MB cada una), edita o funde varias en una sola. Donde de verdad destaca es en la composición densa de texto dentro de la propia imagen: prompts de hasta 4.5k tokens, tipografías de 10px que siguen siendo legibles y 12 idiomas con más de 20 fuentes renderizadas de forma nativa — una plancha de periódico, una carta de restaurante, un storyboard o una hoja de examen salen en una sola pasada, sin tener que pegar los textos encima después. Salida en 1K o 2K, ocho proporciones (1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9) y formato PNG. El precio es plano: $0.035 por imagen tanto en 1K como en 2K, y $0.004 por cada imagen de referencia; solo se cobran las generaciones que salen bien y las fallidas se devuelven. Se llama en apimodels.app con POST /api/v1/images/generations: creas la tarea y después consultas el estado o recibes un callback. Con nuestros propios datos la mediana es de 73 segundos y el 90% termina en 96, así que una ventana de sondeo de 3 minutos va sobrada; los archivos se conservan 7 días. Lo que no hay, dicho sin rodeos: 4K (el techo es 2K) y máscara de inpainting — el retoque de una zona se describe en el prompt. Una única clave de apimodels.app da acceso al resto de modelos de la plataforma con el mismo saldo.
Generated image will appear here
Enter a prompt and click Generate
Text-to-image and image editing on one model name — add reference images and it edits, omit them and it generates
Up to 4.5k-token prompts and 10px small-text rendering — newspapers, storyboards, menus and exam sheets in a single pass
Native multilingual and multi-font rendering, legible for infographics and UI mockups straight out
$0.035 per image at 1K or 2K; each reference image adds $0.004. Failures are never charged
High-volume posters, web and UI layouts, and text-heavy designs where small type must stay legible
Qwen Image 3.0 es una API de generación de imágenes de Alibaba. Qwen Image 3.0 es el modelo de imagen de Alibaba en el que generar y editar son el mismo modelo: sin imágenes de referencia dibuja desde cero y, con ellas (hasta 3, de 10MB cada una), edita o funde varias en una sola. Donde de verdad destaca es en la composición densa de texto dentro de la propia imagen: prompts de hasta 4.5k tokens, tipografías de 10px que siguen siendo legibles y 12 idiomas con más de 20 fuentes renderizadas de forma nativa — una plancha de periódico, una carta de restaurante, un storyboard o una hoja de examen salen en una sola pasada, sin tener que pegar los textos encima después. Salida en 1K o 2K, ocho proporciones (1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9) y formato PNG. El precio es plano: $0.035 por imagen tanto en 1K como en 2K, y $0.004 por cada imagen de referencia; solo se cobran las generaciones que salen bien y las fallidas se devuelven. Se llama en apimodels.app con POST /api/v1/images/generations: creas la tarea y después consultas el estado o recibes un callback. Con nuestros propios datos la mediana es de 73 segundos y el 90% termina en 96, así que una ventana de sondeo de 3 minutos va sobrada; los archivos se conservan 7 días. Lo que no hay, dicho sin rodeos: 4K (el techo es 2K) y máscara de inpainting — el retoque de una zona se describe en el prompt. Una única clave de apimodels.app da acceso al resto de modelos de la plataforma con el mismo saldo. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: 1K: $0.035, 2K: $0.035.
Modelo relacionado: qwen3-image-pro — the higher-fidelity tier of the same model — micro-expressions, pores and hair strands near real photography, 1K $0.037 / 2K $0.075
Modelo relacionado: gpt-image-2 — stronger on general in-image text and the only one here with native 4K — 1K $0.025, 2K $0.03, 4K $0.05
Modelo relacionado: nanobananapro — Gemini 3 Pro Image — reach for it when the subject is a realistic portrait rather than a text-heavy layout
Prompts de hasta 4.5k tokens y texto de 10px — periódicos, storyboards, menús y exámenes se generan como un diseño estructurado, no una imagen con texto pegado encima.
Renderizado multilingüe nativo, ideal para infografías, mockups de UI y material de marketing legible al instante.
Entiende instrucciones complejas y organiza muchos elementos en páginas web, paneles e interfaces en una sola pasada.
Pon imágenes en image_urls y edita — cambia elementos, reestiliza o repinta manteniendo el sujeto; omítelas para texto a imagen.
$0.035 por imagen en 1K y 2K, más $0.004 por imagen de referencia. Los fallos no se cobran, y una sola API key de apimodels.app también llama a imagen, vídeo, LLM y audio.
Qwen Image 3.0 está disponible a través de APIMODELS a: 1K: $0.035, 2K: $0.035. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo Qwen Image 3.0 a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
Qwen Image 3.0 es el modelo de generación de imágenes de Alibaba, fuerte en imágenes realistas, maquetas estructuradas, texto denso dentro de la imagen y tipografía de calidad. En apimodels.app, la generación desde texto y la edición de imágenes son el mismo modelo: el modo se elige automáticamente según envíes o no imágenes de referencia. Sin ellas genera; con ellas edita. 1K/2K, $0.035 fijos por imagen, más $0.004 por cada imagen de referencia.
El Qwen Image 3.0 estándar es el nivel del día a día: seguimiento claro de instrucciones (prompts de hasta 4.5k tokens), render de texto estable (texto pequeño de 10px, 12 idiomas, más de 20 tipografías) y $0.035 fijos tanto en 1K como en 2K, pensado para pósteres, páginas web y mockups de interfaz en volumen. Pro (qwen3-image-pro) es el nivel de mayor fidelidad: microexpresiones, poros y mechones de pelo cercanos a la fotografía real, 1K $0.037 / 2K $0.075, para imágenes principales, retratos y composiciones que necesitan ese detalle extra.
Por imagen y según la resolución, con pago por uso: el nivel estándar cuesta $0.035 tanto en 1K como en 2K; cada imagen de referencia (para edición) suma $0.004. Los fallos nunca se cobran. Ejemplo: una generación desde texto en 1K son $0.035; editar con una imagen de referencia son $0.035 + $0.004 = $0.039.
Pon las imágenes de referencia en image_urls y el backend enruta solo hacia image-to-image. Envía varias para sustituir elementos, cambiar el estilo o repintar manteniendo el sujeto. Omite image_urls y tendrás generación pura desde texto. Un único nombre de modelo, los dos modos, sin cambiar de endpoint.
Es una de sus grandes bazas: prompts de hasta 4.5k tokens y maquetación densa dentro del encuadre permiten sacar un periódico, un storyboard, una carta de restaurante o un examen en una sola pasada, con texto pequeño de 10px legible. Renderiza de forma nativa 12 idiomas y más de 20 tipografías, así que las infografías y los mockups de interfaz salen listos para usar, sin superponer texto después.
Render nativo en 12 idiomas y más de 20 tipografías, con mezcla de alfabetos y maquetas de interfaz multilingües estables. Los prompts se aceptan tanto en chino como en inglés. Eso lo hace muy apropiado para material de marketing multilingüe, contenido educativo y mockups de interfaces web, de videojuegos y de directos.
1K o 2K, en ocho relaciones de aspecto: 1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9. La salida es PNG. Las imágenes de referencia pueden pesar hasta 10MB cada una, en formatos habituales (jpeg / png / webp).
Hasta 3. Varias referencias permiten fusionar imágenes o acotar más la edición. Cada imagen de referencia cuesta $0.004, así que fusionar tres imágenes en 1K sale por $0.035 + 3×$0.004 = $0.047.
Asíncrono: creas una tarea, recibes un taskId y la consultas por sondeo, o pasas un callBackUrl y recibes un webhook al terminar. Los resultados se trasladan a nuestro propio almacenamiento y se devuelven como enlaces de descarga estables.
Qwen Image 3.0 manda en texto denso dentro de la imagen, composición tipográfica multilingüe y maquetas estructuradas (periódicos / cartas / interfaces / exámenes), y a menor precio (desde $0.035). gpt-image-2 es más fuerte en texto dentro de la imagen en general y en 4K nativo. Nano Banana (Gemini) resulta cómodo para retratos realistas e iteración rápida. Para trabajo con mucho texto, mucha maquetación y varios idiomas, tira de Qwen Image 3.0.
Regístrate en apimodels.app, consigue una sola API key y pon model = qwen3-image; esa misma key llama también a modelos de imagen, vídeo, LLM y audio. Sin hacer malabares con varios proveedores ni cuentas separadas; los fallos nunca se cobran y la facturación es por imagen, sin cuota mensual.
Percentiles medidos sobre nuestro propio tráfico de producción: el nivel estándar tiene una mediana de 73s, el 90% termina en menos de 96s y lo más rápido que hemos visto son 36s. Una ventana de sondeo de 3 minutos sobra. Si cortas la petición del cliente a las pocas decenas de segundos, la tarea «colgada» que ves es tu propio timeout: el trabajo sigue corriendo de nuestro lado y al consultar pasará a completed. Un problema real aparece como state=failed, con el motivo en failMsg.
No se cobran. Solo se factura state=completed; una tarea fallida no cuesta nada y puedes reintentar exactamente la misma petición. El fallo más habitual es una señal de saturación del proveedor (UPSTREAM_BUSY), que suele resolverse al reintentar. Los fallos por moderación de contenido o por parámetros inválidos no mejorarán reintentando: cambia el prompt o los parámetros.
Los archivos de resultado se conservan 7 días y luego se borran automáticamente. Descárgalos y alójalos tú si los necesitas más tiempo; no uses nuestras URL como hosting permanente de imágenes en tu base de datos ni en tus páginas.
Ninguna de las dos cosas, y sin rodeos. Ningún nivel de Qwen Image 3.0 pasa de 2K: para 4K nativo usa gpt-image-2 ($0.05 por imagen en 4K). Tampoco hay parámetro de máscara/inpainting: para retocar una zona, pasa el original por image_urls y describe el cambio en el prompt. Sigue bien ese tipo de instrucción, pero no es control por máscara a nivel de píxel.
El mismo modelo, otro nombre. Nuestra cadena de model es qwen3-image (o qwen3-image-pro), que corresponde a qwen-image-3.0 y qwen-image-3.0-pro de Alibaba. Envía la nuestra, sin ningún prefijo.
Legible no es lo mismo que correcto carácter a carácter. El texto pequeño que genera sale realmente nítido, pero la ortografía, las fórmulas, los precios, los códigos de barras y las fechas, todo aquello donde un carácter mal importa, necesitan una revisión humana antes de publicar. Úsalo como capacidad de maquetación, no como herramienta para introducir texto.
En APIMODELS, Qwen Image 3.0 convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite Text to Image, Image Editing, Dense Text Layout, 12 Languages, 20+ Fonts, 1K/2K, Async y puedes valorarlo en precio y capacidad frente a otros modelos de generación de imágenes, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de generación de imágenes con precios en vivo en apimodels.app/models.
Qwen Image 3.0 admite: Text to Image, Image Editing, Dense Text Layout, 12 Languages, 20+ Fonts, 1K/2K, Async. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone Qwen Image 3.0 mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.