
qwen3-imageO Qwen Image 3.0 é o modelo de imagem da Alibaba em que gerar e editar são o mesmo modelo: sem imagens de referência ele cria do zero e, com elas (até 3, de 10MB cada), edita ou funde várias numa só. O ponto mais forte é a diagramação densa de texto dentro da própria imagem: prompts de até 4.5k tokens, letra de 10px que continua legível e 12 idiomas com mais de 20 fontes renderizadas de forma nativa — uma página de jornal, um cardápio, um storyboard ou uma folha de prova saem numa única passada, sem colar os textos por cima depois. Saída em 1K ou 2K, oito proporções (1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9) e formato PNG. O preço é único: $0.035 por imagem em 1K e em 2K, mais $0.004 por imagem de referência; só as gerações bem-sucedidas são cobradas e as que falham são devolvidas. A chamada na apimodels.app é POST /api/v1/images/generations: você cria a tarefa e depois consulta o estado ou recebe um callback. Pelos nossos próprios números, a mediana é de 73 segundos e 90% terminam em 96, então uma janela de polling de 3 minutos sobra; os arquivos ficam 7 dias. O que não existe, sem rodeios: 4K (o teto é 2K) e máscara de inpainting — o ajuste de uma região se descreve no prompt. Uma única chave da apimodels.app abre os demais modelos da plataforma, com o mesmo saldo.
Generated image will appear here
Enter a prompt and click Generate
Text-to-image and image editing on one model name — add reference images and it edits, omit them and it generates
Up to 4.5k-token prompts and 10px small-text rendering — newspapers, storyboards, menus and exam sheets in a single pass
Native multilingual and multi-font rendering, legible for infographics and UI mockups straight out
$0.035 per image at 1K or 2K; each reference image adds $0.004. Failures are never charged
High-volume posters, web and UI layouts, and text-heavy designs where small type must stay legible
Qwen Image 3.0 é uma API de geração de imagens da Alibaba. O Qwen Image 3.0 é o modelo de imagem da Alibaba em que gerar e editar são o mesmo modelo: sem imagens de referência ele cria do zero e, com elas (até 3, de 10MB cada), edita ou funde várias numa só. O ponto mais forte é a diagramação densa de texto dentro da própria imagem: prompts de até 4.5k tokens, letra de 10px que continua legível e 12 idiomas com mais de 20 fontes renderizadas de forma nativa — uma página de jornal, um cardápio, um storyboard ou uma folha de prova saem numa única passada, sem colar os textos por cima depois. Saída em 1K ou 2K, oito proporções (1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9) e formato PNG. O preço é único: $0.035 por imagem em 1K e em 2K, mais $0.004 por imagem de referência; só as gerações bem-sucedidas são cobradas e as que falham são devolvidas. A chamada na apimodels.app é POST /api/v1/images/generations: você cria a tarefa e depois consulta o estado ou recebe um callback. Pelos nossos próprios números, a mediana é de 73 segundos e 90% terminam em 96, então uma janela de polling de 3 minutos sobra; os arquivos ficam 7 dias. O que não existe, sem rodeios: 4K (o teto é 2K) e máscara de inpainting — o ajuste de uma região se descreve no prompt. Uma única chave da apimodels.app abre os demais modelos da plataforma, com o mesmo saldo. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: 1K: $0.035, 2K: $0.035.
Modelo relacionado: qwen3-image-pro — the higher-fidelity tier of the same model — micro-expressions, pores and hair strands near real photography, 1K $0.037 / 2K $0.075
Modelo relacionado: gpt-image-2 — stronger on general in-image text and the only one here with native 4K — 1K $0.025, 2K $0.03, 4K $0.05
Modelo relacionado: nanobananapro — Gemini 3 Pro Image — reach for it when the subject is a realistic portrait rather than a text-heavy layout
Prompts de até 4.5k tokens e texto de 10px — jornais, storyboards, menus e provas são gerados como um layout estruturado, não uma imagem com texto colado.
Renderização multilíngue nativa, boa para infográficos, mockups de UI e materiais de marketing legíveis de imediato.
Entende instruções complexas e organiza muitos elementos em páginas web, painéis e interfaces em uma única passagem.
Coloque imagens em image_urls e ele edita — troca elementos, muda o estilo ou repinta mantendo o sujeito; omita-as para texto para imagem.
$0.035 por imagem em 1K e 2K, mais $0.004 por imagem de referência. Falhas nunca são cobradas, e uma única API key da apimodels.app também chama imagem, vídeo, LLM e áudio.
O Qwen Image 3.0 está disponível pela APIMODELS a: 1K: $0.035, 2K: $0.035. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Qwen Image 3.0 pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
O Qwen Image 3.0 é o modelo de geração de imagens da Alibaba, forte em imagens realistas, layouts estruturados, texto denso dentro da imagem e tipografia de qualidade. Na apimodels.app, geração a partir de texto e edição de imagem são o mesmo modelo: o modo é escolhido automaticamente conforme você envie ou não imagens de referência. Sem elas, ele gera; com elas, edita. 1K/2K, $0.035 fixos por imagem, mais $0.004 por imagem de referência.
O Qwen Image 3.0 padrão é o nível do dia a dia: segue instruções com clareza (prompts de até 4.5k tokens), renderiza texto de forma estável (texto pequeno de 10px, 12 idiomas, mais de 20 fontes) e custa $0.035 fixos tanto em 1K quanto em 2K, feito para pôsteres, páginas web e mockups de interface em volume. O Pro (qwen3-image-pro) é o nível de maior fidelidade: microexpressões, poros e fios de cabelo próximos de uma foto real, 1K $0.037 / 2K $0.075, para imagens principais, retratos e composições que precisam desse detalhe extra.
Por imagem e por resolução, no modelo pague conforme o uso: o nível padrão custa $0.035 tanto em 1K quanto em 2K; cada imagem de referência (na edição) acrescenta $0.004. Falhas nunca são cobradas. Exemplo: uma geração a partir de texto em 1K sai $0.035; editar com uma imagem de referência sai $0.035 + $0.004 = $0.039.
Coloque as imagens de referência em image_urls e o backend roteia sozinho para image-to-image. Envie várias para trocar elementos, mudar o estilo ou repintar mantendo o sujeito. Omita image_urls e você tem geração pura a partir de texto. Um único nome de modelo, os dois modos, sem trocar de endpoint.
Esse é um dos seus grandes trunfos: prompts de até 4.5k tokens e diagramação densa dentro do quadro permitem gerar jornal, storyboard, cardápio ou prova em uma única passagem, com texto pequeno de 10px legível. São 12 idiomas e mais de 20 fontes renderizados nativamente, então infográficos e mockups de interface já saem utilizáveis, sem sobrepor texto depois.
Renderização nativa em 12 idiomas e mais de 20 fontes, com mistura de sistemas de escrita e layouts de interface multilíngues estáveis. Os prompts são aceitos tanto em chinês quanto em inglês. Isso o torna uma boa escolha para peças de marketing multilíngues, conteúdo educacional e mockups de interfaces web, de jogos e de transmissões ao vivo.
1K ou 2K, em oito proporções: 1:1, 3:2, 2:3, 4:3, 3:4, 16:9, 9:16, 21:9. A saída é PNG. As imagens de referência podem ter até 10MB cada, nos formatos usuais (jpeg / png / webp).
Até 3. Várias referências servem para fundir imagens ou impor restrições mais firmes na edição. Cada imagem de referência custa $0.004, então fundir três imagens em 1K dá $0.035 + 3×$0.004 = $0.047.
Assíncrono: você cria uma tarefa, recebe um taskId e faz polling, ou passa um callBackUrl para receber um webhook na conclusão. Os resultados são transferidos para o nosso próprio armazenamento e devolvidos como links de download estáveis.
O Qwen Image 3.0 lidera em texto denso dentro da imagem, composição tipográfica multilíngue e layouts estruturados (jornais / cardápios / interfaces / provas), e por um preço menor (a partir de $0.035). O gpt-image-2 é mais forte em texto dentro da imagem no geral e em 4K nativo. O Nano Banana (Gemini) é prático para retratos realistas e iteração rápida. Para trabalho com muito texto, muita diagramação e vários idiomas, vá de Qwen Image 3.0.
Cadastre-se na apimodels.app, pegue uma única API key e defina model como qwen3-image; a mesma key chama também modelos de imagem, vídeo, LLM e áudio. Sem malabarismo com vários fornecedores ou contas separadas; falhas nunca são cobradas e a cobrança é por imagem, sem mensalidade.
Percentis medidos no nosso próprio tráfego de produção: o nível padrão tem mediana de 73s, 90% terminam em até 96s e o mais rápido que vimos foi 36s. Uma janela de polling de 3 minutos é mais que suficiente. Se você corta a requisição do cliente depois de algumas dezenas de segundos, a tarefa «travada» que você vê é o seu próprio timeout: o job continua rodando do nosso lado e o polling vai virar para completed. Um problema de verdade aparece como state=failed, com o motivo em failMsg.
Não são cobradas. Só state=completed é faturado; uma tarefa que falhou não custa nada e você pode repetir exatamente a mesma requisição. A falha mais comum é um sinal de sobrecarga do fornecedor upstream (UPSTREAM_BUSY), que costuma passar ao repetir. Já falhas por moderação de conteúdo ou parâmetros inválidos não melhoram com repetição: mude o prompt ou os parâmetros.
Os arquivos de resultado ficam guardados por 7 dias e depois são apagados automaticamente. Baixe e hospede por conta própria se precisar deles por mais tempo; não trate as nossas URLs como hospedagem permanente de imagens no seu banco de dados ou nas suas páginas.
Nenhum dos dois, sendo direto. Nenhum nível do Qwen Image 3.0 passa de 2K: para 4K nativo, use o gpt-image-2 ($0.05 por imagem em 4K). Também não há parâmetro de máscara/inpainting: para editar uma região, passe o original em image_urls e descreva a mudança no prompt. Ele segue bem esse tipo de instrução, mas não é controle por máscara no nível do pixel.
Mesmo modelo, nome diferente. Nossa string de model é qwen3-image (ou qwen3-image-pro), que corresponde ao qwen-image-3.0 e ao qwen-image-3.0-pro da Alibaba. Envie a nossa, sem prefixo.
Legível não é o mesmo que correto caractere a caractere. O texto pequeno que ele renderiza sai mesmo nítido, mas ortografia, fórmulas, preços, códigos de barras e datas, tudo aquilo em que um caractere errado importa, precisam de uma revisão humana antes de publicar. Use isso como capacidade de diagramação, não como ferramenta de digitação.
Na APIMODELS, o Qwen Image 3.0 roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Text to Image, Image Editing, Dense Text Layout, 12 Languages, 20+ Fonts, 1K/2K, Async e você pode avaliá-lo em preço e capacidade frente a outros modelos de geração de imagens, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de geração de imagens com preços ao vivo em apimodels.app/models.
O Qwen Image 3.0 suporta: Text to Image, Image Editing, Dense Text Layout, 12 Languages, 20+ Fonts, 1K/2K, Async. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Qwen Image 3.0 por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Weathered sailor on a fishing boat
Create a photorealistic candid photograph of an elderly sailor standing on a small fishing boat. He has weathered skin with visible wrinkles, pores, and sun texture, and a few faded traditional sailor tattoos on his arms. He is calmly adjusting a net while his dog sits nearby on the deck. Shot like a 35mm film photograph, medium close-up at eye level, using a 50mm lens. Soft coastal daylight, shallow depth of field, subtle film grain, natural color balance. The image should feel honest and unposed, with real skin texture, worn materials, and everyday detail. No glamorization, no heavy retouching.
by OpenAI

Automatic coffee machine workflow infographic
Create a detailed Infographic of the functioning and flow of an automatic coffee machine like a Jura. From bean basket, to grinding, to scale, water tank, boiler, etc. I'd like to understand technically and visually the flow.
by OpenAI

Thread streetwear ad with exact typography
Give me a cool in culture ad / fashion shot for a brand called Thread. It's a hip young street brand. The ad shows a group of friends hanging out together with the tagline "Yours to Create." Make it feel like a polished campaign image for a youth streetwear audience: stylish, contemporary, energetic, and tasteful. Use clean composition, strong color direction, natural poses, and premium fashion photography cues. Render the tagline exactly once, clearly and legibly, integrated into the ad layout. No extra text, no watermarks, no unrelated logos.
by OpenAI
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.