
gpt-image-2API GPT Image 2 da OpenAI: texto para imagem e edição com até 16 imagens de referência por requisição, com saída nativa em 1K / 2K / 4K a $0.025 / $0.03 / $0.05 por imagem e qualidade Medium ou High. Uma única API key, muito mais barato que o acesso direto, sem verificação de organização da OpenAI e acessível de qualquer lugar.
Auto follows your reference image when editing. With text-to-image there is nothing to follow, so it renders square (1:1) — pick a ratio here if you want a shape. Widest available is 21:9; asking for a ratio in the prompt has no effect.
Generated image will appear here
Enter a prompt and click Generate
Nos últimos 30 dias, 0.93% das requisições deste canal foram recusadas pelo sistema de segurança do provedor, contra 8.0% no gpt-image-2-all: o mesmo modelo por baixo, só que aqui o critério é mais solto. Se um prompt vive sendo recusado lá, tente por aqui. Requisição recusada não é cobrada
Chame o GPT Image 2 com uma única API key: sem verificação de organização nem de identidade na OpenAI, sem fila de espera e acessível de qualquer lugar, inclusive da China continental
O modelo de imagem mais recente da OpenAI, com aderência ao prompt entre as melhores do mercado
Até 16 imagens de referência por requisição
1:1, 2:3, 3:2, 4:5, 5:4, 4:3, 3:4, 16:9, 9:16, 21:9 (5:4 e 4:5 só em 1K)
$0.025 / $0.03 / $0.05 em 1K / 2K / 4K (qualidade medium); também existem as faixas low e high
Failover automático entre vários canais upstream para manter a disponibilidade
Faça polling no endpoint de tarefa para pegar o resultado: normalmente 40-90 s
GPT Image 2 é uma API de geração de imagens da OpenAI. API GPT Image 2 da OpenAI: texto para imagem e edição com até 16 imagens de referência por requisição, com saída nativa em 1K / 2K / 4K a $0.025 / $0.03 / $0.05 por imagem e qualidade Medium ou High. Uma única API key, muito mais barato que o acesso direto, sem verificação de organização da OpenAI e acessível de qualquer lugar. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: 1K: $0.025, 2K: $0.03, 4K: $0.05.
Modelo relacionado: gpt-image-2-all — same model, but you pick the quality tier — low / medium / high × 1K/2K/4K, and OpenAI-SDK compatible (images.generate / images.edit) so Codex and Cursor can call it directly
Cartazes, criativos de anúncio, capas e embalagens em que as palavras fazem parte da arte: este é o renderizador de texto em imagem mais confiável do nosso catálogo, então os títulos saem compostos, não borrados.
Envie até 16 imagens de referência para manter um personagem, produto ou estilo firme em um lote inteiro, em vez de repetir gerações até duas tomadas coincidirem por acaso.
Troque um fundo, recolora, substitua um elemento — o resto do quadro fica onde estava. Aqui a edição é um caminho de primeira classe, não um truque de prompt.
1K, 2K e 4K saem do modelo nessa resolução — nada é ampliado depois, então detalhes finos e tipografia pequena sobrevivem, a $0.05 o 4K.
O preço depende apenas da resolução ($0.025 / $0.03 / $0.05); a qualidade nunca o altera. Multiplique imagens por faixa e você tem o gasto exato antes da primeira chamada.
O GPT Image 2 está disponível pela APIMODELS a: 1K: $0.025, 2K: $0.03, 4K: $0.05. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo GPT Image 2 pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
O modelo de imagem de próxima geração da OpenAI, com tipografia dentro da imagem mais nítida, edições em nível de pixel mais estáveis, maior conhecimento do mundo, geração rápida e alta fidelidade ao prompt.
Sim. Cadastre-se em apimodels.app, obtenha uma API Key e chame o gpt-image-2 imediatamente: a partir de $0.025 por imagem, com faixas 1K/2K/4K a $0.025/$0.03/$0.05 e até 16 imagens de referência por requisição.
Ambos, por meio de um único endpoint que faz o roteamento automático conforme exista ou não uma imagem de referência. O aspect ratio define a composição da saída e é possível fundir até 16 imagens de referência em uma única requisição.
Edição de produtos de e-commerce, visuais de marketing em lote, SaaS de geração/edição de imagens com IA, camadas de produção para design systems, visuais localizados em vários idiomas, ilustrações educacionais e qualquer fluxo que transforme texto mais imagens em saída visual.
Sim. A renderização de texto multilíngue é um foco central e, junto com um melhor seguimento de instruções em prompts com vários sujeitos e cenas em camadas, layouts complexos e texto dentro da imagem ficam visivelmente mais limpos.
Sim. O gpt-image-2 suporta até 16 imagens de referência por requisição, o que atende lookbooks, prova virtual em modelo, fusão de embalagens e outros cenários com várias referências.
Uma única key para todos os modelos, documentação de API completa com exemplos em cURL / Python / Node.js, tarefas que falham não são cobradas, os resultados ficam hospedados no nosso R2 e há failover automático entre vários canais upstream para maior confiabilidade.
Na apimodels.app, o gpt-image-2 tem preços por nível: $0.025 / $0.03 / $0.05 em 1K / 2K / 4K, sem gasto mínimo nem mensalidade, e tarefas que falham não são cobradas. É uma das formas mais econômicas de usar a API do GPT Image 2.
Faça um POST para https://api.apimodels.app/v1/images/generations com o cabeçalho Authorization: Bearer <sua API key>. No corpo JSON defina model como "gpt-image-2" e um prompt; para editar, adicione image_url (uma) ou image_urls (até 10). A documentação do modelo traz exemplos em curl e Python (requests / compatível com o SDK da OpenAI) prontos para copiar.
É o mesmo modelo gpt-image-2 da OpenAI, então a qualidade é idêntica. A diferença é o acesso: na apimodels.app você usa uma única API key a partir de $0.025/imagem (preços por nível), sem verificação de organização da OpenAI e acessível de qualquer lugar, mais barato e simples que ligar a OpenAI diretamente.
Sim. Cadastre-se na apimodels.app para obter uma API key, sem precisar de conta na OpenAI nem verificação de organização, e o endpoint é acessível da China e de qualquer outro lugar. As imagens geradas ficam hospedadas em nosso R2 para download direto.
Não: ele roda sempre no nível medium e enviar um campo quality não faz efeito nenhum. Isso é proposital: um único nome de modelo, um único parâmetro de resolução, uma decisão a menos e um preço que depende só da resolução ($0.025 / $0.03 / $0.05 em 1K / 2K / 4K). Se você quiser escolher a qualidade, use o gpt-image-2-all: o mesmo modelo por baixo, com a matriz completa de resolução × qualidade exposta (1K/2K/4K × low/medium/high, além de auto). Low em 1K custa $0.01 e o nível high fica disponível quando você quer o máximo de detalhe. Ele também é o canal síncrono compatível com o SDK da OpenAI, então Codex e Cursor conseguem chamá-lo mudando apenas o base_url. O link está no fim desta página, entre os modelos relacionados.
O gpt-image-2 aceita até 16 imagens de referência por requisição para fusão e edição multi-imagem, gera em 1K / 2K / 4K nas qualidades low / medium / high (medium por padrão) e deixa você enquadrar pelo aspect ratio (1:1, 2:3, 3:2, 4:5, 16:9, 9:16 e outros; 5:4 e 4:5 existem só em 1K, não em 2K/4K). O preço vem de resolução × qualidade: no nível medium são $0.025 / $0.03 / $0.05 em 1K / 2K / 4K.
Nos últimos 30 dias de tráfego de produção externo — 24.208 chamadas — a **taxa de sucesso de infraestrutura é de 98.9%**. Ela conta apenas as falhas que cabem a nós resolver: 119 timeouts, 66 de upstream sobrecarregado e 15 em que o upstream não devolveu imagem, 200 no total. Ficam de fora as recusas por política de conteúdo da OpenAI e as requisições malformadas, porque as duas se resolvem ajustando o prompt ou os parâmetros e nenhuma é cobrada. Em resumo: se o seu prompt passa pela política de conteúdo da OpenAI, a entrega é confiável. Vale dizer em voz alta: **quase ninguém neste setor publica uma taxa de sucesso.** Outras páginas de API oferecem «estável» e «alta disponibilidade», adjetivos que você não tem como verificar. Nós publicamos os números reais de 30 dias junto com a forma de calculá-los, e você pode fazer a mesma pergunta a qualquer fornecedor.
Medido em produção ao longo de 30 dias: mediana de 60 segundos e p95 de 157 segundos. Metade das requisições volta em menos de um minuto e 95% em menos de dois minutos e meio. O caminho síncrono (você passa `size` e omite `callback_url`) segura a conexão até a imagem ficar pronta; se preferir não manter conexão aberta, use o caminho de tarefa com polling ou com `callback_url`. Configure os timeouts do cliente acima de 180 segundos.
Falhas nunca são cobradas — timeouts, congestionamento do upstream e recusas por política de conteúdo saem de graça, e você paga somente pelas imagens efetivamente entregues. gpt-image-2 e gpt-image-2-all passam por adaptadores upstream diferentes, então um problema em um não derruba o outro e dá para repetir a tentativa trocando o nome do modelo. Os créditos são reservados antes e liberados automaticamente quando um job falha.
Sem assinatura, sem mensalidade e sem gasto mínimo: você paga por imagem. A menor recarga é de $10 e uma única API key cobre todos os modelos da plataforma (imagem, vídeo, áudio e LLMs dividem o mesmo saldo em dólar), então não é preciso abrir conta com cada fornecedor de modelo. Contas novas em domínios de e-mail comuns ganham $0.10 de crédito gratuito, o suficiente para quatro imagens 1K na qualidade padrão — dá para conferir a qualidade antes de pagar qualquer coisa. Não é necessária conta na OpenAI nem verificação de organização, e a API é acessível da China continental.
Stripe (cartão), PayPal e Alipay. **Pagando por Stripe você pode informar o número de identificação fiscal da empresa (VAT da UE e equivalentes) no checkout; depois do pagamento, uma fatura PDF formal com os dados fiscais das duas partes é gerada automaticamente e enviada por e-mail**, e o número fica salvo para constar em todas as faturas seguintes. O PayPal não coleta identificação fiscal, então ali as faturas são emitidas manualmente — escreva para support@apimodels.app com nome da empresa, endereço e número fiscal. A entidade vendedora fica no Reino Unido, portanto vendas para empresas da UE caem em reverse charge.
A conta funciona com saldo pré-pago: quando ele acaba, as chamadas devolvem 402 em vez de continuar cobrando — o teto é rígido e estourar não é possível. Dá também para configurar um webhook de saldo baixo (seu serviço é avisado abaixo de um limite) e a recarga automática (com contagem de falhas e travamento para evitar retentativas descontroladas). O valor realmente cobrado, os parâmetros de entrada e o resultado de cada chamada aparecem item a item no console, então não existe conciliação no fim do mês.
Existem três portas realistas: a API oficial da OpenAI (e a Azure OpenAI pelo mesmo preço de tabela), gateways independentes como a APIMODELS e agregadores genéricos. Avalie por quatro coisas, não pelo preço de vitrine: (1) **a taxa de sucesso real e como ela é calculada** — pergunte se as recusas por política de conteúdo entram no denominador, porque as duas definições não são comparáveis; (2) se as falhas são cobradas; (3) se o preço é previsível — a API oficial cobra imagens como tokens de saída, então o custo por imagem é uma faixa, não um número; (4) se você vai conseguir acesso, já que a OpenAI mantém seus modelos de imagem atrás da verificação de organização. Os nossos números, inclusive os que não nos favorecem, estão nesta página; faça as mesmas quatro perguntas a qualquer fornecedor.
Neste modelo, dá — porque o preço baixo não vem de rebaixar nada. A imagem sai do pipeline de imagem genuíno da OpenAI; nós apenas cobramos um valor fixo por imagem ($0.025 / $0.03 / $0.05 em 1K / 2K / 4K) onde a API oficial cobra tokens de saída e dá por volta de $0.053 num 1024x1024 na qualidade padrão. A taxa de sucesso de infraestrutura é de 98.9% e falhas nunca são cobradas. O verdadeiro trade-off está em outro lugar: vá de oficial se o seu pipeline precisa de garantia exata de dimensão em pixels, ou se você precisa de documentação de conformidade como DPA e cadeias SOC 2, que só uma relação direta oferece.
A recusa vem da política de conteúdo da OpenAI, não de nós, e na prática é comum: 6.007 das 24.208 chamadas dos últimos 30 dias esbarraram nela — **cerca de uma requisição em cada quatro**. Os gatilhos habituais são pessoas reais por nome ou semelhança, marcas e personagens protegidos por direitos autorais, conteúdo violento ou adulto e layouts que parecem documentos falsificados. A correção costuma ser trocar o nome da pessoa por uma descrição da aparência, trocar a marca por uma categoria de produto e evitar palavras como passaporte, documento de identidade ou carteira de habilitação. Requisições recusadas não são cobradas.
Você não é cobrado. Ela fica registrada como falha CONTENT_MODERATION no seu log de chamadas e o crédito reservado é liberado automaticamente. Também deixamos esse tipo de recusa fora da «taxa de sucesso de infraestrutura»: os 98.9% contam apenas timeouts, congestionamento do upstream e respostas sem imagem, porque são as falhas que um prompt diferente não resolveria.
Pelos nossos termos, você mantém os direitos sobre o que envia e sobre o que gera, e o uso comercial é permitido. Duas ressalvas que vale conhecer: o uso final continua sujeito à política de conteúdo da OpenAI (daí a pergunta sobre recusas acima) e as jurisdições divergem sobre se imagens geradas por IA têm direito autoral — consulte sua assessoria jurídica antes de construir ativos de marca em cima delas ou reivindicar exclusividade.
Os arquivos de resultado ficam **7 dias** no nosso armazenamento de objetos e depois são apagados, então baixe ou re-hospede o que precisar. Prompts e registros de chamadas permanecem no console por muito tempo, então dá para consultar os parâmetros quando quiser. Uma distinção importante: a URL pré-assinada de upload vale 10 minutos — ela serve para enviar o material de origem e não tem relação com a retenção de 7 dias dos resultados.
Na APIMODELS, o GPT Image 2 roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Text to Image, Image Editing, Multi-Image, 1K/2K/4K, Async e você pode avaliá-lo em preço e capacidade frente a outros modelos de geração de imagens, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de geração de imagens com preços ao vivo em apimodels.app/models.
O GPT Image 2 suporta: Text to Image, Image Editing, Multi-Image, 1K/2K/4K, Async. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o GPT Image 2 por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.
Substituir texto é o pedido mais comum para este modelo e também o mais difícil de acertar no prompt: o texto novo precisa cair na mesma tipografia, no mesmo tamanho e sobre o mesmo fundo. Se preferir não montar esse fluxo do zero, o EditTextImage é o nosso próprio front-end para isso — roda sobre este modelo e pede apenas a imagem, o que está escrito e o que deveria estar. Há um guia para editar o texto de uma captura e outro para manter a mesma fonte do original, que é exatamente onde a maioria dos prompts manuais falha.
A APIMODELS facilita o acesso à GPT Image 2 API para geração de imagens, edição de imagens, visuais com muito texto e fluxos de trabalho de imagens comerciais de maior qualidade.
A GPT Image-2 API transforma prompts de texto em resultados visuais refinados para criativos de marketing, conceitos de produto, visuais para redes sociais, imagens publicitárias, ilustrações e recursos de design de marca. O fluxo baseado em prompts oferece aos desenvolvedores uma forma flexível de criar experiências de AI Image Generator para ideação visual rápida e resultados refinados.
A GPT-Image-2 API também trabalha a partir de imagens existentes, ideal para mudanças de estilo, substituição de fundo, recolorização de produtos, realce do sujeito e limpeza de composição: edições controladas que preservam as partes importantes da imagem original. Para produtos de AI Image Editor, oferece transformações mais limpas com maior controle visual.
Frases longas, rótulos com várias palavras, pontuação mais clara e consistência de maiúsculas e minúsculas: valioso para mockups de vitrines, pôsteres, conceitos de UI, infográficos, embalagens e recursos de marketing de marca. A tipografia deixa de ser o ponto fraco da imagem.
Altere uma parte da imagem sem afetar o resto: recolorização de produtos, substituição de objetos, atualizações de fundo, refinamentos locais da cena. A iluminação, as sombras, as texturas e o estilo do entorno originais permanecem coerentes, mais limpo do que regenerar a imagem inteira.
Melhor para tarefas em que a credibilidade visual importa: mapas, diagramas de anatomia, reconstruções históricas, cenas arquitetônicas, visuais educativos. Cenas complexas e relações entre objetos são interpretadas com mais fidelidade, tornando os resultados mais críveis.
Resultados de alta qualidade a um ritmo de geração de ~3s (10-40s de ponta a ponta no modo assíncrono). Melhor obediência às instruções para prompts com vários sujeitos, cenas com múltiplas camadas de detalhe e maior controle do layout: prático para a criação visual complexa em escala.
Anúncios localizados, embalagens internacionais, mockups de interface, gráficos educativos, recursos de campanhas de marca: o texto dentro das imagens é parte do design, não um espaço reservado. Precisão linguística e acabamento visual entregues juntos.
Crie uma conta ou faça login na APIMODELS e gere sua API Key no console. Essa key autentica todas as solicitações e conecta a GPT Image 2 API ao seu aplicativo ou fluxo de trabalho interno.
Use o Playground para avaliar antes de integrar. Teste o comportamento do prompt, compare texto para imagem com imagem para imagem, revise a qualidade da saída e valide se atende antes de partir para o código.
Conecte seu serviço backend com solicitações autenticadas. Defina os parâmetros da solicitação, o tratamento de prompts, valide as imagens de entrada e analise as saídas retornadas para que o modelo funcione de forma confiável no seu aplicativo.
Processe os recursos gerados, armazene os arquivos de saída, gerencie as URLs retornadas ou o armazenamento de objetos e defina como os resultados chegam aos usuários ou serviços posteriores. Um pipeline limpo transforma a API em um componente pronto para produção.
Prepare uma operação estável em produção: planejamento de concorrência, lógica de novas tentativas, tratamento de timeouts, fluxo de moderação, logs, controle de custos e as regras específicas do seu produto. Com tudo isso pronto, a API pode impulsionar de forma confiável produtos de AI Image Generator e AI Image Editor.
Para equipes que precisam de volumes constantes de visuais de campanha refinados em todos os canais: imagens publicitárias, criativos de mídia social paga, banners promocionais, gráficos de lançamento, recursos sazonais. Mais rápido do conceito a um resultado utilizável, mais perto de criativos prontos para campanha desde o início.
Encaixa-se no e-commerce e no merchandising, onde as atualizações são controladas (não arte conceitual pontual): trocar fundos, recolorir, refinar imagens de listagem, testar embalagens, alternar visuais hero, sem reconstruir a cena a cada vez. Afeta diretamente a conversão e a velocidade de conteúdo.
Funciona como uma camada de produção dentro de um pipeline de conteúdo mais amplo, não como um recurso isolado: gráficos de apresentação, visuais editoriais, mockups de UI, recursos de blog, infográficos, frames conceituais, imagens de apoio de marca, alinhados a um sistema de comunicação maior.
Muito relevante em diferentes regiões, idiomas e segmentos de público: campanhas localizadas, embalagens multilíngues, promoções regionais, gráficos educativos, recursos de interface. A adaptação visual, a precisão linguística e a consistência criativa avançam juntas.
Preços acessíveis para equipes que querem construir com um modelo de imagem da OpenAI mais potente sem disparar os custos cedo demais. A geração frequente, os testes de prompts, a produção visual em lote e os fluxos de edição em larga escala dependem do preço, agora sob maior controle.
A documentação completa cobre configuração, testes e implantação. Estrutura da solicitação, tratamento de entradas, entrega de saídas, autenticação e lógica de integração: tudo detalhado tanto para a primeira implementação quanto para a iteração de longo prazo.
GPT Image 2, Gemini, Claude, Kling, SparkPix e muito mais podem ser chamados por meio de uma API unificada e uma única key, sem precisar se cadastrar em plataformas separadas. Preços transparentes de pagamento por uso, ideal para desenvolvedores independentes e startups.
As tarefas com state=failed não são cobradas, então tentar novamente é seguro. Os resultados bem-sucedidos são hospedados no nosso R2 e as URLs podem ser consumidas diretamente; ainda assim, recomenda-se persisti-los no seu próprio armazenamento em 24h como defesa adicional.
Prompts shared by their authors — copy and adapt them. Each one credits its author and links back to the original post.

Neon Tokyo Music Video (native stereo audio)
Music video. The soundtrack is a high-energy city-pop / synthwave track with a driving bassline, punchy live drums and a bright analog synth hook, playing continuously from the first frame. Neon-lit Tokyo backstreet at night in the rain. A young female singer in an oversized translucent raincoat performs straight to camera under a red izakaya lantern, singing the hook in sync with the music. Fast cuts landing on the beat: wide shot down the alley with neon reflected in puddles; tight close-up of her face with magenta rim light and rain on her cheek; low-angle push as she walks toward camera when the bass drops; quick insert of rain hitting a buzzing neon sign; back to a wide performance shot as the hook repeats. Anamorphic lens flares, shallow depth of field, 35mm film grain, teal and magenta palette, cinematic colour grade. No on-screen text.
by APIMODELS

Living Wallpaper: Aurora Lake (locked camera)
Locked-off static camera. No zoom, no pan, no dolly, no parallax. Only ambient atmosphere moves: the aurora ribbons drift and undulate slowly across the night sky, thin low mist creeps gently across the lake, the water surface breathes with extremely subtle ripples while keeping the mirror reflection intact, faint stars shimmer. Calm, continuous, seamless ambient loop. Nothing enters or leaves the frame, no new objects, no people, no text.
by APIMODELS
Condor Heroes characters teach English word dream
神雕侠侣主角趣味讲单词 dream 教程
by @nicekate8888
We curate copy-ready prompt libraries — every entry shows its full text and a sample result, ready to adapt.
How to get access, regional availability, and how this model compares with its alternatives.