
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
The nano tier — built for high-volume, low-cost workloads
Reasoning-token support tuned for throughput
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.221 / $1.324 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna é uma API de modelo de linguagem da OpenAI. O GPT-5.6 Luna é o nível nano da família GPT-5.6, pensado para cargas de alto volume e orçamento apertado: raciocínio alto em alta velocidade, entrada de texto e imagem com saída de texto, janela de contexto de 1.050.000 tokens, até 128.000 tokens de saída, suporte a tokens de raciocínio e conhecimento até 16 de fevereiro de 2026. Está disponível na APIMODELS por /v1/chat/completions e /v1/responses: $0.221 de entrada e $1.324 de saída por milhão de tokens, com entrada em cache a $0.022. É 20% do preço do GPT-5.6 Sol e cerca de um quinto da tabela oficial da OpenAI ($1 / $6) — o modelo mais barato da família e a melhor conta para classificação em massa, extração, reescrita e atendimento. No momento o provedor serve apenas o nível de raciocínio max, então ele é invocado como gpt-5.6-luna-max; o nome gpt-5.6-luna é redirecionado para ele pelo mesmo preço. A cobrança é por uso e requisições que falham não são cobradas. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.221, Output: $1.324 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O GPT-5.6 Luna está disponível pela APIMODELS a: Input: $0.221, Output: $1.324 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo GPT-5.6 Luna pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
O GPT-5.6 Luna é o nível nano da família GPT-5.6, feito para cargas de alto volume e sensíveis a custo: raciocínio alto em alta velocidade, entrada de texto e imagem, contexto de 1.050.000 tokens, até 128.000 de saída e conhecimento até fevereiro de 2026. Na apimodels.app custa $0.221 por milhão de tokens de entrada e $1.324 por milhão de saída, com entrada em cache a $0.022 — 20% do GPT-5.6 Sol, cerca de um quinto da tabela oficial da OpenAI ($1 / $6), e o modelo mais barato de toda a família.
Aponte a base_url para https://api.apimodels.app/v1 e coloque gpt-5.6-luna no campo model. Os dois endpoints compatíveis com a OpenAI funcionam — /v1/chat/completions e /v1/responses — e function calling (tools) está disponível. Atenção: o provedor só mantém ativo o nível de raciocínio max, então o nome gpt-5.6-luna é redirecionado automaticamente para gpt-5.6-luna-max, pelo mesmo preço. Uma chave cobre todos os modelos, a cobrança é por uso e requisições que falham não são cobradas.
Quando uma requisição passa de 272.000 tokens de entrada, ela inteira é cobrada a $0.442 de entrada e $1.986 de saída (2× entrada, 1,5× saída), acompanhando o degrau do provedor. Tokens de raciocínio contam como saída.
O próprio Luna é a opção mais barata da família: $0.221 por milhão de tokens de entrada e $1.324 de saída na apimodels.app — um quinto do Sol e da tabela oficial da OpenAI ($1 / $6), com entrada em cache a apenas $0.022. Para classificação em massa, extração, reescrita e atendimento é onde a conta fecha melhor; suba para gpt-5.6-terra ou gpt-5.6-sol quando precisar de mais raciocínio. Migrar da API oficial da OpenAI ou de outro gateway não exige mexer no código: aponte a base_url para https://api.apimodels.app/v1 e use gpt-5.6-luna-max no campo model. A API é compatível com a OpenAI e requisições que falham nunca são cobradas.
A principal: o provedor serve apenas o nível de raciocínio max, então use o identificador gpt-5.6-luna-max (gpt-5.6-luna é redirecionado para ele, pelo mesmo preço). Além disso, cada requisição carrega um preâmbulo de sistema de cerca de 1.450 tokens, então input_tokens nunca fica abaixo desse piso; parallel_tool_calls: false é ignorado e o modelo pode devolver várias tool_calls de uma vez; e acima de 272.000 tokens de entrada a requisição inteira é recobrada. Function calling (tools), streaming e /v1/responses foram verificados e funcionam.
Na APIMODELS, o GPT-5.6 Luna roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Cost-Efficient, High-Volume, Fast, 1.05M Context e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O GPT-5.6 Luna suporta: Cost-Efficient, High-Volume, Fast, 1.05M Context. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o GPT-5.6 Luna por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.