
gpt-6-lunaGPT-6 Luna é o nível eficiente da família GPT-6 da OpenAI; a própria OpenAI o descreve como seu modelo mais eficiente para tarefas focadas de alto volume. Foi lançado em setembro de 2026 junto com o GPT-6 Sol. No APIMODELS custa $0.09 por 1M de tokens de entrada e $0.45 por 1M de saída, 10% abaixo da lista da OpenAI de $0.10 / $0.50, com entrada em cache a $0.009. As especificações batem com Sol e Astra: contexto de 1.050.000 tokens, 128.000 de saída máxima, entrada de texto e imagens e corte de conhecimento em 18 de maio de 2026. reasoning_effort aceita none / low / medium (padrão) / high / xhigh / max; tokens de raciocínio são cobrados como saída e contam dentro de max_tokens: use low ou none para classificação, extração e outro trabalho em massa, que é onde este nível se paga. Quando a entrada passa de 272K tokens, entrada e entrada em cache são cobradas a 2× e a saída a 1,5×, a faixa de contexto longo compartilhada pela família. Chame pelos /v1/chat/completions ou /v1/responses compatíveis com OpenAI com uma única chave; chamadas de função funcionam nos dois endpoints: verificamos que o /v1/chat/completions devolve tool_calls com o reasoning_effort padrão, então a exigência de reasoning_effort none da documentação da OpenAI não se aplica aqui. Requisições com falha não são cobradas.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 por 1M de tokens contra os $0.10 / $0.50 de lista; entrada em cache $0.009
OpenAI: seu modelo mais eficiente para tarefas focadas de alto volume — classificação, extração, roteamento
Mesmas especificações de Sol e Astra; entrada de texto e imagens; conhecimento até 18 de maio de 2026
Tokens de raciocínio são cobrados como saída e contam em max_tokens: use low ou none para trabalho em massa
GPT-6 Luna é uma API de modelo de linguagem da OpenAI. GPT-6 Luna é o nível eficiente da família GPT-6 da OpenAI; a própria OpenAI o descreve como seu modelo mais eficiente para tarefas focadas de alto volume. Foi lançado em setembro de 2026 junto com o GPT-6 Sol. No APIMODELS custa $0.09 por 1M de tokens de entrada e $0.45 por 1M de saída, 10% abaixo da lista da OpenAI de $0.10 / $0.50, com entrada em cache a $0.009. As especificações batem com Sol e Astra: contexto de 1.050.000 tokens, 128.000 de saída máxima, entrada de texto e imagens e corte de conhecimento em 18 de maio de 2026. reasoning_effort aceita none / low / medium (padrão) / high / xhigh / max; tokens de raciocínio são cobrados como saída e contam dentro de max_tokens: use low ou none para classificação, extração e outro trabalho em massa, que é onde este nível se paga. Quando a entrada passa de 272K tokens, entrada e entrada em cache são cobradas a 2× e a saída a 1,5×, a faixa de contexto longo compartilhada pela família. Chame pelos /v1/chat/completions ou /v1/responses compatíveis com OpenAI com uma única chave; chamadas de função funcionam nos dois endpoints: verificamos que o /v1/chat/completions devolve tool_calls com o reasoning_effort padrão, então a exigência de reasoning_effort none da documentação da OpenAI não se aplica aqui. Requisições com falha não são cobradas. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.09, Output: $0.45 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O GPT-6 Luna está disponível pela APIMODELS a: Input: $0.09, Output: $0.45 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo GPT-6 Luna pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
$0.09 por 1M de tokens de entrada, $0.45 por 1M de saída e $0.009 por entrada em cache: 90% da lista da OpenAI de $0.10 / $0.50 / $0.01. Quando a entrada de uma requisição passa de 272K tokens, entrada e entrada em cache são cobradas a 2× e a saída a 1,5×, igual à faixa de contexto longo da OpenAI. A cobrança é por token real, tokens de raciocínio contam como saída e requisições com falha são grátis.
A OpenAI descreve o Luna como seu modelo mais eficiente para tarefas focadas de alto volume, e o Sol como o nível de trabalho. Aqui o Luna custa $0.09 / $0.45 e o Sol $1.00 / $5.00, mais de dez vezes de diferença. Use o Luna para classificação, extração, roteamento, resumos e triagem de logs: muito volume e pouca dificuldade por item. Use o Sol quando precisar de mais raciocínio ou de agentes de horizonte longo. As especificações são idênticas: contexto de 1,05M, saída de 128K, entrada de texto e imagens.
O GPT-6 Luna usa por padrão reasoning_effort medium, e os tokens de raciocínio contam dentro de max_tokens: no nosso teste com max_tokens 300, todos os 300 tokens foram para o raciocínio e nenhum texto visível voltou. Para trabalho em massa, ponha reasoning_effort em low ou none, ou deixe em max_tokens folga suficiente para o raciocínio.
POST https://api.apimodels.app/v1/chat/completions ou /v1/responses com model gpt-6-luna e Authorization: Bearer sua chave do apimodels; no SDK da OpenAI só muda o base_url. Streaming, chamadas de função, saída JSON e entrada de imagem funcionam: verificamos que o /v1/chat/completions devolve tool_calls com o reasoning_effort padrão, então a exigência de reasoning_effort none da documentação da OpenAI não se aplica aqui.
Na APIMODELS, o GPT-6 Luna roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta 10% Below Official, High Volume, 1.05M Context, Reasoning Effort e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O GPT-6 Luna suporta: 10% Below Official, High Volume, 1.05M Context, Reasoning Effort. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o GPT-6 Luna por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.