
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
The nano tier — built for high-volume, low-cost workloads
Reasoning-token support tuned for throughput
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.221 / $1.324 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna es una API de modelo de lenguaje de OpenAI. GPT-5.6 Luna es el nivel nano de la familia GPT-5.6, el que está pensado para cargas de alto volumen y presupuestos ajustados: razonamiento alto a gran velocidad, entrada de texto e imagen con salida de texto, ventana de contexto de 1.050.000 tokens, hasta 128.000 tokens de salida, soporte de tokens de razonamiento y conocimiento hasta el 16 de febrero de 2026. Disponible en APIMODELS por /v1/chat/completions y /v1/responses: $0.221 de entrada y $1.324 de salida por millón de tokens, con la entrada en caché a $0.022. Es un 20% de lo que cuesta GPT-5.6 Sol y cerca de una quinta parte de la tarifa oficial de OpenAI ($1 / $6): el modelo más barato de la familia y la mejor cuenta para clasificación masiva, extracción, reescritura y atención al cliente. Actualmente el proveedor solo sirve el nivel de razonamiento max, así que se invoca como gpt-5.6-luna-max; el nombre gpt-5.6-luna se redirige a él al mismo precio. Se paga por uso y las peticiones fallidas no se cobran. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.221, Output: $1.324 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
GPT-5.6 Luna está disponible a través de APIMODELS a: Input: $0.221, Output: $1.324 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo GPT-5.6 Luna a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
GPT-5.6 Luna es el nivel nano de la familia GPT-5.6, pensado para cargas de alto volumen y sensibles al coste: razonamiento alto a gran velocidad, entrada de texto e imagen, contexto de 1.050.000 tokens, hasta 128.000 de salida y conocimiento hasta febrero de 2026. En apimodels.app cuesta $0.221 por millón de tokens de entrada y $1.324 por millón de salida, con la entrada en caché a $0.022: un 20% de GPT-5.6 Sol, aproximadamente una quinta parte de la tarifa oficial de OpenAI ($1 / $6), y el modelo más barato de toda la familia.
Apunta base_url a https://api.apimodels.app/v1 y pon gpt-5.6-luna en el campo model. Funcionan los dos endpoints compatibles con OpenAI, /v1/chat/completions y /v1/responses, y las llamadas a funciones (tools) están disponibles. Ojo: el proveedor solo tiene activo el nivel de razonamiento max, así que el nombre gpt-5.6-luna se redirige automáticamente a gpt-5.6-luna-max, al mismo precio. Una clave cubre todos los modelos, se paga por uso y las peticiones fallidas no se cobran.
Cuando una petición supera los 272.000 tokens de entrada, se factura entera a $0.442 de entrada y $1.986 de salida (2× entrada, 1,5× salida), igual que el escalón del proveedor. Los tokens de razonamiento se cuentan como salida.
Luna es, dentro de la propia familia, la opción más barata: $0.221 por millón de tokens de entrada y $1.324 de salida en apimodels.app, una quinta parte de Sol y de la tarifa oficial de OpenAI ($1 / $6), con la entrada en caché a solo $0.022. Para clasificación masiva, extracción, reescritura y atención al cliente es donde mejor sale la cuenta; sube a gpt-5.6-terra o gpt-5.6-sol cuando necesites más razonamiento. Migrar desde la API oficial de OpenAI o desde otra pasarela no exige tocar el código: apunta base_url a https://api.apimodels.app/v1 y pon gpt-5.6-luna-max en model. La API es compatible con OpenAI y las peticiones fallidas nunca se cobran.
La más importante: el proveedor solo sirve el nivel de razonamiento max, así que usa el identificador gpt-5.6-luna-max (gpt-5.6-luna queda redirigido a él, al mismo precio). Aparte de eso, cada petición arrastra un preámbulo de sistema de unos 1.450 tokens, así que input_tokens nunca baja de ese piso; parallel_tool_calls: false se ignora y el modelo puede devolver varias tool_calls a la vez; y por encima de 272.000 tokens de entrada se refactura toda la petición. Las llamadas a funciones (tools), el streaming y /v1/responses están verificados y funcionan.
En APIMODELS, GPT-5.6 Luna convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite Cost-Efficient, High-Volume, Fast, 1.05M Context y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
GPT-5.6 Luna admite: Cost-Efficient, High-Volume, Fast, 1.05M Context. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone GPT-5.6 Luna mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.