
gpt-5-6-lunaGPT-5.6 Luna es el nivel nano de la familia GPT-5.6, el que está pensado para cargas de alto volumen y presupuestos ajustados: razonamiento alto a gran velocidad, entrada de texto e imagen con salida de texto, ventana de contexto de 1.050.000 tokens, hasta 128.000 tokens de salida, soporte de tokens de razonamiento y conocimiento hasta el 16 de febrero de 2026. Disponible en APIMODELS por /v1/chat/completions y /v1/responses: $0.16 de entrada y $0.96 de salida por millón de tokens, con la entrada en caché a $0.016. Cuesta alrededor del 12% de lo que cuesta GPT-5.6 Sol y un 20% menos que la tarifa oficial de OpenAI ($0.20 / $1.20): el modelo más económico de la familia y la mejor cuenta para clasificación masiva, extracción, reescritura y atención al cliente. Actualmente el proveedor solo sirve el nivel de razonamiento max, así que se invoca como gpt-5.6-luna-max; el nombre gpt-5.6-luna se redirige a él al mismo precio. Se paga por uso y las peticiones fallidas no se cobran.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
El nivel nano — hecho para cargas de mucho volumen y poco coste
Soporte de tokens de razonamiento afinado para el rendimiento
Entrada de texto + imagen, salida de texto; contexto de 1,05M y hasta 128K de salida
/v1/chat/completions y /v1/responses compatibles con OpenAI; $0.16 / $0.96 por 1M
GPT-5.6 Luna es una API de modelo de lenguaje de OpenAI. GPT-5.6 Luna es el nivel nano de la familia GPT-5.6, el que está pensado para cargas de alto volumen y presupuestos ajustados: razonamiento alto a gran velocidad, entrada de texto e imagen con salida de texto, ventana de contexto de 1.050.000 tokens, hasta 128.000 tokens de salida, soporte de tokens de razonamiento y conocimiento hasta el 16 de febrero de 2026. Disponible en APIMODELS por /v1/chat/completions y /v1/responses: $0.16 de entrada y $0.96 de salida por millón de tokens, con la entrada en caché a $0.016. Cuesta alrededor del 12% de lo que cuesta GPT-5.6 Sol y un 20% menos que la tarifa oficial de OpenAI ($0.20 / $1.20): el modelo más económico de la familia y la mejor cuenta para clasificación masiva, extracción, reescritura y atención al cliente. Actualmente el proveedor solo sirve el nivel de razonamiento max, así que se invoca como gpt-5.6-luna-max; el nombre gpt-5.6-luna se redirige a él al mismo precio. Se paga por uso y las peticiones fallidas no se cobran. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.16, Output: $0.96 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
GPT-5.6 Luna está disponible a través de APIMODELS a: Input: $0.16, Output: $0.96 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo GPT-5.6 Luna a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
GPT-5.6 Luna es el nivel nano de la familia GPT-5.6, pensado para cargas de alto volumen y sensibles al coste: razonamiento alto a gran velocidad, entrada de texto e imagen, contexto de 1.050.000 tokens, hasta 128.000 de salida y conocimiento hasta febrero de 2026. En apimodels.app cuesta $0.16 por millón de tokens de entrada y $0.96 por millón de salida, con la entrada en caché a $0.016: un 20% de GPT-5.6 Sol, un 20% por debajo de la tarifa oficial de OpenAI ($0.20 / $1.20), y el modelo más económico de toda la familia.
Apunta base_url a https://api.apimodels.app/v1 y pon gpt-5.6-luna en el campo model. Funcionan los dos endpoints compatibles con OpenAI, /v1/chat/completions y /v1/responses, y las llamadas a funciones (tools) están disponibles. Ojo: el proveedor solo tiene activo el nivel de razonamiento max, así que el nombre gpt-5.6-luna se redirige automáticamente a gpt-5.6-luna-max, al mismo precio. Una clave cubre todos los modelos, se paga por uso y las peticiones fallidas no se cobran.
Cuando una petición supera los 272.000 tokens de entrada, se factura entera a $0.32 de entrada y $1.44 de salida (2× entrada, 1,5× salida), igual que el escalón del proveedor. Los tokens de razonamiento se cuentan como salida.
Luna es, dentro de la propia familia, la opción más económica: $0.16 por millón de tokens de entrada y $0.96 de salida en apimodels.app, aproximadamente una octava parte de Sol en entrada y una séptima en salida, y un 20% por debajo de la tarifa oficial de OpenAI ($0.20 / $1.20), con la entrada en caché a solo $0.016. Para clasificación masiva, extracción, reescritura y atención al cliente es donde mejor sale la cuenta; sube a gpt-5.6-terra o gpt-5.6-sol cuando necesites más razonamiento. Migrar desde la API oficial de OpenAI o desde otra pasarela no exige tocar el código: apunta base_url a https://api.apimodels.app/v1 y pon gpt-5.6-luna-max en model. La API es compatible con OpenAI y las peticiones fallidas nunca se cobran.
La más importante: el proveedor solo sirve el nivel de razonamiento max, así que usa el identificador gpt-5.6-luna-max (gpt-5.6-luna queda redirigido a él, al mismo precio). Aparte de eso, cada petición arrastra un preámbulo de sistema de unos 1.450 tokens, así que input_tokens nunca baja de ese piso; parallel_tool_calls: false se ignora y el modelo puede devolver varias tool_calls a la vez; y por encima de 272.000 tokens de entrada se refactura toda la petición. Las llamadas a funciones (tools), el streaming y /v1/responses están verificados y funcionan.
En APIMODELS, GPT-5.6 Luna convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite Cost-Efficient, High-Volume, Fast, 1.05M Context y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
GPT-5.6 Luna admite: Cost-Efficient, High-Volume, Fast, 1.05M Context. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone GPT-5.6 Luna mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.
How to get access, regional availability, and how this model compares with its alternatives.