
gpt-6-lunaGPT-6 Luna es el nivel eficiente de la familia GPT-6 de OpenAI; la propia OpenAI lo describe como su modelo más eficiente para tareas enfocadas de alto volumen. Se publicó en septiembre de 2026 junto con GPT-6 Sol. En APIMODELS cuesta $0.09 por 1M de tokens de entrada y $0.45 por 1M de salida, un 10% por debajo de la lista de OpenAI de $0.10 / $0.50, con entrada en caché a $0.009. Las especificaciones coinciden con Sol y Astra: contexto de 1 050 000 tokens, 128 000 de salida máxima, entrada de texto e imágenes y corte de conocimiento del 18 de mayo de 2026. reasoning_effort admite none / low / medium (por defecto) / high / xhigh / max; los tokens de razonamiento se cobran como salida y cuentan dentro de max_tokens: usa low o none para clasificación, extracción y otro trabajo masivo, que es donde este nivel rinde. Cuando la entrada supera 272K tokens, la entrada y la entrada en caché se cobran a 2× y la salida a 1,5×, el tramo de contexto largo compartido por la familia. Se llama por los /v1/chat/completions o /v1/responses compatibles con OpenAI con una sola clave; las llamadas a funciones funcionan en ambos endpoints: comprobamos que /v1/chat/completions devuelve tool_calls con el reasoning_effort por defecto, así que el requisito de reasoning_effort none de la documentación de OpenAI no aplica aquí. Las peticiones fallidas no se cobran.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 por 1M de tokens frente a los $0.10 / $0.50 de lista; entrada en caché $0.009
OpenAI: su modelo más eficiente para tareas enfocadas de alto volumen — clasificación, extracción, enrutado
Mismas especificaciones que Sol y Astra; entrada de texto e imágenes; conocimiento hasta el 18 de mayo de 2026
Los tokens de razonamiento se cobran como salida y cuentan en max_tokens: usa low o none para trabajo masivo
GPT-6 Luna es una API de modelo de lenguaje de OpenAI. GPT-6 Luna es el nivel eficiente de la familia GPT-6 de OpenAI; la propia OpenAI lo describe como su modelo más eficiente para tareas enfocadas de alto volumen. Se publicó en septiembre de 2026 junto con GPT-6 Sol. En APIMODELS cuesta $0.09 por 1M de tokens de entrada y $0.45 por 1M de salida, un 10% por debajo de la lista de OpenAI de $0.10 / $0.50, con entrada en caché a $0.009. Las especificaciones coinciden con Sol y Astra: contexto de 1 050 000 tokens, 128 000 de salida máxima, entrada de texto e imágenes y corte de conocimiento del 18 de mayo de 2026. reasoning_effort admite none / low / medium (por defecto) / high / xhigh / max; los tokens de razonamiento se cobran como salida y cuentan dentro de max_tokens: usa low o none para clasificación, extracción y otro trabajo masivo, que es donde este nivel rinde. Cuando la entrada supera 272K tokens, la entrada y la entrada en caché se cobran a 2× y la salida a 1,5×, el tramo de contexto largo compartido por la familia. Se llama por los /v1/chat/completions o /v1/responses compatibles con OpenAI con una sola clave; las llamadas a funciones funcionan en ambos endpoints: comprobamos que /v1/chat/completions devuelve tool_calls con el reasoning_effort por defecto, así que el requisito de reasoning_effort none de la documentación de OpenAI no aplica aquí. Las peticiones fallidas no se cobran. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.09, Output: $0.45 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
GPT-6 Luna está disponible a través de APIMODELS a: Input: $0.09, Output: $0.45 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo GPT-6 Luna a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
$0.09 por 1M de tokens de entrada, $0.45 por 1M de salida y $0.009 por entrada en caché: el 90% de la lista de OpenAI de $0.10 / $0.50 / $0.01. Cuando la entrada de una petición supera 272K tokens, la entrada y la entrada en caché se cobran a 2× y la salida a 1,5×, igual que el tramo de contexto largo de OpenAI. Se cobra por token real, los tokens de razonamiento cuentan como salida y las peticiones fallidas son gratis.
OpenAI describe a Luna como su modelo más eficiente para tareas enfocadas de alto volumen, y a Sol como el nivel de trabajo. Aquí Luna cuesta $0.09 / $0.45 y Sol $1.00 / $5.00, más de diez veces de diferencia. Usa Luna para clasificación, extracción, enrutado, resúmenes y triaje de logs: mucho volumen y poca dificultad por elemento. Usa Sol cuando necesites más razonamiento o agentes de largo recorrido. Las especificaciones son idénticas: contexto de 1,05M, salida de 128K, entrada de texto e imágenes.
GPT-6 Luna usa por defecto reasoning_effort medium y los tokens de razonamiento cuentan dentro de max_tokens: en nuestra prueba con max_tokens 300, los 300 tokens se fueron en razonar y no volvió texto visible. Para trabajo masivo pon reasoning_effort en low o none, o deja en max_tokens margen suficiente para el razonamiento.
POST https://api.apimodels.app/v1/chat/completions o /v1/responses con model gpt-6-luna y Authorization: Bearer tu clave de apimodels; en el SDK de OpenAI solo cambia base_url. Funcionan streaming, llamadas a funciones, salida JSON y entrada de imágenes: comprobamos que /v1/chat/completions devuelve tool_calls con el reasoning_effort por defecto, así que el requisito de reasoning_effort none de la documentación de OpenAI no aplica aquí.
En APIMODELS, GPT-6 Luna convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite 10% Below Official, High Volume, 1.05M Context, Reasoning Effort y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
GPT-6 Luna admite: 10% Below Official, High Volume, 1.05M Context, Reasoning Effort. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone GPT-6 Luna mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.