
gpt-5-6-terraGPT-5.6 Terra is designed for workloads that balance intelligence and cost — the mini tier of the GPT-5.6 family. It offers higher reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.551 input / $3.309 output per 1M tokens (cached input $0.055) — exactly half of GPT-5.6 Sol, and about 78% below OpenAI's own $2.5 / $15 list. One API key for every model, reachable from China, only successful requests billed.
The mini tier — strong reasoning at a fraction of the frontier price
Seven levels: gpt-5.6-terra plus -low / -medium / -high / -xhigh / -max / -ultra, all one price
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.551 / $3.309 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-terra",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-terra",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-terra",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-terra) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Terra es una API de modelo de lenguaje de OpenAI. GPT-5.6 Terra es el nivel mini de la familia GPT-5.6, el punto donde la inteligencia y el coste se equilibran: más razonamiento a buena velocidad, entrada de texto e imagen con salida de texto, ventana de contexto de 1.050.000 tokens, hasta 128.000 tokens de salida, soporte de tokens de razonamiento y conocimiento hasta el 16 de febrero de 2026. Disponible en APIMODELS por /v1/chat/completions y /v1/responses: $0.551 de entrada y $3.309 de salida por millón de tokens, con la entrada en caché a $0.055. Es exactamente la mitad de lo que cuesta GPT-5.6 Sol y cerca de una quinta parte de la tarifa oficial de OpenAI ($2.5 / $15), lo que lo convierte en la opción por defecto para chat, programación y agentes con llamadas a herramientas cuando el máximo razonamiento no compensa el gasto. Una clave para todos los modelos y solo se cobran las peticiones correctas. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.551, Output: $3.309 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
GPT-5.6 Terra está disponible a través de APIMODELS a: Input: $0.551, Output: $3.309 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo GPT-5.6 Terra a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
GPT-5.6 Terra es el nivel intermedio (mini) de la familia GPT-5.6: más razonamiento a buena velocidad, entrada de texto e imagen, contexto de 1.050.000 tokens, hasta 128.000 de salida, tokens de razonamiento y conocimiento hasta febrero de 2026. En apimodels.app cuesta $0.551 por millón de tokens de entrada y $3.309 por millón de salida, con la entrada en caché a $0.055: exactamente la mitad que GPT-5.6 Sol y cerca de una quinta parte de la tarifa oficial de OpenAI ($2.5 / $15).
Apunta base_url a https://api.apimodels.app/v1 y pon gpt-5.6-terra en el campo model. Funcionan los dos endpoints compatibles con OpenAI, /v1/chat/completions y /v1/responses, de modo que openai-python, Cherry Studio o Cursor sirven sin cambios. Para ajustar la profundidad de razonamiento cambia el sufijo: -low, -medium, -high, -xhigh, -max o -ultra, todos al mismo precio por token. Una sola clave te da acceso a todos los modelos, se paga por uso y las peticiones fallidas no se cobran.
Si una petición supera los 272.000 tokens de entrada, se factura entera a $1.102 de entrada y $4.964 de salida, es decir 2× la entrada y 1,5× la salida, igual que el escalón de precio del proveedor. Los tokens de razonamiento cuentan como tokens de salida.
Terra es el término medio: cuesta exactamente la mitad que Sol ($0.551 / $3.309 frente a $1.103 / $6.618) y rinde de sobra para chat, programación y agentes con llamadas a herramientas. Elige Sol cuando necesites el máximo razonamiento, y Luna cuando manden el volumen y el coste ($0.221 / $1.324, un 20% de Sol). Los tres comparten endpoint compatible con OpenAI: se cambia de uno a otro modificando solo el nombre del modelo, sin tocar el código.
Tres cosas conviene saber. El proveedor añade un preámbulo de sistema de unos 1.450 tokens a cada petición, así que usage.input_tokens nunca baja de ahí. parallel_tool_calls: false se ignora aguas arriba y el modelo puede devolver varias tool_calls a la vez, de modo que tu manejador debe aceptar más de una. Y a partir de 272.000 tokens de entrada la petición entera se refactura (2× entrada, 1,5× salida). Por lo demás, entrada de texto e imagen, llamadas a funciones, streaming y /v1/responses funcionan con normalidad.
En APIMODELS, GPT-5.6 Terra convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite Balanced, Higher Reasoning, Fast, 1.05M Context y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
GPT-5.6 Terra admite: Balanced, Higher Reasoning, Fast, 1.05M Context. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone GPT-5.6 Terra mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.