
gpt-5-6-terraGPT-5.6 Terra is designed for workloads that balance intelligence and cost — the mini tier of the GPT-5.6 family. It offers higher reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.551 input / $3.309 output per 1M tokens (cached input $0.055) — exactly half of GPT-5.6 Sol, and about 78% below OpenAI's own $2.5 / $15 list. One API key for every model, reachable from China, only successful requests billed.
The mini tier — strong reasoning at a fraction of the frontier price
Seven levels: gpt-5.6-terra plus -low / -medium / -high / -xhigh / -max / -ultra, all one price
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.551 / $3.309 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-terra",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-terra",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-terra",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-terra) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Terra é uma API de modelo de linguagem da OpenAI. O GPT-5.6 Terra é o nível mini da família GPT-5.6, o ponto em que inteligência e custo se equilibram: mais raciocínio com boa velocidade, entrada de texto e imagem com saída de texto, janela de contexto de 1.050.000 tokens, até 128.000 tokens de saída, suporte a tokens de raciocínio e conhecimento até 16 de fevereiro de 2026. Está disponível na APIMODELS por /v1/chat/completions e /v1/responses: $0.551 de entrada e $3.309 de saída por milhão de tokens, com entrada em cache a $0.055. É exatamente metade do preço do GPT-5.6 Sol e cerca de um quinto da tabela oficial da OpenAI ($2.5 / $15), o que faz dele a escolha padrão para chat, programação e agentes com chamadas de ferramentas quando o raciocínio máximo não compensa o gasto. Uma chave para todos os modelos e cobrança apenas das requisições bem-sucedidas. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.551, Output: $3.309 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O GPT-5.6 Terra está disponível pela APIMODELS a: Input: $0.551, Output: $3.309 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo GPT-5.6 Terra pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
O GPT-5.6 Terra é o nível intermediário (mini) da família GPT-5.6: mais raciocínio com boa velocidade, entrada de texto e imagem, contexto de 1.050.000 tokens, até 128.000 de saída, tokens de raciocínio e conhecimento até fevereiro de 2026. Na apimodels.app custa $0.551 por milhão de tokens de entrada e $3.309 por milhão de saída, com entrada em cache a $0.055 — exatamente metade do GPT-5.6 Sol e cerca de um quinto da tabela oficial da OpenAI ($2.5 / $15).
Aponte a base_url para https://api.apimodels.app/v1 e coloque gpt-5.6-terra no campo model. Os dois endpoints compatíveis com a OpenAI funcionam — /v1/chat/completions e /v1/responses — então openai-python, Cherry Studio e Cursor funcionam sem alteração. Para ajustar a profundidade de raciocínio, troque o sufixo: -low, -medium, -high, -xhigh, -max ou -ultra, todos com o mesmo preço por token. Uma única chave dá acesso a todos os modelos, a cobrança é por uso e requisições que falham não são cobradas.
Se uma requisição passar de 272.000 tokens de entrada, ela inteira é cobrada a $1.102 de entrada e $4.964 de saída — ou seja, 2× a entrada e 1,5× a saída, acompanhando o degrau de preço do provedor. Tokens de raciocínio contam como tokens de saída.
O Terra é o meio-termo: custa exatamente metade do Sol ($0.551 / $3.309 contra $1.103 / $6.618) e dá conta com folga de chat, programação e agentes com chamadas de ferramentas. Escolha o Sol quando precisar do raciocínio máximo, e o Luna quando volume e custo falarem mais alto ($0.221 / $1.324, 20% do Sol). Os três compartilham o endpoint compatível com a OpenAI: trocar entre eles é mudar só o nome do modelo, sem mexer no código.
Três pontos merecem atenção. O provedor acrescenta um preâmbulo de sistema de cerca de 1.450 tokens a cada requisição, então usage.input_tokens nunca fica abaixo disso. parallel_tool_calls: false é ignorado do lado do provedor e o modelo pode devolver várias tool_calls de uma vez — deixe seu handler preparado para mais de uma. E a partir de 272.000 tokens de entrada a requisição inteira é recobrada (2× entrada, 1,5× saída). Fora isso, entrada de texto e imagem, function calling, streaming e /v1/responses funcionam normalmente.
Na APIMODELS, o GPT-5.6 Terra roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta Balanced, Higher Reasoning, Fast, 1.05M Context e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O GPT-5.6 Terra suporta: Balanced, Higher Reasoning, Fast, 1.05M Context. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o GPT-5.6 Terra por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.