
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
The nano tier — built for high-volume, low-cost workloads
Reasoning-token support tuned for throughput
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.221 / $1.324 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna — это API категории «языковая модель» от OpenAI. GPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.221, Output: $1.324 per 1M tokens.
Build intelligent conversational systems to automatically answer user queries and improve service efficiency.
Automatically write articles, emails, ad copy, and other text content to boost productivity.
Assist with code writing, debugging, and code review to accelerate software development.
Understand and analyze unstructured data, extract key insights, and generate summary reports.
GPT-5.6 Luna доступна через APIMODELS по цене: Input: $0.221, Output: $1.324 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель GPT-5.6 Luna через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
GPT-5.6 Luna — младший уровень семейства GPT-5.6 для чувствительных к цене задач большого объёма: высокий уровень рассуждений при высокой скорости, приём текста и изображений, контекст 1 050 000 токенов, до 128 000 токенов на выходе, поддержка токенов рассуждения, знания по февраль 2026 года. На apimodels.app это $0.221 за миллион входных токенов и $1.324 за миллион выходных (вход из кэша — $0.022) — 20% от цены GPT-5.6 Sol, примерно пятая часть официального прайса OpenAI ($1 / $6), и самая дешёвая модель в семействе GPT-5.6.
Укажите base_url https://api.apimodels.app/v1 и передайте gpt-5.6-luna в поле model. Работают оба совместимых с OpenAI эндпоинта — /v1/chat/completions и /v1/responses, поддерживаются вызовы функций (tools). gpt-5.6-luna — каноническое имя; старое написание gpt-5.6-luna-max по-прежнему ведёт на ту же модель по той же цене. Один API-ключ на все модели, оплата по факту использования, неудачные запросы никогда не тарифицируются.
Если вход запроса превышает 272 000 токенов, весь запрос тарифицируется по $0.442 за вход и $1.986 за выход (2× вход, 1,5× выход) — так же, как у поставщика на этой ступени. Токены рассуждения считаются выходными.
Luna сама по себе — самый дешёвый уровень семейства GPT-5.6: $0.221 за миллион входных токенов и $1.324 за миллион выходных на apimodels.app — пятая часть цены Sol и примерно пятая часть официального прайса OpenAI ($1/$6), при этом вход из кэша стоит всего $0.022. Для массовой классификации, извлечения данных, переписывания текста и задач поддержки это лучшее соотношение цены и результата; переходите на gpt-5.6-terra или gpt-5.6-sol, когда нужны более сильные рассуждения. Миграция с прямого OpenAI или другого шлюза не требует правок кода: укажите base_url https://api.apimodels.app/v1 и model gpt-5.6-luna. API совместим с OpenAI, неудачные запросы никогда не тарифицируются.
Используйте идентификатор модели gpt-5.6-luna; старое написание gpt-5.6-luna-max по-прежнему ведёт на ту же модель по той же цене. Помимо этого, поставщик добавляет к каждому запросу системную преамбулу примерно на 1 450 токенов, поэтому input_tokens никогда не опускается ниже этого порога; `parallel_tool_calls: false` игнорируется, и модель может вернуть сразу несколько tool_calls; а вход свыше 272 000 токенов пересчитывает весь запрос по повышенной ставке. Вызовы функций (tools), стриминг и /v1/responses проверены и работают.
В APIMODELS GPT-5.6 Luna соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Cost-Efficient, High-Volume, Fast, 1.05M Context; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
GPT-5.6 Luna поддерживает: Cost-Efficient, High-Volume, Fast, 1.05M Context. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт GPT-5.6 Luna через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.