
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
Уровень nano — сделан под большие объёмы при низкой цене
Поддержка токенов рассуждения, настроенная на пропускную способность
Вход текст + изображение, выход текст; контекст 1,05 млн токенов, до 128K на выходе
Совместимые с OpenAI /v1/chat/completions и /v1/responses; $0.221 / $1.324 за 1M токенов
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna — это API категории «языковая модель» от OpenAI. GPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.221, Output: $1.324 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
GPT-5.6 Luna доступна через APIMODELS по цене: Input: $0.221, Output: $1.324 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель GPT-5.6 Luna через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
GPT-5.6 Luna — младший уровень семейства GPT-5.6 для чувствительных к цене задач большого объёма: высокий уровень рассуждений при высокой скорости, приём текста и изображений, контекст 1 050 000 токенов, до 128 000 токенов на выходе, поддержка токенов рассуждения, знания по февраль 2026 года. На apimodels.app это $0.221 за миллион входных токенов и $1.324 за миллион выходных (вход из кэша — $0.022) — 20% от цены GPT-5.6 Sol, примерно пятая часть официального прайса OpenAI ($1 / $6), и самая дешёвая модель в семействе GPT-5.6.
Укажите base_url https://api.apimodels.app/v1 и передайте gpt-5.6-luna в поле model. Работают оба совместимых с OpenAI эндпоинта — /v1/chat/completions и /v1/responses, поддерживаются вызовы функций (tools). gpt-5.6-luna — каноническое имя; старое написание gpt-5.6-luna-max по-прежнему ведёт на ту же модель по той же цене. Один API-ключ на все модели, оплата по факту использования, неудачные запросы никогда не тарифицируются.
Если вход запроса превышает 272 000 токенов, весь запрос тарифицируется по $0.442 за вход и $1.986 за выход (2× вход, 1,5× выход) — так же, как у поставщика на этой ступени. Токены рассуждения считаются выходными.
Luna сама по себе — самый дешёвый уровень семейства GPT-5.6: $0.221 за миллион входных токенов и $1.324 за миллион выходных на apimodels.app — пятая часть цены Sol и примерно пятая часть официального прайса OpenAI ($1/$6), при этом вход из кэша стоит всего $0.022. Для массовой классификации, извлечения данных, переписывания текста и задач поддержки это лучшее соотношение цены и результата; переходите на gpt-5.6-terra или gpt-5.6-sol, когда нужны более сильные рассуждения. Миграция с прямого OpenAI или другого шлюза не требует правок кода: укажите base_url https://api.apimodels.app/v1 и model gpt-5.6-luna. API совместим с OpenAI, неудачные запросы никогда не тарифицируются.
Используйте идентификатор модели gpt-5.6-luna; старое написание gpt-5.6-luna-max по-прежнему ведёт на ту же модель по той же цене. Помимо этого, поставщик добавляет к каждому запросу системную преамбулу примерно на 1 450 токенов, поэтому input_tokens никогда не опускается ниже этого порога; `parallel_tool_calls: false` игнорируется, и модель может вернуть сразу несколько tool_calls; а вход свыше 272 000 токенов пересчитывает весь запрос по повышенной ставке. Вызовы функций (tools), стриминг и /v1/responses проверены и работают.
В APIMODELS GPT-5.6 Luna соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Cost-Efficient, High-Volume, Fast, 1.05M Context; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
GPT-5.6 Luna поддерживает: Cost-Efficient, High-Volume, Fast, 1.05M Context. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт GPT-5.6 Luna через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.