
gpt-6-lunaGPT-6 Luna — экономичный уровень семейства GPT-6 от OpenAI; сама OpenAI называет её самой эффективной моделью для сфокусированных задач с большим объёмом. Выпущена в сентябре 2026 года вместе с GPT-6 Sol. На APIMODELS она стоит $0.09 за 1M входных и $0.45 за 1M выходных токенов — на 10% ниже прайса OpenAI $0.10 / $0.50, кэшированный ввод $0.009. Характеристики совпадают с Sol и Astra: контекст 1 050 000 токенов, максимум 128 000 на выходе, ввод текста и изображений, граница знаний — 18 мая 2026 года. reasoning_effort принимает none / low / medium (по умолчанию) / high / xhigh / max; токены рассуждения тарифицируются как вывод и входят в max_tokens — для классификации, извлечения и другой массовой работы ставьте low или none, именно там этот уровень окупается. При вводе свыше 272K токенов ввод и кэшированный ввод считаются по 2×, вывод — по 1,5×, как у всего семейства. Вызов через OpenAI-совместимые /v1/chat/completions или /v1/responses одним ключом; вызов функций работает на обоих эндпоинтах — мы проверили, что tool_calls возвращаются на /v1/chat/completions при reasoning_effort по умолчанию, так что требование reasoning_effort none из документации OpenAI здесь не действует. Неудачные запросы не тарифицируются.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 за 1M токенов против прайса $0.10 / $0.50; кэшированный ввод $0.009
OpenAI: самая эффективная модель для сфокусированных задач с большим объёмом — классификация, извлечение, маршрутизация
Те же характеристики, что у Sol и Astra; текст и изображения на входе; знания по 18 мая 2026
Токены рассуждения считаются как вывод и входят в max_tokens — для массовой работы ставьте low или none
GPT-6 Luna — это API категории «языковая модель» от OpenAI. GPT-6 Luna — экономичный уровень семейства GPT-6 от OpenAI; сама OpenAI называет её самой эффективной моделью для сфокусированных задач с большим объёмом. Выпущена в сентябре 2026 года вместе с GPT-6 Sol. На APIMODELS она стоит $0.09 за 1M входных и $0.45 за 1M выходных токенов — на 10% ниже прайса OpenAI $0.10 / $0.50, кэшированный ввод $0.009. Характеристики совпадают с Sol и Astra: контекст 1 050 000 токенов, максимум 128 000 на выходе, ввод текста и изображений, граница знаний — 18 мая 2026 года. reasoning_effort принимает none / low / medium (по умолчанию) / high / xhigh / max; токены рассуждения тарифицируются как вывод и входят в max_tokens — для классификации, извлечения и другой массовой работы ставьте low или none, именно там этот уровень окупается. При вводе свыше 272K токенов ввод и кэшированный ввод считаются по 2×, вывод — по 1,5×, как у всего семейства. Вызов через OpenAI-совместимые /v1/chat/completions или /v1/responses одним ключом; вызов функций работает на обоих эндпоинтах — мы проверили, что tool_calls возвращаются на /v1/chat/completions при reasoning_effort по умолчанию, так что требование reasoning_effort none из документации OpenAI здесь не действует. Неудачные запросы не тарифицируются. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.09, Output: $0.45 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
GPT-6 Luna доступна через APIMODELS по цене: Input: $0.09, Output: $0.45 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель GPT-6 Luna через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$0.09 за 1M входных токенов, $0.45 за 1M выходных и $0.009 за кэшированный ввод — 90% от прайса OpenAI $0.10 / $0.50 / $0.01. Если ввод одного запроса превышает 272K токенов, ввод и кэшированный ввод считаются по 2×, а вывод — по 1,5×, как в тарификации длинного контекста у OpenAI. Оплата по фактическим токенам, токены рассуждения считаются как вывод, неудачные запросы бесплатны.
OpenAI описывает Luna как самую эффективную модель для сфокусированных задач с большим объёмом, а Sol — как рабочую лошадку. У нас Luna стоит $0.09 / $0.45, Sol — $1.00 / $5.00, разница больше чем в десять раз. Берите Luna для классификации, извлечения, маршрутизации, суммаризации и разбора логов: много запросов, каждый простой. Берите Sol, когда нужны более сильные рассуждения или длинные агентные сессии. Характеристики одинаковые: контекст 1,05M, вывод 128K, ввод текста и изображений.
У GPT-6 Luna reasoning_effort по умолчанию medium, а токены рассуждения входят в max_tokens — в нашем тесте с max_tokens 300 все 300 токенов ушли на рассуждение, и видимого текста не вернулось. Для массовой работы ставьте reasoning_effort low или none либо оставляйте в max_tokens запас под рассуждение.
POST https://api.apimodels.app/v1/chat/completions или /v1/responses с model gpt-6-luna и Authorization: Bearer ваш ключ apimodels; в OpenAI SDK меняется только base_url. Стриминг, вызов функций, JSON-вывод и ввод изображений работают — мы проверили, что tool_calls возвращаются на /v1/chat/completions при reasoning_effort по умолчанию, так что требование reasoning_effort none из документации OpenAI здесь не действует.
В APIMODELS GPT-6 Luna соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает 10% Below Official, High Volume, 1.05M Context, Reasoning Effort; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
GPT-6 Luna поддерживает: 10% Below Official, High Volume, 1.05M Context, Reasoning Effort. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт GPT-6 Luna через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.