
grok-4.6Grok 4.6 — флагманская модель xAI, и это поколение сделано под длительные агентные сценарии и многошаговую работу: исследовать тему, вносить правки в кодовую базу подряд, довести идею до готового результата — она выдерживает много ходов подряд и по дороге сама себя перепроверяет. Индекс интеллекта Artificial Analysis — 61, наравне с GPT-5.6 Sol, и выше версии 4.5 по всем опубликованным тестам. Контекст 500K, на вход принимает текст и изображения, четыре уровня усилия рассуждения (low / medium / high — по умолчанию — / xhigh). Цена: $1.765 за миллион входных токенов и $5.294 за выходные, на 12% ниже официального прайса xAI ($2 / $6), кэшированный ввод — $0.441. Вызывается через совместимый с OpenAI эндпоинт /v1/chat/completions; /v1/responses тоже работает, и живой веб-поиск запускается именно на нём. Неудачные запросы не тарифицируются. Два момента, о которых стоит знать заранее: уровень усилия по умолчанию — high, замеренное время ответа около 53 секунд, поэтому таймаут клиента ставьте больше 60 секунд; и в тарифицируемые выходные токены входят токены рассуждения, так что счёт может оказаться больше видимого ответа — если глубокое рассуждение не нужно, понизьте reasoning_effort.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$1.765 input / $5.294 output per 1M against official $2.00 / $6.00, with cached input at $0.441. Same model, same weights — the price difference is not a lesser tier
The 4.6 release targets tasks that span many steps — researching a topic, working across a codebase, turning an idea into a finished artifact — with more self-checking along the way. 500K-token context
low / medium / high / xhigh via reasoning_effort. Measured on our channel: 464 / 1,720 / 2,663 / 3,341 reasoning tokens on the same prompt. Unlike GPT-5.6, xhigh really is the deepest tier here
12/12 correct across 12 concurrent calls using a nested schema with enums and arrays — arguments parsed cleanly with no cross-request mixing. Streaming, multi-turn and parallel tool calls all pass
Cached input bills at $0.441 instead of $1.765. We send a per-conversation routing key so repeat turns keep landing on a warm server — without it, cache hits drop back to cold on roughly every other repeat
The default reasoning_effort is high, which runs about 53 seconds — set a client timeout above 60s. And billed output includes reasoning tokens, so your bill can exceed the visible answer; lower the effort when you do not need the depth
Grok 4.6 — это API категории «языковая модель» от xAI. Grok 4.6 — флагманская модель xAI, и это поколение сделано под длительные агентные сценарии и многошаговую работу: исследовать тему, вносить правки в кодовую базу подряд, довести идею до готового результата — она выдерживает много ходов подряд и по дороге сама себя перепроверяет. Индекс интеллекта Artificial Analysis — 61, наравне с GPT-5.6 Sol, и выше версии 4.5 по всем опубликованным тестам. Контекст 500K, на вход принимает текст и изображения, четыре уровня усилия рассуждения (low / medium / high — по умолчанию — / xhigh). Цена: $1.765 за миллион входных токенов и $5.294 за выходные, на 12% ниже официального прайса xAI ($2 / $6), кэшированный ввод — $0.441. Вызывается через совместимый с OpenAI эндпоинт /v1/chat/completions; /v1/responses тоже работает, и живой веб-поиск запускается именно на нём. Неудачные запросы не тарифицируются. Два момента, о которых стоит знать заранее: уровень усилия по умолчанию — high, замеренное время ответа около 53 секунд, поэтому таймаут клиента ставьте больше 60 секунд; и в тарифицируемые выходные токены входят токены рассуждения, так что счёт может оказаться больше видимого ответа — если глубокое рассуждение не нужно, понизьте reasoning_effort. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $1.765, Output: $5.294 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
Grok 4.6 доступна через APIMODELS по цене: Input: $1.765, Output: $5.294 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Grok 4.6 через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$1.765 за 1M входных токенов и $5.294 за 1M выходных, кэшированный вход — $0.441. У xAI официально $2.00 / $6.00, то есть здесь обе стороны на 12% дешевле. Оплата по факту использования, без минимального пополнения и подписки, неудачные запросы не тарифицируются. Родственная Grok 4.5 стоит $1.5 / $5 — дешевле, на одну ступень возможностей ниже.
POST https://api.apimodels.app/v1/chat/completions с заголовком Authorization: Bearer YOUR_API_KEY и телом {"model":"grok-4.6","messages":[{"role":"user","content":"..."}]}. Это обычная форма OpenAI, поэтому openai-python и openai-node с base_url=https://api.apimodels.app/v1 работают без правок, как и Cursor, Cline и Codex. Для потокового ответа добавьте stream:true. /v1/responses тоже поддерживается.
Релиз 4.6 нацелен на долгоживущих агентов: задачи в много шагов — работа по всей кодовой базе, доведение идеи до готового результата — держатся лучше, и модель по дороге чаще перепроверяет саму себя. Индекс интеллекта Artificial Analysis — 61, наравне с GPT-5.6 Sol, и выше, чем у 4.5 (56), по всем опубликованным тестам. Берите Grok 4.5 ($1.5 / $5), когда важен бюджет и задачи короткие; берите 4.6 для длительной работы. Эндпоинт тот же — переключение меняет одно поле.
Да, и мы это не «прощупали», а нагрузили: не потоковый режим, многоходовой диалог с возвратом результатов инструментов, потоковый режим и параллельные вызовы инструментов в одном ходе — всё прошло 5/5. Затем 12 одновременных запросов по вложенной схеме с enum и массивами вернулись 12/12 корректными: аргументы разобрались чисто, перемешивания между запросами не было. У апстримов Grok исторически бывали плавающие сбои вызова инструментов на смешанных пулах; на этом канале это не воспроизвелось.
low, medium, high и xhigh, по умолчанию high. На одном фиксированном промпте мы замерили 464 / 1 720 / 2 663 / 3 341 токенов рассуждения соответственно — строго по возрастанию, и, в отличие от GPT-5.6, xhigh здесь действительно самый глубокий уровень. Уровень по умолчанию отвечает примерно за 53 секунды, поэтому ставьте таймаут клиента выше 60 секунд, а не оставляйте 30.
Потому что в тарифицируемые выходные токены входят токены рассуждения. Замеренный пример: модель ответила одним числом — один видимый токен — потратив перед этим 1 052 токена на рассуждение, и вызов тарифицируется как 1 053. Это не накрутка с нашей стороны: апстрим выставляет нам счёт ровно по такому принципу, и мы передаём его как есть. Понизьте reasoning_effort, когда глубина не нужна, — стоимость упадёт сразу.
Ввод изображений работает — в тестах модель точно вычитала текст с картинки. Живой веб-поиск запускается на эндпоинте /v1/responses через tools:[{"type":"web_search"}]; там он действительно выполняется и возвращает записи web_search_call и настоящие ссылки-источники. Передача search_parameters в /v1/chat/completions сейчас ничего не даёт — модель выводит вызов инструмента просто текстом, — так что на этом пути на неё полагаться не стоит.
500K токенов. Он напрямую доступен из материкового Китая без аккаунта xAI и без VPN, и тот же самый API-ключ открывает все остальные модели платформы. Длинные диалоги автоматически попадают в кэш промптов, и закэшированная часть тарифицируется по $0.441 вместо $1.765; мы также держим маршрутизацию по диалогу «липкой», чтобы повторные ходы попадали на сервер с прогретым кэшем.
В APIMODELS Grok 4.6 соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Frontier, Long-Running Agents, Tool Calling, 500K Context, Vision; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
Grok 4.6 поддерживает: Frontier, Long-Running Agents, Tool Calling, 500K Context, Vision. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Grok 4.6 через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.