
glm-5.3Zhipu GLM-5.3 — Z.ai's newest reasoning model, built for long-horizon agent work and complex software engineering, with a 1M-token context window and improved coding and token efficiency over GLM-5.2. Served via the OpenAI-compatible chat-completions endpoint. Supports prompt caching, with cache hits billed at $0.247 / 1M input tokens.
Built for multi-step agent workflows
Fits entire codebases in one request
Reliable function calling for agents
Cache hits billed at $0.247 / 1M input
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GLM-5.3 — это API категории «языковая модель» от Zhipu. GLM-5.3 — модель рассуждения от Z.ai (Zhipu), выпущенная в августе 2026 года. Относительно GLM-5.2 она заметнее всего прибавила в программировании и в экономии токенов, а целится в длинные агентные сценарии и сложную программную инженерию: задачи, которые тянутся много ходов подряд — пройти по кодовой базе, довести правку до рабочего состояния, удержать план. Окно контекста — 1M токенов, так что в один запрос помещается целый репозиторий. Вызов функций и стриминг мы проверили на своём канале, а не переписали из спецификации поставщика: вложенная схема с enum вернулась стандартной структурой tool_calls с аргументами, которые парсятся напрямую, а стриминговый запрос отдал 22 SSE-кадра с нормальной инкрементальной выдачей. Цена: $1.33 за миллион входных токенов и $4.18 за выходные, кэшированный ввод — $0.247; это на 5% ниже официального прайса Z.ai ($1.40 / $4.40 / $0.26) по всем трём тарифам, доплаты за длинный контекст нет. Вызывается через совместимый с OpenAI эндпоинт /v1/chat/completions, /v1/responses тоже поддерживается. Аккаунт Z.ai не нужен, эндпоинт доступен напрямую, неудачные запросы не тарифицируются. Практический совет по стоимости: держите повторяющийся префикс — системный промпт и контекст кодовой базы — неизменным между ходами, тогда он попадёт в кэш и будет считаться по $0.247 вместо $1.33, то есть в 5,4 раза дешевле; на родственной модели у нас 84% входных токенов проходят именно по кэшированному тарифу. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $1.33, Output: $4.18 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
GLM-5.3 доступна через APIMODELS по цене: Input: $1.33, Output: $4.18 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель GLM-5.3 через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$1.33 за 1M входных токенов и $4.18 за 1M выходных, кэшированный ввод — $0.247. Официальный прайс Z.ai: $1.40 / $4.40 / $0.26, то есть здесь дешевле на 5% по всем трём тарифам. Оплата по факту, без минимального пополнения и подписки; неудачные запросы не тарифицируются. Полный контекст в 1M токенов считается по тем же ставкам — доплаты за длинный контекст нет.
GLM-5.3 — модель рассуждения, выпущенная Z.ai в августе 2026. Относительно 5.2 она заметнее всего прибавила в программировании и экономии токенов, а рассчитана на длинные агентные сценарии и сложную инженерию, с окном контекста 1M токенов. Правило выбора простое: берите 5.3 для многошаговых агентов и работы по всей кодовой базе, берите 5.2, когда задача короткая, а цена важнее. На APIMODELS 5.2 стоит $0.9 / $3.15, а 5.3 — $1.33 / $4.18. Эндпоинт один и тот же, переключение — это одно поле model.
POST https://api.apimodels.app/v1/chat/completions с заголовком Authorization: Bearer YOUR_API_KEY и телом {"model":"glm-5.3","messages":[{"role":"user","content":"..."}]}. Это обычный формат OpenAI: достаточно указать base_url=https://api.apimodels.app/v1 в openai-python или openai-node, и код заработает без изменений; так же подключаются Cursor, Cline и Codex. Для стриминга добавьте stream:true. Эндпоинт /v1/responses тоже поддерживается — на нашем шлюзе он транслируется в chat-completions.
И то и другое, причём мы проверили это на собственном канале, а не переписали характеристики поставщика. Вложенная схема с enum и обязательным полем вернулась стандартной структурой tool_calls, аргументы — корректный JSON, который парсится напрямую. Стриминговый запрос отдал 22 SSE-кадра с нормальной инкрементальной выдачей. Эти две проверки мы прогоняем на каждом новом канале: не прошёл — не публикуем.
Окно контекста — 1M токенов. Главный рычаг по стоимости — кэш промптов: повторяющийся префикс (системный промпт, контекст кодовой базы, история диалога) после попадания в кэш тарифицируется по $0.247 вместо $1.33 — разница в 5,4 раза. Агентные нагрузки по своей природе сильно повторяются: на родственной модели мы наблюдаем 84% попаданий в кэш на продакшен-трафике, поэтому реальный счёт выходит заметно ниже прикидки по полной входной цене.
Аккаунт Z.ai не нужен, корпоративная верификация тоже. Эндпоинт доступен напрямую, включая материковый Китай, а оплата идёт с общего баланса APIMODELS: один ключ открывает ещё и Claude, Gemini, GPT, Grok и остальные модели платформы. Для большинства команд именно это и есть причина использовать агрегатор — не 5% экономии, а отсутствие пяти отдельных аккаунтов и пяти счетов. Пополнить баланс можно картой, PayPal или USDT.
В APIMODELS GLM-5.3 соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Reasoning, Tool Calling, 1M Context, OpenAI-compatible, Prompt Cache; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
GLM-5.3 поддерживает: Reasoning, Tool Calling, 1M Context, OpenAI-compatible, Prompt Cache. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт GLM-5.3 через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.