
qwen3.8-maxQwen3.8 Max — новейший флагман Qwen от Alibaba. Главное отличие от 3.7 Max в том, что глубина размышления стала регулируемой: reasoning_effort принимает low, medium и xhigh (по умолчанию xhigh), и вы выбираете баланс между глубиной ответа, задержкой и стоимостью вывода для каждого запроса. Контекст 1M токенов, формат OpenAI, /v1/chat/completions, вызов функций, JSON и стриминг. На APIMODELS $2.00 / $6.00 за 1M токенов, кэшированный ввод $0.25 — столько же, сколько в официальном прайсе Alibaba: на этом поколении мы не играем с ценой, вы получаете отсутствие аккаунта Alibaba Cloud, прямой доступ из материкового Китая и один ключ с общим балансом на все модели платформы. Отдельно про длинные диалоги: preserve_thinking включён по умолчанию, поэтому размышление прошлых ходов возвращается в модель и тарифицируется как ввод на каждом следующем шаге.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
reasoning_effort low / medium / xhigh trades depth against latency and output cost
Million-token context window
Reasoning tokens are part of completion_tokens — typically 85-95% of the output on short prompts. Set reasoning_effort to control it.
Function calling + JSON output, OpenAI-compatible
Qwen3.8 Max — это API категории «языковая модель» от Alibaba. Qwen3.8 Max — новейший флагман Qwen от Alibaba. Главное отличие от 3.7 Max в том, что глубина размышления стала регулируемой: reasoning_effort принимает low, medium и xhigh (по умолчанию xhigh), и вы выбираете баланс между глубиной ответа, задержкой и стоимостью вывода для каждого запроса. Контекст 1M токенов, формат OpenAI, /v1/chat/completions, вызов функций, JSON и стриминг. На APIMODELS $2.00 / $6.00 за 1M токенов, кэшированный ввод $0.25 — столько же, сколько в официальном прайсе Alibaba: на этом поколении мы не играем с ценой, вы получаете отсутствие аккаунта Alibaba Cloud, прямой доступ из материкового Китая и один ключ с общим балансом на все модели платформы. Отдельно про длинные диалоги: preserve_thinking включён по умолчанию, поэтому размышление прошлых ходов возвращается в модель и тарифицируется как ввод на каждом следующем шаге. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $2.00, Output: $6.00 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
Qwen3.8 Max доступна через APIMODELS по цене: Input: $2.00, Output: $6.00 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Qwen3.8 Max через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$2.00 / $6.00 за 1M токенов, кэшированный ввод $0.25 — столько же, сколько в официальном прайсе Alibaba. На этом поколении мы не играем с ценой. Что вы получаете вместо скидки: не нужен аккаунт Alibaba Cloud и верификация, endpoint доступен напрямую из материкового Китая, один ключ открывает Claude, Gemini, GPT, Grok и всё остальное с общим балансом, оплата по факту без минимального пополнения, неудачные запросы не списываются.
Потому что размышление включено ПО УМОЛЧАНИЮ, а токены размышления входят в completion_tokens и тарифицируются по цене вывода, хотя в ответе вы их не видите. Замер: запрос «напиши 60 слов» вернул 3 783 токена вывода, из них 3 715 — размышление, первый вывод через 39 секунд. Тот же запрос с enable_thinking:false — 72 токена и 1,2 секунды. Для простых и массовых задач отключайте размышление или ограничивайте его через thinking_budget / reasoning_effort.
POST https://api.apimodels.app/v1/chat/completions с заголовком Authorization: Bearer YOUR_API_KEY и телом {"model":"qwen3.8-max","messages":[{"role":"user","content":"..."}]}. Обычный формат OpenAI — достаточно указать base_url=https://api.apimodels.app/v1 в openai-python или openai-node. Для потокового вывода добавьте stream:true. Контекст — 1M токенов.
В APIMODELS Qwen3.8 Max соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает Reasoning / Thinking, Flagship, 1M Context, Tool Calling, Streaming; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
Qwen3.8 Max поддерживает: Reasoning / Thinking, Flagship, 1M Context, Tool Calling, Streaming. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Qwen3.8 Max через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.