
gemini-3.8-flashGemini 3.8 Flash — модель Flash, выпущенная Google 2 сентября 2026 года. На APIMODELS она стоит $0.450 за миллион входных токенов и $2.250 за выходные, на 40% ниже собственного прайса Google ($0.75 / $3.75); причём этот прайс — вводный, с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Google прямо говорит, что это поколение сделано под программирование и агентов, а не под самые сложные рассуждения, и опубликованные результаты идут туда же: первое место на DeepSWE v1.1, 89.4% на Terminal-Bench 2.1, и победа над Claude Opus 5 сразу в трёх тестах — HLE-Verified (54.9% против 54.4%), Vals Finance Agent v2 (61.4% против 58.6%) и Harvey's Legal Agent (10.0% против 6.7%). Контекст — 1M токенов, до 64K на выход, на вход принимаются текст, изображения, аудио, видео и PDF, срез знаний — март 2026. Два предупреждения, которые лучше знать заранее, оба измеренные: модель заметно больше «думает», а токены рассуждения тарифицируются по выходной ставке — в нашей пробе она потратила 83 токена рассуждения на ответ из двух слов; и время до первого токена по замерам Artificial Analysis составляет около 13.3 секунды при медиане 2.99 секунды, поэтому она хороша для пакетной обработки и длинных агентных прогонов, а не для интерактивного чата. Для коротких запросов, где решают цена и задержка, дешевле Gemini 3.1 Flash Lite ($0.375 / $2.25). Кэшированный ввод — $0.172 за миллион. Неудачные запросы не тарифицируются.
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Gemini 3.8 Flash — это API категории «языковая модель» от Google. Gemini 3.8 Flash — модель Flash, выпущенная Google 2 сентября 2026 года. На APIMODELS она стоит $0.450 за миллион входных токенов и $2.250 за выходные, на 40% ниже собственного прайса Google ($0.75 / $3.75); причём этот прайс — вводный, с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Google прямо говорит, что это поколение сделано под программирование и агентов, а не под самые сложные рассуждения, и опубликованные результаты идут туда же: первое место на DeepSWE v1.1, 89.4% на Terminal-Bench 2.1, и победа над Claude Opus 5 сразу в трёх тестах — HLE-Verified (54.9% против 54.4%), Vals Finance Agent v2 (61.4% против 58.6%) и Harvey's Legal Agent (10.0% против 6.7%). Контекст — 1M токенов, до 64K на выход, на вход принимаются текст, изображения, аудио, видео и PDF, срез знаний — март 2026. Два предупреждения, которые лучше знать заранее, оба измеренные: модель заметно больше «думает», а токены рассуждения тарифицируются по выходной ставке — в нашей пробе она потратила 83 токена рассуждения на ответ из двух слов; и время до первого токена по замерам Artificial Analysis составляет около 13.3 секунды при медиане 2.99 секунды, поэтому она хороша для пакетной обработки и длинных агентных прогонов, а не для интерактивного чата. Для коротких запросов, где решают цена и задержка, дешевле Gemini 3.1 Flash Lite ($0.375 / $2.25). Кэшированный ввод — $0.172 за миллион. Неудачные запросы не тарифицируются. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.450, Output: $2.250 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
Gemini 3.8 Flash доступна через APIMODELS по цене: Input: $0.450, Output: $2.250 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Gemini 3.8 Flash через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$0.450 за миллион входных токенов и $2.250 за выходные — на 40% ниже собственного прайса Google ($0.75 / $3.75). Этот прайс у Google вводный: с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Кэшированный ввод — $0.172 за миллион. Оплата по факту, без подписки и минимального пополнения; неудачные запросы не тарифицируются, весь контекст в 1M токенов идёт по той же входной ставке.
3.8 Flash вышла 2 сентября 2026 года, и Google настраивала её под программирование и агентов: первое место на DeepSWE v1.1 и 89.4% на Terminal-Bench 2.1. Здесь она стоит $0.450 / $2.250, примерно на 32% дешевле 3.6 Flash ($0.662 / $3.302), то есть она одновременно и новее, и дешевле. Но если нагрузка — это короткие запросы в большом количестве, которым нужен мгновенный ответ, берите Gemini 3.1 Flash Lite ($0.375 / $2.25): дешевле по входу и заметно быстрее до первого токена, тогда как у 3.8 Flash он измеряется примерно в 13.3 секунды.
Токены рассуждения тарифицируются по выходной ставке, а это поколение «думает» заметно больше предыдущих. В нашей пробе модель потратила 83 токена рассуждения, чтобы выдать ответ из двух слов — видимый вывод был длиной в один токен. Artificial Analysis намерила 120 млн выходных токенов на своём наборе тестов при медиане в 71 млн. Поэтому стоимость считайте по сумме candidatesTokenCount и thoughtsTokenCount в usageMetadata, а не по видимому тексту. Если глубокое рассуждение не нужно, ограничьте maxOutputTokens или возьмите 3.1 Flash Lite.
В APIMODELS Gemini 3.8 Flash соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает 40% Below Official, Agentic Coding, 1M Context, Multimodal Input; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
Gemini 3.8 Flash поддерживает: 40% Below Official, Agentic Coding, 1M Context, Multimodal Input. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Gemini 3.8 Flash через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.