
gemini-3.8-flashGemini 3.8 Flash — модель Flash, выпущенная Google 2 сентября 2026 года. На APIMODELS она стоит $0.450 за миллион входных токенов и $2.250 за выходные, на 40% ниже собственного прайса Google ($0.75 / $3.75); причём этот прайс — вводный, с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Google прямо говорит, что это поколение сделано под программирование и агентов, а не под самые сложные рассуждения, и опубликованные результаты идут туда же: первое место на DeepSWE v1.1, 89.4% на Terminal-Bench 2.1, и победа над Claude Opus 5 сразу в трёх тестах — HLE-Verified (54.9% против 54.4%), Vals Finance Agent v2 (61.4% против 58.6%) и Harvey's Legal Agent (10.0% против 6.7%). Контекст — 1M токенов, до 64K на выход, на вход принимаются текст, изображения, аудио, видео и PDF, срез знаний — март 2026. Два предупреждения, которые лучше знать заранее, оба измеренные: модель заметно больше «думает», а токены рассуждения тарифицируются по выходной ставке — в нашей пробе она потратила 83 токена рассуждения на ответ из двух слов; и время до первого токена по замерам Artificial Analysis составляет около 13.3 секунды при медиане 2.99 секунды, поэтому она хороша для пакетной обработки и длинных агентных прогонов, а не для интерактивного чата. Для коротких запросов, где решают цена и задержка, дешевле Gemini 3.1 Flash Lite ($0.375 / $2.25). Кэшированный ввод — $0.172 за миллион. Неудачные запросы не тарифицируются.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
Gemini 3.8 Flash — это API категории «языковая модель» от Google. Gemini 3.8 Flash — модель Flash, выпущенная Google 2 сентября 2026 года. На APIMODELS она стоит $0.450 за миллион входных токенов и $2.250 за выходные, на 40% ниже собственного прайса Google ($0.75 / $3.75); причём этот прайс — вводный, с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Google прямо говорит, что это поколение сделано под программирование и агентов, а не под самые сложные рассуждения, и опубликованные результаты идут туда же: первое место на DeepSWE v1.1, 89.4% на Terminal-Bench 2.1, и победа над Claude Opus 5 сразу в трёх тестах — HLE-Verified (54.9% против 54.4%), Vals Finance Agent v2 (61.4% против 58.6%) и Harvey's Legal Agent (10.0% против 6.7%). Контекст — 1M токенов, до 64K на выход, на вход принимаются текст, изображения, аудио, видео и PDF, срез знаний — март 2026. Два предупреждения, которые лучше знать заранее, оба измеренные: модель заметно больше «думает», а токены рассуждения тарифицируются по выходной ставке — в нашей пробе она потратила 83 токена рассуждения на ответ из двух слов; и время до первого токена по замерам Artificial Analysis составляет около 13.3 секунды при медиане 2.99 секунды, поэтому она хороша для пакетной обработки и длинных агентных прогонов, а не для интерактивного чата. Для коротких запросов, где решают цена и задержка, дешевле Gemini 3.1 Flash Lite ($0.375 / $2.25). Кэшированный ввод — $0.172 за миллион. Неудачные запросы не тарифицируются. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.450, Output: $2.250 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
Gemini 3.8 Flash доступна через APIMODELS по цене: Input: $0.450, Output: $2.250 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Gemini 3.8 Flash через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$0.450 за миллион входных токенов и $2.250 за выходные — на 40% ниже собственного прайса Google ($0.75 / $3.75). Этот прайс у Google вводный: с 1 января 2027 года официальная цена становится $1.50 / $7.50, и разрыв вырастет до 70%. Кэшированный ввод — $0.172 за миллион. Оплата по факту, без подписки и минимального пополнения; неудачные запросы не тарифицируются, весь контекст в 1M токенов идёт по той же входной ставке.
3.8 Flash вышла 2 сентября 2026 года, и Google настраивала её под программирование и агентов: первое место на DeepSWE v1.1 и 89.4% на Terminal-Bench 2.1. Здесь она стоит $0.450 / $2.250, примерно на 32% дешевле 3.6 Flash ($0.662 / $3.302), то есть она одновременно и новее, и дешевле. Но если нагрузка — это короткие запросы в большом количестве, которым нужен мгновенный ответ, берите Gemini 3.1 Flash Lite ($0.375 / $2.25): дешевле по входу и заметно быстрее до первого токена, тогда как у 3.8 Flash он измеряется примерно в 13.3 секунды.
Токены рассуждения тарифицируются по выходной ставке, а это поколение «думает» заметно больше предыдущих. В нашей пробе модель потратила 83 токена рассуждения, чтобы выдать ответ из двух слов — видимый вывод был длиной в один токен. Artificial Analysis намерила 120 млн выходных токенов на своём наборе тестов при медиане в 71 млн. Поэтому стоимость считайте по сумме candidatesTokenCount и thoughtsTokenCount в usageMetadata, а не по видимому тексту. Если глубокое рассуждение не нужно, ограничьте maxOutputTokens или возьмите 3.1 Flash Lite.
В APIMODELS Gemini 3.8 Flash соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает 40% Below Official, Agentic Coding, 1M Context, Multimodal Input; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
Gemini 3.8 Flash поддерживает: 40% Below Official, Agentic Coding, 1M Context, Multimodal Input. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Gemini 3.8 Flash через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.