
gemini-3.8-flashO Gemini 3.8 Flash é o modelo Flash que a Google lançou a 2 de setembro de 2026. Na APIMODELS custa $0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75) — e essa tabela é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A Google diz claramente que esta geração foi afinada para programação e agentes, e não para o raciocínio mais difícil, e os resultados publicados seguem essa direção: primeiro lugar no DeepSWE v1.1, 89.4% no Terminal-Bench 2.1 e vitórias sobre o Claude Opus 5 em três provas — HLE-Verified (54.9% contra 54.4%), Vals Finance Agent v2 (61.4% contra 58.6%) e Harvey's Legal Agent (10.0% contra 6.7%). O contexto é de 1M tokens com até 64K de saída; a entrada aceita texto, imagem, áudio, vídeo e PDF, e o corte de conhecimento é março de 2026. Dois avisos medidos, e não presumidos: o modelo «pensa» bastante mais do que os anteriores e os tokens de raciocínio são faturados à tarifa de saída — na nossa sonda gastou 83 tokens de raciocínio para responder duas palavras; e o tempo até ao primeiro token medido pela Artificial Analysis anda pelos 13.3 segundos, contra uma mediana de 2.99, pelo que serve para processamento em lote e agentes longos, não para conversa interativa. Para pedidos curtos em que mandam preço e latência, o Gemini 3.1 Flash Lite ($0.375 / $2.25) compensa mais. A entrada em cache é $0.172 por milhão e pedidos falhados nunca são cobrados.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
Gemini 3.8 Flash é uma API de modelo de linguagem da Google. O Gemini 3.8 Flash é o modelo Flash que a Google lançou a 2 de setembro de 2026. Na APIMODELS custa $0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75) — e essa tabela é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A Google diz claramente que esta geração foi afinada para programação e agentes, e não para o raciocínio mais difícil, e os resultados publicados seguem essa direção: primeiro lugar no DeepSWE v1.1, 89.4% no Terminal-Bench 2.1 e vitórias sobre o Claude Opus 5 em três provas — HLE-Verified (54.9% contra 54.4%), Vals Finance Agent v2 (61.4% contra 58.6%) e Harvey's Legal Agent (10.0% contra 6.7%). O contexto é de 1M tokens com até 64K de saída; a entrada aceita texto, imagem, áudio, vídeo e PDF, e o corte de conhecimento é março de 2026. Dois avisos medidos, e não presumidos: o modelo «pensa» bastante mais do que os anteriores e os tokens de raciocínio são faturados à tarifa de saída — na nossa sonda gastou 83 tokens de raciocínio para responder duas palavras; e o tempo até ao primeiro token medido pela Artificial Analysis anda pelos 13.3 segundos, contra uma mediana de 2.99, pelo que serve para processamento em lote e agentes longos, não para conversa interativa. Para pedidos curtos em que mandam preço e latência, o Gemini 3.1 Flash Lite ($0.375 / $2.25) compensa mais. A entrada em cache é $0.172 por milhão e pedidos falhados nunca são cobrados. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.450, Output: $2.250 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O Gemini 3.8 Flash está disponível pela APIMODELS a: Input: $0.450, Output: $2.250 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Gemini 3.8 Flash pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
$0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75). Essa tabela da Google é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A entrada em cache custa $0.172 por milhão. Paga-se pelo uso, sem subscrição nem carregamento mínimo; pedidos falhados não são cobrados e o contexto completo de 1M segue a mesma taxa de entrada.
O 3.8 Flash saiu a 2 de setembro de 2026 e a Google afinou-o para programação e agentes: primeiro lugar no DeepSWE v1.1 e 89.4% no Terminal-Bench 2.1. Aqui custa $0.450 / $2.250, cerca de 32% menos do que o 3.6 Flash ($0.662 / $3.302) — é ao mesmo tempo o mais recente e o mais barato dos dois. Mas se a sua carga são pedidos curtos em grande volume que têm de responder de imediato, fique com o Gemini 3.1 Flash Lite ($0.375 / $2.25): mais barato à entrada e muito mais rápido até ao primeiro token, que no 3.8 Flash ronda os 13.3 segundos.
Os tokens de raciocínio são faturados à taxa de saída, e esta geração pensa bastante mais do que as anteriores. Na nossa sonda gastou 83 tokens de raciocínio para dar uma resposta de duas palavras — a saída visível tinha um único token. A Artificial Analysis mediu 120 milhões de tokens de saída no seu conjunto de testes, contra uma mediana de 71 milhões. Calcule o custo somando candidatesTokenCount e thoughtsTokenCount no usageMetadata, e não pelo texto visível. Se não precisa de raciocínio profundo, limite o maxOutputTokens ou use o 3.1 Flash Lite.
Na APIMODELS, o Gemini 3.8 Flash roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta 40% Below Official, Agentic Coding, 1M Context, Multimodal Input e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O Gemini 3.8 Flash suporta: 40% Below Official, Agentic Coding, 1M Context, Multimodal Input. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Gemini 3.8 Flash por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.