
gemini-3.8-flashO Gemini 3.8 Flash é o modelo Flash que a Google lançou a 2 de setembro de 2026. Na APIMODELS custa $0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75) — e essa tabela é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A Google diz claramente que esta geração foi afinada para programação e agentes, e não para o raciocínio mais difícil, e os resultados publicados seguem essa direção: primeiro lugar no DeepSWE v1.1, 89.4% no Terminal-Bench 2.1 e vitórias sobre o Claude Opus 5 em três provas — HLE-Verified (54.9% contra 54.4%), Vals Finance Agent v2 (61.4% contra 58.6%) e Harvey's Legal Agent (10.0% contra 6.7%). O contexto é de 1M tokens com até 64K de saída; a entrada aceita texto, imagem, áudio, vídeo e PDF, e o corte de conhecimento é março de 2026. Dois avisos medidos, e não presumidos: o modelo «pensa» bastante mais do que os anteriores e os tokens de raciocínio são faturados à tarifa de saída — na nossa sonda gastou 83 tokens de raciocínio para responder duas palavras; e o tempo até ao primeiro token medido pela Artificial Analysis anda pelos 13.3 segundos, contra uma mediana de 2.99, pelo que serve para processamento em lote e agentes longos, não para conversa interativa. Para pedidos curtos em que mandam preço e latência, o Gemini 3.1 Flash Lite ($0.375 / $2.25) compensa mais. A entrada em cache é $0.172 por milhão e pedidos falhados nunca são cobrados.
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Gemini 3.8 Flash é uma API de modelo de linguagem da Google. O Gemini 3.8 Flash é o modelo Flash que a Google lançou a 2 de setembro de 2026. Na APIMODELS custa $0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75) — e essa tabela é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A Google diz claramente que esta geração foi afinada para programação e agentes, e não para o raciocínio mais difícil, e os resultados publicados seguem essa direção: primeiro lugar no DeepSWE v1.1, 89.4% no Terminal-Bench 2.1 e vitórias sobre o Claude Opus 5 em três provas — HLE-Verified (54.9% contra 54.4%), Vals Finance Agent v2 (61.4% contra 58.6%) e Harvey's Legal Agent (10.0% contra 6.7%). O contexto é de 1M tokens com até 64K de saída; a entrada aceita texto, imagem, áudio, vídeo e PDF, e o corte de conhecimento é março de 2026. Dois avisos medidos, e não presumidos: o modelo «pensa» bastante mais do que os anteriores e os tokens de raciocínio são faturados à tarifa de saída — na nossa sonda gastou 83 tokens de raciocínio para responder duas palavras; e o tempo até ao primeiro token medido pela Artificial Analysis anda pelos 13.3 segundos, contra uma mediana de 2.99, pelo que serve para processamento em lote e agentes longos, não para conversa interativa. Para pedidos curtos em que mandam preço e latência, o Gemini 3.1 Flash Lite ($0.375 / $2.25) compensa mais. A entrada em cache é $0.172 por milhão e pedidos falhados nunca são cobrados. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.450, Output: $2.250 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O Gemini 3.8 Flash está disponível pela APIMODELS a: Input: $0.450, Output: $2.250 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Gemini 3.8 Flash pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
$0.450 por milhão de tokens de entrada e $2.250 de saída, 40% abaixo da própria tabela da Google ($0.75 / $3.75). Essa tabela da Google é introdutória: a partir de 1 de janeiro de 2027 o preço oficial passa a $1.50 / $7.50 e a diferença alarga para 70%. A entrada em cache custa $0.172 por milhão. Paga-se pelo uso, sem subscrição nem carregamento mínimo; pedidos falhados não são cobrados e o contexto completo de 1M segue a mesma taxa de entrada.
O 3.8 Flash saiu a 2 de setembro de 2026 e a Google afinou-o para programação e agentes: primeiro lugar no DeepSWE v1.1 e 89.4% no Terminal-Bench 2.1. Aqui custa $0.450 / $2.250, cerca de 32% menos do que o 3.6 Flash ($0.662 / $3.302) — é ao mesmo tempo o mais recente e o mais barato dos dois. Mas se a sua carga são pedidos curtos em grande volume que têm de responder de imediato, fique com o Gemini 3.1 Flash Lite ($0.375 / $2.25): mais barato à entrada e muito mais rápido até ao primeiro token, que no 3.8 Flash ronda os 13.3 segundos.
Os tokens de raciocínio são faturados à taxa de saída, e esta geração pensa bastante mais do que as anteriores. Na nossa sonda gastou 83 tokens de raciocínio para dar uma resposta de duas palavras — a saída visível tinha um único token. A Artificial Analysis mediu 120 milhões de tokens de saída no seu conjunto de testes, contra uma mediana de 71 milhões. Calcule o custo somando candidatesTokenCount e thoughtsTokenCount no usageMetadata, e não pelo texto visível. Se não precisa de raciocínio profundo, limite o maxOutputTokens ou use o 3.1 Flash Lite.
Na APIMODELS, o Gemini 3.8 Flash roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta 40% Below Official, Agentic Coding, 1M Context, Multimodal Input e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O Gemini 3.8 Flash suporta: 40% Below Official, Agentic Coding, 1M Context, Multimodal Input. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Gemini 3.8 Flash por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.