
gemini-3.8-flashGemini 3.8 Flash es el modelo Flash que Google lanzó el 2 de septiembre de 2026. En APIMODELS cuesta $0.450 por millón de tokens de entrada y $2.250 de salida, un 40% por debajo de la propia tarifa de Google ($0.75 / $3.75) — y esa tarifa es introductoria: desde el 1 de enero de 2027 el precio oficial pasa a $1.50 / $7.50 y la diferencia se ensancha al 70%. Google dice sin rodeos que esta generación está afinada para programación y agentes, no para el razonamiento más difícil, y los resultados publicados van en esa dirección: primer puesto en DeepSWE v1.1, 89.4% en Terminal-Bench 2.1 y victorias sobre Claude Opus 5 en tres pruebas — HLE-Verified (54.9% frente a 54.4%), Vals Finance Agent v2 (61.4% frente a 58.6%) y Harvey's Legal Agent (10.0% frente a 6.7%). El contexto es de 1M de tokens con hasta 64K de salida; la entrada admite texto, imagen, audio, vídeo y PDF, y el corte de conocimiento es marzo de 2026. Dos avisos medidos, no supuestos: el modelo «piensa» bastante más que sus predecesores y los tokens de razonamiento se facturan a la tarifa de salida — en nuestra prueba gastó 83 tokens de razonamiento para responder dos palabras; y el tiempo hasta el primer token que mide Artificial Analysis ronda los 13.3 segundos frente a una mediana de 2.99, así que encaja en procesamiento por lotes y agentes largos, no en chat interactivo. Para peticiones cortas donde mandan el precio y la latencia, Gemini 3.1 Flash Lite ($0.375 / $2.25) sale mejor. La entrada en caché es $0.172 por millón y las peticiones fallidas no se cobran.
$0.450 / $2.250 against $0.75 / $3.75
89.4% on Terminal-Bench 2.1
Text, image, audio, video, PDF in
Thinking tokens bill at the output rate
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Gemini 3.8 Flash es una API de modelo de lenguaje de Google. Gemini 3.8 Flash es el modelo Flash que Google lanzó el 2 de septiembre de 2026. En APIMODELS cuesta $0.450 por millón de tokens de entrada y $2.250 de salida, un 40% por debajo de la propia tarifa de Google ($0.75 / $3.75) — y esa tarifa es introductoria: desde el 1 de enero de 2027 el precio oficial pasa a $1.50 / $7.50 y la diferencia se ensancha al 70%. Google dice sin rodeos que esta generación está afinada para programación y agentes, no para el razonamiento más difícil, y los resultados publicados van en esa dirección: primer puesto en DeepSWE v1.1, 89.4% en Terminal-Bench 2.1 y victorias sobre Claude Opus 5 en tres pruebas — HLE-Verified (54.9% frente a 54.4%), Vals Finance Agent v2 (61.4% frente a 58.6%) y Harvey's Legal Agent (10.0% frente a 6.7%). El contexto es de 1M de tokens con hasta 64K de salida; la entrada admite texto, imagen, audio, vídeo y PDF, y el corte de conocimiento es marzo de 2026. Dos avisos medidos, no supuestos: el modelo «piensa» bastante más que sus predecesores y los tokens de razonamiento se facturan a la tarifa de salida — en nuestra prueba gastó 83 tokens de razonamiento para responder dos palabras; y el tiempo hasta el primer token que mide Artificial Analysis ronda los 13.3 segundos frente a una mediana de 2.99, así que encaja en procesamiento por lotes y agentes largos, no en chat interactivo. Para peticiones cortas donde mandan el precio y la latencia, Gemini 3.1 Flash Lite ($0.375 / $2.25) sale mejor. La entrada en caché es $0.172 por millón y las peticiones fallidas no se cobran. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.450, Output: $2.250 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
Gemini 3.8 Flash está disponible a través de APIMODELS a: Input: $0.450, Output: $2.250 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo Gemini 3.8 Flash a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
$0.450 por millón de tokens de entrada y $2.250 de salida, un 40% por debajo de la propia tarifa de Google ($0.75 / $3.75). Esa tarifa de Google es introductoria: desde el 1 de enero de 2027 el precio oficial pasa a $1.50 / $7.50 y la diferencia se ensancha al 70%. La entrada en caché cuesta $0.172 por millón. Se paga por uso, sin suscripción ni recarga mínima; las peticiones fallidas no se cobran y el contexto completo de 1M va a la misma tarifa de entrada.
La 3.8 Flash salió el 2 de septiembre de 2026 y Google la afinó para programación y agentes: primer puesto en DeepSWE v1.1 y 89.4% en Terminal-Bench 2.1. Aquí cuesta $0.450 / $2.250, alrededor de un 32% menos que la 3.6 Flash ($0.662 / $3.302), o sea que es a la vez la más nueva y la más barata de las dos. Ahora bien, si tu carga son peticiones cortas en gran volumen que deben responder al instante, quédate con Gemini 3.1 Flash Lite ($0.375 / $2.25): más barata de entrada y mucho más rápida hasta el primer token, que en la 3.8 Flash se mide en unos 13.3 segundos.
Los tokens de razonamiento se facturan a la tarifa de salida, y esta generación piensa bastante más que las anteriores. En nuestra prueba gastó 83 tokens de razonamiento para dar una respuesta de dos palabras: la salida visible era un solo token. Artificial Analysis midió 120 millones de tokens de salida en su batería de pruebas frente a una mediana de 71 millones. Calcula el coste sumando candidatesTokenCount y thoughtsTokenCount en usageMetadata, no por el texto visible. Si no necesitas razonamiento profundo, limita maxOutputTokens o usa la 3.1 Flash Lite.
En APIMODELS, Gemini 3.8 Flash convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite 40% Below Official, Agentic Coding, 1M Context, Multimodal Input y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
Gemini 3.8 Flash admite: 40% Below Official, Agentic Coding, 1M Context, Multimodal Input. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone Gemini 3.8 Flash mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.