
deepseek-v4.1-flashDeepSeek V4.1 Flash is the V4.1 generation of DeepSeek’s fast, high-throughput model for general chat, summarisation and agent tool use. It has a 1M-token context window, tool calling, JSON output and streaming, and is served via the OpenAI-compatible /v1/chat/completions endpoint. Pricing follows DeepSeek’s peak / off-peak schedule: peak (01:00–04:00 and 06:00–10:00 UTC) $0.405 input / $1.62 output / $0.0081 cached per 1M tokens, off-peak $0.2025 / $0.81 / $0.00405. Prompt-cache hits are billed at the cached rate.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Newer Flash release in the DeepSeek V4 family
Million-token context window for long inputs
Function calling + JSON output, OpenAI-compatible
Off-peak rates are half of peak; cache hits billed at the cached rate
DeepSeek V4.1 Flash es una API de modelo de lenguaje de DeepSeek. DeepSeek V4.1 Flash is the V4.1 generation of DeepSeek’s fast, high-throughput model for general chat, summarisation and agent tool use. It has a 1M-token context window, tool calling, JSON output and streaming, and is served via the OpenAI-compatible /v1/chat/completions endpoint. Pricing follows DeepSeek’s peak / off-peak schedule: peak (01:00–04:00 and 06:00–10:00 UTC) $0.405 input / $1.62 output / $0.0081 cached per 1M tokens, off-peak $0.2025 / $0.81 / $0.00405. Prompt-cache hits are billed at the cached rate. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.405, Output: $1.62 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
DeepSeek V4.1 Flash está disponible a través de APIMODELS a: Input: $0.405, Output: $1.62 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo DeepSeek V4.1 Flash a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
En APIMODELS, DeepSeek V4.1 Flash convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite V4.1, Tool Calling, 1M Context, Streaming, OpenAI-compatible y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
DeepSeek V4.1 Flash admite: V4.1, Tool Calling, 1M Context, Streaming, OpenAI-compatible. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone DeepSeek V4.1 Flash mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.