
deepseek-v4.1-flashDeepSeek V4.1 Flash is the V4.1 generation of DeepSeek’s fast, high-throughput model for general chat, summarisation and agent tool use. It has a 1M-token context window, tool calling, JSON output and streaming, and is served via the OpenAI-compatible /v1/chat/completions endpoint. Pricing follows DeepSeek’s peak / off-peak schedule: peak (01:00–04:00 and 06:00–10:00 UTC) $0.405 input / $1.62 output / $0.0081 cached per 1M tokens, off-peak $0.2025 / $0.81 / $0.00405. Prompt-cache hits are billed at the cached rate.
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
Newer Flash release in the DeepSeek V4 family
Million-token context window for long inputs
Function calling + JSON output, OpenAI-compatible
Off-peak rates are half of peak; cache hits billed at the cached rate
DeepSeek V4.1 Flash é uma API de modelo de linguagem da DeepSeek. DeepSeek V4.1 Flash is the V4.1 generation of DeepSeek’s fast, high-throughput model for general chat, summarisation and agent tool use. It has a 1M-token context window, tool calling, JSON output and streaming, and is served via the OpenAI-compatible /v1/chat/completions endpoint. Pricing follows DeepSeek’s peak / off-peak schedule: peak (01:00–04:00 and 06:00–10:00 UTC) $0.405 input / $1.62 output / $0.0081 cached per 1M tokens, off-peak $0.2025 / $0.81 / $0.00405. Prompt-cache hits are billed at the cached rate. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.405, Output: $1.62 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O DeepSeek V4.1 Flash está disponível pela APIMODELS a: Input: $0.405, Output: $1.62 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo DeepSeek V4.1 Flash pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
Na APIMODELS, o DeepSeek V4.1 Flash roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta V4.1, Tool Calling, 1M Context, Streaming, OpenAI-compatible e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O DeepSeek V4.1 Flash suporta: V4.1, Tool Calling, 1M Context, Streaming, OpenAI-compatible. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o DeepSeek V4.1 Flash por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.