DeepSeek 按钟点计价。官方 API 上,V4.1 Flash 在北京时间工作日 09:00–12:00、14:00–18:00(即 UTC 01:00–04:00、06:00–10:00)每百万 token 输入 $0.30 / 输出 $1.20;其余时段、整个周末和国内法定节假日恰好半价,$0.15 / $0.60。缓存输入峰时 $0.006、谷时 $0.003。比价时多数人会漏掉这一点,因为大部分转售渠道根本不透传谷时价。
在 APIMODELS 上,同一个模型两个时段都比官方低 10%:峰时 $0.27 / $1.08 / 缓存 $0.0054,谷时 $0.135 / $0.54 / 缓存 $0.0027,峰时同样只算工作日、节假日同样按谷时。模型 ID 是 deepseek-v4.1-flash;老 ID deepseek-v4-flash 照常可用、同价 —— DeepSeek 官方也已经把退役的 V4 Flash 名字交给 V4.1 来服务。
可靠性用生产数据说话:近 30 天外部流量(已剔除内部账号)里,deepseek-v4-flash 处理 20,011 次调用、成功率 99.6%,deepseek-v4.1-flash 493 次、零失败。失败的调用一律不计费。
每百万 token 价格,2026-09-30 在各家价目页或公开 API 上逐一核对。「全天」表示该渠道不分北京时段、一个价到底。OpenRouter 上有几个更便宜的量化(fp4)变体,权重不同,不列入对比。
| 渠道 | 输入 | 缓存输入 | 输出 | 时段 |
|---|---|---|---|---|
| DeepSeek 官方 | $0.30 | $0.006 | $1.20 | 峰时(北京工作日时段) |
| DeepSeek 官方 | $0.15 | $0.003 | $0.60 | 谷时、周末、节假日 |
| APIMODELS | $0.27 | $0.0054 | $1.08 | 峰时 |
| APIMODELS | $0.135 | $0.0027 | $0.54 | 谷时、周末、节假日 |
| Together AI | $0.30 | $0.006 | $1.20 | 全天 |
| Fireworks | $0.30 | $0.006 | $1.20 | 全天(优先档 $0.375 / $1.50) |
| OpenRouter 多数渠道 | $0.30 | — | $1.20 | 全天 |
| SiliconFlow(官网) | $0.15 | $0.003 | $0.60 | 挂牌价 |
举个例子:1,000 万输入 token(一半命中缓存)加 200 万输出 token。在全天 $0.30 / $0.006 / $1.20 的渠道上跑,花 $3.93。同样的任务在 APIMODELS 峰时花 $3.54,谷时花 $1.77。把批量任务排到北京工作时间以外,省下的比换任何渠道都多;而我们在此之上的 10% 是每个时段都有。
如果你已经有充好人民币的 DeepSeek 平台账号、也只用 DeepSeek,直接走官方没问题,差价就是这 10%。走网关的理由在价格之外:不需要中国手机号或实名认证,一个美元余额,Stripe、PayPal、支付宝都能付,同一个 key、同一个 OpenAI 兼容 base URL 还能调 Claude、GPT、Gemini、Qwen 等 130 多个模型。
cURL
curl https://api.apimodels.app/v1/chat/completions \
-H "Authorization: Bearer $APIMODELS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4.1-flash",
"messages": [{"role": "user", "content": "Summarise this log in three bullet points."}]
}'Python
from openai import OpenAI
client = OpenAI(api_key="YOUR_APIMODELS_KEY", base_url="https://api.apimodels.app/v1")
r = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify this ticket: refund, bug or question?"}],
)
print(r.choices[0].message.content)
print(r.usage) # cache hits appear here and bill at the cached rate官方每百万 token 峰时(北京工作日工作时段)输入 $0.30 / 输出 $1.20,其余时段 $0.15 / $0.60,缓存输入分别 $0.006 与 $0.003。在 APIMODELS 上两个时段都再低 10%:峰时 $0.27 / $1.08,谷时 $0.135 / $0.54。
峰时是北京时间周一到周五 09:00–12:00 和 14:00–18:00(UTC 01:00–04:00、06:00–10:00)。其余全部是半价谷时:夜间、午休、整个周末,以及国庆 10 月 1–7 日这类法定节假日。APIMODELS 用的是同一套日历。
DeepSeek 已经把 V4 Flash 这个名字退役,改由 V4.1 Flash 按 V4.1 价格提供服务。在 APIMODELS 上两个 ID 都能用、计费相同,现有代码不用改。
那些渠道跑的是量化(fp4)版本,或者 V4 Flash 0731 这类旧快照,和 V4.1 Flash 不是同一套权重。比价要同款比:全精度 V4.1 Flash 在几乎所有渠道的峰时价都是 $0.30 / $1.20。