下列所有模型通过统一 API、一个 key 即可调用。点击模型查看完整 playground 与文档。
| 模型 | model 参数 | 价格 | 说明 |
|---|---|---|---|
| Claude Opus 5 | claude-opus-5 | $3 / $15 | Anthropic's newest Opus — a step change on deep reasoning, agentic coding and long-horizon work, at 40% off official pricing. 1M context, adaptive thinking on by default, native tool use. Works with Claude Code, Cursor and the OpenAI SDK alike. |
| Claude Fable 5 | claude-fable-5 | $5 / $25 | Claude Fable 5 是 Anthropic 最新、最强的公开可用大语言模型,在 APIMODELS 上价格约为官方的一半(比官方便宜约 50%,输入 $5 / 输出 $25 每百万 token)。开箱支持 Claude Code、Anthropic SDK 及 Cursor 等 Anthropic 兼容客户端调用。具备超长上下文、多模态(识图)理解、复杂推理与企业级知识工作能力,并带严格安全保护。通过 Anthropic Messages API(/v1/messages)提供原生工具调用,请求参数与 Opus 4.8 一致。 |
| Claude Opus 4.8 | claude-opus-4-8 | $3 / $13 | claude-opus-4-8 是目前 Anthropic 最强的"能一个人扛住长时间复杂工作的工具",特别适合开发者做大项目、建 Agent,或者对质量和自主性要求极高的场景。 |
| Claude Opus 4.7 | claude-opus-4-7 | $3.676 / $18.382 | Claude Opus 4.7 支持 100 万 token 上下文窗口、128K 最大输出 token、自适应思维,与 Opus 4.6 拥有相同的工具与平台能力。 |
| Claude Opus 4.7 (Thinking) | claude-opus-4-7-thinking | $3.676 / $18.382 | Claude Opus 4.7 扩展思维版,显式开启长链推理,适用于最复杂的任务。 |
| Claude Opus 4.6 | claude-opus-4-6 | $1.765 / $8.824 | 最新 Opus 模型,具备终极性能和推理能力。 |
| Claude Opus 4.6 (Thinking) | claude-opus-4-6-thinking | $1.765 / $8.824 | Claude Opus 4.6 扩展思维版,适用于最复杂的推理任务。 |
| Claude Sonnet 5 | claude-sonnet-5 | $2.353 / $11.765 | Claude Sonnet 5 是 Anthropic 最新的 Sonnet 模型,默认且最大都是 100 万 token 上下文窗口(没有更小的上下文变体)、最大 128K 输出 token、自适应思维,工具与平台功能与 Claude Sonnet 4.6 相同,唯一例外是不支持优先级(Priority Tier)。在 APIMODELS 上 $2.353 输入 / $11.765 输出(每百万 token,较官方价低 22%),并支持提示词缓存(缓存命中 $0.147/M、缓存写入 $2.059/M);计费的输出 token 含模型内部思考 token,与 Anthropic 官方口径一致。通过 Anthropic Messages API(/v1/messages)提供原生工具调用,Claude Code、Anthropic SDK 及 Cursor 等 Anthropic 兼容客户端可直接接入,请求参数与 Opus 4.8 一致。 |
| Claude Sonnet 4.6 | claude-sonnet-4-6 | $1.059 / $5.295 | 最新 Sonnet 模型,具备最佳性能和效率。 |
| Claude Sonnet 4.6 (Thinking) | claude-sonnet-4-6-thinking | $1.059 / $5.295 | Claude Sonnet 4.6 扩展思维版,适用于复杂推理任务。 |
| Claude Opus 4.5 | claude-opus-4-5-20251101 | $1.765 / $8.824 | 最新 Opus 模型,具备增强能力和改进推理。 |
| Claude Opus 4.5 (Thinking) | claude-opus-4-5-20251101-thinking | $1.765 / $8.824 | Claude Opus 4.5 扩展思维版,适用于最复杂的推理任务。 |
| Claude Sonnet 4.5 | claude-sonnet-4-5-20250929 | $1.059 / $5.295 | 最新 Sonnet 模型,性能和效率均有提升。 |
| Claude Sonnet 4.5 (Thinking) | claude-sonnet-4-5-20250929-thinking | $1.059 / $5.295 | Claude Sonnet 4.5 扩展思维版,适用于复杂推理任务。 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 | $0.353 / $1.765 | 快速且经济的轻量级任务模型。适合简单查询和快速响应。 |
| Claude Haiku 4.5 (Thinking) | claude-haiku-4-5-20251001-thinking | $0.353 / $1.765 | Claude Haiku 4.5 扩展思维版,适用于复杂推理任务。 |
| Claude Opus 4 | claude-opus-4-20250514 | $5.295 / $26.471 | 最强大的模型,具备卓越的推理和分析能力。 |
| Claude Opus 4 (Thinking) | claude-opus-4-20250514-thinking | $5.295 / $26.471 | Claude Opus 4 扩展思维版,适用于最复杂的推理任务。 |
| Claude Sonnet 4 | claude-sonnet-4-20250514 | $1.059 / $5.295 | 均衡型模型,性能优秀且成本高效。适用于大多数任务。 |
| Claude Sonnet 4 (Thinking) | claude-sonnet-4-20250514-thinking | $1.059 / $5.295 | Claude Sonnet 4 扩展思维版,适用于复杂推理任务。 |
| Gemini 3.6 Flash | gemini-3.6-flash | $0.662 / $3.302 | Gemini 3.6 Flash 是最新一代 Flash。相比 3.5 Flash,输入价持平、输出更便宜 —— 这个定价结构对 agent 类和长链路任务特别友好:那类任务的成本大头在模型产出而不是提示词上,输出降价直接压低总账。价格 $0.662 / $3.302 每 1M token。通过统一接口调用,一个 API Key 同时可用图片、视频、音频模型。 |
| Gemini 3.5 Flash | gemini-3.5-flash | $0.662 / $3.971 | Gemini 3.5 Flash 已正式发布 (GA),性能稳定,可大规模用于生产。最智能的 Flash 模型,在智能体执行、编码与长链任务上持续领先。 |
| Gemini 3.1 Flash Lite | gemini-3.1-flash-lite | $0.375 / $2.25 | 最具性价比的多模态模型,速度最快,适用于高频轻量级任务。适合大规模 Agent 任务、简单数据提取和超低延迟应用。 |
| Gemini 3.1 Pro Preview | gemini-3.1-pro-preview | $0.824 / $4.941 | 最新 Pro 模型,具备增强推理和多模态能力。 |
| Gemini 3 Flash Preview | gemini-3-flash-preview | $0.2 / $1.2 | 快速高效的多模态模型。适合快速响应和简单任务。 |
| Gemini 3 Pro Preview | gemini-3-pro-preview | $0.442 / $2.648 | 高级多模态推理模型,具备卓越能力。 |
| Gemini 3 Pro (Thinking) | gemini-3-pro-preview-thinking | $0.442 / $2.648 | Gemini 3 Pro 扩展思维版,适用于复杂推理任务。 |
| GPT-5.6 Sol | gpt-5-6-sol | $1.103 / $6.618 | GPT-5.6 Sol 是 OpenAI GPT-5.6 家族的旗舰、最强推理模型,大致对应早期 GPT-5 家族无后缀的顶配档;gpt-5.6 别名即路由到 Sol。支持推理 token、文本+图像输入与文本输出,1,050,000 token 上下文、128,000 最大输出 token,知识截止 2026 年 2 月 16 日。已在 APIMODELS 上线,输入 $1.103 / 输出 $6.618 每百万 token(缓存输入 $0.110),约为 OpenAI 官方 $5/$30 的两成,可通过 /v1/chat/completions 与 /v1/responses 两个端点调用,另有 -low/-medium/-high/-xhigh/-max/-ultra 六档推理规格同价:一个 API Key 覆盖全部模型,价格低于官方,国内可直连、无需组织认证,失败不扣费。 |
| GPT-5.6 Terra | gpt-5-6-terra | $0.551 / $3.309 | GPT-5.6 Terra 是 GPT-5.6 家族用于平衡智能与成本的 mini 档,推理更强、速度快,支持文本+图像输入与文本输出,1,050,000 token 上下文、128,000 最大输出 token,支持推理 token,知识截止 2026 年 2 月 16 日。已在 APIMODELS 上线,输入 $0.551 / 输出 $3.309 每百万 token(缓存输入 $0.055),恰为 Sol 的一半、约为官方 $2.5/$15 的两成,可用 /v1/chat/completions 与 /v1/responses 两个端点,另有 -low/-medium/-high/-xhigh/-max/-ultra 六档同价:一个 Key 调用全部模型、价格低于官方、国内可直连。 |
| GPT-5.6 Luna | gpt-5-6-luna | $0.221 / $1.324 | GPT-5.6 Luna 是 GPT-5.6 家族面向成本敏感、高并发场景的 nano 档,高推理、速度快,支持文本+图像输入与文本输出,1,050,000 token 上下文、128,000 最大输出 token,支持推理 token,知识截止 2026 年 2 月 16 日。已在 APIMODELS 上线,输入 $0.221 / 输出 $1.324 每百万 token(缓存输入 $0.022),为 Sol 的两成、约为官方 $1/$6 的两成。当前上游仅开放 max 推理档,模型名请填 gpt-5.6-luna-max(gpt-5.6-luna 会自动路由到它);按量计费、价格低于官方、国内可直连。 |
| Grok 4.6 | grok-4.6 | $1.765 / $5.294 | Grok 4.6 是 xAI 的旗舰模型,这一代专门冲着【长跑 Agent】和多步骤工作去的 —— 研究一个主题、在代码库里连续改动、把一个想法做成可交付的成品,都能跨很多轮撑下来,过程中还会自己回头验证。Artificial Analysis 智能指数 61,与 GPT-5.6 Sol 持平,并在各项公开评测上全面超过 4.5。500K 上下文,支持文本与图片输入,四档推理强度(low / medium / high 默认 / xhigh)。定价输入 $1.765 / 输出 $5.294 每百万 token,比 xAI 官方($2 / $6)低 12%,缓存输入 $0.441。走 OpenAI 兼容的 /v1/chat/completions;/v1/responses 也可用,而且联网检索只在那条上跑得起来。失败不扣费。⚠️ 两点要知道:默认推理档是 high,实测约 53 秒,客户端超时请设 60 秒以上;计费的输出 token 含推理 token,所以账单可能高于你看到的可见回答,不需要深推理时把 reasoning_effort 调低。 |
| Grok 4.5 | grok-4.5 | $1.5 / $5 | Grok 4.5 是 xAI 最新旗舰模型,在编程、非幻觉率、Agent 工具调用与指令跟随能力上引领行业,支持非推理与推理两种模式,500K 上下文。通过 OpenAI 兼容的 /v1/chat/completions 端点调用(anthropic /v1/messages 请改用此端点)。定价低于 xAI 官方:输入 $1.5、输出 $5 每百万 token(官方 $2.0/$6.0,输入省 25%、输出省约 17%)。 |
| GPT-5.5 | gpt-5-5 | $3 / $18 | GPT-5.5 是 OpenAI 面向 Agent 编码、知识工作、科研与复杂多步任务的高级推理模型。通过 Responses API(/v1/responses)调用,支持可调推理强度(low–xhigh)、联网搜索、函数调用与多模态输入。OpenAI Codex 设 wire_api = "responses" 即可直接接入。 |
| GPT-5.4 | gpt-5-4 | $1.8 / $10.8 | GPT-5.4 是 OpenAI 面向复杂专业工作与 Agent 编码的前沿模型。通过 Responses API(/v1/responses)调用,推理强度用请求体的 reasoning.effort(low–xhigh)控制,支持联网搜索、函数调用与多模态输入。OpenAI Codex 设 wire_api = "responses" 即可直接接入。 |
| GLM-5.2 | glm-5.2 | $0.9 / $3.15 | GLM-5.2 是智谱(Zhipu)的推理模型,函数调用 / 工具使用能力是它的强项,适合做 agent 编排和结构化输出。通过 OpenAI 兼容的 chat-completions 接口调用,支持提示词缓存 —— 缓存命中部分按 $0.28 每 1M 输入 token 计,多轮长上下文对话能省下可观成本。价格 $0.9 / $3.15 每 1M token。 |
| DeepSeek V4 Flash | deepseek-v4-flash | $0.12 / $0.24 | DeepSeek V4 Flash 是 DeepSeek V4 家族里的轻量高吞吐档,面向通用对话、摘要、分类这类常规文本任务做了吞吐优化。1M token 上下文,支持工具调用(function calling)、JSON 输出与流式返回,通过 OpenAI 兼容的 /v1/chat/completions 调用 —— 把 base_url 指向 apimodels.app 即可,SDK 不用换。价格 $0.12 / $0.24 每 1M token(输入 / 输出),缓存命中 $0.00238,比 DeepSeek 官方价低约 15%。要推理深度和 agent 能力请看 V4 Pro。 |
| DeepSeek V4 Pro | deepseek-v4-pro | $0.37 / $0.74 | DeepSeek V4 Pro 是 DeepSeek 的高性能档,推理与 agent 能力是这一代的重点,1M token 上下文。它会通过 reasoning_content 字段把完整思维链返回给你,便于审计推理过程或做二次加工;同时支持工具调用、JSON 输出与流式,OpenAI 兼容 /v1/chat/completions。价格 $0.37 / $0.74 每 1M token,缓存命中 $0.00308,比 DeepSeek 官方价低约 15%。只要通用对话和高吞吐、不需要思维链的话,V4 Flash 更划算。 |
| Qwen3.7 Max | qwen3.7-max | $1.76 / $5.29 | Alibaba Qwen3.7 Max — the most capable Qwen3.7 model: top-tier reasoning and agent ability, 1M-token context, hybrid thinking. Tool calling, streaming; OpenAI-compatible. |
| Qwen3.7 Plus | qwen3.7-plus | $0.88 / $1.18 | Qwen3.7 Plus 是阿里 Qwen3.7 家族里性价比最高的一档:推理与 agent 能力接近 Max,价格却只是其中一小部分,1M token 上下文,并支持混合思考模式(通过 reasoning_content 返回推理过程,可按需开关)。工具调用、JSON 输出、流式全都有,OpenAI 兼容 /v1/chat/completions。价格 $0.8824 / $1.1765 每 1M token。中文任务和长文档处理是它的主场。 |
| Text Embedding 3 Small | text-embedding-3-small | $0.018 / 1M tokens | 小型嵌入模型,高效且经济,适用于大多数场景。 |
| Text Embedding 3 Large | text-embedding-3-large | $0.059 / 1M tokens | 大型嵌入模型,精度更高,维度灵活可调。 |
调 POST /api/v1/messages,model 填 claude-opus-4-8 或 gemini-3-pro-preview 等,按前缀自动路由。OpenAI 格式(gpt-/grok-/glm-)走 /v1/chat/completions。
便宜——按 token 计费、低于官方,无月费。一把 Key 覆盖 Claude/Gemini/GPT/Grok/GLM 等,免去多家账号。
支持。stream: true 走 SSE 流式;工具/函数调用透传给上游。改 base URL 即可用 Anthropic / OpenAI SDK。