
qwen3.8-maxQwen3.8 Max 是阿里最新一代通义千问旗舰,以推理为中心 —— 思考默认开启,而且深度可以分档控制:reasoning_effort 传 low / medium / xhigh,按请求在"答得深"和"快且便宜"之间取舍。1M token 上下文,工具调用、JSON 输出、流式全都有,OpenAI 兼容 /v1/chat/completions。⚠️ 思考消耗的 token 算在 completion_tokens 里(短提示下通常占输出的 85–95%),所以想控成本就调 reasoning_effort,别只盯着正文长度。价格 $2.00 / $6.00 每 1M token。
View complete API reference with all parameters and examples.
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
reasoning_effort low / medium / xhigh trades depth against latency and output cost
Million-token context window
Reasoning tokens are part of completion_tokens — typically 85-95% of the output on short prompts. Set reasoning_effort to control it.
Function calling + JSON output, OpenAI-compatible
Qwen3.8 Max 是由 Alibaba 提供的大语言模型 API。Qwen3.8 Max 是阿里最新一代通义千问旗舰,以推理为中心 —— 思考默认开启,而且深度可以分档控制:reasoning_effort 传 low / medium / xhigh,按请求在"答得深"和"快且便宜"之间取舍。1M token 上下文,工具调用、JSON 输出、流式全都有,OpenAI 兼容 /v1/chat/completions。⚠️ 思考消耗的 token 算在 completion_tokens 里(短提示下通常占输出的 85–95%),所以想控成本就调 reasoning_effort,别只盯着正文长度。价格 $2.00 / $6.00 每 1M token。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:Input: $2.00, Output: $6.00 per 1M tokens。
构建智能对话系统,自动回答用户问题,提升客户服务效率。
自动撰写文章、邮件、广告文案等文本内容,提高内容产出效率。
辅助代码编写、调试和代码审查,加速软件开发流程。
理解和分析非结构化数据,提取关键信息并生成报告摘要。
Qwen3.8 Max 通过 APIMODELS 平台调用,当前定价:Input: $2.00, Output: $6.00 per 1M tokens。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 Qwen3.8 Max 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
Qwen3.8 Max 是阿里最新一代旗舰,相比 3.7 Max 的主要变化是思考深度可以分档控制:reasoning_effort 传 low / medium / xhigh,按请求在「答得深」和「快且便宜」之间取舍,而 3.7 只能整体开关思考或设 token 上限。价格上 3.8 Max 是 $2.00 / $6.00,3.7 Max 是 $2.25 / $6.75 —— 新一代反而更便宜。两者同一个端点,换档只改 model 一个字段。
不便宜,和官方挂牌价一样:$2.00 / $6.00 每百万 token,缓存输入 $0.25。我们不在这一代上做价格文章。用我们的理由是别的:不需要阿里云账号和实名认证、国内可直连、一把 key 同时调 Claude / Gemini / GPT / Grok 等所有模型并共用一个余额、按量付费无起充门槛、失败请求不扣费。如果你要的就是最低价,直接去官方开户是一样的。
可选 low / medium / xhigh,默认 xhigh(最深)。为兼容其它厂商的写法,high 和 max 会映射到 xhigh,minimal 映射到 low,none 等于关闭思考。它与 thinking_budget 不能同时传,传了会报错 —— 二选一。未设 reasoning_effort 时,thinking_budget 会自动映射回档位:0–4096 对应 low,4097–16384 对应 medium,16385–262144 对应 xhigh。
因为 qwen3.8-max 的 preserve_thinking 默认开启 —— 它会把历史轮次的思考内容(reasoning_content)一起回传给模型作为上下文。好处是模型记得自己之前怎么想的,代价是那些历史思考在每一轮追问里都会作为输入重新计费。长对话的输入 token 因此会比只看可见消息估算出来的高不少。想省钱就缩短历史,或改用不默认回传思考的档位。
POST https://api.apimodels.app/v1/chat/completions,带 Authorization: Bearer YOUR_API_KEY,body 是 {"model":"qwen3.8-max","messages":[{"role":"user","content":"..."}],"reasoning_effort":"low"}。标准 OpenAI 格式,openai-python / openai-node 改 base_url 即可。100 万 token 上下文,流式加 stream:true。
在 APIMODELS,Qwen3.8 Max 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 Reasoning / Thinking、Flagship、1M Context、Tool Calling、Streaming,你可以在价格和能力上把它和其它大语言模型模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有大语言模型模型与实时价格见 apimodels.app/models。
Qwen3.8 Max 支持:Reasoning / Thinking、Flagship、1M Context、Tool Calling、Streaming。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 Qwen3.8 Max,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。