
gpt-5-6-lunaGPT-5.6 Luna 是 GPT-5.6 家族面向成本敏感、高并发场景的 nano 档,高推理、速度快,支持文本+图像输入与文本输出,1,050,000 token 上下文、128,000 最大输出 token,支持推理 token,知识截止 2026 年 2 月 16 日。已在 APIMODELS 上线,输入 $0.16 / 输出 $0.96 每百万 token(缓存输入 $0.016),较官方 $0.20/$1.20 低 20%。(OpenAI 已于 2026-08-21 下调 GPT-5.6 全线挂牌价,此前引用的旧挂牌价已作废。)当前上游仅开放 max 推理档,模型名请填 gpt-5.6-luna-max(gpt-5.6-luna 会自动路由到它);按量计费、价格低于官方、国内可直连。
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
nano 档 —— 为高并发、低成本的活儿准备的
支持推理 token,按吞吐量调校
文本 + 图像输入、文本输出;105 万上下文,最大输出 128K
OpenAI 兼容的 /v1/chat/completions 与 /v1/responses;每百万 token $0.16 / $0.96
GPT-5.6 Luna 是由 OpenAI 提供的大语言模型 API。GPT-5.6 Luna 是 GPT-5.6 家族面向成本敏感、高并发场景的 nano 档,高推理、速度快,支持文本+图像输入与文本输出,1,050,000 token 上下文、128,000 最大输出 token,支持推理 token,知识截止 2026 年 2 月 16 日。已在 APIMODELS 上线,输入 $0.16 / 输出 $0.96 每百万 token(缓存输入 $0.016),较官方 $0.20/$1.20 低 20%。(OpenAI 已于 2026-08-21 下调 GPT-5.6 全线挂牌价,此前引用的旧挂牌价已作废。)当前上游仅开放 max 推理档,模型名请填 gpt-5.6-luna-max(gpt-5.6-luna 会自动路由到它);按量计费、价格低于官方、国内可直连。 通过 APIMODELS 平台,您可以使用统一的 API 接口调用该模型,按量计费、价格透明。当前定价:Input: $0.16, Output: $0.96 per 1M tokens。
构建智能对话系统,自动回答用户问题,提升客户服务效率。
自动撰写文章、邮件、广告文案等文本内容,提高内容产出效率。
辅助代码编写、调试和代码审查,加速软件开发流程。
理解和分析非结构化数据,提取关键信息并生成报告摘要。
GPT-5.6 Luna 通过 APIMODELS 平台调用,当前定价:Input: $0.16, Output: $0.96 per 1M tokens。按量计费,用多少付多少。
在 APIMODELS 注册账号并获取 API Key,然后通过我们的统一 API 端点调用即可。我们提供详细的 API 文档和 cURL、Python、Node.js 代码示例。
APIMODELS 通过聚合平台提供与官方相同的 GPT-5.6 Luna 模型。我们提供统一的 API 接口,无需分别注册各平台账号,一个 API Key 即可调用所有模型。
GPT-5.6 Luna 是 GPT-5.6 家族面向成本敏感、高并发场景的 nano 档,高推理、速度快,支持文本+图像输入,1,050,000 上下文、128,000 最大输出、推理 token,知识截止 2026 年 2 月。在 apimodels.app 上输入 $0.16 / 输出 $0.96 每百万 token(缓存输入 $0.016),约为 GPT-5.6 Sol 的八分之一,较 OpenAI 官方 $0.20 / $1.20 低 20%,是 GPT-5.6 家族里最便宜的一档。
把 base_url 指向 https://api.apimodels.app/v1,模型名填 gpt-5.6-luna,OpenAI 兼容的 /v1/chat/completions 与 /v1/responses 两个端点都支持,函数调用(tools)可用。注意:上游目前只开放了 max 推理档,其余几档尚未接通,所以 gpt-5.6-luna 这个名字会自动路由到 gpt-5.6-luna-max,价格完全相同。一个 API Key 覆盖全部模型,按量计费、失败不扣费、国内可直连。
单次请求输入超过 272,000 token 时,该请求整体按输入 $0.32 / 输出 $1.44 计费(输入 2 倍、输出 1.5 倍),与上游的长上下文加价规则一致。推理 token 计入输出 token。
Luna 本身就是 GPT-5.6 家族里最便宜的一档:$0.16 输入 / $0.96 输出每百万 token,输入约为 Sol 的八分之一、输出约七分之一,较 OpenAI 官方 $0.20 / $1.20 低 20%,缓存命中的输入只要 $0.016。做批量分类、抽取、改写、客服这类高并发场景,Luna 的性价比最好;要更强推理再往上换 gpt-5.6-terra 或 gpt-5.6-sol。如果你原来在用 OpenAI 官方或别的中转,把 base_url 换成 https://api.apimodels.app/v1、模型名换成 gpt-5.6-luna-max 即可,接口完全 OpenAI 兼容,不用改代码,失败不扣费。
规范模型名是 gpt-5.6-luna;历史上用过的 gpt-5.6-luna-max 仍可继续传,会自动解析到同一个模型、同价。另外上游注入的系统前缀大小随渠道池浮动 —— 2026-09-05 实测一句话的 prompt 约 4,400 input token(其中约 3,840 为缓存命中),也见过个位数的请求,别按固定下限估算;parallel_tool_calls: false 会被忽略,可能一次返回多个 tool_call;输入超过 272,000 token 后整单加价。函数调用(tools)、流式、/v1/responses 均已实测可用。
在 APIMODELS,GPT-5.6 Luna 与 60+ 个模型共用一个 API Key、一个余额,所以选型只看合不合适,不存在锁定。它支持 Cost-Efficient、High-Volume、Fast、1.05M Context,你可以在价格和能力上把它和其它大语言模型模型对比,换模型只需改一个模型名字符串——无需新账号、无需重新对接。所有大语言模型模型与实时价格见 apimodels.app/models。
GPT-5.6 Luna 支持:Cost-Efficient、High-Volume、Fast、1.05M Context。完整参数与调用方式见 APIMODELS 的 API 文档。
可以。APIMODELS 提供可直接访问的统一 API,一个 API Key 即可调用 GPT-5.6 Luna,无需分别注册官方账号、也无需自行处理官方接口的网络访问。
我们支持 Stripe(Visa、Mastercard 等国际信用卡)和支付宝付款。充值后积分即时到账。