
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
The nano tier — built for high-volume, low-cost workloads
Reasoning-token support tuned for throughput
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.221 / $1.324 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna は OpenAI の大規模言語モデル API です。GPT-5.6 Luna は GPT-5.6 ファミリーの nano ティアで、大量処理と予算重視のワークロード向けの一段です。高い推論品質を高速に返し、テキストと画像を入力してテキストを出力します。コンテキストウィンドウは 1,050,000 トークン、出力は最大 128,000 トークン、推論トークンに対応し、知識のカットオフは 2026 年 2 月 16 日。APIMODELS では /v1/chat/completions と /v1/responses の両方から呼べます。料金は 100 万トークンあたり入力 $0.221、出力 $1.324、キャッシュ済み入力は $0.022。GPT-5.6 Sol の 2 割、OpenAI 公式価格($1 / $6)の約 5 分の 1 で、ファミリー最安です。大量分類、抽出、リライト、カスタマーサポートではこれが一番割に合います。現在プロバイダ側が max 推論ティアしか提供していないため、実際の呼び出しは gpt-5.6-luna-max になります。gpt-5.6-luna という名前は同じ価格でそこへ転送されます。従量課金で、失敗したリクエストは課金されません。 APIMODELS のプラットフォーム経由なら、統一 API と明朗な従量課金でこのモデルを呼び出せます。 現在の料金: Input: $0.221, Output: $1.324 per 1M tokens。
問い合わせに自動で答える対話システムを構築し、対応の効率を上げます。
記事、メール、広告コピーなどの文章を自動で書き、制作の手数を減らします。
コードの記述、デバッグ、レビューを補助し、開発を前に進めます。
非構造化データを読み解き、要点を抽出して要約レポートにまとめます。
GPT-5.6 Luna は APIMODELS 経由で Input: $0.221, Output: $1.324 per 1M tokens で利用できます。課金は従量制で、生成した分だけの支払いです。
APIMODELS に登録して API キーを取得し、統一エンドポイントを呼ぶだけです。cURL / Python / Node.js のサンプルを含む詳しいドキュメントを用意しています。
APIMODELS は同じ GPT-5.6 Luna を集約プラットフォーム経由で提供します。統一された API インターフェースなので、プロバイダごとにアカウントを作る必要はありません。キー 1 本ですべてのモデルに届きます。
GPT-5.6 ファミリーの nano ティアで、大量処理とコスト重視のワークロード向けです。高い推論品質を高速に返し、テキストと画像を入力、コンテキストは 1,050,000 トークン、出力は最大 128,000 トークン、知識は 2026 年 2 月まで。apimodels.app では 100 万トークンあたり入力 $0.221、出力 $1.324、キャッシュ済み入力は $0.022 です。GPT-5.6 Sol の 2 割、OpenAI 公式価格($1 / $6)の約 5 分の 1 で、ファミリー最安のモデルです。
base_url を https://api.apimodels.app/v1 に向け、model に gpt-5.6-luna を入れるだけです。OpenAI 互換の /v1/chat/completions と /v1/responses の両方が使え、function calling(tools)にも対応しています。一点だけ注意。プロバイダ側が max 推論ティアしか有効にしていないため、gpt-5.6-luna という名前は同じ価格で自動的に gpt-5.6-luna-max へ転送されます。キー 1 本で全モデルをカバーし、従量課金、失敗したリクエストは課金されません。
入力が 272,000 トークンを超えたリクエストは、そのリクエスト全体が入力 $0.442 / 出力 $1.986(入力 2 倍、出力 1.5 倍)で再計算されます。プロバイダ側の段階制と同じです。推論トークンは出力として数えられます。
ファミリー内では Luna が最安です。apimodels.app で 100 万トークンあたり入力 $0.221 / 出力 $1.324、Sol と OpenAI 公式価格($1 / $6)の 5 分の 1、キャッシュ済み入力はわずか $0.022。大量分類、抽出、リライト、カスタマーサポートで最も割に合います。もっと推論が要るなら gpt-5.6-terra か gpt-5.6-sol に上げてください。OpenAI 公式 API や他のゲートウェイからの移行はコードを触る必要がありません。base_url を https://api.apimodels.app/v1 に向け、model に gpt-5.6-luna-max を入れるだけです。API は OpenAI 互換で、失敗したリクエストは一切課金されません。
最大の制約は、プロバイダが max 推論ティアしか提供していないことです。識別子は gpt-5.6-luna-max を使ってください(gpt-5.6-luna は同じ価格でそこへ転送されます)。ほかに、リクエストごとに約 1,450 トークンのシステム前置きが付くため input_tokens はその下限を下回りません。parallel_tool_calls: false は無視され、モデルが複数の tool_calls を同時に返すことがあります。入力 272,000 トークンを超えるとリクエスト全体が再計算されます。function calling(tools)、ストリーミング、/v1/responses はいずれも動作確認済みです。
APIMODELS では GPT-5.6 Luna が 60 以上のモデルと同じ API キー・同じ残高の上に並んでいるので、選択は「相性」の問題であって「囲い込み」の問題ではありません。Cost-Efficient、High-Volume、Fast、1.05M Context に対応しており、他の大規模言語モデルモデルと価格・機能を並べて評価できます。乗り換えはモデル名の文字列を 1 つ書き換えるだけ。新しいアカウントも追加の実装も要りません。大規模言語モデルの選択肢と最新価格は apimodels.app/models で確認できます。
GPT-5.6 Luna は次に対応しています: Cost-Efficient、High-Volume、Fast、1.05M Context。パラメータの全一覧と呼び出し例は APIMODELS のドキュメントをご覧ください。
はい。APIMODELS は GPT-5.6 Luna を単一の統一 API とキー 1 本で提供します。プロバイダごとのアカウントも、各社の地域ごとのネットワーク経路を自分で面倒みる必要もありません。
Stripe(Visa、Mastercard などの国際カード)と Alipay に対応しています。支払い後、残高はすぐ反映されます。