
gpt-5-6-lunaGPT-5.6 Luna is optimized for cost-sensitive, high-volume workloads — the nano tier of the GPT-5.6 family. It delivers high reasoning at fast speed, text + image input and text output, a 1,050,000-token context window, 128,000 max output tokens, reasoning-token support, and a Feb 16 2026 knowledge cutoff. Live on APIMODELS over both /v1/chat/completions and /v1/responses: $0.221 input / $1.324 output per 1M tokens (cached input $0.022) — 20% of GPT-5.6 Sol, and about 78% below OpenAI's own $1 / $6 list. Call it as gpt-5.6-luna-max; the gpt-5.6-luna alias routes here. One API key for every model, pay-as-you-go, only successful requests billed.
The nano tier — built for high-volume, low-cost workloads
Reasoning-token support tuned for throughput
Text + image input, text output; 1.05M context, 128K max output
OpenAI-compatible /v1/chat/completions and /v1/responses; $0.221 / $1.324 per 1M
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "gpt-5-6-luna",
"stream": true,
"messages": [...]
}Enable the model to use tools and call functions.
{
"model": "gpt-5-6-luna",
"tools": [{
"type": "function",
"function": {
"name": "get_weather",
"description": "Get current weather for a location",
"parameters": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}
}],
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Get structured JSON responses from the model.
{
"model": "gpt-5-6-luna",
"response_format": {"type": "json_object"},
"messages": [{"role": "user", "content": "Extract info as JSON: John is 30 years old"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., gpt-5-6-luna) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | No | Maximum tokens in the response |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 2.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| tools | array | No | Function calling tools definition |
| response_format | object | No | Output format (e.g., json_object) |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
GPT-5.6 Luna은(는) OpenAI의 대규모 언어 모델 API입니다. GPT-5.6 Luna는 GPT-5.6 제품군의 nano 등급으로, 대량 처리와 예산이 빠듯한 워크로드를 겨냥한 단계입니다. 높은 추론 품질을 빠르게 돌려주며 텍스트와 이미지를 입력받아 텍스트를 출력합니다. 컨텍스트 윈도우는 1,050,000 토큰, 출력은 최대 128,000 토큰이고 추론 토큰을 지원하며 지식 컷오프는 2026년 2월 16일입니다. APIMODELS에서는 /v1/chat/completions와 /v1/responses 양쪽으로 호출할 수 있습니다. 요금은 100만 토큰 기준 입력 $0.221, 출력 $1.324이고 캐시된 입력은 $0.022입니다. GPT-5.6 Sol의 20%, OpenAI 공식 가격($1 / $6)의 약 5분의 1로 제품군에서 가장 저렴합니다. 대량 분류, 추출, 리라이팅, 고객 응대라면 이 등급이 가장 수지가 맞습니다. 현재 공급자 쪽이 max 추론 등급만 제공하고 있어 실제 호출은 gpt-5.6-luna-max로 이뤄지며, gpt-5.6-luna라는 이름은 같은 가격으로 그쪽에 연결됩니다. 사용한 만큼만 내고, 실패한 요청은 청구되지 않습니다. APIMODELS 플랫폼을 거치면 통합 API와 투명한 종량 과금으로 이 모델을 호출할 수 있습니다. 현재 가격: Input: $0.221, Output: $1.324 per 1M tokens.
문의에 자동으로 답하는 대화 시스템을 만들어 응대 효율을 높입니다.
기사와 이메일, 광고 카피 같은 글을 자동으로 써서 작업량을 줄입니다.
코드 작성과 디버깅, 리뷰를 도와 개발 속도를 올립니다.
비정형 데이터를 읽어내 핵심을 뽑고 요약 리포트로 정리합니다.
GPT-5.6 Luna은(는) APIMODELS를 통해 Input: $0.221, Output: $1.324 per 1M tokens에 이용할 수 있습니다. 과금은 종량제라서 생성한 만큼만 냅니다.
APIMODELS에 가입해 API 키를 받고 통합 엔드포인트를 호출하면 됩니다. cURL / Python / Node.js 예제를 담은 상세 문서를 제공합니다.
APIMODELS는 같은 GPT-5.6 Luna을(를) 집약 플랫폼을 통해 제공합니다. API 인터페이스가 통합되어 있어 공급자마다 계정을 만들 필요가 없고, 키 하나로 모든 모델에 닿습니다.
GPT-5.6 제품군의 nano 등급으로 대량 처리와 비용에 민감한 워크로드를 겨냥합니다. 높은 추론 품질을 빠르게 돌려주고 텍스트와 이미지를 입력받으며, 컨텍스트는 1,050,000 토큰, 출력은 최대 128,000 토큰, 지식은 2026년 2월까지입니다. apimodels.app에서는 100만 토큰 기준 입력 $0.221, 출력 $1.324이고 캐시된 입력은 $0.022입니다. GPT-5.6 Sol의 20%, OpenAI 공식 가격($1 / $6)의 약 5분의 1로 제품군에서 가장 저렴합니다.
base_url을 https://api.apimodels.app/v1로 바꾸고 model에 gpt-5.6-luna를 넣으면 됩니다. OpenAI 호환인 /v1/chat/completions와 /v1/responses가 모두 동작하고 function calling(tools)도 지원합니다. 한 가지만 유의하세요. 공급자 쪽이 max 추론 등급만 열어 두고 있어 gpt-5.6-luna라는 이름은 같은 가격으로 gpt-5.6-luna-max에 자동 연결됩니다. 키 하나로 모든 모델을 쓰고, 사용한 만큼만 내며, 실패한 요청은 청구되지 않습니다.
입력이 272,000 토큰을 넘는 요청은 그 요청 전체가 입력 $0.442 / 출력 $1.986(입력 2배, 출력 1.5배)로 다시 계산됩니다. 공급자의 구간 정책과 같습니다. 추론 토큰은 출력으로 집계됩니다.
제품군 안에서는 Luna가 가장 저렴합니다. apimodels.app에서 100만 토큰 기준 입력 $0.221 / 출력 $1.324로 Sol과 OpenAI 공식 가격($1 / $6)의 5분의 1이고, 캐시된 입력은 $0.022에 불과합니다. 대량 분류, 추출, 리라이팅, 고객 응대에서 수지가 가장 잘 맞습니다. 추론이 더 필요하면 gpt-5.6-terra나 gpt-5.6-sol로 올리세요. OpenAI 공식 API나 다른 게이트웨이에서 옮겨올 때 코드를 고칠 필요가 없습니다. base_url을 https://api.apimodels.app/v1로 두고 model에 gpt-5.6-luna-max를 넣기만 하면 됩니다. API는 OpenAI 호환이고 실패한 요청은 절대 청구되지 않습니다.
가장 큰 제약은 공급자가 max 추론 등급만 제공한다는 점입니다. 식별자는 gpt-5.6-luna-max를 쓰세요(gpt-5.6-luna는 같은 가격으로 그쪽에 연결됩니다). 그 밖에 요청마다 약 1,450 토큰의 시스템 서두가 붙어 input_tokens가 그 아래로 내려가지 않습니다. parallel_tool_calls: false는 무시되어 모델이 여러 tool_calls를 한 번에 돌려줄 수 있습니다. 입력 272,000 토큰을 넘으면 요청 전체가 다시 계산됩니다. function calling(tools), 스트리밍, /v1/responses는 모두 동작을 확인했습니다.
APIMODELS에서는 GPT-5.6 Luna이(가) 60개가 넘는 모델과 같은 API 키, 같은 잔액 위에 나란히 놓입니다. 그래서 선택은 궁합의 문제이지 종속의 문제가 아닙니다. Cost-Efficient、High-Volume、Fast、1.05M Context을(를) 지원하며 다른 대규모 언어 모델 모델과 가격·성능을 나란히 놓고 따져볼 수 있습니다. 갈아타기는 모델 이름 문자열 하나만 바꾸면 되고 새 계정도 추가 작업도 필요 없습니다. 대규모 언어 모델 선택지와 실시간 가격은 apimodels.app/models에서 볼 수 있습니다.
GPT-5.6 Luna은(는) 다음을 지원합니다: Cost-Efficient、High-Volume、Fast、1.05M Context. 전체 파라미터와 호출 예제는 APIMODELS 문서를 참고하세요.
네. APIMODELS는 GPT-5.6 Luna을(를) 하나의 통합 API와 키 한 개로 제공합니다. 공급자별 계정도 필요 없고, 각 공급자의 지역별 네트워크 경로를 직접 챙길 필요도 없습니다.
Stripe(Visa, Mastercard 등 해외 카드)와 Alipay를 지원합니다. 결제 후 잔액은 즉시 반영됩니다.