
claude-sonnet-5-5Claude Sonnet 5.5는 Anthropic Claude 5.5 제품군의 두 번째 모델로 2026년 9월 28일에 공개되었습니다. APIMODELS에서는 입력 100만 토큰당 $1.20, 출력 100만 토큰당 $6.00로 공식 정가 $2 / $10보다 40% 저렴하며, 캐시 읽기 $0.12, 캐시 쓰기 $1.50입니다. Anthropic은 이 모델을 속도와 지능의 가장 좋은 조합이라고 부르며, Opus 5.5를 보완하는 더 빠르고 저렴한 모델로 자리매김합니다. 강점은 범위가 분명한 일상 업무, 버그 수정, 에이전트 코딩 루프, 그리고 완성도 높은 문서, 슬라이드, 스프레드시트입니다. Anthropic이 밝힌 Sonnet 5 대비 변화는 다음과 같습니다. 출력 속도가 30% 이상 빨라져 지금까지 가장 빠른 Sonnet이 되었고, 같은 작업에 쓰는 토큰과 도구 호출이 크게 줄어 작업당 비용이 최대 30% 낮아졌습니다. Terminal-Bench 4.0은 10.3%에서 70.6%로, CursorBench 4.0은 34.1%에서 55.5%로 올랐고, GDPval-AA는 1844점으로 Opus 5.5보다 2점 낮을 뿐이며, 컴퓨터 사용 OSWorld 2.1은 57.0%에서 80.1%가 되었습니다. 글은 더 명확해졌고, 스크린샷만으로 포켓몬스터 레드를 클리어한 첫 Sonnet이기도 합니다. 다만 오래 판단해야 하는 복잡하고 열린 작업에서는 Opus 5.5가 확실히 강하다고 Anthropic이 직접 밝히고 있습니다. 사양은 100만 토큰 컨텍스트, 최대 출력 128K, 텍스트와 이미지 입력, 신뢰할 수 있는 지식 기준일 2026년 6월입니다. 토크나이저는 Sonnet 5와 같고 캐시 가능한 최소 프롬프트는 512 토큰입니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 high입니다. thinking에 disabled를 보낼 수 없게 되었고, 가장 낮은 설정인 between_tools가 사전 사고를 끕니다. 그 밖의 호환성 깨짐 변경으로, 강제 도구 사용(tool_choice any 또는 특정 도구 지정)과 기본값이 아닌 temperature, top_p, top_k는 오류를 반환하고, thinking 블록은 모델과 대화에 묶이며, 이전 computer_20251124 도구는 받지 않습니다. /v1/messages 또는 OpenAI 호환 /v1/chat/completions로 키 하나로 호출하며, 실패한 요청은 과금되지 않습니다.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-sonnet-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-sonnet-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
100만 토큰당 $1.20 / $6.00, 공식 정가는 $2 / $10. 캐시 읽기 $0.12, 쓰기 $1.50
Anthropic: 역대 가장 빠른 Sonnet. 토큰과 도구 호출이 줄어 작업당 최대 30% 저렴
Anthropic: Terminal-Bench 4.0 70.6%(Sonnet 5는 10.3%), CursorBench 4.0 55.5%(Sonnet 5는 34.1%)
GDPval-AA 1844, Opus 5.5는 1846. 컴퓨터 사용 OSWorld 2.1 80.1%(Sonnet 5는 57.0%)
텍스트와 이미지 입력. 지식 기준일 2026년 6월. 토크나이저는 Sonnet 5와 동일
가장 낮은 설정은 between_tools(disabled는 오류). 강제 도구 사용도 오류
Claude Sonnet 5.5은(는) Anthropic의 대규모 언어 모델 API입니다. Claude Sonnet 5.5는 Anthropic Claude 5.5 제품군의 두 번째 모델로 2026년 9월 28일에 공개되었습니다. APIMODELS에서는 입력 100만 토큰당 $1.20, 출력 100만 토큰당 $6.00로 공식 정가 $2 / $10보다 40% 저렴하며, 캐시 읽기 $0.12, 캐시 쓰기 $1.50입니다. Anthropic은 이 모델을 속도와 지능의 가장 좋은 조합이라고 부르며, Opus 5.5를 보완하는 더 빠르고 저렴한 모델로 자리매김합니다. 강점은 범위가 분명한 일상 업무, 버그 수정, 에이전트 코딩 루프, 그리고 완성도 높은 문서, 슬라이드, 스프레드시트입니다. Anthropic이 밝힌 Sonnet 5 대비 변화는 다음과 같습니다. 출력 속도가 30% 이상 빨라져 지금까지 가장 빠른 Sonnet이 되었고, 같은 작업에 쓰는 토큰과 도구 호출이 크게 줄어 작업당 비용이 최대 30% 낮아졌습니다. Terminal-Bench 4.0은 10.3%에서 70.6%로, CursorBench 4.0은 34.1%에서 55.5%로 올랐고, GDPval-AA는 1844점으로 Opus 5.5보다 2점 낮을 뿐이며, 컴퓨터 사용 OSWorld 2.1은 57.0%에서 80.1%가 되었습니다. 글은 더 명확해졌고, 스크린샷만으로 포켓몬스터 레드를 클리어한 첫 Sonnet이기도 합니다. 다만 오래 판단해야 하는 복잡하고 열린 작업에서는 Opus 5.5가 확실히 강하다고 Anthropic이 직접 밝히고 있습니다. 사양은 100만 토큰 컨텍스트, 최대 출력 128K, 텍스트와 이미지 입력, 신뢰할 수 있는 지식 기준일 2026년 6월입니다. 토크나이저는 Sonnet 5와 같고 캐시 가능한 최소 프롬프트는 512 토큰입니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 high입니다. thinking에 disabled를 보낼 수 없게 되었고, 가장 낮은 설정인 between_tools가 사전 사고를 끕니다. 그 밖의 호환성 깨짐 변경으로, 강제 도구 사용(tool_choice any 또는 특정 도구 지정)과 기본값이 아닌 temperature, top_p, top_k는 오류를 반환하고, thinking 블록은 모델과 대화에 묶이며, 이전 computer_20251124 도구는 받지 않습니다. /v1/messages 또는 OpenAI 호환 /v1/chat/completions로 키 하나로 호출하며, 실패한 요청은 과금되지 않습니다. APIMODELS 플랫폼을 거치면 통합 API와 투명한 종량 과금으로 이 모델을 호출할 수 있습니다. 현재 가격: Input: $1.20, Output: $6.00 per 1M tokens.
문의에 자동으로 답하는 대화 시스템을 만들어 응대 효율을 높입니다.
기사와 이메일, 광고 카피 같은 글을 자동으로 써서 작업량을 줄입니다.
코드 작성과 디버깅, 리뷰를 도와 개발 속도를 올립니다.
비정형 데이터를 읽어내 핵심을 뽑고 요약 리포트로 정리합니다.
Claude Sonnet 5.5은(는) APIMODELS를 통해 Input: $1.20, Output: $6.00 per 1M tokens에 이용할 수 있습니다. 과금은 종량제라서 생성한 만큼만 냅니다.
APIMODELS에 가입해 API 키를 받고 통합 엔드포인트를 호출하면 됩니다. cURL / Python / Node.js 예제를 담은 상세 문서를 제공합니다.
APIMODELS는 같은 Claude Sonnet 5.5을(를) 집약 플랫폼을 통해 제공합니다. API 인터페이스가 통합되어 있어 공급자마다 계정을 만들 필요가 없고, 키 하나로 모든 모델에 닿습니다.
입력 100만 토큰당 $1.20, 출력 100만 토큰당 $6.00이며 캐시 읽기 $0.12, 캐시 쓰기 $1.50입니다. Anthropic 정가는 $2 / $10, 캐시 읽기 $0.20, 5분 캐시 쓰기 $2.50이라 네 항목 모두 40% 저렴합니다. 실제 토큰 수로 과금하고 실패한 요청은 무료이며 월 최소 결제도 없습니다. Batch API는 제공하지 않습니다.
Anthropic 발표에 따르면 출력 속도가 30% 이상 빨라져 지금까지 가장 빠른 Sonnet이 되었습니다. 같은 작업에 쓰는 토큰과 도구 호출이 크게 줄어 작업당 비용은 최대 30% 낮아집니다. 에이전트 코딩이 크게 좋아져 Terminal-Bench 4.0은 10.3%에서 70.6%로, CursorBench 4.0은 34.1%에서 55.5%로 올랐습니다. 실무형 지식 작업인 GDPval-AA는 1844점으로 Opus 5.5보다 2점 낮을 뿐이고, 컴퓨터 사용 OSWorld 2.1은 57.0%에서 80.1%로 올랐습니다. 글도 더 명확해졌고 문서, 슬라이드, 스프레드시트 작성이 강점으로 꼽힙니다. 컨텍스트 100만, 출력 128K는 그대로이고 토크나이저도 같으며, 캐시 가능한 최소 프롬프트는 1,024에서 512 토큰으로 낮아졌습니다.
둘 다 됩니다. Anthropic 네이티브 POST https://api.apimodels.app/v1/messages 또는 OpenAI 호환 /v1/chat/completions에 model을 claude-sonnet-5-5로, Authorization: Bearer에 apimodels 키를 넣어 보냅니다. 스트리밍, 도구 호출, 이미지 입력을 지원하고, Claude Code와 Anthropic SDK는 base URL을 https://api.apimodels.app로 바꾸고 apimodels 키를 쓰면 됩니다. Sonnet 5에서 옮길 때는 모델 이름만 claude-sonnet-5-5로 바꾸면 됩니다.
여기서는 Sonnet 5.5가 $1.20 / $6.00, Sonnet 5가 $1.60 / $8.00, Opus 5.5가 $2.40 / $12.00입니다. Sonnet 5.5는 입력과 출력 모두 Sonnet 5보다 싸고, 더 빠르며 작업당 토큰도 적게 쓰므로 새 프로젝트를 굳이 Sonnet 5로 시작할 이유는 거의 없습니다. 예외는 캐시 비중이 아주 큰 트래픽으로, Sonnet 5의 캐시 읽기 $0.10, 쓰기 $1.40이 Sonnet 5.5의 $0.12 / $1.50보다 조금 낮습니다. Opus 5.5는 두 배 가격이고, Anthropic도 오래 판단해야 하는 복잡하고 열린 작업에서는 Opus 5.5가 확실히 강하다고 말합니다. 범위가 분명한 코딩, 버그 수정, 사무 문서에는 Sonnet 5.5면 충분합니다.
평소처럼 Anthropic의 cache_control로 접두부를 표시하면 됩니다. 캐시 쓰기는 100만 토큰당 $1.50, 이후 적중은 $0.12로 입력 단가 $1.20의 10분의 1입니다. 캐시되지 않은 부분은 일반 입력 단가로 과금됩니다. Sonnet 5.5에서 캐시할 수 있는 최소 프롬프트는 512 토큰이라 그보다 짧은 접두부는 캐시되지 않습니다. 같은 접두부로 세 번 보낸 저희 테스트에서는 쓰기 1회, 적중 2회였습니다. Claude Code는 캐시 표시를 자동으로 붙입니다.
컨텍스트 100만 토큰, 한 번에 최대 128K 토큰 출력, 텍스트와 이미지 입력, 지식 기준일 2026년 6월입니다. Anthropic이 정한 Sonnet 5.5 규칙은 이렇습니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 high이며, thinking에 disabled를 보낼 수 없습니다(400 반환). 가장 낮은 설정은 between_tools입니다. tool_choice를 any나 특정 도구로 지정하면 오류가 나므로 auto나 none을 쓰세요. temperature, top_p, top_k를 기본값이 아닌 값으로 보내도 오류가 나니 보내지 마세요. thinking 블록은 모델과 대화에 묶여 있어 이전 메시지를 수정한 뒤 옛 thinking 블록을 다시 보내면 실패할 수 있으니, 대화는 뒤에 덧붙이기만 하세요.
APIMODELS에서는 Claude Sonnet 5.5이(가) 60개가 넘는 모델과 같은 API 키, 같은 잔액 위에 나란히 놓입니다. 그래서 선택은 궁합의 문제이지 종속의 문제가 아닙니다. 40% Below Official、30%+ Faster、1M Context、Agentic Coding을(를) 지원하며 다른 대규모 언어 모델 모델과 가격·성능을 나란히 놓고 따져볼 수 있습니다. 갈아타기는 모델 이름 문자열 하나만 바꾸면 되고 새 계정도 추가 작업도 필요 없습니다. 대규모 언어 모델 선택지와 실시간 가격은 apimodels.app/models에서 볼 수 있습니다.
Claude Sonnet 5.5은(는) 다음을 지원합니다: 40% Below Official、30%+ Faster、1M Context、Agentic Coding. 전체 파라미터와 호출 예제는 APIMODELS 문서를 참고하세요.
네. APIMODELS는 Claude Sonnet 5.5을(를) 하나의 통합 API와 키 한 개로 제공합니다. 공급자별 계정도 필요 없고, 각 공급자의 지역별 네트워크 경로를 직접 챙길 필요도 없습니다.
Stripe(Visa, Mastercard 등 해외 카드)와 Alipay를 지원합니다. 결제 후 잔액은 즉시 반영됩니다.
How to get access, regional availability, and how this model compares with its alternatives.