
claude-haiku-5-5Claude Haiku 5.5는 Anthropic Claude 5.5 제품군의 Haiku 등급 모델로 2026년 10월 7일에 공개되었습니다. APIMODELS에서는 입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.45로 공식 정가 $0.10 / $0.50보다 10% 저렴하며, 캐시 읽기 $0.009, 캐시 쓰기 $0.1125입니다. Anthropic은 이 모델을 대량 처리와 비용이 중요한 작업용으로 내놓았습니다. 요약, 컨텍스트 압축, 데이터베이스 쿼리, 분류, 큰 에이전트 시스템 안의 하위 에이전트, 실시간 고객 상담, 브라우저 사용 등입니다. Anthropic이 공개한 Claude Haiku 5.5 벤치마크(effort max, 5회 평균)는 Haiku 4.5보다 크게 올랐습니다. GDPval-AA 1620 대 735, 컴퓨터 사용 OSWorld 2.1 72.4% 대 15.7%, Terminal-Bench 4.0 39.2% 대 0.0%, Humanity's Last Exam(도구 없이) 45.9% 대 10.2%, Chartography 46.4% 대 6.4%입니다. 여기서 같은 가격인 OpenAI의 대량 처리용 모델 GPT-6 Luna와 비교하면, 둘 다 점수가 있는 항목은 모두 Haiku 5.5가 앞섭니다(GDPval-AA 1620 대 1437, AA-Briefcase 1578 대 1336, OSWorld 2.1 72.4% 대 48.9%, Terminal-Bench 4.0 39.2% 대 16.4%, FrontierCode 1.1 46.4% 대 42.4%, Chartography 46.4% 대 29.1%). 다만 Luna 수치는 Anthropic의 비교와 제3자 측정에서 나온 것이며 OpenAI가 발표한 값이 아닙니다. Anthropic도 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 낫다고 분명히 밝혔습니다. 사양은 컨텍스트 100만 토큰, 최대 출력 128K, 텍스트·이미지 입력, 지식 기준일 2026년 6월, 최소 캐시 프롬프트 512 토큰이며, 토크나이저는 같은 글에서 Haiku 4.5보다 토큰을 약 30% 더 만듭니다. Anthropic 가격표와 마찬가지로 프롬프트가 100,000 토큰을 넘는 요청은 모든 단가가 5배(입력 $0.45, 출력 $2.25)입니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 medium(low~max)입니다. 사고를 끌 수 있는 것은 effort가 high 이하일 때뿐이며 budget_tokens는 거부됩니다. 키 하나로 /v1/messages와 OpenAI 호환 /v1/chat/completions에서 호출할 수 있고 실패한 요청은 과금되지 않습니다.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
100만 토큰당 $0.09 / $0.45(정가 $0.10 / $0.50), 캐시 읽기 $0.009 · 쓰기 $0.1125
Anthropic, effort max: GDPval-AA 1620(Haiku 4.5는 735), OSWorld 2.1 72.4%(15.7%), Terminal-Bench 4.0 39.2%(0.0%)
공통 항목 전부 앞섬: GDPval-AA 1620 대 1437, OSWorld 2.1 72.4% 대 48.9%, Terminal-Bench 4.0 39.2% 대 16.4%
Anthropic: 요약, 컨텍스트 압축, 분류, DB 쿼리, 하위 에이전트, 실시간 상담, 브라우저 사용
텍스트·이미지 입력, 지식 기준일 2026년 6월, 10만 토큰 초과 프롬프트는 모든 단가 5배
effort low~max, effort가 high 이하일 때 사고 끄기 가능, budget_tokens는 오류
Claude Haiku 5.5은(는) Anthropic의 대규모 언어 모델 API입니다. Claude Haiku 5.5는 Anthropic Claude 5.5 제품군의 Haiku 등급 모델로 2026년 10월 7일에 공개되었습니다. APIMODELS에서는 입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.45로 공식 정가 $0.10 / $0.50보다 10% 저렴하며, 캐시 읽기 $0.009, 캐시 쓰기 $0.1125입니다. Anthropic은 이 모델을 대량 처리와 비용이 중요한 작업용으로 내놓았습니다. 요약, 컨텍스트 압축, 데이터베이스 쿼리, 분류, 큰 에이전트 시스템 안의 하위 에이전트, 실시간 고객 상담, 브라우저 사용 등입니다. Anthropic이 공개한 Claude Haiku 5.5 벤치마크(effort max, 5회 평균)는 Haiku 4.5보다 크게 올랐습니다. GDPval-AA 1620 대 735, 컴퓨터 사용 OSWorld 2.1 72.4% 대 15.7%, Terminal-Bench 4.0 39.2% 대 0.0%, Humanity's Last Exam(도구 없이) 45.9% 대 10.2%, Chartography 46.4% 대 6.4%입니다. 여기서 같은 가격인 OpenAI의 대량 처리용 모델 GPT-6 Luna와 비교하면, 둘 다 점수가 있는 항목은 모두 Haiku 5.5가 앞섭니다(GDPval-AA 1620 대 1437, AA-Briefcase 1578 대 1336, OSWorld 2.1 72.4% 대 48.9%, Terminal-Bench 4.0 39.2% 대 16.4%, FrontierCode 1.1 46.4% 대 42.4%, Chartography 46.4% 대 29.1%). 다만 Luna 수치는 Anthropic의 비교와 제3자 측정에서 나온 것이며 OpenAI가 발표한 값이 아닙니다. Anthropic도 복잡한 에이전트 코딩에는 Sonnet 5.5와 Opus 5.5가 더 낫다고 분명히 밝혔습니다. 사양은 컨텍스트 100만 토큰, 최대 출력 128K, 텍스트·이미지 입력, 지식 기준일 2026년 6월, 최소 캐시 프롬프트 512 토큰이며, 토크나이저는 같은 글에서 Haiku 4.5보다 토큰을 약 30% 더 만듭니다. Anthropic 가격표와 마찬가지로 프롬프트가 100,000 토큰을 넘는 요청은 모든 단가가 5배(입력 $0.45, 출력 $2.25)입니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 medium(low~max)입니다. 사고를 끌 수 있는 것은 effort가 high 이하일 때뿐이며 budget_tokens는 거부됩니다. 키 하나로 /v1/messages와 OpenAI 호환 /v1/chat/completions에서 호출할 수 있고 실패한 요청은 과금되지 않습니다. APIMODELS 플랫폼을 거치면 통합 API와 투명한 종량 과금으로 이 모델을 호출할 수 있습니다. 현재 가격: Input: $0.09, Output: $0.45 per 1M tokens.
문의에 자동으로 답하는 대화 시스템을 만들어 응대 효율을 높입니다.
기사와 이메일, 광고 카피 같은 글을 자동으로 써서 작업량을 줄입니다.
코드 작성과 디버깅, 리뷰를 도와 개발 속도를 올립니다.
비정형 데이터를 읽어내 핵심을 뽑고 요약 리포트로 정리합니다.
Claude Haiku 5.5은(는) APIMODELS를 통해 Input: $0.09, Output: $0.45 per 1M tokens에 이용할 수 있습니다. 과금은 종량제라서 생성한 만큼만 냅니다.
APIMODELS에 가입해 API 키를 받고 통합 엔드포인트를 호출하면 됩니다. cURL / Python / Node.js 예제를 담은 상세 문서를 제공합니다.
APIMODELS는 같은 Claude Haiku 5.5을(를) 집약 플랫폼을 통해 제공합니다. API 인터페이스가 통합되어 있어 공급자마다 계정을 만들 필요가 없고, 키 하나로 모든 모델에 닿습니다.
입력 100만 토큰당 $0.09, 출력 100만 토큰당 $0.45이며 캐시 읽기 $0.009, 캐시 쓰기 $0.1125로 Anthropic 정가 $0.10 / $0.50, $0.01, $0.125보다 10% 낮습니다. 공식 가격표와 마찬가지로 한 요청의 프롬프트(새 입력 + 캐시 읽기·쓰기 합계)가 100,000 토큰을 넘으면 그 요청의 모든 단가가 5배가 됩니다. 입력 $0.45, 출력 $2.25, 캐시 읽기 $0.045, 캐시 쓰기 $0.5625이고 정가로는 $0.50 / $2.50 / $0.05 / $0.625입니다. 실제 토큰 수로 과금하고 실패한 요청은 무료이며 월 최소 결제도 없습니다.
Anthropic 출시 표(effort max, 5회 평균) 기준으로 지식 업무 GDPval-AA v2.1 1620(Haiku 4.5는 735), AA-Briefcase v1.1 1578(614), 컴퓨터 사용 OSWorld 2.1 오프라인 세트 72.4%(15.7%), Terminal-Bench 4.0 39.2%(0.0%), Humanity's Last Exam 도구 없이 45.9%·도구 사용 57.4%(10.2%·18.7%), FrontierCode 1.1 46.4%, Chartography(도구 없이) 46.4%(6.4%)입니다. 시스템 카드에는 SWE-Bench Pro 64.8도 있습니다. 주의할 점은 두 가지입니다. API 기본값은 medium effort이고 이 설정에서 GDPval-AA는 1620이 아니라 1277입니다. 그리고 에이전트 코딩에서는 Sonnet 5.5(Terminal-Bench 4.0 70.6%)가 여전히 크게 앞섭니다.
두 모델 모두 공개 점수가 있는 항목에서는 전부 Haiku 5.5가 앞섭니다. GDPval-AA 1620 대 1437, AA-Briefcase 1578 대 1336, OSWorld 2.1 72.4% 대 48.9%, Terminal-Bench 4.0 39.2% 대 16.4%, FrontierCode 1.1 46.4% 대 42.4%, Chartography 46.4% 대 29.1%, PhysicianBench 43.0% 대 33.6%입니다. 다만 Luna 쪽 숫자는 주의해서 봐야 합니다. 모두 OpenAI가 직접 발표한 수치가 아닙니다. GDPval-AA와 AA-Briefcase는 Artificial Analysis가, OSWorld와 PhysicianBench는 Anthropic이 OpenAI API로 측정했고, Terminal-Bench는 공개 리더보드, FrontierCode는 Cognition, Chartography는 Surge AI가 공개한 값입니다. OpenAI 발표문에 실린 Luna 점수는 DeepSWE v1.1 66.6% 하나뿐이며 Haiku 5.5에는 이 항목 점수가 없습니다.
APIMODELS에서는 둘 다 100만 토큰당 $0.09 / $0.45, 캐시 읽기 $0.009라서 정가가 아니라 작업 성격으로 고르면 됩니다. 에이전트 하위 작업, 컴퓨터·브라우저 조작, 지식 업무라면 Haiku 5.5가 맞습니다. 벤치마크 격차가 가장 큰 영역입니다. 프롬프트가 10만~27.2만 토큰이라면 GPT-6 Luna가 낫습니다. Haiku 5.5는 이 구간을 5배로 과금하지만 Luna의 긴 프롬프트 할증은 272K를 넘어야 시작됩니다(입력 2배, 출력 1.5배). Luna는 reasoning effort를 none으로 두어 추론을 완전히 끌 수도 있고, 두 모델은 토크나이저가 달라 같은 글도 토큰 수가 다르니 자신의 프롬프트로 직접 재 보세요. 복잡한 에이전트 코딩에는 Anthropic도 Sonnet 5.5(여기서 $1.20 / $6.00)를 권합니다.
둘 다 됩니다. Anthropic 네이티브 POST https://api.apimodels.app/v1/messages 또는 OpenAI 호환 /v1/chat/completions에 model을 claude-haiku-5-5로, Authorization: Bearer에 apimodels 키를 넣어 보냅니다. 스트리밍, 도구 호출, 이미지 입력, 프롬프트 캐시(cache_control, 최소 512 토큰)를 지원하고, Claude Code와 Anthropic SDK는 base URL을 https://api.apimodels.app로, 키를 apimodels 키로 바꾸기만 하면 됩니다. Haiku 4.5(여기서 $0.353 / $1.765)에서 옮겨 올 때는 모델명만 claude-haiku-5-5로 바꾸면 되고, OpenAI 형식의 reasoning_effort는 Anthropic의 effort로 변환됩니다.
컨텍스트 100만 토큰, 한 번에 최대 128K 토큰 출력, 텍스트와 이미지 입력, 지식 기준일 2026년 6월입니다. Anthropic이 정한 Haiku 5.5 규칙은 이렇습니다. 적응형 사고가 기본으로 켜져 있고 effort 기본값은 medium입니다. thinking을 disabled로 보낼 수 있는 건 effort가 high 이하일 때뿐이며 budget_tokens는 오류를 냅니다. temperature는 1, top_p는 0.99로 고정이라 Anthropic 공식 API에서는 다른 값이 오류가 나지만, 저희 OpenAI 호환 엔드포인트는 이 두 값을 보내지 않으므로 일반 클라이언트는 그대로 동작합니다. 또 같은 글이라도 Haiku 4.5보다 토큰이 약 30% 더 나옵니다.
APIMODELS에서는 Claude Haiku 5.5이(가) 60개가 넘는 모델과 같은 API 키, 같은 잔액 위에 나란히 놓입니다. 그래서 선택은 궁합의 문제이지 종속의 문제가 아닙니다. 10% Below Official、High Volume、1M Context、Adaptive Thinking을(를) 지원하며 다른 대규모 언어 모델 모델과 가격·성능을 나란히 놓고 따져볼 수 있습니다. 갈아타기는 모델 이름 문자열 하나만 바꾸면 되고 새 계정도 추가 작업도 필요 없습니다. 대규모 언어 모델 선택지와 실시간 가격은 apimodels.app/models에서 볼 수 있습니다.
Claude Haiku 5.5은(는) 다음을 지원합니다: 10% Below Official、High Volume、1M Context、Adaptive Thinking. 전체 파라미터와 호출 예제는 APIMODELS 문서를 참고하세요.
네. APIMODELS는 Claude Haiku 5.5을(를) 하나의 통합 API와 키 한 개로 제공합니다. 공급자별 계정도 필요 없고, 각 공급자의 지역별 네트워크 경로를 직접 챙길 필요도 없습니다.
Stripe(Visa, Mastercard 등 해외 카드)와 Alipay를 지원합니다. 결제 후 잔액은 즉시 반영됩니다.
How to get access, regional availability, and how this model compares with its alternatives.