
claude-haiku-5-5Claude Haiku 5.5 — модель уровня Haiku в семействе Claude 5.5 от Anthropic, выпущенная 7 октября 2026 года. На APIMODELS она стоит $0.09 за 1M входных и $0.45 за 1M выходных токенов — на 10% ниже официального прайса $0.10 / $0.50, чтение кэша $0.009, запись $0.1125. Anthropic предназначает её для больших объёмов и задач, где важна цена: саммари, сжатие контекста, запросы к базам данных, классификация, субагенты в крупных агентных системах, живая поддержка клиентов и работа в браузере. Бенчмарки Claude Haiku 5.5, опубликованные Anthropic (усилие max, среднее по пяти прогонам), — большой шаг вперёд от Haiku 4.5: GDPval-AA 1620 против 735, управление компьютером OSWorld 2.1 72.4% против 15.7%, Terminal-Bench 4.0 39.2% против 0.0%, Humanity's Last Exam без инструментов 45.9% против 10.2%, Chartography 46.4% против 6.4%. Haiku 5.5 против GPT-6 Luna — модели OpenAI для больших объёмов, которая у нас стоит столько же: везде, где у обеих есть результат, впереди Haiku 5.5 — GDPval-AA 1620 против 1437, AA-Briefcase 1578 против 1336, OSWorld 2.1 72.4% против 48.9%, Terminal-Bench 4.0 39.2% против 16.4%, FrontierCode 1.1 46.4% против 42.4%, Chartography 46.4% против 29.1%; при этом цифры Luna взяты из сравнения Anthropic и сторонних прогонов, а не опубликованы OpenAI. Anthropic прямо пишет, что для сложного агентного программирования лучше подходят Sonnet 5.5 и Opus 5.5. Характеристики: контекст 1M токенов, вывод до 128K, ввод текста и изображений, знания по июнь 2026 года, минимальный кэшируемый промпт — 512 токенов; токенизатор даёт примерно на 30% больше токенов на тот же текст, чем у Haiku 4.5. Как и в прайсе Anthropic, запрос с промптом больше 100 000 токенов тарифицируется по всем ставкам ×5 (ввод $0.45, вывод $2.25). Адаптивное мышление включено по умолчанию, effort — medium (доступно от low до max); отключить мышление можно только при effort high и ниже, budget_tokens отклоняется. Вызов через /v1/messages или OpenAI-совместимый /v1/chat/completions одним ключом; неудачные запросы не оплачиваются.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 за 1M токенов против официальных $0.10 / $0.50; чтение кэша $0.009, запись $0.1125
Anthropic, усилие max: GDPval-AA 1620 (Haiku 4.5: 735), OSWorld 2.1 72.4% (15.7%), Terminal-Bench 4.0 39.2% (0.0%)
Впереди во всех общих тестах: GDPval-AA 1620 против 1437, OSWorld 2.1 72.4% против 48.9%, Terminal-Bench 4.0 39.2% против 16.4%
По Anthropic: саммари, сжатие контекста, классификация, запросы к БД, субагенты, поддержка и работа в браузере
Текст и изображения на входе; знания по июнь 2026; промпт больше 100K — все ставки ×5
Effort от low до max; отключить мышление можно при effort high и ниже; budget_tokens даёт ошибку
Claude Haiku 5.5 — это API категории «языковая модель» от Anthropic. Claude Haiku 5.5 — модель уровня Haiku в семействе Claude 5.5 от Anthropic, выпущенная 7 октября 2026 года. На APIMODELS она стоит $0.09 за 1M входных и $0.45 за 1M выходных токенов — на 10% ниже официального прайса $0.10 / $0.50, чтение кэша $0.009, запись $0.1125. Anthropic предназначает её для больших объёмов и задач, где важна цена: саммари, сжатие контекста, запросы к базам данных, классификация, субагенты в крупных агентных системах, живая поддержка клиентов и работа в браузере. Бенчмарки Claude Haiku 5.5, опубликованные Anthropic (усилие max, среднее по пяти прогонам), — большой шаг вперёд от Haiku 4.5: GDPval-AA 1620 против 735, управление компьютером OSWorld 2.1 72.4% против 15.7%, Terminal-Bench 4.0 39.2% против 0.0%, Humanity's Last Exam без инструментов 45.9% против 10.2%, Chartography 46.4% против 6.4%. Haiku 5.5 против GPT-6 Luna — модели OpenAI для больших объёмов, которая у нас стоит столько же: везде, где у обеих есть результат, впереди Haiku 5.5 — GDPval-AA 1620 против 1437, AA-Briefcase 1578 против 1336, OSWorld 2.1 72.4% против 48.9%, Terminal-Bench 4.0 39.2% против 16.4%, FrontierCode 1.1 46.4% против 42.4%, Chartography 46.4% против 29.1%; при этом цифры Luna взяты из сравнения Anthropic и сторонних прогонов, а не опубликованы OpenAI. Anthropic прямо пишет, что для сложного агентного программирования лучше подходят Sonnet 5.5 и Opus 5.5. Характеристики: контекст 1M токенов, вывод до 128K, ввод текста и изображений, знания по июнь 2026 года, минимальный кэшируемый промпт — 512 токенов; токенизатор даёт примерно на 30% больше токенов на тот же текст, чем у Haiku 4.5. Как и в прайсе Anthropic, запрос с промптом больше 100 000 токенов тарифицируется по всем ставкам ×5 (ввод $0.45, вывод $2.25). Адаптивное мышление включено по умолчанию, effort — medium (доступно от low до max); отключить мышление можно только при effort high и ниже, budget_tokens отклоняется. Вызов через /v1/messages или OpenAI-совместимый /v1/chat/completions одним ключом; неудачные запросы не оплачиваются. Через платформу APIMODELS доступ к этой модели идёт по единому API с прозрачной оплатой по факту использования. Текущая цена: Input: $0.09, Output: $0.45 per 1M tokens.
Диалоговые системы, которые сами отвечают на вопросы пользователей и разгружают поддержку.
Статьи, письма, рекламные тексты и прочее — пишутся автоматически и экономят часы работы.
Писать код, искать ошибки и проводить ревью — разработка идёт быстрее.
Разбирать неструктурированные данные, вытаскивать главное и собирать сводные отчёты.
Claude Haiku 5.5 доступна через APIMODELS по цене: Input: $0.09, Output: $0.45 per 1M tokens. Оплата идёт по факту использования — вы платите только за то, что сгенерировали.
Зарегистрируйтесь на APIMODELS, получите API-ключ и обращайтесь к нашему единому эндпоинту. Есть подробная документация с примерами на cURL, Python и Node.js.
APIMODELS отдаёт ту же самую модель Claude Haiku 5.5 через свою агрегирующую платформу. Мы предоставляем единый интерфейс API, поэтому отдельные аккаунты у каждого поставщика не нужны — один ключ открывает доступ ко всем моделям.
$0.09 за 1M входных токенов и $0.45 за 1M выходных, чтение кэша $0.009, запись в кэш $0.1125 — на 10% ниже прайса Anthropic: $0.10 / $0.50, $0.01 и $0.125. Как и у Anthropic, если промпт одного запроса (новый ввод плюс чтение и запись кэша) превышает 100 000 токенов, все ставки этого запроса умножаются на 5: ввод $0.45, вывод $2.25, чтение кэша $0.045, запись $0.5625 (в прайсе — $0.50 / $2.50 / $0.05 / $0.625). Оплата по фактическим токенам, неудачные запросы бесплатны, абонентской платы нет.
Таблица Anthropic на запуске (усилие max, среднее по пяти прогонам): GDPval-AA v2.1 — 1620 (у Haiku 4.5 — 735), AA-Briefcase v1.1 — 1578 (614), OSWorld 2.1, офлайн-подмножество, управление компьютером — 72.4% (15.7%), Terminal-Bench 4.0 — 39.2% (0.0%), Humanity's Last Exam — 45.9% без инструментов и 57.4% с инструментами (10.2% и 18.7%), FrontierCode 1.1 — 46.4%, Chartography без инструментов — 46.4% (6.4%). В системной карте есть ещё SWE-Bench Pro 64.8. Две оговорки: по умолчанию API работает с усилием medium, и там GDPval-AA равен 1277, а не 1620; в агентном программировании Sonnet 5.5 (Terminal-Bench 4.0 70.6%) по-прежнему заметно сильнее.
Везде, где у обеих моделей есть опубликованный результат, впереди Haiku 5.5: GDPval-AA 1620 против 1437, AA-Briefcase 1578 против 1336, OSWorld 2.1 72.4% против 48.9%, Terminal-Bench 4.0 39.2% против 16.4%, FrontierCode 1.1 46.4% против 42.4%, Chartography 46.4% против 29.1%, PhysicianBench 43.0% против 33.6%. Цифры Luna стоит читать осторожно: ни одна из них не опубликована OpenAI. GDPval-AA и AA-Briefcase прогоняла Artificial Analysis, OSWorld и PhysicianBench — сама Anthropic через API OpenAI, Terminal-Bench взят из публичного рейтинга, FrontierCode прогоняла Cognition, Chartography опубликовала Surge AI. В анонсе OpenAI у Luna один результат — DeepSWE v1.1 66.6%, а у Haiku 5.5 этого теста нет.
На APIMODELS обе стоят $0.09 / $0.45 за 1M токенов, чтение кэша — $0.009, так что выбирать стоит по задаче, а не по цене. Haiku 5.5 — для подзадач агентов, управления компьютером и браузером и офисной аналитики: здесь её отрыв в бенчмарках самый большой. GPT-6 Luna — для промптов от 100K до 272K токенов: Haiku 5.5 считает их по пятикратной ставке, а у Luna надбавка за длинный промпт начинается только после 272K (ввод ×2, вывод ×1.5). Кроме того, Luna принимает reasoning effort none — совсем без рассуждений, а токенизаторы у моделей разные, и один и тот же текст даёт разное число токенов: проверьте на своих промптах. Для сложного агентного кода сама Anthropic советует Sonnet 5.5 (у нас $1.20 / $6.00).
Работают оба варианта: нативный Anthropic POST https://api.apimodels.app/v1/messages или OpenAI-совместимый /v1/chat/completions, с model claude-haiku-5-5 и Authorization: Bearer ваш ключ apimodels. Поддерживаются стриминг, вызов инструментов, изображения на входе и кэширование промптов (cache_control, минимум 512 токенов); в Claude Code и Anthropic SDK достаточно сменить base URL на https://api.apimodels.app и подставить ключ apimodels. При переходе с Haiku 4.5 (у нас $0.353 / $1.765) поменяйте имя модели на claude-haiku-5-5; reasoning_effort в OpenAI-формате переводится в параметр effort Anthropic.
Контекст 1M токенов, до 128K выходных токенов за запрос, ввод текста и изображений, граница знаний — июнь 2026 года. Правила Anthropic для Haiku 5.5: адаптивное мышление включено по умолчанию, effort по умолчанию — medium; отключить мышление (disabled) можно только при effort high и ниже, а budget_tokens возвращает ошибку; temperature зафиксирована на 1, top_p — на 0.99, и другие значения в официальном API Anthropic дают ошибку — наш OpenAI-совместимый эндпоинт просто не передаёт эти параметры, так что обычные клиенты работают без правок; токенизатор даёт примерно на 30% больше токенов на тот же текст, чем у Haiku 4.5.
В APIMODELS Claude Haiku 5.5 соседствует более чем с 60 моделями под одним API-ключом и общим балансом, поэтому выбор — это вопрос соответствия задаче, а не привязки к поставщику. Модель поддерживает 10% Below Official, High Volume, 1M Context, Adaptive Thinking; вы можете сравнить её по цене и возможностям с другими моделями категории «языковая модель» и переключиться, изменив одну строку с именем модели — без нового аккаунта и без переписывания интеграции. Все варианты категории «языковая модель» с актуальными ценами — на apimodels.app/models.
Claude Haiku 5.5 поддерживает: 10% Below Official, High Volume, 1M Context, Adaptive Thinking. Полный список параметров и примеры вызовов — в документации APIMODELS.
Да. APIMODELS отдаёт Claude Haiku 5.5 через единый API и один ключ — отдельные аккаунты у каждого поставщика не нужны, и вам не приходится самостоятельно решать вопросы регионального сетевого доступа к каждому из них.
Принимаем Stripe (Visa, Mastercard и другие международные карты) и Alipay. Баланс становится доступен сразу после оплаты.
How to get access, regional availability, and how this model compares with its alternatives.