
claude-haiku-5-5O Claude Haiku 5.5 é o nível Haiku da família Claude 5.5 da Anthropic, lançado em 7 de outubro de 2026. No APIMODELS custa $0.09 por 1M de tokens de entrada e $0.45 por 1M de saída, 10% abaixo da lista oficial de $0.10 / $0.50, com leituras de cache a $0.009 e gravações a $0.1125. A Anthropic o direciona para trabalho de grande volume e sensível a custo: resumos, compactação de contexto, consultas a bancos de dados, classificação, subagentes dentro de sistemas de agentes maiores, suporte ao cliente ao vivo e uso de navegador. Os benchmarks do Claude Haiku 5.5 publicados pela Anthropic (esforço max, média de cinco execuções) mostram um grande salto em relação ao Haiku 4.5: GDPval-AA 1620 contra 735, uso do computador no OSWorld 2.1 72.4% contra 15.7%, Terminal-Bench 4.0 39.2% contra 0.0%, Humanity's Last Exam sem ferramentas 45.9% contra 10.2% e Chartography 46.4% contra 6.4%. Haiku 5.5 vs GPT-6 Luna, o modelo de volume da OpenAI que aqui custa o mesmo: o Haiku 5.5 fica à frente em todos os testes em que os dois têm resultado (GDPval-AA 1620 contra 1437, AA-Briefcase 1578 contra 1336, OSWorld 2.1 72.4% contra 48.9%, Terminal-Bench 4.0 39.2% contra 16.4%, FrontierCode 1.1 46.4% contra 42.4%, Chartography 46.4% contra 29.1%), embora os números do Luna venham da comparação da Anthropic e de avaliações de terceiros, não da OpenAI. A Anthropic também diz com clareza que o Sonnet 5.5 e o Opus 5.5 continuam melhores para programação agêntica complexa. Especificações: contexto de 1M de tokens, até 128K de saída, entrada de texto e imagem, conhecimento até junho de 2026 e prompt mínimo armazenável em cache de 512 tokens; o tokenizador gera cerca de 30% mais tokens que o do Haiku 4.5 para o mesmo texto. Assim como na lista da Anthropic, uma requisição cujo prompt passa de 100.000 tokens é cobrada com todas as tarifas ×5 (entrada $0.45, saída $2.25). O pensamento adaptativo vem ligado com effort medium (de low a max); só pode ser desligado com effort high ou abaixo, e budget_tokens é recusado. A chamada é feita por /v1/messages ou pelo /v1/chat/completions compatível com OpenAI com uma única chave, e requisições com falha não são cobradas.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 por 1M de tokens contra os $0.10 / $0.50 de lista; cache: leitura $0.009, gravação $0.1125
Anthropic, esforço max: GDPval-AA 1620 (Haiku 4.5: 735), OSWorld 2.1 72.4% (15.7%), Terminal-Bench 4.0 39.2% (0.0%)
À frente em todos os testes em comum: GDPval-AA 1620 contra 1437, OSWorld 2.1 72.4% contra 48.9%, Terminal-Bench 4.0 39.2% contra 16.4%
Anthropic: resumos, compactação, classificação, consultas a banco de dados, subagentes, suporte ao vivo e navegador
Entrada de texto e imagem; conhecimento até junho de 2026; prompts acima de 100K: todas as tarifas ×5
Effort de low a max; o pensamento pode ser desligado com effort high ou abaixo; budget_tokens dá erro
Claude Haiku 5.5 é uma API de modelo de linguagem da Anthropic. O Claude Haiku 5.5 é o nível Haiku da família Claude 5.5 da Anthropic, lançado em 7 de outubro de 2026. No APIMODELS custa $0.09 por 1M de tokens de entrada e $0.45 por 1M de saída, 10% abaixo da lista oficial de $0.10 / $0.50, com leituras de cache a $0.009 e gravações a $0.1125. A Anthropic o direciona para trabalho de grande volume e sensível a custo: resumos, compactação de contexto, consultas a bancos de dados, classificação, subagentes dentro de sistemas de agentes maiores, suporte ao cliente ao vivo e uso de navegador. Os benchmarks do Claude Haiku 5.5 publicados pela Anthropic (esforço max, média de cinco execuções) mostram um grande salto em relação ao Haiku 4.5: GDPval-AA 1620 contra 735, uso do computador no OSWorld 2.1 72.4% contra 15.7%, Terminal-Bench 4.0 39.2% contra 0.0%, Humanity's Last Exam sem ferramentas 45.9% contra 10.2% e Chartography 46.4% contra 6.4%. Haiku 5.5 vs GPT-6 Luna, o modelo de volume da OpenAI que aqui custa o mesmo: o Haiku 5.5 fica à frente em todos os testes em que os dois têm resultado (GDPval-AA 1620 contra 1437, AA-Briefcase 1578 contra 1336, OSWorld 2.1 72.4% contra 48.9%, Terminal-Bench 4.0 39.2% contra 16.4%, FrontierCode 1.1 46.4% contra 42.4%, Chartography 46.4% contra 29.1%), embora os números do Luna venham da comparação da Anthropic e de avaliações de terceiros, não da OpenAI. A Anthropic também diz com clareza que o Sonnet 5.5 e o Opus 5.5 continuam melhores para programação agêntica complexa. Especificações: contexto de 1M de tokens, até 128K de saída, entrada de texto e imagem, conhecimento até junho de 2026 e prompt mínimo armazenável em cache de 512 tokens; o tokenizador gera cerca de 30% mais tokens que o do Haiku 4.5 para o mesmo texto. Assim como na lista da Anthropic, uma requisição cujo prompt passa de 100.000 tokens é cobrada com todas as tarifas ×5 (entrada $0.45, saída $2.25). O pensamento adaptativo vem ligado com effort medium (de low a max); só pode ser desligado com effort high ou abaixo, e budget_tokens é recusado. A chamada é feita por /v1/messages ou pelo /v1/chat/completions compatível com OpenAI com uma única chave, e requisições com falha não são cobradas. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $0.09, Output: $0.45 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O Claude Haiku 5.5 está disponível pela APIMODELS a: Input: $0.09, Output: $0.45 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Claude Haiku 5.5 pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
$0.09 por 1M de tokens de entrada e $0.45 por 1M de saída, com leituras de cache a $0.009 e gravações a $0.1125: 10% abaixo dos $0.10 / $0.50, $0.01 e $0.125 da lista da Anthropic. Assim como na lista oficial, quando o prompt de uma requisição (entrada nova mais leituras e gravações de cache) passa de 100.000 tokens, todas as tarifas daquela requisição são multiplicadas por 5: entrada $0.45, saída $2.25, leitura de cache $0.045 e gravação $0.5625, contra $0.50 / $2.50 / $0.05 / $0.625 na lista. Você paga por token real, requisições com falha não são cobradas e não há mínimo mensal.
A tabela de lançamento da Anthropic, com esforço max e média de cinco execuções: GDPval-AA v2.1 (trabalho de conhecimento) 1620 (Haiku 4.5: 735), AA-Briefcase v1.1 1578 (614), OSWorld 2.1 subconjunto offline (uso do computador) 72.4% (15.7%), Terminal-Bench 4.0 39.2% (0.0%), Humanity's Last Exam 45.9% sem ferramentas e 57.4% com ferramentas (10.2% e 18.7%), FrontierCode 1.1 46.4% e Chartography sem ferramentas 46.4% (6.4%). O system card acrescenta SWE-Bench Pro 64.8. Duas ressalvas: a API usa esforço medium por padrão, e nele a Anthropic informa GDPval-AA 1277 em vez de 1620; em programação agêntica o Sonnet 5.5 (Terminal-Bench 4.0 70.6%) continua bem à frente.
O Haiku 5.5 fica à frente em todos os testes em que os dois têm resultado publicado: GDPval-AA 1620 contra 1437, AA-Briefcase 1578 contra 1336, OSWorld 2.1 72.4% contra 48.9%, Terminal-Bench 4.0 39.2% contra 16.4%, FrontierCode 1.1 46.4% contra 42.4%, Chartography 46.4% contra 29.1% e PhysicianBench 43.0% contra 33.6%. Leia o lado do Luna com cuidado: nenhum desses números foi publicado pela OpenAI. A Artificial Analysis rodou GDPval-AA e AA-Briefcase, a Anthropic rodou OSWorld e PhysicianBench pela API da OpenAI, o Terminal-Bench vem do ranking público, a Cognition rodou o FrontierCode e a Surge AI publicou o Chartography. O anúncio da OpenAI dá ao Luna um único número, DeepSWE v1.1 66.6%, teste em que o Haiku 5.5 não tem resultado.
No APIMODELS os dois custam $0.09 / $0.45 por 1M de tokens com leituras de cache a $0.009, então a escolha depende da tarefa, não do preço de lista. Escolha o Haiku 5.5 para subtarefas de agentes, uso de computador e navegador e trabalho de conhecimento, onde a vantagem dele nos benchmarks é maior. Escolha o GPT-6 Luna para prompts entre 100K e 272K tokens: o Haiku 5.5 cobra essa faixa a 5×, enquanto o acréscimo do Luna por prompt longo só começa acima de 272K (entrada ×2, saída ×1.5). O Luna também aceita reasoning effort none, sem raciocínio, e os tokenizadores são diferentes, então o mesmo texto não gera o mesmo número de tokens: meça com os seus próprios prompts. Para programação agêntica complexa, a própria Anthropic indica o Sonnet 5.5 ($1.20 / $6.00 aqui).
Os dois funcionam: o nativo da Anthropic POST https://api.apimodels.app/v1/messages ou o /v1/chat/completions compatível com OpenAI, com model claude-haiku-5-5 e Authorization: Bearer sua chave da apimodels. Há suporte a streaming, chamadas de ferramenta, entrada de imagem e cache de prompt (cache_control, mínimo de 512 tokens); no Claude Code e no SDK da Anthropic basta trocar a base URL para https://api.apimodels.app e usar sua chave da apimodels. Vindo do Haiku 4.5 ($0.353 / $1.765 aqui), troque o nome do modelo para claude-haiku-5-5; o reasoning_effort no endpoint da OpenAI é convertido no ajuste effort da Anthropic.
Janela de contexto de 1M de tokens, até 128K tokens de saída por chamada, entrada de texto e imagem e conhecimento até junho de 2026. Regras da Anthropic para o Haiku 5.5: o pensamento adaptativo vem ligado, com effort medium por padrão; o pensamento só pode ser enviado como disabled com effort high ou abaixo, e budget_tokens retorna erro; temperature é fixa em 1 e top_p em 0.99, então outros valores dão erro na API oficial da Anthropic, mas nosso endpoint compatível com OpenAI os omite para que os clientes comuns continuem funcionando; e o tokenizador gera cerca de 30% mais tokens que o Haiku 4.5 para o mesmo texto.
Na APIMODELS, o Claude Haiku 5.5 roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta 10% Below Official, High Volume, 1M Context, Adaptive Thinking e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O Claude Haiku 5.5 suporta: 10% Below Official, High Volume, 1M Context, Adaptive Thinking. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Claude Haiku 5.5 por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.
How to get access, regional availability, and how this model compares with its alternatives.