
claude-sonnet-5-5Claude Sonnet 5.5 é o segundo modelo da família Claude 5.5 da Anthropic, lançado em 28 de setembro de 2026. No APIMODELS custa $1.20 por 1M de tokens de entrada e $6.00 por 1M de saída, 40% abaixo da lista oficial de $2 / $10, com leituras de cache a $0.12 e gravações a $1.50. A Anthropic o descreve como sua melhor combinação de velocidade e inteligência e como o parceiro mais rápido e econômico do Opus 5.5 para tarefas do dia a dia bem delimitadas: corrigir bugs, ciclos de programação agêntica e documentos, apresentações e planilhas bem acabados. Novidades em relação ao Sonnet 5, segundo a Anthropic: saída mais de 30% mais rápida (o Sonnet mais veloz até agora); bem menos tokens e chamadas de ferramenta para o mesmo trabalho, o que deixa cada tarefa até 30% mais barata; Terminal-Bench 4.0 de 10.3% para 70.6% e CursorBench 4.0 de 34.1% para 55.5%; 1844 no GDPval-AA, dois pontos abaixo do Opus 5.5; 80.1% em uso do computador (OSWorld 2.1) contra 57.0%; escrita mais clara, e é o primeiro Sonnet a zerar Pokémon Red só com capturas de tela. A Anthropic também diz com clareza que o Opus 5.5 continua bem mais forte em trabalho complexo e aberto que exige julgamento contínuo. Especificações: janela de contexto de 1M de tokens, 128K de saída máxima, entrada de texto e imagem e conhecimento confiável até junho de 2026; o tokenizador é o mesmo do Sonnet 5 e o prompt mínimo cacheável é de 512 tokens. O pensamento adaptativo vem ligado com effort high por padrão; thinking não aceita mais disabled e o nível mais baixo, between_tools, desliga o pensamento antecipado. Outras mudanças incompatíveis: uso forçado de ferramenta (tool_choice any ou uma ferramenta específica) e temperature, top_p ou top_k fora do padrão retornam erro, os blocos thinking ficam presos ao modelo e à conversa, e a ferramenta antiga computer_20251124 não é mais aceita. Chame por /v1/messages ou pelo /v1/chat/completions compatível com OpenAI com uma única chave; requisições com falha não são cobradas.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-sonnet-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-sonnet-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-sonnet-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$1.20 / $6.00 por 1M de tokens contra os $2 / $10 de lista; cache: leitura $0.12, gravação $1.50
Anthropic: o Sonnet mais veloz, com menos tokens e chamadas de ferramenta; até 30% menos por tarefa
Anthropic: Terminal-Bench 4.0 70.6% (Sonnet 5: 10.3%), CursorBench 4.0 55.5% (Sonnet 5: 34.1%)
GDPval-AA 1844 contra 1846 do Opus 5.5; uso do computador OSWorld 2.1 80.1% (Sonnet 5: 57.0%)
Entrada de texto e imagens; conhecimento até junho de 2026; mesmo tokenizador do Sonnet 5
O nível mais baixo é between_tools (disabled dá erro); uso forçado de ferramenta dá erro
Claude Sonnet 5.5 é uma API de modelo de linguagem da Anthropic. Claude Sonnet 5.5 é o segundo modelo da família Claude 5.5 da Anthropic, lançado em 28 de setembro de 2026. No APIMODELS custa $1.20 por 1M de tokens de entrada e $6.00 por 1M de saída, 40% abaixo da lista oficial de $2 / $10, com leituras de cache a $0.12 e gravações a $1.50. A Anthropic o descreve como sua melhor combinação de velocidade e inteligência e como o parceiro mais rápido e econômico do Opus 5.5 para tarefas do dia a dia bem delimitadas: corrigir bugs, ciclos de programação agêntica e documentos, apresentações e planilhas bem acabados. Novidades em relação ao Sonnet 5, segundo a Anthropic: saída mais de 30% mais rápida (o Sonnet mais veloz até agora); bem menos tokens e chamadas de ferramenta para o mesmo trabalho, o que deixa cada tarefa até 30% mais barata; Terminal-Bench 4.0 de 10.3% para 70.6% e CursorBench 4.0 de 34.1% para 55.5%; 1844 no GDPval-AA, dois pontos abaixo do Opus 5.5; 80.1% em uso do computador (OSWorld 2.1) contra 57.0%; escrita mais clara, e é o primeiro Sonnet a zerar Pokémon Red só com capturas de tela. A Anthropic também diz com clareza que o Opus 5.5 continua bem mais forte em trabalho complexo e aberto que exige julgamento contínuo. Especificações: janela de contexto de 1M de tokens, 128K de saída máxima, entrada de texto e imagem e conhecimento confiável até junho de 2026; o tokenizador é o mesmo do Sonnet 5 e o prompt mínimo cacheável é de 512 tokens. O pensamento adaptativo vem ligado com effort high por padrão; thinking não aceita mais disabled e o nível mais baixo, between_tools, desliga o pensamento antecipado. Outras mudanças incompatíveis: uso forçado de ferramenta (tool_choice any ou uma ferramenta específica) e temperature, top_p ou top_k fora do padrão retornam erro, os blocos thinking ficam presos ao modelo e à conversa, e a ferramenta antiga computer_20251124 não é mais aceita. Chame por /v1/messages ou pelo /v1/chat/completions compatível com OpenAI com uma única chave; requisições com falha não são cobradas. Pela plataforma APIMODELS, você acessa este modelo por uma API unificada com preços transparentes de pagamento por uso. Preço atual: Input: $1.20, Output: $6.00 per 1M tokens.
Crie sistemas de conversa inteligentes que respondem automaticamente e melhoram a eficiência do atendimento.
Escreva automaticamente artigos, e-mails, textos publicitários e mais para aumentar a produtividade.
Auxilie na escrita, depuração e revisão de código para acelerar o desenvolvimento.
Entenda e analise dados não estruturados, extraia insights e gere resumos.
O Claude Sonnet 5.5 está disponível pela APIMODELS a: Input: $1.20, Output: $6.00 per 1M tokens. A cobrança é por uso — você paga apenas pelo que gera.
Cadastre-se na APIMODELS, obtenha sua chave de API e chame nosso endpoint unificado. Oferecemos documentação detalhada com exemplos em cURL, Python e Node.js.
A APIMODELS oferece o mesmo modelo Claude Sonnet 5.5 pela nossa plataforma de agregação. Fornecemos uma interface de API unificada, então você não precisa de contas separadas por provedor: uma única chave para acessar todos os modelos.
$1.20 por 1M de tokens de entrada e $6.00 por 1M de saída, com leituras de cache a $0.12 e gravações a $1.50. A Anthropic lista $2 / $10, leituras de cache a $0.20 e gravações de 5 minutos a $2.50, então as quatro tarifas ficam 40% abaixo. A cobrança é por token real, requisições com falha são grátis e não há mínimo mensal. Não oferecemos endpoint Batch.
Segundo a Anthropic: gera a saída mais de 30% mais rápido e é o Sonnet mais veloz até agora; precisa de bem menos tokens e chamadas de ferramenta para o mesmo trabalho, então cada tarefa sai até 30% mais barata; dá um salto grande em programação agêntica, com o Terminal-Bench 4.0 indo de 10.3% para 70.6% e o CursorBench 4.0 de 34.1% para 55.5%; em trabalho de conhecimento (GDPval-AA) marca 1844, dois pontos abaixo do Opus 5.5; em uso do computador (OSWorld 2.1) sobe de 57.0% para 80.1%; e escreve com mais clareza, com documentos, apresentações e planilhas entre os pontos fortes. O contexto de 1M e a saída de 128K não mudam, o tokenizador é o mesmo e o prompt mínimo cacheável cai de 1.024 para 512 tokens.
Os dois funcionam: o nativo da Anthropic POST https://api.apimodels.app/v1/messages ou o /v1/chat/completions compatível com OpenAI, com model claude-sonnet-5-5 e Authorization: Bearer sua chave do apimodels. Streaming, chamadas de ferramenta e entrada de imagem são suportados; no Claude Code e no SDK da Anthropic basta trocar a base URL para https://api.apimodels.app e usar sua chave do apimodels. Vindo do Sonnet 5, troque o nome do modelo para claude-sonnet-5-5.
Aqui o Sonnet 5.5 custa $1.20 / $6.00, o Sonnet 5 $1.60 / $8.00 e o Opus 5.5 $2.40 / $12.00. O Sonnet 5.5 fica abaixo do Sonnet 5 na entrada e na saída, além de ser mais rápido e gastar menos tokens por tarefa, então quase não há motivo para começar projetos novos no Sonnet 5. A exceção é o tráfego muito apoiado em cache: o Sonnet 5 lê cache a $0.10 e grava a $1.40, um pouco abaixo dos $0.12 / $1.50 do Sonnet 5.5. O Opus 5.5 custa o dobro e, segundo a Anthropic, continua claramente mais forte em trabalho complexo e aberto que exige julgamento contínuo; para código bem delimitado, correção de bugs e documentos de escritório, o Sonnet 5.5 dá conta.
Marque o prefixo com cache_control, como de costume na Anthropic. Gravar no cache custa $1.50 por 1M de tokens e cada acerto depois custa $0.12, um décimo do preço de entrada de $1.20; o que não estiver em cache paga a tarifa normal de entrada. O prompt mínimo cacheável no Sonnet 5.5 é de 512 tokens, então prefixos menores não são guardados. No nosso teste, três chamadas com o mesmo prefixo geraram uma gravação e dois acertos. O Claude Code coloca as marcações de cache sozinho.
Janela de contexto de 1M de tokens, até 128K tokens de saída por chamada, entrada de texto e imagem e conhecimento até junho de 2026. Regras da Anthropic para o Sonnet 5.5: o pensamento adaptativo vem ligado com effort high por padrão, e thinking não aceita mais disabled (retorna 400) — o nível mais baixo é between_tools; tool_choice any ou apontando uma ferramenta específica retorna erro, então use auto ou none; temperature, top_p ou top_k fora do padrão também dão erro, é melhor não enviá-los; e os blocos thinking ficam presos ao modelo e à conversa, então reenviar um bloco antigo depois de editar mensagens anteriores pode falhar — só acrescente mensagens no fim.
Na APIMODELS, o Claude Sonnet 5.5 roda junto com mais de 60 modelos usando uma única chave de API e um único saldo, então escolher é questão de adequação, não de dependência. Ele suporta 40% Below Official, 30%+ Faster, 1M Context, Agentic Coding e você pode avaliá-lo em preço e capacidade frente a outros modelos de modelo de linguagem, trocando ao alterar uma única string com o nome do modelo — sem nova conta ou integração. Veja todas as opções de modelo de linguagem com preços ao vivo em apimodels.app/models.
O Claude Sonnet 5.5 suporta: 40% Below Official, 30%+ Faster, 1M Context, Agentic Coding. Consulte a documentação da APIMODELS para todos os parâmetros e exemplos de chamada.
Sim. A APIMODELS expõe o Claude Sonnet 5.5 por uma única API unificada e uma só chave, sem contas separadas por provedor e sem precisar lidar com o acesso de rede regional de cada provedor.
Aceitamos Stripe (Visa, Mastercard e outros cartões internacionais) e Alipay. O saldo fica disponível imediatamente após o pagamento.
How to get access, regional availability, and how this model compares with its alternatives.