
claude-haiku-5-5Claude Haiku 5.5 es el nivel Haiku de la familia Claude 5.5 de Anthropic, publicado el 7 de octubre de 2026. En APIMODELS cuesta $0.09 por 1M de tokens de entrada y $0.45 por 1M de salida, un 10% por debajo de la lista oficial de $0.10 / $0.50, con lecturas de caché a $0.009 y escrituras a $0.1125. Anthropic lo orienta a trabajo de gran volumen y sensible al coste: resúmenes, compactación de contexto, consultas a bases de datos, clasificación, subagentes dentro de sistemas de agentes más grandes, soporte al cliente en vivo y uso del navegador. Los benchmarks de Claude Haiku 5.5 que publicó Anthropic (esfuerzo max, media de cinco ejecuciones) suponen un gran salto respecto a Haiku 4.5: GDPval-AA 1620 frente a 735, uso del ordenador en OSWorld 2.1 72.4% frente a 15.7%, Terminal-Bench 4.0 39.2% frente a 0.0%, Humanity's Last Exam sin herramientas 45.9% frente a 10.2% y Chartography 46.4% frente a 6.4%. Haiku 5.5 vs GPT-6 Luna, el modelo de volumen de OpenAI que aquí cuesta lo mismo: Haiku 5.5 va por delante en todas las pruebas donde ambos tienen resultado (GDPval-AA 1620 frente a 1437, AA-Briefcase 1578 frente a 1336, OSWorld 2.1 72.4% frente a 48.9%, Terminal-Bench 4.0 39.2% frente a 16.4%, FrontierCode 1.1 46.4% frente a 42.4%, Chartography 46.4% frente a 29.1%), aunque las cifras de Luna proceden de la comparación de Anthropic y de evaluaciones de terceros, no de OpenAI. Anthropic también dice sin rodeos que Sonnet 5.5 y Opus 5.5 siguen siendo mejores para la programación agéntica compleja. Especificaciones: contexto de 1M de tokens, hasta 128K de salida, entrada de texto e imágenes, conocimiento hasta junio de 2026 y un prompt mínimo cacheable de 512 tokens; el tokenizador produce alrededor de un 30% más de tokens que el de Haiku 4.5 para el mismo texto. Igual que en la lista de Anthropic, una petición cuyo prompt supera los 100.000 tokens se cobra con todas las tarifas ×5 (entrada $0.45, salida $2.25). El pensamiento adaptativo viene activado con effort medium (de low a max); solo se puede desactivar con effort high o inferior, y budget_tokens se rechaza. Se llama por /v1/messages o por /v1/chat/completions compatible con OpenAI con una sola clave, y las peticiones fallidas no se cobran.
View complete API reference with all parameters and examples.
Enable real-time streaming responses with Server-Sent Events.
{
"model": "claude-haiku-5-5",
"stream": true,
"max_tokens": 1024,
"messages": [...]
}Enable Claude to use tools and call functions.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"name": "get_weather",
"description": "Get current weather for a location",
"input_schema": {
"type": "object",
"properties": {
"location": {"type": "string", "description": "City name"}
},
"required": ["location"]
}
}],
"tool_choice": {"type": "auto"},
"messages": [{"role": "user", "content": "What's the weather in Tokyo?"}]
}Analyze PDF documents by sending them as base64 encoded content.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{
"role": "user",
"content": [{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "<base64_encoded_pdf>"
}
}, {
"type": "text",
"text": "Summarize this document."
}]
}]
}Get structured JSON responses that match your schema.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"output_format": {
"type": "json_schema",
"schema": {
"type": "object",
"properties": {
"name": {"type": "string"},
"age": {"type": "integer"}
},
"required": ["name", "age"]
}
},
"messages": [{"role": "user", "content": "Extract info: John is 30 years old"}]
}Enable Claude to search the web for up-to-date information.
{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"tools": [{
"type": "web_search_20250305",
"name": "web_search",
"max_uses": 5
}],
"messages": [{"role": "user", "content": "What's the latest news about AI?"}]
}| Parameter | Type | Required | Description |
|---|---|---|---|
| model | string | Yes | Model identifier (e.g., claude-haiku-5-5) |
| messages | array | Yes | Array of message objects with role and content |
| max_tokens | integer | Yes | Maximum tokens in the response (1 - 128000) |
| system | string | No | System prompt to set context |
| stream | boolean | No | Enable streaming responses (SSE) |
| temperature | number | No | Sampling temperature (0.0 - 1.0) |
| top_p | number | No | Nucleus sampling threshold (0.0 - 1.0) |
| top_k | integer | No | Top-k sampling (0 - infinity) |
| stop_sequences | array | No | Sequences that stop generation |
| tools | array | No | Function calling tools definition |
| tool_choice | object | No | Tool selection strategy (auto/any/tool) |
| thinking | object | No | Enable extended thinking mode |
| output_format | object | No | Structured output with JSON schema |
View complete API reference with streaming, thinking, and more.
Billing: Cost = (input_tokens * input_price + output_tokens * output_price) / 1,000,000
$0.09 / $0.45 por 1M de tokens frente a los $0.10 / $0.50 de lista; caché: lectura $0.009, escritura $0.1125
Anthropic, esfuerzo max: GDPval-AA 1620 (Haiku 4.5: 735), OSWorld 2.1 72.4% (15.7%), Terminal-Bench 4.0 39.2% (0.0%)
Por delante en todas las pruebas comunes: GDPval-AA 1620 frente a 1437, OSWorld 2.1 72.4% frente a 48.9%, Terminal-Bench 4.0 39.2% frente a 16.4%
Anthropic: resúmenes, compactación, clasificación, consultas a bases de datos, subagentes, soporte en vivo y navegador
Entrada de texto e imágenes; conocimiento hasta junio de 2026; prompts de más de 100K: todas las tarifas ×5
Effort de low a max; el pensamiento se puede desactivar con effort high o inferior; budget_tokens da error
Claude Haiku 5.5 es una API de modelo de lenguaje de Anthropic. Claude Haiku 5.5 es el nivel Haiku de la familia Claude 5.5 de Anthropic, publicado el 7 de octubre de 2026. En APIMODELS cuesta $0.09 por 1M de tokens de entrada y $0.45 por 1M de salida, un 10% por debajo de la lista oficial de $0.10 / $0.50, con lecturas de caché a $0.009 y escrituras a $0.1125. Anthropic lo orienta a trabajo de gran volumen y sensible al coste: resúmenes, compactación de contexto, consultas a bases de datos, clasificación, subagentes dentro de sistemas de agentes más grandes, soporte al cliente en vivo y uso del navegador. Los benchmarks de Claude Haiku 5.5 que publicó Anthropic (esfuerzo max, media de cinco ejecuciones) suponen un gran salto respecto a Haiku 4.5: GDPval-AA 1620 frente a 735, uso del ordenador en OSWorld 2.1 72.4% frente a 15.7%, Terminal-Bench 4.0 39.2% frente a 0.0%, Humanity's Last Exam sin herramientas 45.9% frente a 10.2% y Chartography 46.4% frente a 6.4%. Haiku 5.5 vs GPT-6 Luna, el modelo de volumen de OpenAI que aquí cuesta lo mismo: Haiku 5.5 va por delante en todas las pruebas donde ambos tienen resultado (GDPval-AA 1620 frente a 1437, AA-Briefcase 1578 frente a 1336, OSWorld 2.1 72.4% frente a 48.9%, Terminal-Bench 4.0 39.2% frente a 16.4%, FrontierCode 1.1 46.4% frente a 42.4%, Chartography 46.4% frente a 29.1%), aunque las cifras de Luna proceden de la comparación de Anthropic y de evaluaciones de terceros, no de OpenAI. Anthropic también dice sin rodeos que Sonnet 5.5 y Opus 5.5 siguen siendo mejores para la programación agéntica compleja. Especificaciones: contexto de 1M de tokens, hasta 128K de salida, entrada de texto e imágenes, conocimiento hasta junio de 2026 y un prompt mínimo cacheable de 512 tokens; el tokenizador produce alrededor de un 30% más de tokens que el de Haiku 4.5 para el mismo texto. Igual que en la lista de Anthropic, una petición cuyo prompt supera los 100.000 tokens se cobra con todas las tarifas ×5 (entrada $0.45, salida $2.25). El pensamiento adaptativo viene activado con effort medium (de low a max); solo se puede desactivar con effort high o inferior, y budget_tokens se rechaza. Se llama por /v1/messages o por /v1/chat/completions compatible con OpenAI con una sola clave, y las peticiones fallidas no se cobran. A través de la plataforma APIMODELS puedes acceder a este modelo mediante una API unificada con precios de pago por uso transparentes. Precio actual: Input: $0.09, Output: $0.45 per 1M tokens.
Crea sistemas conversacionales inteligentes que responden automáticamente y mejoran la eficiencia del servicio.
Redacta automáticamente artículos, correos, textos publicitarios y más para aumentar la productividad.
Apoya la escritura, depuración y revisión de código para acelerar el desarrollo.
Comprende y analiza datos no estructurados, extrae información clave y genera resúmenes.
Claude Haiku 5.5 está disponible a través de APIMODELS a: Input: $0.09, Output: $0.45 per 1M tokens. La facturación es de pago por uso: solo pagas por lo que generas.
Regístrate en APIMODELS, obtén tu clave API y llama a nuestro endpoint unificado. Ofrecemos documentación detallada con ejemplos en cURL, Python y Node.js.
APIMODELS ofrece el mismo modelo Claude Haiku 5.5 a través de nuestra plataforma de agregación. Proporcionamos una interfaz de API unificada, así que no necesitas cuentas separadas por proveedor: una sola clave para acceder a todos los modelos.
$0.09 por 1M de tokens de entrada y $0.45 por 1M de salida, con lecturas de caché a $0.009 y escrituras a $0.1125: un 10% por debajo de los $0.10 / $0.50, $0.01 y $0.125 de la lista de Anthropic. Igual que en la lista oficial, si el prompt de una petición (entrada nueva más lecturas y escrituras de caché) supera los 100.000 tokens, todas las tarifas de esa petición se multiplican por 5: entrada $0.45, salida $2.25, lectura de caché $0.045 y escritura $0.5625, frente a $0.50 / $2.50 / $0.05 / $0.625 de lista. Pagas por token real, las peticiones fallidas no se cobran y no hay mínimo mensual.
La tabla de lanzamiento de Anthropic, con esfuerzo max y media de cinco ejecuciones: GDPval-AA v2.1 (trabajo de conocimiento) 1620 (Haiku 4.5: 735), AA-Briefcase v1.1 1578 (614), OSWorld 2.1 subconjunto offline (uso del ordenador) 72.4% (15.7%), Terminal-Bench 4.0 39.2% (0.0%), Humanity's Last Exam 45.9% sin herramientas y 57.4% con herramientas (10.2% y 18.7%), FrontierCode 1.1 46.4% y Chartography sin herramientas 46.4% (6.4%). La ficha del sistema añade SWE-Bench Pro 64.8. Dos matices: la API usa por defecto esfuerzo medium, donde Anthropic da GDPval-AA 1277 en vez de 1620, y en programación agéntica Sonnet 5.5 (Terminal-Bench 4.0 70.6%) sigue claramente por delante.
Haiku 5.5 va por delante en todas las pruebas donde ambos tienen resultado publicado: GDPval-AA 1620 frente a 1437, AA-Briefcase 1578 frente a 1336, OSWorld 2.1 72.4% frente a 48.9%, Terminal-Bench 4.0 39.2% frente a 16.4%, FrontierCode 1.1 46.4% frente a 42.4%, Chartography 46.4% frente a 29.1% y PhysicianBench 43.0% frente a 33.6%. Conviene leer con cuidado el lado de Luna: ninguna de esas cifras la publicó OpenAI. Artificial Analysis ejecutó GDPval-AA y AA-Briefcase, Anthropic ejecutó OSWorld y PhysicianBench a través de la API de OpenAI, Terminal-Bench sale del ranking público, Cognition ejecutó FrontierCode y Surge AI publicó Chartography. El anuncio de OpenAI da a Luna una sola cifra, DeepSWE v1.1 66.6%, prueba en la que Haiku 5.5 no tiene resultado.
En APIMODELS ambos cuestan $0.09 / $0.45 por 1M de tokens con lecturas de caché a $0.009, así que la elección depende de la tarea, no del precio de lista. Elige Haiku 5.5 para subtareas de agentes, uso del ordenador y del navegador y trabajo de conocimiento, donde su ventaja en benchmarks es mayor. Elige GPT-6 Luna para prompts de entre 100K y 272K tokens: Haiku 5.5 los cobra a 5×, mientras que el recargo de Luna por prompt largo solo empieza por encima de 272K (entrada ×2, salida ×1.5). Luna además acepta reasoning effort none, sin razonamiento, y los tokenizadores son distintos, así que el mismo texto no da el mismo número de tokens: mídelo con tus propios prompts. Para programación agéntica compleja, la propia Anthropic recomienda Sonnet 5.5 ($1.20 / $6.00 aquí).
Ambos funcionan: el nativo de Anthropic POST https://api.apimodels.app/v1/messages o el /v1/chat/completions compatible con OpenAI, con model claude-haiku-5-5 y Authorization: Bearer tu clave de apimodels. Admite streaming, llamadas a herramientas, entrada de imagen y caché de prompts (cache_control, mínimo 512 tokens); en Claude Code y el SDK de Anthropic basta con cambiar la base URL a https://api.apimodels.app y usar tu clave de apimodels. Si vienes de Haiku 4.5 ($0.353 / $1.765 aquí), cambia el nombre del modelo a claude-haiku-5-5; reasoning_effort en el endpoint de OpenAI se traduce al ajuste effort de Anthropic.
Ventana de contexto de 1M de tokens, hasta 128K tokens de salida por llamada, entrada de texto e imágenes y conocimiento hasta junio de 2026. Reglas de Anthropic para Haiku 5.5: el pensamiento adaptativo viene activado con effort medium por defecto; el pensamiento solo se puede enviar como disabled con effort high o inferior, y budget_tokens devuelve error; temperature está fijada en 1 y top_p en 0.99, así que otros valores dan error en la API oficial de Anthropic, aunque nuestro endpoint compatible con OpenAI los omite para que los clientes habituales sigan funcionando; y el tokenizador genera alrededor de un 30% más de tokens que Haiku 4.5 para el mismo texto.
En APIMODELS, Claude Haiku 5.5 convive con más de 60 modelos bajo una sola clave API y un solo saldo, así que elegir es cuestión de ajuste, no de dependencia. Admite 10% Below Official, High Volume, 1M Context, Adaptive Thinking y puedes valorarlo en precio y capacidad frente a otros modelos de modelo de lenguaje, y cambiar modificando una sola cadena con el nombre del modelo: sin nueva cuenta ni integración. Explora todas las opciones de modelo de lenguaje con precios en vivo en apimodels.app/models.
Claude Haiku 5.5 admite: 10% Below Official, High Volume, 1M Context, Adaptive Thinking. Consulta la documentación de APIMODELS para ver todos los parámetros y ejemplos de llamada.
Sí. APIMODELS expone Claude Haiku 5.5 mediante una única API unificada y una sola clave, sin cuentas separadas por proveedor ni necesidad de gestionar tú mismo el acceso de red regional de cada proveedor.
Aceptamos Stripe (Visa, Mastercard y otras tarjetas internacionales) y Alipay. El saldo está disponible al instante tras el pago.
How to get access, regional availability, and how this model compares with its alternatives.