TL;DR Crea un subagente propio con
model: haikuy solo las herramientas que necesita. El mío arranca en 8K tokens por petición y paga la tarifa baja de Haiku 5.5, un 90% menos que Haiku 4.5. Mi sesión principal en Haiku arranca en 51K, a medio camino del escalón de 100K donde el descuento baja al 50%.
Claude Haiku 5.5 (claude-haiku-5-5) salió el 7 de octubre de 2026 y desde la v2.1.293 es lo que responde cuando Claude Code pide haiku en la API de Anthropic. Cuesta $0,10/$0,50 por MTok frente a los $1/$5 de Haiku 4.5, pero solo mientras el prompt no pase de 100K tokens. Por encima, $0,50/$2,50. En Claude Code ese escalón decide dónde te ahorras el 90% y dónde solo la mitad.
Qué trae
| Prueba | Haiku 5.5 | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 39,2% | 0,0% | 70,6% |
| OSWorld 2.1 (computer use) | 72,4% | 15,7% | 83,9% |
| Humanity's Last Exam (con herramientas) | 57,4% | 18,7% | 64,5% |
Son las cifras de Anthropic, no mías. No llega a Sonnet 5.5, pero el salto desde Haiku 4.5 es enorme, sobre todo en agentic coding. Además es el primer Haiku con effort ajustable (de low a max, medium por defecto), tiene 1M de contexto y, según Anthropic, es su modelo más rápido hasta hoy. Ellos mismos lo colocan "as a subagent on coding work", al lado de Opus 5.5 y Sonnet 5.5.
El precio tiene un escalón en 100K
| Por MTok | Haiku 5.5 (hasta 100K) | Haiku 5.5 (más de 100K) | Haiku 4.5 |
|---|---|---|---|
| Entrada | $0,10 | $0,50 | $1 |
| Salida | $0,50 | $2,50 | $5 |
| Escritura de caché (1 h) | $0,20 | $1 | $2 |
| Lectura de caché | $0,01 | $0,05 | $0,10 |
El escalón se mide por petición, según el tamaño del prompt. Y en Claude Code cada petición lleva el system prompt, las herramientas, tu CLAUDE.md y toda la conversación hasta ese momento.
Cuánto pesa una petición en Claude Code
Lo medí en este mismo repo con la v2.1.293. Primero, la sesión principal en Haiku con una pregunta de una palabra:
claude -p --model haiku --output-format json "Reply with the single word OK"
Después, otra sesión igual, esta vez delegando una búsqueda en el subagente finder que tienes más abajo: Haiku y tres herramientas. Los tamaños por petición, leídos de los transcripts:
sesión principal (Haiku 5.5) 51.059 tokens por petición
subagente finder (Haiku 5.5) 8.097 tokens por petición
La sesión principal llega a la mitad del escalón antes de hacer nada. En cuanto lees unos cuantos archivos, la conversación pasa de 100K y pagas la tarifa alta. Sigue saliendo a mitad de precio que Haiku 4.5, pero ya no a una décima parte.
El subagente arranca con su propio contexto, sin tu conversación, y con solo las herramientas que le diste. Ahí cabe mucho trabajo antes de rozar los 100K.
Un detalle más: Haiku 5.5 cuenta más tokens que Haiku 4.5 para el mismo texto. La misma pregunta, desde la misma carpeta, me dio 47.311 tokens en Haiku 5.5 y 40.032 en Haiku 4.5, un 18% más. Un subagente que con Haiku 4.5 rondaba los 85K puede pasar de 100K con Haiku 5.5.
Dónde compensa: un subagente propio en Haiku
1. Crea el subagente
En .claude/agents/finder.md (o en ~/.claude/agents/ para todos tus proyectos):
---
name: finder
description: Finds the files in the repo that mention a term and reports their paths
tools: Glob, Grep, Read
model: haiku
---
You search the repository with Grep and Glob and report the matching file paths, one per line.
model: haiku es lo que lo saca de tu modelo principal. Sin esa línea, el subagente corre con el modelo de tu sesión. Y tools es lo que lo mantiene ligero: cada herramienta que no le das es una definición menos en cada petición. El resto del formato está en cómo crear agentes personalizados.
Buenos candidatos son las búsquedas, los resúmenes de logs o de documentación, clasificar o extraer datos. Es decir, trabajo mecánico que repites y donde la velocidad pesa más que el razonamiento.
2. Comprueba qué modelo respondió
Pídele a Claude que use el subagente y lanza la prueba en -p con --output-format json: el campo modelUsage lista claude-haiku-5-5 con sus tokens. En una sesión interactiva, /usage lo desglosa en "Usage by model".
Si quieres que todos los subagentes sin modelo propio vayan a Haiku, existe CLAUDE_CODE_SUBAGENT_MODEL, que expliqué en effort por modelo. Yo prefiero fijarlo en cada definición: el general-purpose también hereda el modelo de la variable, y ese hace trabajo que sí quiero en Opus.
Lo que ya usa Haiku sin que hagas nada
Desde la v2.1.293, todo esto corre en Haiku 5.5 en la API de Anthropic:
- El subagente
claude-code-guide, el que responde cuando preguntas cómo funciona Claude Code. - Los hooks prompt, salvo que les pongas
model. - El evaluador de
/goal, que decide tras cada turno si se cumplió la condición. - Las tareas de fondo, como los resúmenes que usa
claude --resume.
ANTHROPIC_DEFAULT_HAIKU_MODEL controla las cuatro: cambia a qué resuelve haiku y en qué modelo corren.
Lo que no usa Haiku es el agente Explore. Corre con el modelo de tu sesión principal (con Fable, en Opus). Si lo leíste en mi tabla de modelos, ese dato ya no vale.
La letra pequeña
- Necesita Claude Code v2.1.293 (
claude update). Es la versión que pide la documentación para usar Haiku 5.5. - Solo en la API de Anthropic. En Bedrock, Google Cloud's Agent Platform, Microsoft Foundry y Claude Platform on AWS,
haikusigue resolviendo a Haiku 4.5. - Una sesión guardada en Haiku 4.5 se reanuda en Haiku 5.5 si tu ajuste
modeleshaiku. - El thinking no se apaga. Como en Opus 5.5 y Sonnet 5.5, el único control es el effort.
Documentación oficial: Model configuration · Subagents · Introducing Claude Haiku 5.5
Requisitos
- Claude Code v2.1.293 o superior. Todas las mediciones de arriba son de esa versión, con la cuenta de este repo en la API de Anthropic. El tamaño exacto de tus peticiones depende de tu
CLAUDE.md, tus MCP y tus skills: mide el tuyo con el mismo comando.