← Claude Code Hub
✦ Tip #222 Oct 8, 2026

Claude Haiku 5.5 en Claude Code: subagentes un 90% más económicos

Claude Haiku 5.5 es el nuevo Haiku de Claude Code: un 90% más económico que Haiku 4.5 y muy por encima en benchmarks. Pero el descuento entero solo vale por debajo de 100K tokens, y tu sesión ya arranca con la mitad.

El mismo Haiku 5.5, dos precios: un subagente propio en Haiku arranca en 8.097 tokens por petición y se queda en la tarifa de $0,10 por MTok, mientras la sesión principal arranca en 51.059 y cruza los 100K, donde pasa a $0,50

TL;DR Crea un subagente propio con model: haiku y solo las herramientas que necesita. El mío arranca en 8K tokens por petición y paga la tarifa baja de Haiku 5.5, un 90% menos que Haiku 4.5. Mi sesión principal en Haiku arranca en 51K, a medio camino del escalón de 100K donde el descuento baja al 50%.

Claude Haiku 5.5 (claude-haiku-5-5) salió el 7 de octubre de 2026 y desde la v2.1.293 es lo que responde cuando Claude Code pide haiku en la API de Anthropic. Cuesta $0,10/$0,50 por MTok frente a los $1/$5 de Haiku 4.5, pero solo mientras el prompt no pase de 100K tokens. Por encima, $0,50/$2,50. En Claude Code ese escalón decide dónde te ahorras el 90% y dónde solo la mitad.

Qué trae

Prueba Haiku 5.5 Haiku 4.5 Sonnet 5.5
Terminal-Bench 4.0 39,2% 0,0% 70,6%
OSWorld 2.1 (computer use) 72,4% 15,7% 83,9%
Humanity's Last Exam (con herramientas) 57,4% 18,7% 64,5%

Son las cifras de Anthropic, no mías. No llega a Sonnet 5.5, pero el salto desde Haiku 4.5 es enorme, sobre todo en agentic coding. Además es el primer Haiku con effort ajustable (de low a max, medium por defecto), tiene 1M de contexto y, según Anthropic, es su modelo más rápido hasta hoy. Ellos mismos lo colocan "as a subagent on coding work", al lado de Opus 5.5 y Sonnet 5.5.

El precio tiene un escalón en 100K

Por MTok Haiku 5.5 (hasta 100K) Haiku 5.5 (más de 100K) Haiku 4.5
Entrada $0,10 $0,50 $1
Salida $0,50 $2,50 $5
Escritura de caché (1 h) $0,20 $1 $2
Lectura de caché $0,01 $0,05 $0,10

El escalón se mide por petición, según el tamaño del prompt. Y en Claude Code cada petición lleva el system prompt, las herramientas, tu CLAUDE.md y toda la conversación hasta ese momento.

Cuánto pesa una petición en Claude Code

Lo medí en este mismo repo con la v2.1.293. Primero, la sesión principal en Haiku con una pregunta de una palabra:

claude -p --model haiku --output-format json "Reply with the single word OK"

Después, otra sesión igual, esta vez delegando una búsqueda en el subagente finder que tienes más abajo: Haiku y tres herramientas. Los tamaños por petición, leídos de los transcripts:

sesión principal (Haiku 5.5)    51.059 tokens por petición
subagente finder (Haiku 5.5)     8.097 tokens por petición

La sesión principal llega a la mitad del escalón antes de hacer nada. En cuanto lees unos cuantos archivos, la conversación pasa de 100K y pagas la tarifa alta. Sigue saliendo a mitad de precio que Haiku 4.5, pero ya no a una décima parte.

El subagente arranca con su propio contexto, sin tu conversación, y con solo las herramientas que le diste. Ahí cabe mucho trabajo antes de rozar los 100K.

Un detalle más: Haiku 5.5 cuenta más tokens que Haiku 4.5 para el mismo texto. La misma pregunta, desde la misma carpeta, me dio 47.311 tokens en Haiku 5.5 y 40.032 en Haiku 4.5, un 18% más. Un subagente que con Haiku 4.5 rondaba los 85K puede pasar de 100K con Haiku 5.5.

Dónde compensa: un subagente propio en Haiku

1. Crea el subagente

En .claude/agents/finder.md (o en ~/.claude/agents/ para todos tus proyectos):

---
name: finder
description: Finds the files in the repo that mention a term and reports their paths
tools: Glob, Grep, Read
model: haiku
---
You search the repository with Grep and Glob and report the matching file paths, one per line.

model: haiku es lo que lo saca de tu modelo principal. Sin esa línea, el subagente corre con el modelo de tu sesión. Y tools es lo que lo mantiene ligero: cada herramienta que no le das es una definición menos en cada petición. El resto del formato está en cómo crear agentes personalizados.

Buenos candidatos son las búsquedas, los resúmenes de logs o de documentación, clasificar o extraer datos. Es decir, trabajo mecánico que repites y donde la velocidad pesa más que el razonamiento.

2. Comprueba qué modelo respondió

Pídele a Claude que use el subagente y lanza la prueba en -p con --output-format json: el campo modelUsage lista claude-haiku-5-5 con sus tokens. En una sesión interactiva, /usage lo desglosa en "Usage by model".

Si quieres que todos los subagentes sin modelo propio vayan a Haiku, existe CLAUDE_CODE_SUBAGENT_MODEL, que expliqué en effort por modelo. Yo prefiero fijarlo en cada definición: el general-purpose también hereda el modelo de la variable, y ese hace trabajo que sí quiero en Opus.

Lo que ya usa Haiku sin que hagas nada

Desde la v2.1.293, todo esto corre en Haiku 5.5 en la API de Anthropic:

  • El subagente claude-code-guide, el que responde cuando preguntas cómo funciona Claude Code.
  • Los hooks prompt, salvo que les pongas model.
  • El evaluador de /goal, que decide tras cada turno si se cumplió la condición.
  • Las tareas de fondo, como los resúmenes que usa claude --resume.

ANTHROPIC_DEFAULT_HAIKU_MODEL controla las cuatro: cambia a qué resuelve haiku y en qué modelo corren.

Lo que no usa Haiku es el agente Explore. Corre con el modelo de tu sesión principal (con Fable, en Opus). Si lo leíste en mi tabla de modelos, ese dato ya no vale.

La letra pequeña

  • Necesita Claude Code v2.1.293 (claude update). Es la versión que pide la documentación para usar Haiku 5.5.
  • Solo en la API de Anthropic. En Bedrock, Google Cloud's Agent Platform, Microsoft Foundry y Claude Platform on AWS, haiku sigue resolviendo a Haiku 4.5.
  • Una sesión guardada en Haiku 4.5 se reanuda en Haiku 5.5 si tu ajuste model es haiku.
  • El thinking no se apaga. Como en Opus 5.5 y Sonnet 5.5, el único control es el effort.

Documentación oficial: Model configuration · Subagents · Introducing Claude Haiku 5.5

Requisitos

  • Claude Code v2.1.293 o superior. Todas las mediciones de arriba son de esa versión, con la cuenta de este repo en la API de Anthropic. El tamaño exacto de tus peticiones depende de tu CLAUDE.md, tus MCP y tus skills: mide el tuyo con el mismo comando.
Guía gratuita

Los 51 esenciales, en una guía.

Una página por tip. Cinco capítulos. Lo que de verdad uso a diario en producción. Sin teoría, sin humo.

  • I. Empieza bien 10 tips
  • II. Conciencia 3 tips
  • III. Maestría 22 tips
  • IV. Autonomía 10 tips
  • V. Comparativa 6 tips
¿Eres desarrollador/a Web profesional?

Recibirás la guía por email · Te unes a la newsletter Gravitas · Cancela cuando quieras

de 51
#

Wmedia · 51 Tips
Guía gratuita · 51 tips · 5 capítulos

Los 51 esenciales, en una guía.

¿Eres desarrollador/a Web profesional? · Cancela cuando quieras
Workshop para equipos

Multiplica el output de tu equipo sin sacrificar calidad: workshop AI First de 6 a 8 horas, online, sobre la plataforma Claude.

Ver el workshop

¿Quieres los 51 esenciales de Claude Code en una guía?