TL;DR El millón de tokens de contexto ya no es de un modelo, es de varios, y no todos lo llevan igual: Sonnet 5 y Fable 5 corren siempre en 1M sin sufijo ni créditos, mientras que Opus y Sonnet 4.6 lo activan con
[1m]y dependen de tu plan. Sin recargo en ningún caso. Y sigue valiendo lo de siempre: que quepa no significa que convenga llenarlo.
Corrección (agosto 2026): este tip nació cuando el 1M era una novedad de Opus 4.6 y decía que Claude Code arrancaba con ese modelo por defecto. Ya no. Hoy lo soportan Fable 5, Sonnet 5, Sonnet 4.6 y todos los Opus desde el 4.6, el modelo por defecto depende de tu plan, y la diferencia importante no es quién lo tiene sino cómo lo enciende cada uno.
La ventana de contexto pasa de 200K a 1M: cinco veces más espacio antes de que Claude necesite compactar. Sesiones más largas, menos interrupciones, y capacidad para trabajar con monorepos completos sin fragmentar el contexto.
Pero hay una trampa: el rendimiento del modelo se degrada con tokens lejanos. Es lo que se conoce como context drift, y cuanto más lejos está la información del punto actual de la conversación, menos preciso es el modelo al recuperarla. Que puedas llenar 1M de tokens no significa que debas hacerlo.
Nativo o con sufijo, que no es lo mismo
Aquí está la distinción que casi nadie tiene clara, y es la que decide si tienes que hacer algo o no:
| Modelo | Cómo se activa el 1M | Qué cuesta |
|---|---|---|
| Sonnet 5 | Nativo. No hay variante de 200K, no hay sufijo [1m] que elegir |
Nada extra, en ningún plan |
| Fable 5 | Nativo, igual que Sonnet 5 | Nada extra |
| Opus (4.6 en adelante) | Con el sufijo: opus[1m] |
Incluido en Max, Team y Enterprise. En Pro pide usage credits |
| Sonnet 4.6 | Con el sufijo: sonnet[1m] |
Pide usage credits en todos los planes |
| API y pay-as-you-go | Según el modelo | Acceso completo |
En ningún caso hay recargo por token. La doc oficial lo dice así:
"The 1M context window uses standard model pricing with no premium for tokens beyond 200K."
Si estás en Sonnet 5 o en Fable 5, ya llevas el millón puesto aunque no hayas tocado nada. Si estás en Opus, no: ahí el sufijo es tuyo.
Y si te preguntas si se puede usar Claude Code sin suscripción mensual, la vía pay-as-you-go por API es la respuesta corta, y la versión completa, con la trampa del plan free y el programa Open Source, está aquí.
Cómo aprovecharlo sin desperdiciar contexto
1. Monitoriza con /context
Usa el comando /context para ver cuánto contexto estás consumiendo en tiempo real. No esperes a que Claude compacte automáticamente, anticípate.
2. Compacta antes de que lo haga Claude
La auto-compactación salta cuando el contexto se acerca al límite, y ese límite es el menor de dos cosas: tu ventana de auto-compact y el contexto máximo del modelo. En Sonnet 5, con la ventana en auto, eso ronda los 967K tokens. Cuando salta sola, ya has perdido precisión en los tokens antiguos, así que compacta tú:
/compact enfócate en el módulo de autenticación
Las instrucciones opcionales le dicen a Claude qué priorizar al resumir.
3. No cargues contexto que no necesitas
Que tengas 1M no significa que debas cargar el codebase entero. Carga selectivamente, directorios concretos y archivos relevantes. Claude lee bajo demanda; no necesitas pre-cargar todo.
A la razón de precisión se le suma una de consumo: lo que cargas ahí no se paga una vez, se reenvía en cada turno que le quede a la sesión. Una ventana cinco veces más grande no rebaja ese coste, le da cinco veces más sitio.
4. Selecciona la variante 1M cuando el modelo la necesite
Solo hace falta en Opus y en Sonnet 4.6. El sufijo va con el alias o con el nombre completo del modelo:
/model opus[1m]
/model sonnet[1m]
/model claude-opus-4-8[1m]
O al lanzar Claude Code:
claude --model opus[1m]
5. Controlar cuándo compacta
CLAUDE_AUTOCOMPACT_PCT_OVERRIDE mueve el porcentaje de umbral al que salta la compactación:
export CLAUDE_AUTOCOMPACT_PCT_OVERRIDE=70
Eso es el umbral en porcentaje. El tamaño de la ventana sobre la que se calcula ese porcentaje es otra cosa distinta, y la pueden fijar cuatro sitios: quién decide tu ventana de auto-compact. Ahí también está el aviso que da el propio Claude Code, y que va en contra de la intuición: bajar la ventana no ahorra, hace que compactes más veces.
6. Apagarlo del todo
export CLAUDE_CODE_DISABLE_1M_CONTEXT=1
Quita las variantes 1M del selector de modelos. Y en los que lo llevan de serie, Sonnet 5 y Fable 5, va más lejos: los trata como si tuvieran una ventana de 200K.
Referencia
| Aspecto | Detalle |
|---|---|
| Ventana clásica | 200K tokens |
| Ventana extendida | 1M tokens |
| 1M nativo, sin sufijo | Sonnet 5, Fable 5 |
1M con sufijo [1m] |
Opus 4.6 en adelante, Sonnet 4.6 |
| Sintaxis | opus[1m], sonnet[1m], claude-opus-4-8[1m] |
| Umbral de auto-compactación | El menor entre tu ventana de auto-compact y el máximo del modelo (~967K en Sonnet 5 con auto) |
| Mover el porcentaje | CLAUDE_AUTOCOMPACT_PCT_OVERRIDE |
| Desactivar 1M | CLAUDE_CODE_DISABLE_1M_CONTEXT=1 |
| Precio por token | Sin recargo: la misma tarifa en toda la ventana |
Documentación oficial: Model configuration, extended context
Forma parte de los 10 hábitos para ahorrar tokens en Claude Code. Y cuál de los tres modelos usar en cada caso está en Sonnet 5, Opus 5 y Fable 5.
Comprobado en Claude Code v2.1.251.