← Claude Code Hub
✦ Tip #148 Jul 28, 2026

Thinking en Claude Code: ya no lo controlas, pero lo pagas igual

El thinking dejó de ser un interruptor tuyo: ahora el modelo decide en cada paso si razona. Te quedan tres mandos y, según el modelo que uses, uno o dos no hacen absolutamente nada.

Los tres mandos del thinking de Claude Code cableados hacia una caja donde el modelo decide en cada paso: /effort tiene el cable conectado y con flujo, mientras que Option+T y MAX_THINKING_TOKENS lo tienen cortado con una equis, en Fable 5 y en los modelos adaptativos

TL;DR El único mando que mueve la aguja es /effort. El interruptor de thinking (Option+T, alwaysThinkingEnabled) no hace nada en Fable 5. MAX_THINKING_TOKENS con cualquier valor distinto de 0 lo ignoran todos los modelos adaptativos, que son justo los que usas. Y de las palabras mágicas solo queda ultrathink, que tampoco sube el effort. Comprobado en la v2.1.220.

Piensa en la última vez que escribiste think hard en un prompt. O que pusiste MAX_THINKING_TOKENS=8000 en tu .zshrc para gastar menos. Ninguna de las dos cosas hace lo que crees en el modelo que estás usando hoy.

El thinking de Claude cambió de naturaleza y el cambio se comunicó fatal. Antes era un presupuesto que fijabas tú. Ahora es una decisión que toma el modelo en cada paso: mira lo que le pides, calcula si razonar mejora la respuesta y actúa. Anthropic lo llama razonamiento adaptativo, y la consecuencia práctica es que la misma conversación tiene turnos con razonamiento y turnos sin él.

Los mandos siguen ahí, en la interfaz y en la documentación. Lo que ya no está claro es cuáles siguen conectados a algo.

Este es el mando real, tal cual aparece al escribir /effort:

Effort

              Faster                                        Smarter
    ────────────────●──────────────────────────┊──────────────────────
     low    medium  high     xhigh      max    ┊   ultracode
                                                   xhigh + workflows

  ←/→ to adjust · Enter to confirm · Esc to cancel

Qué es el thinking

Es el razonamiento que Claude genera antes de responder: reformula lo que le pides, prueba enfoques, comprueba resultados intermedios y descarta los caminos que no se sostienen. Ese texto llega en bloques de thinking por delante de la respuesta.

Dos consecuencias que conviene tener claras desde el principio. Se factura como tokens de output, aunque no lo veas. Y compite por el mismo espacio que la respuesta, porque cuenta dentro del max_tokens de la petición.

Mando 1: /effort, el único que mueve la aguja

El effort no es un límite de tokens, es una postura. La documentación de Anthropic define nivel por nivel cuánto razona el modelo:

Nivel Comportamiento del thinking
low Razona lo mínimo. Se salta el razonamiento en tareas simples
medium Razonamiento moderado. Puede saltárselo en consultas sencillas
high Casi siempre razona. Es el default en todos los modelos salvo Opus 4.7
xhigh Siempre razona en profundidad, con exploración extendida
max Siempre razona y sin límite de profundidad

Si el modelo activo no soporta el nivel que pides, Claude Code baja al más alto que sí soporte: xhigh corre como high en Opus 4.6. Y ultracode no es un nivel de modelo, es un ajuste de Claude Code que envía xhigh y además orquesta workflows.

Consejo que no es mío sino de Anthropic: déjalo donde viene. Súbelo cuando tengas un motivo concreto, no por sistema. Las tres formas de fijarlo (comando, variable de entorno y settings.json) están en cómo ajustar el effort level, y el criterio de cuándo tocarlo, en Sonnet 5, Opus 5 y Fable 5.

Mando 2: el interruptor, que en Fable 5 no existe

Hay un interruptor de encendido y apagado, y tiene dos superficies. Option+T en macOS (Alt+T en Windows y Linux) lo cambia para la sesión actual. En /config está el mismo interruptor con nombre propio:

Toggle thinking mode
Enable or disable thinking for this session.

❯ 1. Enabled ✓   Claude will think before responding
  2. Disabled    Claude will respond without extended thinking

Ojo al alcance, porque la pantalla y la documentación no dicen lo mismo. El menú habla de "this session", pero lo que /config escribe es alwaysThinkingEnabled en ~/.claude/settings.json, y la documentación lo describe como el valor por defecto para todas las sesiones. El cambio realmente puntual es Option+T.

Ahora la parte que casi nadie sabe: en Fable 5 el interruptor no hace nada. Ni Option+T, ni alwaysThinkingEnabled, ni la variable de entorno. Fable 5 siempre razona, y lo único que decide cuánto es el nivel de effort. Si tu modelo diario es Fable 5, ese interruptor es decoración.

En Opus 5 sí se puede apagar, pero solo hasta effort high. Por encima, la petición no degrada: devuelve un error 400 en cada turno. Lo comprobamos con el comando puesto, y está en el tip de los consejos de Opus 5. Apagar el thinking y subir el effort son movimientos incompatibles.

Mando 3: el presupuesto, que tu modelo ignora

Aquí está el error más extendido, y lo he tenido publicado yo mismo. La receta que circula por todas partes es esta:

export MAX_THINKING_TOKENS=8000   # no hace nada en tu modelo

Los valores distintos de cero solo se aplican en el modo de presupuesto fijo, y ese modo ya no existe en los modelos que usas. Fable 5, Sonnet 5 y todos los Opus desde el 4.7 son adaptativos siempre. En ellos, ese 8000 se ignora.

Lo único que la variable conserva es el caso extremo:

export MAX_THINKING_TOKENS=0      # esto sí apaga el thinking

Con tres asteriscos. En Fable 5 tampoco funciona. En proveedores externos (Bedrock, Foundry, Google Cloud) lo que hace es omitir el parámetro thinking, y un modelo adaptativo puede seguir razonando igual. Y CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1, que era la forma de volver al presupuesto fijo, solo aplica a Opus 4.6 y Sonnet 4.6, y desde la v2.1.111 no tiene efecto en nada posterior.

Las palabras mágicas: queda una, y no hace lo que crees

ultrathink sigue siendo palabra clave. La incluyes en cualquier parte del prompt y Claude Code la reconoce, pero lo que hace es añadir una instrucción en contexto, no cambiar tu configuración. El nivel de effort que se envía a la API es exactamente el mismo.

think, think hard y think more ya no son nada. Claude Code las pasa como texto normal del prompt.

Y aquí está el matiz que se pierde cuando alguien resume esto como "ya no funcionan": la propia documentación de Anthropic recomienda dirigir el razonamiento con lenguaje natural, y pone como ejemplo "Please think hard before responding" para fomentarlo y "Answer directly without deliberating" para suprimirlo. O sea, la frase sigue influyendo. Lo que ha perdido es la condición de interruptor: pasó de mecanismo a sugerencia. Si necesitas garantías, el effort es la palanca calibrada; el prompt es sensible a cómo lo redactes.

Lo que pagas por no ver

Te facturan todo el razonamiento, no el que aparece en pantalla. Colapsado, redactado o resumido, el número de tokens de output que pagas es el mismo. Por defecto, además, Claude Code lo redacta, así que estás pagando un texto que no existe para ti hasta que lo activas: la receta probada está en cómo recuperar el thinking oculto, y leerlo en directo con Ctrl+O es de lo más rentable que puedes hacer con un modelo con razonamiento.

Y un coste indirecto que sorprende: el nivel de effort forma parte de la clave de caché. Cambiarlo a mitad de conversación invalida la caché y ese turno reprocesa el historial entero a precio completo. Si vas a tocar effort y modelo, el orden en que lo haces cambia la factura.

Referencia: qué funciona en cada modelo

Modelo Niveles de effort Apagar el thinking MAX_THINKING_TOKENS
Fable 5 low a max Imposible Ignorado, incluido el 0
Opus 5 low a max Hasta effort high Solo 0
Sonnet 5 low a max Solo 0
Opus 4.8 y 4.7 low a max Solo 0
Opus 4.6 y Sonnet 4.6 low, medium, high, max Sí, con CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1

Resumido en una línea: tienes tres mandos y, según el modelo, uno o dos están desconectados. El que nunca falla es el effort, y la recomendación oficial es no tocarlo.

Y si has llegado hasta aquí buscando gastar menos, el thinking es solo uno de los frentes: los otros nueve están en 10 hábitos para ahorrar tokens.

Documentación oficial: Model configuration: extended thinking · Thinking · Steering thinking

Requisitos

  • Comprobado en Claude Code v2.1.220. CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING dejó de aplicar a los modelos nuevos en la v2.1.111.
Guía gratuita

Los 51 esenciales, en PDF.

Una página por tip. Cinco capítulos. Lo que de verdad uso a diario en producción — sin teoría, sin humo.

  • I. Empieza bien 10 tips
  • II. Conciencia 3 tips
  • III. Maestría 22 tips
  • IV. Autonomía 10 tips
  • V. Comparativa 6 tips
¿Eres desarrollador/a Web profesional?

Recibirás la guía por email · Te unes a la newsletter Gravitas · Cancela cuando quieras

de 51
#

Wmedia · 51 Tips
Guía gratuita · 51 tips · 5 capítulos

Los 51 esenciales, en PDF.

¿Eres desarrollador/a Web profesional? · Cancela cuando quieras