TL;DR Pon
Dynamic workflow sizeensmalldesde/config(menos de 5 agentes) y sube el tamaño en el propio prompt cuando la tarea lo merezca. Es una guía, no un tope: el tope de verdad son 1.000 agentes por run, y el aviso de «esto se está poniendo grande» no salta hasta los 25.
Hace un par de meses lancé una tarea de tres archivos. Hora y media después llevaba 11 millones de tokens y casi 400 agentes contando todas las fases, con los refutadores incluidos.
No era un workflow dinámico. Era un agente delegado que había escrito yo, con un verificador al que le había dicho que ante la duda escalase, y sin ningún presupuesto global. Da igual el envoltorio: el fallo es el que le puede pasar a cualquier fan-out, y es siempre el mismo. Nadie decidió cuántos agentes eran demasiados, así que nadie paró.
Hoy hay un dial para eso. Cuando me pasó, no venía puesto ninguno.
Qué es el ajuste
Un workflow dinámico es un script que Claude escribe para orquestar subagentes: tú describes la tarea, y el runtime lo ejecuta en segundo plano mientras tu sesión sigue libre. Cuántos agentes salen de ahí lo decide Claude al escribir el script.
Dynamic workflow size es donde dejas dicho ese número una vez, en lugar de repetirlo en cada prompt.
Resultado:
# La fila de /config, sin tocar
Dynamic workflow size medium (default)
# Ponla donde quieras
/config workflowSizeGuideline=small
# Y la fila pasa a
Dynamic workflow size small
Mientras no elijas, cada run te lo recuerda con un Running in background · medium size (/config) en su línea de progreso. Ese aviso desaparece en cuanto eliges un valor, sea el que sea: es Claude Code señalando que nadie ha decidido todavía, no informándote del tamaño. (Las dos vistas son ilustrativas, el panel de /config es interactivo.)
Los cuatro valores
| Valor | A cuántos agentes apunta Claude |
|---|---|
small |
Menos de 5 |
medium |
Menos de 15 |
large |
Menos de 50 |
unrestricted |
Sin guía: Claude dimensiona según la tarea |
medium es el valor por defecto, pero solo desde la v2.1.219. Antes de esa versión el default era unrestricted, o sea ninguno, y el ajuste ni siquiera existía hasta la v2.1.202. Si te suena raro no haber visto nunca esta fila, es porque es nueva.
Cómo ponerlo
1. De una vez, para todas tus sesiones
/config workflowSizeGuideline=small
También puedes abrir /config y buscar la fila Dynamic workflow size. El cambio entra en el siguiente prompt, no hace falta reiniciar.
2. O en un archivo de ajustes
{
"workflowSizeGuideline": "small"
}
Vale en cualquier archivo de settings desde la v2.1.219, y gana sobre /config. Cuando un archivo define el valor, Claude Code esconde la fila del panel para que no parezca que puedes cambiarla desde ahí.
3. Y súbelo en el prompt cuando la tarea lo pida
usa un workflow grande para migrar todo src/components a Tailwind
Aquí está la parte que hace que el default bajo no te ate. La doc oficial lo dice con estas palabras: la guía se le manda a Claude como consejo, no como tope, así que un prompt que pide otra escala manda sobre el ajuste.
Por eso small es un buen sitio donde vivir. Equivocarte por abajo te cuesta una frase más en el prompt. Equivocarte por arriba te cuesta lo que me costó a mí.
Lo que este ajuste NO hace
No para nada. No es un límite, es una preferencia que viaja en el prompt de Claude. Si el script acaba pidiendo más agentes, los pide.
El tope de verdad está en otro sitio, y ese sí es duro: 16 agentes en paralelo como mucho (menos si tu máquina tiene pocos núcleos) y 1.000 agentes por run. Ese número existe justamente para que un bucle desbocado tenga final.
Y hay un aviso, pero llega tarde. Cuando un workflow programa más de 25 agentes, o su proyección de tokens pasa de 1,5 millones, la línea de progreso muestra un Large workflow. Solo avisa: no pausa ni recorta. Si tú eliges un tamaño, su número sustituye al 25 como umbral. Y con ultracode encendido el aviso no aparece, porque encenderlo ya es decir que sí a las tiradas grandes.
Para situarte: mis 400 agentes eran 16 veces el umbral del aviso, y mis 11 millones de tokens, siete veces el otro.
El segundo mordisco: en qué modelo corren
Esto es lo que casi nadie mira, y multiplica todo lo anterior.
Cada agente de un workflow usa el modelo de tu sesión, salvo que el script mande esa fase a otro o tengas puesta la variable CLAUDE_CODE_SUBAGENT_MODEL, que gana sobre las dos cosas.
Mis casi 400 agentes salieron todos en Fable 5 porque mi sesión estaba en Fable 5. No elegí que 400 agentes corrieran ahí: elegí mi modelo, una vez, al principio del día, y esa decisión se replicó 400 veces sin que nadie me lo preguntara.
Así que antes de un run grande, mira /model. Y si hay fases que no necesitan el modelo fuerte (listar archivos, clasificar, recoger), dilo al describir la tarea y Claude las manda a uno más económico.
Referencia
| Aspecto | Detalle |
|---|---|
| Ajuste | workflowSizeGuideline · fila Dynamic workflow size en /config |
| Valores | small (<5), medium (<15), large (<50), unrestricted |
| Por defecto | medium desde la v2.1.219; unrestricted antes |
| Naturaleza | Consejo que viaja en el prompt, no un límite |
| Precedencia | Archivo de settings > /config |
| Cuándo aplica | En el siguiente prompt |
| Tope real | 16 agentes concurrentes, 1.000 por run |
Aviso Large workflow |
Más de 25 agentes o 1,5 M de tokens proyectados; no con ultracode |
| Modelo de los agentes | El de tu sesión, salvo CLAUDE_CODE_SUBAGENT_MODEL o una fase enrutada |
| Requisitos | v2.1.202 para el ajuste, v2.1.219 para el default y la clave de settings |
Si lo que quieres es saber quién se está comiendo tu cuota ahora mismo, y no solo prevenir el próximo susto, la otra mitad está en qué skill y qué MCP se comen tu límite.
Documentación oficial: Set a size guideline