Subagents que generan subagents, la regla de 5 niveles de Claude Code
Desde junio de 2026 los subagents pueden iniciar sus propios subagents, hasta cinco niveles de profundidad. Cuándo la profundidad ayuda de verdad, cuándo te dispara coste y contexto, y cómo poner un presupuesto de niveles.
Hasta hace poco un montaje de subagents era plano. Un coordinador arrancaba workers, y ahí se acababa. Un worker no podía generar otro subagent por su cuenta. Desde la entrada del changelog de principios de junio eso ha cambiado, los subagents pueden ahora iniciar subagents propios, hasta cinco niveles de profundidad. A primera vista suena a más potencia. En la práctica es sobre todo una forma nueva de reventarte el coste y el contexto si lo haces sin plan. Lo probé durante una semana con distintas profundidades y acabé en una regla bastante conservadora. Este playbook te la enseña.
Requisito: has hecho "Tu primer subagent en 30 minutos" y conoces el patrón CEO-worker del nivel 5, lección 2. Si ya llevas un equipo de varios subagents, "Estructurar un equipo de subagents" también es buena base.
1. Qué ha cambiado
Antes regía una regla dura: solo la sesión principal arranca subagents. Un subagent era un worker sin salida, hace su tarea y devuelve el resultado. Ahora cada subagent puede arrancar otros, y eso sigue de forma recursiva hasta el nivel cinco. El nivel cero es tu sesión principal, el nivel uno el primer worker, y así hasta el cinco, donde se alcanza el límite y cualquier otro spawn se rechaza.
Importante entenderlo: cinco niveles es un techo, no un objetivo. La mayoría de los montajes buenos se quedan en el nivel uno o dos. La profundidad es una herramienta para exactamente un caso, y lo vemos enseguida.
2. Por qué la profundidad rara vez es la respuesta
Cada nivel multiplica. Si tu coordinador arranca tres workers y cada uno de esos workers arranca otros tres, en el nivel dos ya vas por nueve subagents en paralelo. Un nivel más abajo son 27. Cada uno tiene su propio contexto, sus propios tokens, su propia latencia. Tuve una prueba en la que abrí ingenuamente tres por tres por tres, y un encargo de investigación sencillo pasó a costar once dólares en vez de los dos esperados. No porque el trabajo fuera mayor, sino porque 27 subagents reconstruyeron cada uno medio contexto otra vez.
Mi regla aproximada: cada nivel adicional solo se justifica si la tarea de ese nivel se descompone de verdad en subtareas independientes que puedan correr en paralelo. Si no, estás montando una jerarquía cara para algo que un único worker habría hecho en secuencia.
3. El único sitio donde la profundidad ayuda de verdad
El caso que justifica la profundidad se llama fan-out en investigación. Imagina que quieres analizar cinco competidores, y por competidor hay cuatro subpreguntas. Aquí un segundo nivel tiene sentido: el nivel uno es un investigador por competidor, el nivel dos un worker por subpregunta. Cada worker del nivel dos trabaja con un encargo estrecho y bien delimitado y no necesita para nada el contexto grande de los niveles superiores.
Funciona porque las subtareas son realmente independientes. El competidor A no depende del competidor B, la subpregunta uno no depende de la dos. Justo esa independencia es la condición. Si tus subtareas se apoyan unas en otras, eso no va en subagents paralelos sino en un plan secuencial.
4. Fijar de antemano un presupuesto de niveles
Antes de arrancar nada, escribe un límite duro en tu CLAUDE.md o en el prompt del subagent. En mi prompt de coordinador hay una frase del estilo "Puedes abrir como máximo el nivel dos, o sea tú arrancas workers, y esos workers pueden bajar exactamente un nivel más si la tarea se descompone en partes independientes. Más abajo no."
Eso importa más de lo que parece. Sin ese límite, un coordinador tiende a arrancar otro subagent ante cualquier duda en vez de pensar por sí mismo. El límite de cinco niveles del sistema solo te atrapa en el extremo absoluto, y a esas alturas ya llevas quemado demasiado dinero. Pon tu propio límite bastante por debajo.
5. Entender la herencia de permisos
Un subagent profundo no hereda automáticamente los mismos derechos que su padre, y menos mal. Defines por cada definición de subagent qué herramientas y qué scopes de permiso están permitidos. Un investigador del nivel dos normalmente solo debería poder leer e investigar, nunca escribir ficheros.
Mi patrón: cuanto más profundo el nivel, más estrechos los derechos. El coordinador del nivel uno puede crear borradores y juntar resultados. Los workers del nivel dos solo pueden leer y devolver informe. Así, un subagent profundo como mucho investigará tonterías, pero no tocará tus ficheros. Quien todavía no tenga controlados los perfiles de permisos debería trabajarse antes el recipe de settings y permisos.
6. Aislamiento de contexto por nivel
Cada subagent tiene su propio contexto, no ve automáticamente lo que vio el padre. Tú le pasas en el encargo de spawn exactamente lo que necesita. Esa es la palanca de verdad contra la explosión de coste del paso 2.
En concreto significa: no le des a un worker del nivel dos todo el estado de la investigación, sino solo esa subpregunta más los dos o tres hechos que necesita como punto de partida. Cuanto más estrecho el encargo, más barato el subagent y más afilado el resultado. Un worker que arranca con tres frases de contexto y devuelve un informe claro es justo lo que quieres.
7. Medir el coste con /usage
Desde la actualización de junio, /usage en VS Code muestra un desglose por subagent, skill, plugin y servidor MCP de las últimas 24 horas o siete días. Úsalo. Después de una tirada profunda miras adónde han ido de verdad los tokens.
En mi desastre de 27 subagents del paso 2, ese desglose enseñó justo que lo caro no era la investigación en sí, sino la reconstrucción repetida de contexto en el nivel más profundo. Sin el desglose le habría echado la culpa al modelo y habría optimizado por el lado equivocado. Pulsa /usage después de cada tirada con más de un nivel.
8. Estrategia de timeout y de aborto
Los montajes profundos tienen un patrón de fallo que los planos no tienen: un subagent del nivel tres se queda colgado, y los niveles de arriba esperan. Arriba solo ves "Working" y no sabes por qué. Por eso decide de antemano cuánto puede correr un worker como máximo, y qué hace el padre si un hijo no vuelve.
Mi patrón: el coordinador no espera eternamente. Si un worker no entrega nada tras un plazo razonable, el coordinador sigue sin ese resultado parcial y anota el hueco en el informe. Mejor un informe con cuatro de cinco competidores y una nota clara, que una sesión que lleva veinte minutos esperando a un subagent colgado.
9. Depurar cuando un subagent profundo se cuelga
Cuando algo se atasca, recorre los niveles de arriba abajo. La vista de agentes te enseña qué subagent está activo. La actualización de junio arregló varios bugs aquí, por ejemplo que un subagent se quedaba marcado como "active" después de parar a un hijo que él había arrancado. Si vas con una versión antigua, actualiza primero, muchos de esos cuelgues eran sencillamente bugs.
Si el subagent falla de verdad en su tarea y no por un bug, casi siempre es por demasiado o demasiado poco contexto del paso 6. Demasiado poco, y no sabe qué hacer. Demasiado, y se pierde. Mira el encargo de spawn que mandó el padre, ahí está la causa.
10. Cuándo quedarse plano
La respuesta honesta para la mayoría de solo founders y equipos pequeños: quédate en el nivel uno. Un coordinador que arranca cuatro o cinco workers y junta sus resultados cubre el 90 por ciento. La profundidad solo la necesitas cuando una tarea de worker se descompone a su vez limpiamente en subtareas independientes, y eso pasa menos de lo que uno cree.
Mi prueba de una semana lo confirmó. De todos los montajes que llevé, exactamente uno se benefició de verdad del segundo nivel, el fan-out de competidores del paso 3. Todos los demás eran más rápidos, más baratos y más fáciles de depurar con un solo nivel. Que te dejen bajar cinco niveles no significa que debas hacerlo.
Qué sigue
Si ahora estás planeando un montaje de agentes más grande, sigue por nivel 6, lección 7, orquestación multiagente. Quien quiera saber si una tarea necesita siquiera un subagent o si basta una skill, que mire "Subagent o skill o herramienta MCP". Y si te preocupan los costes, "Controles de coste de Claude Code" es el siguiente paso lógico.
Source
La funcionalidad "Sub-agents can now spawn their own sub-agents (up to 5 levels deep)" y el desglose por subagent de /usage vienen del changelog oficial de Claude Code, junio de 2026: https://code.claude.com/docs/en/changelog