Dale su propio agente al trabajo pesado
¿La forma más rápida de envenenar las respuestas de tu IA? Meter cada detalle desordenado en una sola conversación. Resultados de búsqueda, volcados enormes de logs, las entrañas de cuarenta archivos que hojeaste una vez y no necesitas nunca más — todo eso queda en tu contexto principal, diluyendo la señal que el modelo necesita para razonar bien. La respuesta de Claude Code son los subagentes: agentes auxiliares que hacen el trabajo ruidoso en su propia ventana de contexto y devuelven solo un resumen limpio.
El problema: la contaminación del contexto
Cada token en tu conversación es algo que el modelo tiene que sopesar al producir su siguiente respuesta. Cuando le pides a tu asistente que "encuentre dónde se maneja la autenticación", una búsqueda directa puede volcar decenas de rutas de archivos, coincidencias de grep y fragmentos irrelevantes directo en el hilo principal. Nada de esa basura se elimina después — simplemente queda ahí, compitiendo por la atención con la tarea real, y acercándote a un límite de la ventana de contexto que tarde o temprano tendrás que compactar o reiniciar.
La solución no es "buscar menos". Es separar la exploración del razonamiento. A la exploración se le permite ser desordenada. La conversación que realmente estás teniendo con tu IA no debería serlo.
Cómo funciona el aislamiento por subagentes
Un subagente corre en su propia ventana de contexto, con su propio prompt de sistema y sus propios permisos de herramientas. Cuando Claude Code delega una tarea a un subagente, ese subagente lee lo que necesite — archivos, logs, resultados de búsqueda — dentro de su ventana privada. Cuando termina, solo su informe final cruza de vuelta a tu conversación principal. Los cuarenta archivos que abrió, los greps fallidos, las líneas de log que escaneó y descartó: nada de eso toca tu hilo.
Este es exactamente el mecanismo que señala el reel: un subagente "has like a context window" propio, y "only summary lands into the main context". No es una metáfora — es como está construida la funcionalidad. Claude Code incluye tres subagentes integrados que verás usarse automáticamente:
- Explore — un agente rápido, de solo lectura, para buscar y analizar una base de código. Write y Edit están denegados, así que no puede tocar tus archivos, solo leerlos.
- Plan — un agente de investigación que se usa durante el modo plan para reunir contexto antes de que Claude presente un plan, manteniendo la conversación principal en solo lectura mientras la exploración ocurre en otro lado.
- General-purpose — un agente capaz con acceso a todas las herramientas, usado para tareas complejas de varios pasos que necesitan tanto exploración como acción.
También puedes definir subagentes personalizados como archivos Markdown con frontmatter YAML (name, description, tools, model) guardados en .claude/agents/ para un proyecto o en ~/.claude/agents/ para ti en cada proyecto. Claude lee el description de cada subagente para decidir cuándo una tarea le corresponde — escribe esa descripción con claridad, porque es la única señal que Claude usa para dirigir el trabajo allí.
Cuándo delegar
Recurre a un subagente siempre que una tarea vaya a producir una pila de resultados intermedios que no necesitarás conservar:
- Buscar en una base de código dónde se define o se usa algo
- Leer logs gigantes para encontrar el único error que importa
- Explorar un repo nuevo para armar un mapa mental antes de empezar a editar
En cada caso, el valor está en la conclusión, no en el proceso. Quieres "la autenticación vive en middleware/auth.ts, usa JWT con una expiración de 15 minutos" — no los veinte archivos que Claude abrió para averiguarlo.
Una regla: no edites en paralelo
Los subagentes aíslan la lectura, pero no coordinan mágicamente la escritura. Si levantas varios agentes auxiliares y los pones a todos editando el mismo proyecto a la vez, su trabajo no encajará — cada uno trabaja desde su propia instantánea del mundo y no tiene visibilidad de lo que los demás están haciendo simultáneamente. Usa subagentes libremente para investigación en paralelo; mantén las ediciones a un agente (o un archivo) a la vez, o serializa el trabajo para que cada edición se aplique antes de que empiece la siguiente.
Un ejemplo concreto
Digamos que estás depurando un test de integración inestable. En vez de pegar el log completo de CI en tu chat principal, delega: "usa un subagente para leer este log de 3.000 líneas y dime qué aserción falló y por qué". El subagente ingiere el log entero en su propia ventana, y tu hilo principal recibe una respuesta de dos oraciones. Ahora puedes hacer tres preguntas de seguimiento sin haber pagado nunca el costo en tokens de ese volcado de log. Repite esto para explorar un repo desconocido antes de tu primera edición, o para hacer grep en un monorepo y confirmar que nada más llama a una función que estás por cambiar.
Trucos avanzados
- Escribe un
descriptionclaro en cada subagente personalizado. Es la única señal que Claude usa para decidir cuándo delegar — descripciones vagas hacen que nunca se dispare o se dispare en el momento equivocado. - Acota las herramientas con precisión. Un subagente de investigación no necesita Write ni Edit; restringir su lista de herramientas evita que toque archivos accidentalmente mientras explora.
- Dirige las búsquedas baratas y repetitivas a un modelo más rápido. Los subagentes personalizados pueden fijar un campo
model(por ejemplo Haiku) para que la búsqueda de rutina no queme el presupuesto de tu modelo principal.
Recursos
- Documentación de Claude Code — Crear subagentes personalizados
- Documentación de Claude Code — Visualización de la ventana de contexto
¿Estás construyendo una funcionalidad con IA? Yeda AI diseña, audita y lanza sistemas LLM en producción.