Yeda AI Tips · #013

English

Read in English

Dale su propio agente al trabajo pesado

¿La forma más rápida de envenenar las respuestas de tu IA? Meter cada detalle desordenado en una sola conversación. Resultados de búsqueda, volcados enormes de logs, las entrañas de cuarenta archivos que hojeaste una vez y no necesitas nunca más — todo eso queda en tu contexto principal, diluyendo la señal que el modelo necesita para razonar bien. La respuesta de Claude Code son los subagentes: agentes auxiliares que hacen el trabajo ruidoso en su propia ventana de contexto y devuelven solo un resumen limpio.

El problema: la contaminación del contexto

Cada token en tu conversación es algo que el modelo tiene que sopesar al producir su siguiente respuesta. Cuando le pides a tu asistente que "encuentre dónde se maneja la autenticación", una búsqueda directa puede volcar decenas de rutas de archivos, coincidencias de grep y fragmentos irrelevantes directo en el hilo principal. Nada de esa basura se elimina después — simplemente queda ahí, compitiendo por la atención con la tarea real, y acercándote a un límite de la ventana de contexto que tarde o temprano tendrás que compactar o reiniciar.

La solución no es "buscar menos". Es separar la exploración del razonamiento. A la exploración se le permite ser desordenada. La conversación que realmente estás teniendo con tu IA no debería serlo.

Cómo funciona el aislamiento por subagentes

Un subagente corre en su propia ventana de contexto, con su propio prompt de sistema y sus propios permisos de herramientas. Cuando Claude Code delega una tarea a un subagente, ese subagente lee lo que necesite — archivos, logs, resultados de búsqueda — dentro de su ventana privada. Cuando termina, solo su informe final cruza de vuelta a tu conversación principal. Los cuarenta archivos que abrió, los greps fallidos, las líneas de log que escaneó y descartó: nada de eso toca tu hilo.

Este es exactamente el mecanismo que señala el reel: un subagente "has like a context window" propio, y "only summary lands into the main context". No es una metáfora — es como está construida la funcionalidad. Claude Code incluye tres subagentes integrados que verás usarse automáticamente:

También puedes definir subagentes personalizados como archivos Markdown con frontmatter YAML (name, description, tools, model) guardados en .claude/agents/ para un proyecto o en ~/.claude/agents/ para ti en cada proyecto. Claude lee el description de cada subagente para decidir cuándo una tarea le corresponde — escribe esa descripción con claridad, porque es la única señal que Claude usa para dirigir el trabajo allí.

Cuándo delegar

Recurre a un subagente siempre que una tarea vaya a producir una pila de resultados intermedios que no necesitarás conservar:

En cada caso, el valor está en la conclusión, no en el proceso. Quieres "la autenticación vive en middleware/auth.ts, usa JWT con una expiración de 15 minutos" — no los veinte archivos que Claude abrió para averiguarlo.

Una regla: no edites en paralelo

Los subagentes aíslan la lectura, pero no coordinan mágicamente la escritura. Si levantas varios agentes auxiliares y los pones a todos editando el mismo proyecto a la vez, su trabajo no encajará — cada uno trabaja desde su propia instantánea del mundo y no tiene visibilidad de lo que los demás están haciendo simultáneamente. Usa subagentes libremente para investigación en paralelo; mantén las ediciones a un agente (o un archivo) a la vez, o serializa el trabajo para que cada edición se aplique antes de que empiece la siguiente.

Un ejemplo concreto

Digamos que estás depurando un test de integración inestable. En vez de pegar el log completo de CI en tu chat principal, delega: "usa un subagente para leer este log de 3.000 líneas y dime qué aserción falló y por qué". El subagente ingiere el log entero en su propia ventana, y tu hilo principal recibe una respuesta de dos oraciones. Ahora puedes hacer tres preguntas de seguimiento sin haber pagado nunca el costo en tokens de ese volcado de log. Repite esto para explorar un repo desconocido antes de tu primera edición, o para hacer grep en un monorepo y confirmar que nada más llama a una función que estás por cambiar.

Trucos avanzados

Recursos

¿Estás construyendo una funcionalidad con IA? Yeda AI diseña, audita y lanza sistemas LLM en producción.

Habla con nosotros · Lee el blog