Yeda AI Tips · #145

English

Nunca aceptes el primer plan de tu IA sin ver al perdedor

Nunca aceptes el primer plan de tu IA sin ver al perdedor. Cuando un agente te entrega un solo enfoque con un párrafo prolijo de justificación, no estás viendo una decisión: estás viendo un valor por defecto. El modelo tomó el primer patrón plausible de su distribución de entrenamiento y luego lo racionalizó. Eso no es lo mismo que sopesar opciones y elegir.

Por qué una sola opción es una señal de alerta

Una elección solo significa algo en relación con lo que rechazaste. Si no se rechazó nada, no se eligió nada. La salida de una sola opción esconde tres fallas a la vez: el modelo nunca exploró el espacio, así que no puede decirte qué se saltó; no puede mostrar el trade-off que de verdad te importa; y cuando el plan choca contra una pared en la segunda semana, no tienes ningún plan de respaldo documentado ni registro de por qué ganó este camino.

Esto no es una rareza de un modelo: es cómo funciona la generación greedy. Pide "la respuesta" y obtienes la continuación de mayor probabilidad, que es segura, fluida y completamente muda sobre los caminos no tomados.

La solución: divergir y luego converger

Haz que el agente cumpla dos tareas separadas en orden. Primero divergir: generar enfoques genuinamente distintos, no tres versiones de la misma idea. Luego converger: puntuarlos y comprometerse con uno, dejando al segundo mejor en el registro.

FaseQué exigesQué rechazas
Divergir3+ enfoques que difieren en arquitectura, no en redacción"La opción B es la opción A con caché"
JuzgarPuntuar por costo, riesgo y reversibilidadIntuición, o "esta se siente más limpia"
ConvergerUna elección más el segundo mejor y exactamente por qué perdióUn ganador sin alternativa nombrada

Coloca esto en tu prompt o en el paso de planificación de tu agente:

Before recommending anything, generate at least THREE genuinely different
approaches. They must differ in structure, not just naming.

Score each on: implementation cost, blast radius / risk, and reversibility.

Then output:
  1. Your pick and why.
  2. The strongest runner-up and the SPECIFIC reason it lost.
  3. The trigger that would make the runner-up the right call instead.

Esa última línea es la que la gente olvida. "Por qué perdió" es un veredicto estático; "qué lo cambiaría" es un plan de respaldo vivo sobre el que puedes actuar cuando la realidad contradice al plan.

El beneficio

El segundo mejor se gana su lugar dos veces. Cuando la elección se estanca —la biblioteca que elegiste queda obsoleta, la API que asumiste no existe— ya tienes escrito el siguiente movimiento, junto con las condiciones que ahora lo favorecen. Y la opción rechazada es el rastro de auditoría que prueba que la elección fue razonada, no el camino de menor resistencia. Por eso los equipos de ingeniería maduros escriben Architecture Decision Records con secciones obligatorias de "Considered Options" y "Pros and Cons": registrar solo al ganador tira a la basura el análisis que hizo defendible la decisión.

Jugadas avanzadas

Recursos

¿Construyes agentes que de verdad deciden? Yeda AI diseña, audita y despliega sistemas LLM en producción que razonan en lugar de recurrir a valores por defecto.

Habla con nosotros · Lee el blog