Description
El día que le das a tu agente una herramienta que puede mover plata, borrar una tabla o mandarle un mail a un cliente, la cosa cambia. Un agente útil tiene que poder llamar esa herramienta; uno seguro no puede tener permitido llamarla solo. Si la bloqueás del todo, el agente queda inútil. Si le decís al modelo ‘no la uses sin permiso’, hiciste una promesa que se olvida, que racionaliza para saltearla, o que alucina haber recibido. Lo que falta es un mecanismo que mantenga disponible la herramienta peligrosa pero que solo deje pasar la llamada cuando un humano de verdad dijo que sí, fresco, a esa acción exacta.
Esta guía te muestra cómo construir agentes que exigen aprobación humana antes de ejecutar acciones irreversibles, con una garantía real (no una promesa del prompt) de que esa aprobación es genuina, está acotada a una sola acción y no se puede reusar ni falsificar. La estrategia es mover la autorización del lugar donde casi todos la ponen (las instrucciones del modelo, que se olvidan, se racionalizan o se alucinan) al único lugar donde no se puede esquivar: el código que ejecuta la herramienta. Vas a aprender a decidir qué herramientas merecen una barrera y cuáles no, cómo lograr que el humano apruebe en contexto y dentro de la misma conversación sin frenar al agente en todo lo demás, y cómo el agente retoma la tarea solo cuando hay un sí real. El cómo exacto de esa garantía lo construís pieza por pieza, con una implementación de referencia en Python lista para portar a cualquier plataforma. Para ingenieros que ya construyeron agentes y ahora necesitan ponerles límites en los que se pueda confiar.
¿Este libro es para vos?
Esta guía es para: ingenieros que construyen agentes de IA con acceso a herramientas consecuentes (fusionar código, mandar correos masivos, desactivar cuentas, borrar registros) y necesitan que un humano apruebe esas acciones antes de que se ejecuten, sin confiar esa decisión a un prompt.
El secreto de este libro
Las 7 claves para la habilidad de IA que las empresas pagan porque un prompt no la reemplaza. El patrón con el que tu agente conserva sus herramientas peligrosas y aun así nunca dispara una sin un sí humano de verdad. No una promesa enterrada en el prompt que el modelo olvida o de la que se autoconvence, sino una aprobación que el código en ejecución exige, chequea y confía, acotada a una sola acción e imposible de falsificar o reusar. Pasás de un agente que tenés que vigilar a uno que por fin podés dejar correr.
Todo lo que hay adentro
- Capítulo 1: El día que le das a tu agente una herramienta que puede hacer daño de verdad
- Capítulo 2: Qué herramientas tu agente nunca debería ejecutar solo
- Capítulo 3: Qué tiene que ser verdad antes de que la barrera se abra
- Capítulo 4: Cómo una aprobación para una acción se niega a servir para cualquier otra
- Capítulo 5: Qué pasa si alguien manipula la aprobación camino al botón
- Capítulo 6: Poner la barrera donde el modelo no puede discutir
- Capítulo 7: Por qué la aprobación tiene que aparecer justo donde el agente está trabajando
- Capítulo 8: El único lugar por el que un grant nunca puede pasar
- Capítulo 9: Cómo el agente retoma una tarea que dejó a medias
- Capítulo 10: Por qué una aprobación que nunca vence es peor que no tener ninguna
- Capítulo 11: Cuando dos personas aprueban a la vez y el merge pasa dos veces
- Capítulo 12: Mirá todas las piezas funcionando juntas en un solo flujo
- Capítulo 13: La decisión que vas a tomar cada vez que le des una herramienta nueva a un agente
- Capítulo 14: Construir la mitad que frena una llamada peligrosa
- Capítulo 15: Construir la mitad que deja pasar la llamada
- Capítulo 16: Llevar el patrón a cualquier stack que ya uses


