Se veía venir...
Añadir demasiadas skills al LLM de turno hace que el sistema empeore...
Las cosas como son:
Los mejores agentes no son los que ganan más tareas son los que regresan menos a volver a hacer la tarea
Un estudio midió qué pasa cuando añades procedimientos (skills) a un agente.
El resultado: tareas que antes resolvía solo, ahora fallan.
3 causas:
1️⃣ Osmosis de descripción: el skill cambia el comportamiento solo por estar en contexto, aunque nunca se invoque.
2️⃣ Desplazamiento de grounding: el procedimiento prescrito sobrescribe cómo el agente interpreta inputs.
3️⃣ Desplazamiento de verificación: el procedimiento suprime checks que el agente haría por su cuenta.
Spoiler: estamos añadiendo complejidad sin medir el coste real.
Y cuando digo coste... es que literalmente destruyes casos de uso que antes funcionaban.