Hay una duda muy tonta que suele generar confusión cuando hablamos de lo que puede hacer la IA. Es de esas dudas que dentro de unos años nadie entenderá, porque se habrá superado, pero que hoy conviene aclarar: ¿qué es un agente y qué no lo es?
Hasta hace un par de años los LLM eran algo que contestaba preguntas: podíamos verlos como un montón de información comprimida que podíamos consultar. Ahora se están convirtiendo en agentes capaces de llevar a cabo tareas. Y claro, surge la pregunta de dónde está la frontera: ¿un chatbot que busca en internet ya es un agente? ¿Hace falta que pueda ejecutar código?
El señor Andrew Ng tiene una respuesta que me parece bastante sensata: en lugar de discutir si algo es un agente o no, deberíamos hablar de IA agéntica con distintos grados de autonomía. De hecho, eligió el adjetivo «agéntico» precisamente para no tener que contestar con un sí o un no.
- En el nivel menos autónomo, el LLM sigue siempre los mismos pasos, que ha fijado de antemano quien ha programado el sistema. Algo parecido a lo que hacemos al interactuar con un LLM convencional:
prompt usuario -> LLM -> busca en internet -> coge contenidos web -> LLM -> genera texto - En un nivel con autonomía intermedia, el LLM tiene varias herramientas entre las que elegir y decide cuáles usar para completar la tarea:
prompt usuario -> LLM elige entre herramientas (búsqueda web, noticias, arxiv) -> LLM (¿más herramientas?) -> LLM -> genera texto - En el nivel más autónomo, el LLM puede definir su propio flujo de trabajo y las herramientas a utilizar, incluyendo la creación de herramientas nuevas, para completar la tarea.
Para verlo mejor voy a poner un par de ejemplos: uno de lo que mejor conozco, la programación, y otro más cotidiano, buscar vuelos.
En programación
Nivel menos autónomo: le pego al LLM un trozo de código que tiene que terminar y le escribo en el prompt qué tiene que hacer. El LLM busca en internet qué funciones son las más adecuadas y me contesta con el código necesario para implementar la función. Aquí el LLM no tiene acceso al resto del código fuente de mi proyecto, y eso limitaba mucho esta etapa. Tampoco puede compilar el código ni comprobar si funciona.
Nivel de autonomía intermedia: el LLM tiene acceso al código fuente de mi proyecto. Le indico los cambios que debe implementar y él elige sus herramientas (buscar en el código, escribir código, ejecutar las pruebas) para terminar la tarea y comprobar que está bien resuelta. Aquí el agente ya hace muchas de las tareas que hace un programador.
Nivel más autónomo: el LLM podría generar sus propias herramientas para comprobar que la solución que ha escrito se integra en el entorno real: pruebas específicas contra la base de datos, ejecución en entornos concretos, situaciones reales.
En búsqueda de vuelos
Nivel menos autónomo: le pido al LLM que busque vuelos baratos a Bruselas. Hace alguna búsqueda en internet y me devuelve los resultados más interesantes. Pero probablemente no pueda comprobar la disponibilidad real de los vuelos, y los precios seguramente no estarán actualizados.
Nivel de autonomía intermedia: el agente trabaja en un entorno conectado a plataformas de reservas mediante MCP (el protocolo que se está imponiendo para conectar los LLM con herramientas externas), así que puede comprobar la disponibilidad y los precios reales. Y si además le conectamos una cartera con medios de pago, podría hacer la reserva.
Nivel más autónomo: podría generar las herramientas necesarias no sólo para reservar el vuelo, sino para organizar el viaje completo, entender para qué es el viaje y ajustar sus requisitos (número de días, acompañantes, etc.).
Son ejemplos bastante tontos, pero sirven para ilustrar que la autonomía no es una variable booleana de sí o no, sino un espectro en el que los agentes tienen cada vez más capacidad de decisión y de actuación.
Y fijaos en un detalle: el salto de un nivel a otro no depende sólo de lo listo que sea el modelo, sino de lo que le dejamos hacer. Las herramientas que usa un agente definen su ámbito de actuación. El código de mi proyecto, las plataformas de reservas, la cartera. Así que quizá la pregunta útil no sea si algo es un agente o no, sino cuánta autonomía tiene.

Deja un comentario