Árbol de conocimiento
En esta página

Bucle de agente

El ciclo en el que un agente observa un resultado, decide el siguiente paso, actúa y repite hasta terminar.
Actualizado 28 ago 2026

Un bucle de agente repite una secuencia sencilla: observar el estado actual, decidir el siguiente paso, actuar, recibir el resultado y volver a decidir.

La parte importante es que el resultado cambia lo que ocurre después. La ruta completa no está fijada de antemano.

Bucle de agente El agente observa, decide, actúa y recibe un resultado. Ese resultado se convierte en la siguiente observación hasta que alcanza el objetivo y termina. Tarea Observar Leer el último inputo resultado de tool Decidir Elegir el siguiente pasoa partir del resultado Actuar Llamar a una tool odar una respuesta Resultado Recibir el outputdel entorno Siguiente observación Terminar Bucle de agente El agente observa, decide, actúa y recibe un resultado. Ese resultado se convierte en la siguiente observación hasta que alcanza el objetivo y termina. Tarea Observar Leer el último inputo resultado de tool Decidir Elegir el siguiente pasoa partir del resultado Actuar Llamar a una tool odar una respuesta Resultado Recibir el outputdel entorno Terminar Siguiente observación
Figura 1. El agente utiliza el resultado de cada acción para elegir el paso siguiente o terminar.

Ejemplo con un coding agent

Un agente recibe la tarea de corregir un test:

  1. Ejecuta el test y observa el error.
  2. Lee el test y el código relacionado.
  3. Modifica un fichero.
  4. Ejecuta el test otra vez.
  5. Si falla, utiliza el nuevo error para decidir qué revisar.
  6. Si pasa y la tarea está completa, termina.

El agente no necesitaba saber desde el principio cuántas veces leería código o ejecutaría tests. Cada resultado le permitió elegir el paso siguiente.

Tools y ejecución

El modelo normalmente no modifica el entorno por sí solo. Propone una tool call y el harness ejecuta la operación: leer un fichero, cambiar código o lanzar el test. El resultado vuelve al modelo como una observación nueva.

Una tool call aislada no convierte automáticamente una aplicación en un agente. Puede formar parte de una secuencia fija. Hay loop cuando el sistema vuelve a decidir a partir del resultado y puede cambiar de dirección.

Cuándo termina

El loop debe tener una condición útil de finalización. En el ejemplo anterior, el test pasando no basta si la tarea también exige ejecutar el build. La condición de éxito incluye toda la validación solicitada.

También puede terminar porque necesita una decisión del usuario, porque una acción requiere aprobación o porque ya no puede avanzar. Repetir el mismo comando fallido sin cambiar nada no es progreso; el resultado debería provocar otra hipótesis, una petición de ayuda o la parada.

Diferencia frente a un workflow fijo

En un workflow fijo, los pasos ya están definidos: por ejemplo, parsear un fichero, validar su schema y guardarlo. En un agent loop, el modelo elige entre las acciones disponibles según lo que encuentra.

Ambos enfoques pueden combinarse. El agente decide ejecutar los tests, pero el test runner sigue siendo software determinista con pasos conocidos.

Uso de herramientas desarrolla cómo se ejecuta una tool call. Harness de agente explica el programa que mantiene este loop.

Referencias