Las últimas tendencias de IA presentadas por expertos
Obtenga insights curados sobre las noticias más importantes e intrigantes de la IA. Suscríbase a nuestro boletín semanal Think. Consulte la Declaración de privacidad de IBM .
Los agentes jerárquicos son agentes de inteligencia artificial (IA) que trabajan juntos en un sistema multiagente por niveles para realizar tareas complejas. Los agentes de nivel superior en un sistema jerárquico asumen responsabilidades más amplias y delegan subtareas enfocadas a agentes de menor nivel. Los agentes de IA del sistema se comunican verticalmente, y en ocasiones horizontalmente, para mantener todo el sistema alineado.
La estructura en capas separa los sistemas de agentes jerárquicos de los sistemas de agente único o de múltiples agentes planos en los que todos los agentes comparten el mismo nivel. Los sistemas de agentes jerárquicos destacan por su capacidad para abordar problemas complejos: los agentes de nivel superior se encargan de la estrategia y la orquestación de agentes de IA, los agentes de nivel intermedio impulsan la toma de decisiones tácticas de la IA y los agentes de nivel inferior completan las tareas asignadas desde arriba.
Obtenga insights curados sobre las noticias más importantes e intrigantes de la IA. Suscríbase a nuestro boletín semanal Think. Consulte la Declaración de privacidad de IBM .
La mayoría de las estructuras jerárquicas cuentan con dos o tres tipos de agentes, entre los que se incluyen:
Agentes de alto nivel
Agentes de nivel intermedio
Agentes de bajo nivel
Algunas arquitecturas de agentes jerárquicas cuentan con agentes de alto y bajo nivel, mientras que otros sistemas de IA también incluyen una capa intermedia.
Los agentes de alto nivel se encuentran en el nivel superior del sistema agéntico y pueden procesar tareas complejas, formular planes estratégicos, realizar la descomposición de tareas y gestionar procesos.
En las arquitecturas de agentes contemporáneas, los agentes de alto nivel suelen implementarse con modelos de IA avanzados, como modelos de lenguaje grandes (LLM). En el aprendizaje por refuerzo jerárquico tradicional, los agentes de alto nivel se basan en políticas aprendidas o planificadores simbólicos.
Los agentes de alto nivel son responsables del panorama general, gestionando el sistema en su conjunto en consonancia con objetivos más amplios. Interpretar una solicitud de usuario, formar un plan y dividir ese plan en tareas son responsabilidades de un agente de alto nivel.
Los agentes de nivel intermedio reciben directivas de agentes de alto nivel. Refinan e implementan planes, descomponen aún más las tareas cuando es necesario y coordinan equipos de agentes de bajo nivel. En jerarquías sin agentes de nivel intermedio, los agentes de alto nivel asumen estas funciones además de la planificación estratégica a mayor escala.
Los agentes de nivel intermedio también sirven como facilitadores de la comunicación, convirtiendo objetivos amplios en directivas específicas mientras consolidan los informes de los agentes de bajo nivel y los transmiten hacia arriba. Los agentes de alto nivel utilizan este feedback para monitorear el progreso y actualizar los planes según sea necesario.
Los agentes de bajo nivel son los ejecutores en la jerarquía: son agentes especializados que realizan tareas específicas según las indicaciones de los agentes de nivel intermedio y alto por encima de ellos. Los agentes de bajo nivel también se denominan subagentes.
Los agentes autónomos de bajo nivel están especializados en tareas específicas y pueden utilizar lógica basada en reglas, API, políticas aprendidas, controladores robóticos u otros algoritmos específicos de tareas. Algunos agentes de bajo nivel, como los agentes reflexivos simples, carecen de estado, en el sentido de que no mantienen un contexto de tarea ni una representación interna del entorno. Los agentes de nivel superior, como los agentes de aprendizaje, por el contrario, a menudo deben mantener el estado o el contexto para coordinar planes de varios pasos y realizar un seguimiento de las dependencias.
Los agentes de bajo nivel reciben directivas desde arriba, llevan a cabo sus tareas asignadas y luego informan sobre los resultados. Los agentes de nivel intermedio y alto utilizan los resultados de los agentes de nivel bajo para definir los siguientes pasos del proceso, en una serie de dependencias interrelacionadas.
Los sistemas jerárquicos se distinguen por las siguientes características clave:
Jerarquía de agentes
Descomposición de tareas
Especialización
Coordinación basada en feedback
En una empresa, los altos ejecutivos se centran en la planificación a gran escala, los mandos intermedios convierten las directivas de liderazgo en tareas operativas y los empleados manejan la mayor parte de la carga de trabajo real. Los sistemas de agentes jerárquicos aplican la misma estructura a los flujos de trabajo con agentes impulsados por IA.
La estructura de un sistema multiagente jerárquico se conoce como sistema de control por capas. Una estructura jerárquica clara impone roles de trabajo en todo el ecosistema agéntico. Cada nivel de la jerarquía tiene una función específica, ya sea la planificación estratégica, la toma de decisiones, la delegación y la asignación de tareas o la ejecución de tareas operativas.
Los sistemas de agentes jerárquicos prosperan gracias a la descomposición eficiente de tareas: el proceso de dividir una tarea en subtareas más pequeñas. El desglose también incluye cualquier dependencia que vincule tareas separadas. La descomposición de tareas se encuentra fuera del machine learning en muchos campos, como la gestión de proyectos y el desarrollo de software.
La descomposición de tareas es una estrategia útil en general para cualquiera que se enfrente a un desafío imponente. Convertir el desafío en una lista secuencial de pequeñas tareas manejables puede simplificar un proyecto complejo.
Cada nivel de la jerarquía tiene una función específica y, a menudo, cada agente dentro de un nivel también está especializado en una tarea concreta. La especialización de los agentes se observa con mayor frecuencia en los niveles inferiores, donde los agentes más simples enfocados en el trabajo automatizan las tareas rutinarias según sea necesario para cumplir directivas de mayor escala. El énfasis en la especialización agiliza los flujos de trabajo y conduce a una mayor eficiencia.
Los agentes de un sistema jerárquico se comunican constantemente en tiempo real. Algunos sistemas utilizan coordinación asincrónica, mientras que otros son estrictamente sincrónicos.
Los agentes de alto nivel envían directivas a la cadena de mando, mientras que los agentes de nivel inferior informan con los resultados de sus tareas. Los agentes de alto nivel utilizan estos resultados para optimizar la estrategia en el futuro, creando nuevas tareas y alterando la prioridad de las tareas para que se adapten mejor al objetivo a largo plazo.
Mientras tanto, los agentes también pueden comunicarse horizontalmente según sea necesario para coordinar el trabajo y compartir resultados.
Los sistemas de agentes jerárquicos son ideales para la automatización de procesos de negocio y otros casos de uso del mundo real que implican procesos operativos complejos, tales como:
Gestión de la cadena de suministro y logística
Fabricación y producción
RAG agéntica
Ciberseguridad
Vehículos autónomos y bots de entrega
En una implementación de la cadena de suministro y la logística, los agentes de alto nivel se encargarían de planificar la estrategia general de gestión de inventario. Los agentes de nivel intermedio dividirían la estrategia en implementaciones localizadas, mientras que los agentes de bajo nivel se encargarían de las operaciones de almacén y las rutas de envío.
Para la fabricación, los agentes de alto nivel elaborarían una estrategia para ayudar a garantizar que la producción satisfaga la demanda de manera oportuna. Los agentes de nivel intermedio convertirían esas directivas en tareas para que los agentes de bajo nivel las implementen a nivel local, por ejemplo, controlando máquinas y líneas de producción en una fábrica.
La generación aumentada por recuperación (RAG, por sus siglas en inglés) brinda planificación agéntica a los sistemas RAG. Un agente gerente de alto nivel puede coordinar el flujo de trabajo, mientras que los agentes especializados se encargan de la recuperación, reclasificación o puntuación de documentos, resumen y generación de contenido. En muchos sistemas RAG agénticos, la interacción del usuario se realiza a través de una interfaz de chatbot, aunque la RAG también puede impulsar aplicaciones que no sean de chat.
Los sistemas multiagente en el ámbito de la ciberseguridad pueden utilizar un equipo de agentes para supervisar los sistemas y combatir las amenazas. Los agentes de alto nivel se encargarían de coordinar la estrategia a largo plazo y las actualizaciones de las políticas, mientras que los agentes de bajo nivel se ocuparían de la detección rápida de anomalías y de las respuestas automatizadas de contención.
Las flotas de vehículos autónomos pueden gestionarse mediante sistemas de agentes jerárquicos de manera similar a una flota logística. Los agentes de alto nivel optimizarían el inventario de bots de entrega, teniendo en cuenta los horarios de mayor pico de pedidos y otros factores relevantes. Los agentes de nivel intermedio coordinan las entregas dentro de un área asignada, mientras que los agentes de nivel bajo hacen pilotos de bots de entrega individuales.
Los beneficios de un sistema de agentes jerárquicos incluyen:
Dentro de un sistema jerárquico de múltiples agentes, cada agente o grupo de agentes es una unidad discreta. Las pruebas, el desarrollo y la implementación pueden gestionarse de forma individualizada. La estructura modular permite el desarrollo, las actualizaciones y la depuración sin afectar todo el sistema.
La jerarquía aporta claridad. Cada agente en el sistema tiene un rol definido. Sin roles aplicados, los agentes podrían no coordinarse de manera efectiva, lo que llevaría a resultados subóptimos, como cuellos de botella, costos más altos, retrasos en la producción y un flujo de trabajo más caótico.
La modularidad de un sistema de agentes jerárquico mejora su escalabilidad. Las organizaciones pueden agregar más agentes según sea necesario a un grupo, nivel o rol específico sin tener que reconstruir el sistema general desde cero. Un agente de alto nivel puede coordinar un número cada vez mayor de agentes de nivel intermedio y bajo sin necesidad de una reprogramación significativa.
Debido a que los sistemas jerárquicos son modulares, las organizaciones pueden agregar redundancia dentro de los niveles clave, mejorando la tolerancia general a fallas. Al contar con varios agentes que operan en paralelo, un sistema multiagente puede mantener operaciones aunque uno o varios agentes dejen de responder. Los agentes de gestión de nivel superior pueden reasignar tareas y reestructurar flujos de trabajo según sea necesario.
Los desafíos de diseñar e implementar un sistema jerárquico de agentes incluyen:
Complejidad
Rigidez
Obstáculos en la comunicación
Los sistemas jerárquicos tienen un diseño complejo y requieren una comprensión detallada del proceso o la operación que el sistema debe gestionar. Si se diseña correctamente, un sistema de agentes jerárquico puede facilitar una automatización fluida. Sin embargo, cuando el diseño es deficiente, las desventajas pueden incluir operaciones ineficientes, directivas contradictorias para los agentes y costos excesivos.
Los sistemas altamente jerárquicos con largas cadenas de decisión pueden tener dificultades en entornos de alta volatilidad donde los retrasos en cascada conducen a decisiones y acciones obsoletas. Las arquitecturas multiagente más descentralizadas podrían ser más adecuadas para escenarios dinámicos.
Las empresas que desean automatizar partes de su negocio deben ser prudentes al elegir qué áreas son lo suficientemente estables como para confiarlas a un equipo de agentes de IA. Es mejor dejar los entornos impredecibles en manos de equipos de trabajadores humanos más adaptables y de pensamiento rápido.
La calidad de un sistema multiagente jerárquico depende de su ancho de banda de comunicación o de sus limitaciones de latencia. Los agentes deben poder enviar datos hacia arriba y hacia abajo en la cadena de mando para que el sistema funcione sin problemas.
Los retrasos en la comunicación pueden hacer que los agentes de alto nivel reciban datos que ya no reflejan las circunstancias reales. Los obstáculos en la comunicación son especialmente agudos cuando los agentes de alto nivel dependen de un razonamiento computacionalmente costoso, porque los retrasos pueden llevar a que agentes de menor nivel operen con instrucciones obsoletas.
Permita a los desarrolladores crear, desplegar y monitorear agentes de IA con el estudio IBM watsonx.ai.
Cree una productividad revolucionaria con uno de los conjuntos de capacidades más completos de la industria para ayudar a las empresas a crear, personalizar y gestionar asistentes y agentes de IA.
Logre un ahorro de más del 90 % en costos de energía con los modelos más pequeños y abiertos de Granite, diseñados para mejorar la eficiencia de los desarrolladores. Estos modelos preparados para empresas ofrecen un rendimiento excepcional contra puntos de referencia de seguridad y en una amplia gama de tareas empresariales, desde la ciberseguridad hasta el RAG.