La inteligencia artificial avanza hacia un nuevo nivel de autonomía. Anthropic, la empresa desarrolladora de Claude, ha comenzado a probar una innovadora función bautizada como ‘Soñar’ en su plataforma Claude Managed Agents. Esta capacidad permite que el modelo revise sesiones pasadas para identificar patrones, detectar errores y, de esta forma, ayudar a los agentes de IA a perfeccionarse por sí mismos en futuras tareas.
La plataforma Claude Managed Agents está diseñada para que los usuarios creen y desplieguen agentes de inteligencia artificial autónomos basados en Claude directamente en la infraestructura en la nube de Anthropic. Su objetivo es simplificar la ejecución de tareas en sesiones prolongadas sin que sea necesario gestionar servidores de forma manual.
Con la nueva función de ‘Soñar’, Anthropic busca que estos agentes sean más eficientes y trabajen mejor en equipo, aprendiendo de sus propios fallos. La compañía lanzó esta herramienta como una vista previa para investigación. Según explicó la firma en un comunicado oficial, el proceso consiste en que Claude revisa las sesiones de tareas anteriores de los agentes, extrae patrones y organiza los recuerdos para que los agentes logren “mejorar con el tiempo” por sí mismos.
En la práctica, Claude revive las tareas anteriores mediante un método que la empresa denomina “simulación de sueños”. Este sistema revela patrones que “un solo agente no puede percibir” mientras ejecuta una tarea. De esta manera, el modelo identifica errores frecuentes, flujos de trabajo donde convergen varios agentes y preferencias compartidas entre ellos.
Con base en esa información, Claude reestructura la memoria de los agentes e incorpora estas observaciones a medida que evolucionan en las siguientes tareas. El resultado, según Anthropic, se traduce en un mejor desempeño en labores de larga duración y en la orquestación multiagente.
Memoria y sueños: un sistema de autorrefinamiento
“La memoria y los sueños, en conjunto, conforman un sólido sistema de memoria para agentes que se perfeccionan a sí mismos. La memoria permite que cada agente capture lo que aprende durante su trabajo”, aclaró Anthropic en su comunicado.
La función de ‘Soñar’ puede actualizar la memoria de los agentes de forma automática. No obstante, los usuarios tienen la posibilidad de revisar los cambios sugeridos antes de que se apliquen en sesiones futuras, lo que otorga un control adicional sobre el proceso de aprendizaje.
‘Outcomes’ y orquestación multiagente
Además de la función de ‘Soñar’, Anthropic ha implementado una característica denominada ‘Outcomes’ o resultados. Esta opción se basa en definir “una rúbrica que describe qué significa el éxito” en una tarea concreta, de modo que el agente encargado tenga presente ese objetivo y trabaje para alcanzarlo.
Una vez que la tarea se completa, un agente independiente la evalúa de manera automática. Este evaluador compara el resultado obtenido con los criterios establecidos en la rúbrica. Si no se cumplen, el agente vuelve a intentar el proceso de otra forma, tantas veces como sea necesario, hasta lograr el éxito.
Este mecanismo automático garantiza resultados más confiables sin que los usuarios tengan que supervisar cada paso del proceso. Anthropic señala que es una opción particularmente útil para tareas que exigen atención al detalle y una cobertura exhaustiva.
Por otro lado, para escenarios donde la carga de trabajo resulta excesiva para un solo agente, la compañía ha lanzado la orquestación multiagente. En este esquema, un agente principal divide la tarea en distintas partes y delega cada una a un especialista que cuenta con su propio modelo.
Estos agentes especializados trabajan en paralelo en un sistema de archivos compartido y contribuyen al contexto general del agente principal. Además, cada paso de estos subagentes puede rastrearse en la consola de Claude, ofreciendo total transparencia en el proceso.
Tanto ‘Outcomes’ como la orquestación multiagente ya están disponibles en beta pública dentro de la plataforma Managed Agents.
Fuente: Infobae