AgentRadio muestra que coordinar agentes de IA puede superar a modelos más potentes en tareas de código

Un nuevo trabajo sobre AgentRadio apunta a una idea cada vez más importante en inteligencia artificial empresarial: coordinar bien a varios agentes puede rendir más que usar un único modelo más potente. VentureBeat recogió los resultados de investigadores de Coral AI Labs y universidades colaboradoras, que probaron una capa de mensajería asíncrona para agentes de código. En tareas complejas sobre repositorios reales, el sistema superó a agentes aislados y también a un agente individual ejecutado sobre Claude Opus 4.8.

La propuesta parte de un problema conocido por cualquier equipo de ingeniería. Entender un repositorio grande no es una tarea lineal. Hay configuración, rutas de ejecución, dependencias, logs, tests, documentación incompleta y efectos entre módulos. Un agente único puede seguir un camino razonable, pero si descubre tarde una pista importante, quizá ya ha comprimido o perdido contexto. Varios agentes pueden cubrir más terreno, pero solo si comparten hallazgos a tiempo.

AgentRadio intenta resolver un cuello de botella concreto: un agente que trabaja también necesita escuchar cuando otro descubre algo relevante.

El sistema introduce tres primitivas sencillas: crear conversaciones, enviar mensajes y esperar menciones. La diferencia está en que esa comunicación ocurre sin obligar a todos los agentes a detenerse en rondas sincronizadas. En vez de revisar al final lo que hizo cada uno, los agentes pueden avisarse durante la ejecución. Para tareas con dependencias cruzadas, ese matiz cambia mucho.

Según VentureBeat, en el benchmark SWE-Atlas QnA un solo agente con Claude Opus 4.6 resolvió el 32,3% de las tareas. El sistema completo con AgentRadio alcanzó el 62,1% y superó al agente individual con Opus 4.8, que marcaba alrededor del 57,2%. La comparación no significa que los modelos importen menos. Significa que la arquitectura de coordinación empieza a ser una variable de rendimiento por sí misma.

El coste también sube. El artículo recoge que el gasto medio por tarea pasó de unos 2,96 dólares para un agente Opus a 19,45 dólares con la configuración completa. Aun así, los investigadores compararon contra ejecuciones independientes con coste parecido y observaron peor resultado. La conclusión práctica es que gastar más tokens sin coordinación no resuelve necesariamente el problema.

Para empresas, la pregunta no será cuántos agentes desplegar, sino cuándo una tarea justifica repartir responsabilidades.

Los casos más claros son investigaciones de arquitectura, incidentes entre servicios, migraciones con muchos módulos, análisis de seguridad y cambios donde una respuesta incompleta tiene coste. En una modificación local de un archivo, añadir agentes puede ser ruido. En una base de código heredada, con dependencias entre equipos, la coordinación puede evitar que cada agente confirme su propia hipótesis sin ver evidencia contraria.

AgentRadio también anticipa un requisito de gobernanza. Si varios agentes negocian, se corrigen y toman decisiones, la empresa necesita saber qué agente dijo qué, con qué evidencia y por qué se aceptó una acción. La trazabilidad deja de ser un registro bonito y pasa a ser una condición para confiar en flujos autónomos. Sin ella, el resultado puede funcionar, pero será difícil defenderlo en una revisión técnica.

El trabajo no convierte los equipos de agentes en solución universal. Los propios investigadores advierten de que la comunicación puede distraer, propagar errores o aumentar costes si no se enruta bien. Pero sí marca una dirección: la próxima mejora en productividad de software puede venir menos de un modelo único y más de sistemas que asignan tareas, comparten contexto y escalan la revisión como lo haría un equipo humano bien organizado.

Para los responsables de tecnología, el mensaje es útil. Antes de comprar más capacidad, conviene mirar el diseño del flujo. Un agente que no escucha puede quedarse corto. Diez agentes que hablan sin criterio pueden saturar el proceso. La ventaja estará en coordinar lo justo, en el momento correcto y con evidencia verificable.

Contenido generado con IA. Este artículo ha sido elaborado mediante inteligencia artificial y puede no haber sido sometido a una revisión humana sustantiva. Más información sobre nuestra política editorial .