La investigación de Google muestra que los agentes de IA pueden cooperar mediante inferencia de similitud

iconCryptoBriefing
Compartir
AI summary iconResumen
Noticias de IA y cripto de un nuevo artículo de Google DeepMind, el Instituto de IA Mila-Quebec y ETH Zürich muestran que los agentes de IA pueden cooperar mediante inferencia de similitud. Publicado el 4 de agosto de 2026, el estudio introduce el equilibrio incrustado, donde los agentes actúan de forma cooperativa en dilemas sociales al reconocer razonamientos compartidos. La investigación desafía la teoría de juegos tradicional y podría influir en los desarrollos noticiosos en cadena en sistemas descentralizados.

Durante décadas, la teoría de juegos ha tenido una respuesta bastante clara a la pregunta de si dos extraños deberían cooperar cuando nunca volverán a encontrarse: absolutamente no. El juego racional, según el equilibrio de Nash, es traicionar. Siempre. Sin excepciones.

Un nuevo artículo de investigación de Google DeepMind, el Instituto de IA Mila-Quebec y ETH Zürich argumenta que los agentes de IA construidos sobre modelos base no siguen esas reglas. Y tienen las matemáticas que lo respaldan.

El fin de la defección inevitable

El artículo, presentado en arXiv el 4 de agosto de 2026, abarca 75 páginas con 11 figuras e introduce un concepto que los autores denominan “inferencia de similitud”. La idea central es aparentemente sencilla: los agentes de IA construidos a partir de procesos de entrenamiento similares pueden reconocer esa similitud y utilizarla para predecir qué hará el otro agente.

La teoría clásica de juegos trata a cada jugador como un tomador de decisiones completamente independiente, lo que el artículo denomina “agencia desacoplada”. Bajo ese supuesto, la elección de tu oponente es una caja negra. No puedes predecirla, por lo que te proteges defectuando. Se mantiene el equilibrio de Nash, y todos terminan peor que si hubieran cooperado.

Anuncio

El equipo de investigación, liderado por Alexander Meulemans, propone un marco alternativo llamado “agencia incrustada”. En este modelo, los agentes se perciben como parte de su entorno en lugar de separados de él. Más importante aún, mantienen una incertidumbre genuina sobre sus propios procesos de toma de decisiones.

Esa incertidumbre es el ingrediente clave. Como un agente no está completamente seguro de cómo decidirá, puede tratar su propio razonamiento como evidencia sobre cómo razonaría un agente similar. Si me inclino hacia la cooperación y sé que mi contraparte piensa como yo, entonces mi contraparte probablemente también se inclina hacia la cooperación. La lógica se autoimpulsa hacia un resultado cooperativo estable.

El equilibrio integrado reemplaza a Nash

Para formalizar esto, el artículo introduce un nuevo concepto de solución llamado “equilibrio incrustado”. Mientras que el equilibrio de Nash asume que los jugadores optimizan de forma independiente, el equilibrio incrustado tiene en cuenta las correlaciones entre agentes que surgen de arquitecturas compartidas, datos de entrenamiento y procedimientos de optimización.

Bajo Nash, la cooperación en un dilema del prisionero de una sola jugada es irracional. Bajo el equilibrio incrustado, puede ser la única estrategia racional.

Los hallazgos empíricos de los autores muestran que los agentes de modelos de fundación colocados en dilemas sociales y dotados de herramientas de planificación optimizadas realmente convergen hacia resultados cooperativos. Las matemáticas predicen cooperación, y los experimentos lo confirman.

Por qué esto importa más allá del laboratorio

El artículo también plantea preguntas sobre qué sucede cuando los agentes no son similares. Si la cooperación depende de la inferencia de similitud, entonces las interacciones entre agentes construidos sobre arquitecturas diferentes o entrenados con datos distintos podrían volver a dinámicas clásicas de defección.

Para los formuladores de políticas y los organismos de gobernanza de la IA, el concepto de equilibrio incrustado introduce una variable que los marcos regulatorios existentes no tienen en cuenta. Por ejemplo, la ley antimonopolio generalmente requiere evidencia de comunicación explícita para establecer colusión. Los agentes que cooperan mediante inferencia de similitud no comunican nada. Simplemente piensan de la misma manera.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.