Harvard y MIT crean 8.3 mil millones de agentes de IA para simular el comportamiento humano global

icon MarsBit
Compartir
AI summary iconResumen
Un equipo liderado por Harvard y MIT, que incluye a OpenAI y Google DeepMind, ha lanzado MatrAIx, un sistema que genera 8.3 mil millones de agentes de IA para simular el comportamiento humano global. El proyecto utiliza 1.290 dimensiones para modelar poblaciones de diversos trasfondos y estilos de vida. Los agentes de IA operan en encuestas, chatbots, sitios web y aplicaciones, logrando un 91,5% de consistencia en las pruebas. La iniciativa se alinea con las crecientes noticias de IA + cripto y refleja el interés en la política cripto global.

Si te preparas para reencarnarte, ¿en qué país es más probable que nazcas?

¿Qué profesión, ingresos, valores e incluso qué pequeña preferencia por el color de un botón en una aplicación tendrás?

En el pasado, calcular esta probabilidad que abarca la sociología, la economía conductual y la psicología hacía que innumerables sociólogos y estadísticos se quedaran calvos.

Estudio de usuarios

La escena de ciencia ficción de la película The Matrix de 1999 ¡acaba de hacerse realidad!

Liderado por doctores de Harvard y MIT, con la participación de más de 40 expertos de OpenAI, Anthropic, Google DeepMind, xAI y otros, más de 200 científicos de élite lanzan MatrAIx, creando 8.3 mil millones de agentes para simular el comportamiento humano real en todo el mundo.

Estudio de usuarios

En la feroz batalla por el trono de los grandes modelos, los gigantes, de repente, se unieron de manera tácita para tejer una red: una «cortina digital» que encierra el comportamiento de toda la humanidad.

Estudio de usuarios

Papel: https://arxiv.org/abs/2608.04205

Repositorio de GitHub: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

Les otorgan personalidad a los agentes de IA:

1. Se crearon 8.3 mil millones de perfiles de usuarios a nivel mundial, que cubren 1.290 dimensiones, incluyendo antecedentes, psicología, habilidades, comportamiento y estilo de vida.

2. Admite la evaluación de agentes de perfil de usuario en cuatro tipos de entornos: encuestas, chatbots de IA, sitios web y aplicaciones.

3. Ofrece más de 1.000 tareas de evaluación que cubren 25+ áreas, incluyendo comercio, software, finanzas y salud.

Estudio de usuarios

Las habilidades clave de los investigadores de usuarios tradicionales y los product managers se devaluaron instantáneamente.

Al mismo tiempo, cada uno debe enfrentar un problema:

Cuando tu «personalidad» es solo una distribución de probabilidad coherente en 1290 dimensiones, ¿cómo demuestras que sigues siendo el único irreductible a simulación?

IA calcula toda la personalidad de la humanidad.

El momento Oppenheimer del product manager

La investigación de usuarios tradicional tuvo su «momento Oppenheimer» hoy.

Anteriormente, las grandes empresas tecnológicas necesitaban meses para lanzar una nueva aplicación o estrategia, reclutando cientos o miles de voluntarios reales de diversos colores y orígenes, y realizando innumerables pruebas piloto e entrevistas presenciales.

En el mundo de silicio de MatrAIx, este proceso de alta barrera, alta latencia y alto costo se comprime en un instante.

La base de datos de Persona-8B tiene un tamaño de 8.3 mil millones, logrando un espejo preciso uno a uno con la población total real de la Tierra física en este momento.

Estudio de usuarios

They don't need to pay for five insurances and one fund, yet they understand better than you how to elegantly reject a poor UI design on macOS.

Con estos 8.3 mil millones de nativos digitales disponibles para ser movilizados en cualquier momento, lo siguiente que hay que hacer es integrarlos en la vida social.

El equipo de MatrAIx ha creado cuatro entornos de simulación interactiva de canal completo, denominados MatrAIx Playground:

Estudio de usuarios

Encuestas: probar conceptos, sensibilidad a precios y disposición a pagar de distintos grupos.

Chat de IA (chatbots de IA): registro completo de la trayectoria de la conversación, seguimiento de las fluctuaciones emocionales reales y los hábitos de seguimiento de los usuarios virtuales cuando se enfrentan a errores o disparates de la IA [1.1.5].

Sitios web (Websites): El agente busca, compara precios y lee reseñas en esta red de prueba como un usuario normal, y finalmente toma una decisión de compra.

Aplicaciones: Esto ya ni siquiera es un enfrentamiento a nivel de texto. Los agentes pueden controlar directamente el escritorio de Linux, macOS e iOS mediante ratón virtual, teclado y toque para realizar diversas operaciones complejas con software cotidiano. El sistema registra sin omitir ningún detalle los cambios en archivos, cambios de permisos y trayectorias de operación.

En este entorno de prueba, el equipo de investigación ha implementado 1,010 tareas de evaluación complejas en 25 dominios diferentes (que abarcan comercio, software, finanzas, medicina, entre otros).

Estudio de usuarios

Realizaron un total de 18,189 experimentos de simulación a gran escala de interacciones de usuarios.

En 400 experimentos de control extremadamente rigurosos, estos agentes virtuales impulsados por modelos de base alcanzaron una consistencia del 91,5% con los personajes especificados.

Estudio de usuarios

Al evaluar la coherencia de los personajes extraídos de seres humanos reales, los expertos humanos otorgaron una puntuación alta de 4.135 (sobre 5).

Y el modelo subyacente que impulsa a estos avatares virtuales ya ha alcanzado un rendimiento casi idéntico al estándar de oro evaluado por humanos:

Claude Opus 4.8: en el 93.8% de los casos, su error de evaluación se mantiene dentro de 1 punto de la calificación de expertos humanos.

GPT-5.5: En el 79.2% de los casos, el error es de menos de 1 minuto.

Esto indica que los modelos de vanguardia actuales no solo dominan la lógica y el sentido común, sino que también han adquirido el "simulador de empatía" de la sociología.

Pueden calcular con precisión cómo una mujer de 50 años, perteneciente a la clase media estadounidense y con una personalidad conservadora e introvertida, manifestaría una furia y una decepción sutiles ante una vulnerabilidad en un producto tecnológico.

¿Cómo se «crearon» estos 8.300 millones de fantasmas digitales?

Detrás de cada «persona» hay una matriz de atributos precisa con 1.290 dimensiones de retrato. Estas dimensiones se dividen en cinco zonas centrales: información de fondo, características psicológicas, habilidades profesionales, interacción y comportamiento, vida diaria.

Estudio de usuarios

Las fuentes de datos incluyen estadísticas poblacionales de las Naciones Unidas, General Social Survey, biografías de Wikipedia, reseñas de consumo reales de Amazon, encuestas de desarrolladores de Stack Overflow…

Si se combinan al azar, la IA solo creará «monstruos cibernéticos» sin lógica. Por ejemplo, una entidad que vive en una zona rural de Kenia, tiene solo educación primaria, solo habla islandés, posee un doctorado de Harvard y gana un millón de dólares al año.

Para resolver este problema, el equipo de investigación construyó un gran gráfico dirigido acíclico (DAG). Existe una dependencia condicional estricta entre atributos:

Estudio de usuarios

Cuando el sistema determina la «capacidad en inglés» de un avatar virtual, debe calcular primero la probabilidad conjunta de los nodos padres «idioma principal» y «región».

Añada un filtro de compatibilidad aún más cruel: siempre que haya un conflicto irracional entre atributos padre e hijo, la puntuación se reinicia inmediatamente y la combinación se elimina con un solo clic.

Estudio de usuarios

Bajo el proceso de esta fórmula, los personajes virtuales generados mantienen una amplia diversidad, al tiempo que conservan una coherencia lógica inquebrantable en su interior.

Además, se incluyen cientos de millones de «fragmentos de alma reales» extraídos de historiales reales de humanos, como Wikipedia, historial de compras de Amazon y encuestas de desarrolladores de Stack Overflow; cada espíritu en la base de datos Persona-8B es como una persona real que vivió con carne y sangre en un universo paralelo.

¿Alguna vez has pensado: que tu preferencia por el color de una cierta aplicación en realidad se puede reducir al producto de las probabilidades de los nodos padres?

Cuando la personalidad se mide con precisión en 1290 escalas, lo que el ser humano llama «único» es, para la IA, solo una distribución de probabilidad coherente.

El bucle de Möbius del vacío

Es un milagro técnico, pero si quitas el manto de eficiencia que lo cubre, verás una verdad aterradora.

Los modelos grandes (como GPT-5.5, Claude Opus 4.8) desempeñan el papel de "consumidores" y "miembros de la sociedad" en MatrAIx para evaluar y probar a otro "persona virtual" impulsado por un modelo grande.

Es como si una persona, con la mano izquierda actuando como cliente, comprara el pan que hizo con la mano derecha, y luego la mano izquierda le diera a la mano derecha una calificación de cinco estrellas.

Estudio de usuarios

En este ciclo cerrado, los seres humanos reales, desaparecieron.

Si un usuario virtual otorga una puntuación alta del 91,5% a un nuevo medicamento o una aplicación de redes sociales en el entorno de prueba, ¿garantiza eso que complacerá a los seres humanos reales, que lloran, se portan mal, y están influenciados por el clima y las hormonas?

El efecto secundario más aterrador de este «ecosistema de autociclo» es la desaparición total de las «colas negras y las almas».

Las artes más grandes de la historia humana, los modelos de negocio más disruptivos e incluso los avances científicos más impresionantes a menudo no provienen de la «coherencia» calculada en 1290 escalas de probabilidad.

A menudo nacen de obsesiones incomprensibles y confusiones lógicas fortuitas: los valores atípicos que el filtro del algoritmo DAG considera «incompatibles» y elimina con un solo clic.

Si en el futuro todos los productos digitales, políticas y contenidos pueden probarse y optimizarse mediante una "simulación de AI de 8.3 mil millones de personas", entonces este mundo se volverá extremadamente fluido.

Pero también se volverá extremadamente vacío y aburrido.

Este es un mundo aburrido diseñado específicamente para satisfacer las preferencias de los fantasmas digitales.

Al final del artículo, el equipo de investigación mantuvo la prudencia y claridad propias de los científicos:

Los usuarios virtuales nunca podrán reemplazar por completo a los seres humanos reales; para las decisiones de alto riesgo que afectan el destino de la sociedad y las conclusiones científicas importantes, la participación directa de usuarios reales sigue siendo irremplazable.

Referencias:

https://matraix.ai/

https://arxiv.org/abs/2608.04205

https://github.com/MatrAIx-ai/MatrAIx-Persona-8B

https://x.com/MatrAIx2026/status/2085217711781564492

Este artículo proviene del canal de WeChat "Nuevas Inteligencias", autor: Apocalipsis ASI, editor: David

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.