Si te preparas para reencarnarte, ¿en qué país es más probable que nazcas?
¿Qué profesión, ingresos, valores e incluso qué pequeña preferencia por el color de un botón en una aplicación tendrás?
En el pasado, calcular esta probabilidad que abarca la sociología, la economía conductual y la psicología hacía que innumerables sociólogos y estadísticos se quedaran calvos.

La escena de ciencia ficción de la película The Matrix de 1999 ¡acaba de hacerse realidad!
Liderado por doctores de Harvard y MIT, con la participación de más de 40 expertos de OpenAI, Anthropic, Google DeepMind, xAI y otros, más de 200 científicos de élite lanzan MatrAIx, creando 8.3 mil millones de agentes para simular el comportamiento humano real en todo el mundo.

En la feroz batalla por el trono de los grandes modelos, los gigantes, de repente, se unieron de manera tácita para tejer una red: una «cortina digital» que encierra el comportamiento de toda la humanidad.

Papel: https://arxiv.org/abs/2608.04205
Repositorio de GitHub: https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
Les otorgan personalidad a los agentes de IA:
1. Se crearon 8.3 mil millones de perfiles de usuarios a nivel mundial, que cubren 1.290 dimensiones, incluyendo antecedentes, psicología, habilidades, comportamiento y estilo de vida.
2. Admite la evaluación de agentes de perfil de usuario en cuatro tipos de entornos: encuestas, chatbots de IA, sitios web y aplicaciones.
3. Ofrece más de 1.000 tareas de evaluación que cubren 25+ áreas, incluyendo comercio, software, finanzas y salud.

Las habilidades clave de los investigadores de usuarios tradicionales y los product managers se devaluaron instantáneamente.
Al mismo tiempo, cada uno debe enfrentar un problema:
Cuando tu «personalidad» es solo una distribución de probabilidad coherente en 1290 dimensiones, ¿cómo demuestras que sigues siendo el único irreductible a simulación?
IA calcula toda la personalidad de la humanidad.
El momento Oppenheimer del product manager
La investigación de usuarios tradicional tuvo su «momento Oppenheimer» hoy.
Anteriormente, las grandes empresas tecnológicas necesitaban meses para lanzar una nueva aplicación o estrategia, reclutando cientos o miles de voluntarios reales de diversos colores y orígenes, y realizando innumerables pruebas piloto e entrevistas presenciales.
En el mundo de silicio de MatrAIx, este proceso de alta barrera, alta latencia y alto costo se comprime en un instante.
La base de datos de Persona-8B tiene un tamaño de 8.3 mil millones, logrando un espejo preciso uno a uno con la población total real de la Tierra física en este momento.

They don't need to pay for five insurances and one fund, yet they understand better than you how to elegantly reject a poor UI design on macOS.
Con estos 8.3 mil millones de nativos digitales disponibles para ser movilizados en cualquier momento, lo siguiente que hay que hacer es integrarlos en la vida social.
El equipo de MatrAIx ha creado cuatro entornos de simulación interactiva de canal completo, denominados MatrAIx Playground:

Encuestas: probar conceptos, sensibilidad a precios y disposición a pagar de distintos grupos.
Chat de IA (chatbots de IA): registro completo de la trayectoria de la conversación, seguimiento de las fluctuaciones emocionales reales y los hábitos de seguimiento de los usuarios virtuales cuando se enfrentan a errores o disparates de la IA [1.1.5].
Sitios web (Websites): El agente busca, compara precios y lee reseñas en esta red de prueba como un usuario normal, y finalmente toma una decisión de compra.
Aplicaciones: Esto ya ni siquiera es un enfrentamiento a nivel de texto. Los agentes pueden controlar directamente el escritorio de Linux, macOS e iOS mediante ratón virtual, teclado y toque para realizar diversas operaciones complejas con software cotidiano. El sistema registra sin omitir ningún detalle los cambios en archivos, cambios de permisos y trayectorias de operación.
En este entorno de prueba, el equipo de investigación ha implementado 1,010 tareas de evaluación complejas en 25 dominios diferentes (que abarcan comercio, software, finanzas, medicina, entre otros).

Realizaron un total de 18,189 experimentos de simulación a gran escala de interacciones de usuarios.
En 400 experimentos de control extremadamente rigurosos, estos agentes virtuales impulsados por modelos de base alcanzaron una consistencia del 91,5% con los personajes especificados.

Al evaluar la coherencia de los personajes extraídos de seres humanos reales, los expertos humanos otorgaron una puntuación alta de 4.135 (sobre 5).
Y el modelo subyacente que impulsa a estos avatares virtuales ya ha alcanzado un rendimiento casi idéntico al estándar de oro evaluado por humanos:
Claude Opus 4.8: en el 93.8% de los casos, su error de evaluación se mantiene dentro de 1 punto de la calificación de expertos humanos.
GPT-5.5: En el 79.2% de los casos, el error es de menos de 1 minuto.
Esto indica que los modelos de vanguardia actuales no solo dominan la lógica y el sentido común, sino que también han adquirido el "simulador de empatía" de la sociología.
Pueden calcular con precisión cómo una mujer de 50 años, perteneciente a la clase media estadounidense y con una personalidad conservadora e introvertida, manifestaría una furia y una decepción sutiles ante una vulnerabilidad en un producto tecnológico.
¿Cómo se «crearon» estos 8.300 millones de fantasmas digitales?
Detrás de cada «persona» hay una matriz de atributos precisa con 1.290 dimensiones de retrato. Estas dimensiones se dividen en cinco zonas centrales: información de fondo, características psicológicas, habilidades profesionales, interacción y comportamiento, vida diaria.

Las fuentes de datos incluyen estadísticas poblacionales de las Naciones Unidas, General Social Survey, biografías de Wikipedia, reseñas de consumo reales de Amazon, encuestas de desarrolladores de Stack Overflow…
Si se combinan al azar, la IA solo creará «monstruos cibernéticos» sin lógica. Por ejemplo, una entidad que vive en una zona rural de Kenia, tiene solo educación primaria, solo habla islandés, posee un doctorado de Harvard y gana un millón de dólares al año.
Para resolver este problema, el equipo de investigación construyó un gran gráfico dirigido acíclico (DAG). Existe una dependencia condicional estricta entre atributos:

Cuando el sistema determina la «capacidad en inglés» de un avatar virtual, debe calcular primero la probabilidad conjunta de los nodos padres «idioma principal» y «región».
Añada un filtro de compatibilidad aún más cruel: siempre que haya un conflicto irracional entre atributos padre e hijo, la puntuación se reinicia inmediatamente y la combinación se elimina con un solo clic.

Bajo el proceso de esta fórmula, los personajes virtuales generados mantienen una amplia diversidad, al tiempo que conservan una coherencia lógica inquebrantable en su interior.
Además, se incluyen cientos de millones de «fragmentos de alma reales» extraídos de historiales reales de humanos, como Wikipedia, historial de compras de Amazon y encuestas de desarrolladores de Stack Overflow; cada espíritu en la base de datos Persona-8B es como una persona real que vivió con carne y sangre en un universo paralelo.
¿Alguna vez has pensado: que tu preferencia por el color de una cierta aplicación en realidad se puede reducir al producto de las probabilidades de los nodos padres?
Cuando la personalidad se mide con precisión en 1290 escalas, lo que el ser humano llama «único» es, para la IA, solo una distribución de probabilidad coherente.
El bucle de Möbius del vacío
Es un milagro técnico, pero si quitas el manto de eficiencia que lo cubre, verás una verdad aterradora.
Los modelos grandes (como GPT-5.5, Claude Opus 4.8) desempeñan el papel de "consumidores" y "miembros de la sociedad" en MatrAIx para evaluar y probar a otro "persona virtual" impulsado por un modelo grande.
Es como si una persona, con la mano izquierda actuando como cliente, comprara el pan que hizo con la mano derecha, y luego la mano izquierda le diera a la mano derecha una calificación de cinco estrellas.

En este ciclo cerrado, los seres humanos reales, desaparecieron.
Si un usuario virtual otorga una puntuación alta del 91,5% a un nuevo medicamento o una aplicación de redes sociales en el entorno de prueba, ¿garantiza eso que complacerá a los seres humanos reales, que lloran, se portan mal, y están influenciados por el clima y las hormonas?
El efecto secundario más aterrador de este «ecosistema de autociclo» es la desaparición total de las «colas negras y las almas».
Las artes más grandes de la historia humana, los modelos de negocio más disruptivos e incluso los avances científicos más impresionantes a menudo no provienen de la «coherencia» calculada en 1290 escalas de probabilidad.
A menudo nacen de obsesiones incomprensibles y confusiones lógicas fortuitas: los valores atípicos que el filtro del algoritmo DAG considera «incompatibles» y elimina con un solo clic.
Si en el futuro todos los productos digitales, políticas y contenidos pueden probarse y optimizarse mediante una "simulación de AI de 8.3 mil millones de personas", entonces este mundo se volverá extremadamente fluido.
Pero también se volverá extremadamente vacío y aburrido.
Este es un mundo aburrido diseñado específicamente para satisfacer las preferencias de los fantasmas digitales.
Al final del artículo, el equipo de investigación mantuvo la prudencia y claridad propias de los científicos:
Los usuarios virtuales nunca podrán reemplazar por completo a los seres humanos reales; para las decisiones de alto riesgo que afectan el destino de la sociedad y las conclusiones científicas importantes, la participación directa de usuarios reales sigue siendo irremplazable.
Referencias:
https://matraix.ai/
https://arxiv.org/abs/2608.04205
https://github.com/MatrAIx-ai/MatrAIx-Persona-8B
https://x.com/MatrAIx2026/status/2085217711781564492
Este artículo proviene del canal de WeChat "Nuevas Inteligencias", autor: Apocalipsis ASI, editor: David
