Perplexity AI abre el WANDR Benchmark para evaluar agentes de IA

iconCryptoBriefing
Compartir
AI summary iconResumen
Perplexity AI ha abierto el código de WANDR, un benchmark para evaluar agentes de IA en tareas de investigación complejas. La herramienta, alineada con Perplexity Computer, obtuvo una puntuación de 0.386 en pruebas iniciales, superando a otras. Al 11 de julio de 2026, Grok 4.5 de xAI lideraba en WANDR cuando se combinaba con Perplexity Computer. Los operadores que utilizan TA para el análisis de criptomonedas y el interés abierto pueden encontrar este desarrollo relevante para evaluar herramientas de investigación impulsadas por IA.

Perplexity AI está lanzando WANDR, un benchmark diseñado para evaluar qué tan bien los agentes de IA manejan tareas de investigación complejas y multicapa. El lanzamiento de código abierto proporciona a desarrolladores e investigadores una forma estandarizada de medir si sus sistemas de IA pueden realizar realmente trabajos de investigación serios.

WANDR, que significa Wide and Nuanced Deep Research, está diseñado específicamente para las tareas de “investigación amplia” que Perplexity denomina, que requieren búsquedas amplias e investigaciones profundas, alineadas con las capacidades de Perplexity Computer.

Lo que realmente mide WANDR

El punto de referencia está diseñado para replicar las cargas de trabajo exigentes típicas de entornos de investigación profesional, superando con creces la simple respuesta a preguntas o la resumen de un solo documento.

Anuncio

Perplexity posiciona WANDR como una evolución de marcos de evaluación anteriores como WideSearch, reflejando un cambio hacia cargas de trabajo profesionales más realistas.

El benchmark llega junto con el marco "Search as Code" (SaC) de Perplexity, que trata las consultas de investigación como flujos de trabajo programables en lugar de cadenas de búsqueda simples. En evaluaciones preliminares el 1 de junio de 2026, la implementación de SaC de Perplexity obtuvo una puntuación de 0.386 en el benchmark WANDR. La siguiente puntuación más alta fue 0.152, lo que significa que el sistema de Perplexity superó a su competidor más cercano aproximadamente 2.5 veces.

La conexión Perplexity Computer

WANDR está directamente vinculado a Perplexity Computer, el producto de agente de IA de la empresa que orquesta múltiples modelos para realizar tareas complejas de investigación y flujos de trabajo. La prueba de referencia sirve como capa de evaluación para el tipo de trabajo para el que está diseñado Perplexity Computer.

En febrero de 2026, Perplexity liberó el benchmark DRACO, otra herramienta de evaluación diseñada para avanzar en la comprensión colectiva de las capacidades de la IA. WANDR sigue el mismo patrón.

Al 11 de julio de 2026, Grok 4.5 de xAI logró las puntuaciones más altas en WANDR cuando se utilizó junto con Perplexity Computer, demostrando que los sistemas de terceros pueden desempeñarse bien en el benchmark.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.