Perplexity AI open-source le benchmark WANDR pour évaluer les agents IA

iconCryptoBriefing
Partager
AI summary iconRésumé
Perplexity AI a open-sourcé WANDR, un benchmark pour évaluer les agents IA dans des tâches de recherche complexes. L'outil, aligné avec Perplexity Computer, a obtenu un score de 0,386 lors des premiers tests, surpassant les autres. Au 11 juillet 2026, Grok 4.5 de xAI menait sur WANDR lorsqu'il était associé à Perplexity Computer. Les traders utilisant l'analyse technique pour le crypto et l'analyse de l'open interest peuvent trouver ce développement pertinent pour évaluer les outils de recherche pilotés par l'IA.

Perplexity AI lance WANDR, un benchmark conçu pour évaluer la capacité des agents IA à gérer des tâches de recherche complexes et multicouches. La version open source offre aux développeurs et chercheurs un moyen standardisé de mesurer la capacité de leurs systèmes IA à effectuer véritablement un travail d'enquête sérieux.

WANDR, qui signifie Wide and Nuanced Deep Research, est spécifiquement conçu pour les tâches de « recherche large » telles que les définit Perplexity, nécessitant une recherche étendue et une investigation approfondie, en accord avec les capacités de Perplexity Computer.

Ce que mesure réellement WANDR

Le benchmark est conçu pour reproduire les charges de travail exigeantes typiquement rencontrées dans les environnements de recherche professionnelle, allant bien au-delà de la simple réponse à des questions ou de la synthèse de documents uniques.

Publicité

Perplexity positionne WANDR comme une évolution des cadres d'évaluation précédents comme WideSearch, reflétant un passage vers des charges de travail professionnelles plus réalistes.

Le benchmark arrive en même temps que le cadre « Search as Code » (SaC) de Perplexity, qui traite les requêtes de recherche comme des workflows programmables plutôt que comme de simples chaînes de recherche. Lors des évaluations préliminaires du 1er juin 2026, la mise en œuvre SaC de Perplexity a obtenu un score de 0,386 sur le benchmark WANDR. Le meilleur score suivant était de 0,152, ce qui signifie que le système de Perplexity a surpassé son concurrent le plus proche d’un facteur d’environ 2,5 fois.

La connexion Perplexity Computer

WANDR est directement lié à Perplexity Computer, le produit d'agent IA de l'entreprise qui orchestre plusieurs modèles pour gérer des tâches complexes de recherche et de flux de travail. Le benchmark sert de couche d'évaluation pour le type de travail pour lequel Perplexity Computer est conçu.

En février 2026, Perplexity a open-sourcé le benchmark DRACO, un autre outil d'évaluation visant à approfondir la compréhension collective des capacités de l'IA. WANDR suit le même modèle.

Au 11 juillet 2026, Grok 4.5 de xAI a obtenu les meilleurs scores sur WANDR lorsqu'il est utilisé en conjonction avec Perplexity Computer, démontrant que les systèmes tiers peuvent bien performer sur ce benchmark.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.