تُصدر Perplexity AI WANDR، وهو معيار مصمم لتقييم مدى كفاءة وكلاء الذكاء الاصطناعي في التعامل مع مهام بحثية معقدة ومتعددة الطبقات. يوفر الإصدار مفتوح المصدر طريقة موحدة للمطورين والباحثين لقياس ما إذا كانت أنظمتهم الذكية الاصطناعية قادرة فعليًا على إجراء أعمال بحثية جادة.
WANDR، التي ترمز إلى البحث العميق الواسع والدقيق، مصممة خصيصًا للمهام التي تسمّيها Perplexity "البحث الواسع" والتي تتطلب بحثًا واسعًا وتحريًا عميقًا، وتوافق قدرات Perplexity Computer.
ما الذي يقيسه WANDR فعليًا
تم تصميم المعيار لمحاكاة أحمال العمل الصارمة التي تُوجد عادةً في بيئات البحث المهنية، ويتخطى بكثير مجرد الإجابة على الأسئلة أو تلخيص مستند واحد.
تعتبر Perplexity WANDR تطورًا لإطارات التقييم السابقة مثل WideSearch، مما يعكس انتقالًا نحو أحمال عمل مهنية أكثر واقعية.
يأتي المعيار جنبًا إلى جنب مع إطار عمل "البحث كرمز" الخاص بـ Perplexity، أو SaC، الذي يعامل استعلامات البحث كسير عمل قابلة للبرمجة بدلاً من سلاسل بحث بسيطة. في التقييمات الأولية في 1 يونيو 2026، حصل تنفيذ SaC الخاص بـ Perplexity على درجة 0.386 في معيار WANDR. وكانت أعلى درجة تالية 0.152، مما يعني أن نظام Perplexity تفوق على منافسه الأقرب بعامل يقارب 2.5 مرة.
اتصال Perplexity Computer
يُرتبط WANDR مباشرة بـ Perplexity Computer، منتج وكيل الذكاء الاصطناعي للشركة الذي ينسق نماذج متعددة للتعامل مع مهام البحث والسير العمل المعقدة. ويمثل المعيار طبقة التقييم لنوع العمل الذي صُممت من أجله Perplexity Computer.
في فبراير 2026، أصدرت Perplexity معيار DRACO كمصدر مفتوح، وهو أداة تقييم أخرى تهدف إلى تعزيز الفهم الجماعي لقدرات الذكاء الاصطناعي. واتبعت WANDR نفس النمط.
في 11 يوليو 2026، حقق Grok 4.5 من xAI أعلى الدرجات على WANDR عند استخدامه بالاقتران مع Perplexity Computer، مما يُظهر أن الأنظمة الخارجية يمكنها الأداء بشكل جيد على المعيار.
