GROK 4.7: أفضل في المهام الطويلة، لكنه ليس أقوى في كل مكان أطلقت xAI نموذج Grok 4.7، المصمم للبرمجة ووكلاء الذكاء الاصطناعي والمهمات التي يمكن أن تستغرق ساعات. يأتي الإصدار الجديد مع نموذج أساسي جديد، وتدريب RL أطول على المهام الصعبة، وتحسين في التحقق الذاتي، ونافذة سياق طويلة تصل إلى 500K رمز. وهو متاح بالفعل في Cursor وGrok Build والواجهة البرمجية (API). وفقًا لاختبارات xAI، يظهر Grok 4.7 تحسينات واضحة: - CursorBench 4.0: 46.3% مقابل 40.4% لـ Grok 4.6 - DeepSWE: 71% مقابل 65.2% - Terminal-Bench: 38% مقابل 20.3% في CursorBench، تفوق Grok 4.7 على GPT-5.6 Sol، لكنه لا يزال متخلفًا عن Fable 5.1. الاختبارات المستقلة تقدم صورة أكثر تباينًا. تعطي Artificial Analysis لـ Grok 4.7 تحسنًا طفيفًا - 46 مقابل 44 على مؤشر الذكاء الخاص بها. ومع ذلك، يبدو أن النموذج أقوى كوكيل برمجي داخل Grok Build. هناك أيضًا عيب: Grok 4.7 أكثر تفصيلًا وطولًا في الإجابات. يبقى سعر الرمز دون تغيير، لكن الإخراج الأطول يعني أن بعض المهام قد تصبح أكثر تكلفة. أسعار الواجهة البرمجية: 2 دولار لكل مليون رمز مدخل / 6 دولارات لكل مليون رمز مخرج. بمجرد تجاوز النص التحفيزي 200K رمز، يتضاعف سعر الرمز. النسخة السريعة أسرع بمقدار مرتين وأكثر تكلفة، وهي متاحة حاليًا فقط في Cursor وGrok Build. بشكل عام، فإن Grok 4.7 يكون الأكثر منطقية لجلسات البرمجة الطويلة، والمستودعات الكبيرة، والمهمات المعقدة متعددة الخطوات. أما بالنسبة للنصوص القصيرة، فقد يكون التحسن أصغر بكثير. إذًا، هل Grok 4.7 ترقية كبيرة حقًا - أم مجرد نموذج أكثر تكلفة يبرز في مجموعة أضيق من المهام؟
Michael Web3Wandererمشاركة

المصدر:عرض النسخة الأصلية
إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات.
يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.