تقوم ByteDance ببناء أنظمة ذكاء اصطناعي يمكنها توليد مقاطع فيديو في الوقت الفعلي مع الوعي المكاني. وقد جعلت شركة والدة TikTok من نماذج العالم، التي تشمل توليد فيديو تفاعلي في الوقت الفعلي ووعي ثلاثي الأبعاد، أولوية رئيسية للذكاء الاصطناعي لعام 2026.
العناصر التقنية الأساسية
فريق بحث Seed التابع لـ ByteDance قد قام بتجميع الإصدارات بوتيرة ثابتة. تم إطلاق Seedance 2.0 في فبراير 2026 مع التركيز على توليد متعدد الوسائط بدقة فيزيائية. ثم جاء Seedance 2.5 في 31 يوليو، والذي دفع الحدود أكثر مع مقاطع صوتية-مرئية أحادية المرور بطول 30 ثانية، وتحكمات مكانية محسّنة، ونظام مرجعي للطين لرسم الحركة ثلاثية الأبعاد.
ورقة من arXiv نُشرت تقريبًا في 24 أغسطس قدمت التدريب التنافسي التلقائي ما بعد التدريب، أو AAPT. يمكن للنموذج الموصوف في الورقة توليد الفيديو بمعدل 24 إطارًا في الثانية مع تأخير منخفض، وإنتاج مخرجات متماسكة تستمر دقيقة واحدة.
قبل Seedance 2.5، كانت ByteDance قد أطلقت بالفعل Helios، وهو نموذج بوزن مفتوح حقق حوالي 19.5 إطارًا في الثانية لمقاطع الفيديو التي تستمر دقيقة واحدة وتعمل على وحدة معالجة رسومية واحدة. تم إصدار Helios في مارس 2026.
تشمل الحزمة أيضًا وحدات تحكم تفاعلية. تقبل الأنظمة مدخلات الوضع والكاميرا، مما يمكّن التطبيقات مثل توليد البشر الافتراضيين حيث يمكن للمستخدمين توجيه الناتج بدلاً من مجرد إعطاء تعليمات له.
نماذج العالم ومقياس Genie 3
في يونيو 2026، رفعت ByteDance نماذج العالم إلى مستوى أولويات الذكاء الاصطناعي العليا. الهدف المعلن هو مطابقة Google’s Genie 3، وهو معيار لمحاكاة العالم التفاعلية.
بايت دانس تُستثمر أموالًا كبيرة في هذا الجهد. لقد وصلت ميزانيات بيانات التدريب للنماذج العالمية إلى أرقام ثمانية بأرقام صينية.
مختبر الوسائط المتعددة في الشركة يُسوّق في نفس الوقت خطوط إنتاج فيديو مكاني 4D و6DoF (ست درجات من الحرية) للمحتوى الحجمي. تعالج هذه الأنظمة تجارب مكانية مباشرة وحسب الطلب، مع ملاحظة تقدم النشر من أواخر عام 2025 حتى عام 2026.
