MiniMax تطلق نموذج H3 متعدد الوسائط لإنشاء الفيديو والصورة والصوت

iconChainthink
مشاركة
AI summary iconملخص
تُظهر البيانات على السلسلة أن MiniMax أطلقت نموذجها متعدد الوسائط H3 في 31 يوليو 2026، ويدعم توليد الفيديو والصورة والصوت عبر اللغة الطبيعية. يتعامل النموذج مع نقل الحركة، ومراجع الشخصيات، وتحرير الفيديو في خطوة واحدة. يمكنه توليد 15 ثانية من فيديو بدقة 2K مع صوت ستيريو بسعر 0.13 دولار للثانية. ستُفتح أوزان النموذج من قِبل MiniMax قريبًا. يظل مؤشر الخوف والطمع في مجال توليد الذكاء الاصطناعي مرتفعًا مع ظهور أدوات جديدة.

رسالة ChainThink، 31 يوليو، وفقًا للإعلان الرسمي، أطلقت MiniMax نموذج التوليد متعدد الوسائط H3، الذي يمكنه فهم النصوص والصور والفيديوهات والأصوات في آنٍ واحد، وتوليد أو تحرير الفيديوهات بناءً على أمر لغوي طبيعي.

تدعم H3 دمج نقل الإجراءات، ومراجع الشخصيات، ومراجع الصوت، وتحرير الفيديو في مهمة واحدة. على سبيل المثال، يمكن للمستخدم أن يطلب من النموذج الاعتماد على حركة الكاميرا من فيديو، وشخصية من صورة أخرى، وصوت من مقطع صوتي ثالث.

يُمكن لهذا النموذج إنشاء فيديو بحد أقصى 15 ثانية، ويدعم دقة 2K وصوت ستيريو أصلي. من حيث أسعار الواجهة البرمجية الرسمية، تكون تكلفة 2K عند 0.13 دولار لكل ثانية، أي حوالي 1.95 دولار لإنشاء فيديو مدته 15 ثانية؛

768P بسعر 0.09 دولار لكل ثانية. يمكن إدخال ما يصل إلى 9 صور و3 مقاطع فيديو و3 مقاطع صوتية في مهمة واحدة، بحد أقصى 12 ملفًا.

تخطط MiniMax لفتح أوزان النموذج خلال الأيام القادمة، ولم تُعلن الشركة الرسمية بعد عن تقييم موحد للنموذج مقارنةً بـ Seedance و Veo وغيرها.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.