إطلاق Inworld TTS-2، ويتفوق على Sonic3.6 في تقليد الصوت

icon MarsBit
مشاركة
AI summary iconملخص
تم إطلاق TTS-2 من Inworld، وحقق درجة 1123 في مسابقة الصوت المُحكم، متقدماً بـ 4 نقاط على Sonic 3.6. يُحسّن النموذج الكلام الطبيعي من خلال تحسين النبرة، والفترات الصامتة، والاتساق عبر اللغات. يعمل تقليد الصوت مع تسجيلات قصيرة. مع تحوّل سوق التشفير، يظل مؤشر الخوف والطمع مقياساً رئيسياً للمتداولين.

كشف Beating AI أن شركة Inworld، المتخصصة في الذكاء الاصطناعي الصوتي في الوقت الفعلي، أطلقت رسميًا Realtime TTS-2. وفي أحدث تقييمات Artificial Analysis ضمن Controlled Voice Arena، حصلت على 1123 Elo، متفوقة على Cartesia Sonic 3.6 الذي حصل على 1119 بفارق 4 نقاط. يعتمد هذا التصنيف على اختبارات عمياء حيث يتم نسخ نفس مجموعة من 8 أصوات بواسطة نماذج مختلفة، ويُقيّم من يتحدث بشكل أكثر طبيعية وواقعية، مع التركيز على النطق، والوقفات، والنبرة، والإيقاع. كما تستخدم النموذج أصواتًا حقيقية من الجولات السابقة كسياق، وتُحلل نبرة المستخدم وإيقاعه وحالته العاطفية لضبط الجملة التالية. يمكن للمطورين كتابة تعليمات بلغة طبيعية مثل "تحدث بهمس" أو "بصوت متعب لكن دافئ بعد يوم عمل"، وإضافة أصوات مثل الضحك، والأنين، والتنفس. كما يدعم النموذج الحفاظ على نفس الصوت عبر اللغات المختلفة، بالإضافة إلى نسخ الأصوات باستخدام تسجيلات قصيرة. وتؤكد Inworld أن هذه النسخة من النموذج صُممت خصيصًا للحوار في الوقت الفعلي، وتستفيد من النبرة والإيقاع والحالة العاطفية في التواصل الصوتي الكامل.

إخلاء المسؤولية: قد تكون المعلومات الواردة في هذه الصفحة قد حصلت عليها من أطراف ثالثة ولا تعكس بالضرورة وجهات نظر أو آراء KuCoin. يُقدّم هذا المحتوى لأغراض إعلامية عامة فقط ، دون أي تمثيل أو ضمان من أي نوع ، ولا يجوز تفسيره على أنه مشورة مالية أو استثمارية. لن تكون KuCoin مسؤولة عن أي أخطاء أو سهو ، أو عن أي نتائج ناتجة عن استخدام هذه المعلومات. يمكن أن تكون الاستثمارات في الأصول الرقمية محفوفة بالمخاطر. يرجى تقييم مخاطر المنتج بعناية وتحملك للمخاطر بناء على ظروفك المالية الخاصة. لمزيد من المعلومات، يرجى الرجوع إلى شروط الاستخدام واخلاء المسؤولية.