[TL;DR Щоденний обраний матеріал] AI-режисер, що за 5 днів відновив сцену катастрофи 400-річної давнини з династії Мін — це не наукова фантастика, а реальне застосування багатомодального моделювання Alibaba Cloud! Від історичних джерел до експлозійних сцен — AI не лише малює та монтує, але й розуміє наміри режисера, повністю замінюючи місяці традиційного виробництва фільмів. Хто ще наважується казати, що AI — це лише іграшка? 📌 AI-короткометражний фільм Лу Чуаня: революція у виробництві фільмів - Традиційне відновлення катастрофічних сцен тривало місяці й коштувало мільйони доларів — AI справився за 5 днів. - Експлозії, античні персонажі, історична реконструкція — точність понад 95%, чотири цикли налаштування промптів для перетворення історичних джерел у візуальну форму. - Модель Alibaba AI не просто надає матеріали — вона глибоко інтегрована в творчий процес, забезпечуючи більше половини генерації одного відео. 📌 Повномасштабний вибух у багатомодальному AI: презентація сімейства моделей - Qwen3.8/4/5 в розробці — розмір параметрів наближається до 5–10 трильйонів. - Оновлення: зображення Qwen-Image-3.1, відео Wan/Happy Horse, музика Happy Shrimp 1.1, аудіо Qwen-Audio-3.1, світова модель HappyOyster 2.0. - Інтеграція моделей для вирішення змішаних завдань — реклама, кіно, музика — AI вже працює не окремо, а синхронно. 📌 Професійне творчість та промислова реалізація: проблеми та досягнення - AI-музика стикається з складними питаннями авторських прав та галузевих правил — спільна робота галузі та розвиток екосистеми лише починаються. - Ефективність створення AI-співаків стрибнула: невелика команда з 6 осіб може керувати десятками IP-адрес, один акаунт набрав 200 000 підписників за 4 місяці, загальна кількість переглядів — понад 2 мiliardi. - Практичні завдання вимагають єдиного контексту та синхронної роботи багатомодальних систем — однобоких здатностей більше недостатньо. 📌 Єдина багатомодальна модель: наступний етап AI - Майбутнє багатомодальності — не послідовне чергування, а нативна єдність: вся інформація використовує один спільний контекст. - Alibaba розробляє Agentic Video, щоб модель самостійно розуміла сюжет, кадрування та організацію персонажів, повністю позбавляючи нас від «карточного» створення. - Упродовж трьох років ми можемо очікувати справжню багатомодальну генерацію AI, де досвід більше не обмежений межами окремих модальностей. AI переходить від «може генерувати» до «може виконати завдання». Чи не цікаво вам — яка галузь наступною постраждає від AI? #AIРеволюціяУТворчості #ЕраБагатомодальностi
$MIAПоділитися
Джерело:Показати оригінал
Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації.
Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.