Бувший керівник з штучного інтелекту NVIDIA порушує трансформер з 5T контекстом фізичного ІІ, симулюючи Всесвіт

icon MarsBit
Поділитися
AI summary iconКороткий зміст
Новини штучного інтелекту та криптовалют: стартап Accelerated Understanding оголосив про новий проект — фізичну модель штучного інтелекту, яка симулює чотиривимірні системи за допомогою нейронних операторів, обходячи Transformer. Модель обробляє до 5 трильйонів токенів за одне висновування. Засновники Аніма Анандкумар і Бенедикт Єнік, колишні працівники NVIDIA, відмовилися від пропозиції Project Prometheus, щоб розробляти незалежно. Єдина рамка моделі для фізичних симуляцій може змінити напрямок розвитку ШІ на користь застосувань, орієнтованих на фізику.

Неймовірно!

Штучний інтелект почав передбачати всю всесвітню

Мовний опис світу від LLM, відеомодель світу передбачає (динамічні) зображення, а цього разу безпосередньо передбачає чотиривимірний фізичний стан простору й часу.

Найбільш захоплюючим є те, що він використовує нову архітектуру «нейронний оператор», а не Transformer, який зараз на піку популярності.

У одному висновку безпосередньо виведіть повну чотиривимірну траєкторію, включаючи часовий вимір.

Це вимагає надзвичайно великої довжини контексту, а тепер стартап Accelerated Understanding підняв довжину контексту під час навчання до трильйона (1T), а під час виведення — понад п’ять трильйонів!

Фізичний ІІ

Що означає 5 трильйонів? Це в 5 мільйонів разів більше, ніж у сучасних найкращих LLM! Це як якби ви попросили AI одночасно прочитати 5 мільйонів разів «Війну і мир» — і він усе запам’ятав.

Порівняй, уважно проаналізуй.

Час — це не фундаментальна річ, він більше схожий на прояв, що випливає з глибшої інформаційної структури, чи не цікаво? Якщо розгорнути цю ідею до крайньості, це дорівнює генерації всього фізичного всесвіту.

Ще більш здивувало те, що засновники цього стартапу відмовилися від пропозиції колишнього найбагатшого людини світу Джеффа Безоса, який пропонував 35% акцій, річну зарплату у 2 мільйони доларів США та фінансування на суму понад 2 мільярди доларів США.

А за ними, можливо, стоять «духовні акціонери» і приховані підштовхувачі — чоловік у шкіряній куртці — генеральний директор NVIDIA Хуань Ренсюнь.

5 трильйонів контексту — це не «безпечний суперінтелект» Іллі

Вчора відомий інвестор з Сіліконової долини висловився невизначено, але всі в мережі почали припускати, що Ilya на цього разу може зробити великий хід зі своїм SSI.

Фізичний ІІ

А зараз таємниця здається розкритою: це не Ілля, навіть не мова, а справжній «універсальний генератор».

Фізичний ІІ

Ця група жахливих даних Accelerated Understanding поширюється як вогонь:

  • Розмір параметрів моделі: завершено попереднє навчання моделі зі значенням до 1 трильйона (1 Trillion) параметрів.
  • Екстремальна масштабованість: розмір експериментів зростав до 35 трильйонів (35 Trillion) параметрів.
  • Контекст періоду навчання: 1 Trillion (1 трильйон).
  • Контекст періоду міркувань: понад 5 трильйонів.

Фізичний ІІ

На тлі такого масштабного контексту ця модель продемонструвала жахливу здатність:

Під час фізичного моделювання він не вимагає підвибірки (No sub-sampling) та не потребує обробки частинами (No chunking).

Зіштовхнувшись із надзвичайно складною фізичною системою 4D-простору, вона здатна «одноразово (One-shot)» генерувати повну траєкторію руху всього простору-часу!

Крім того, через єдину базову логіку одна й та ж модель може одночасно розв’язувати фізичні задачі з абсолютно різних галузей!

Це раніше було немислимим.

Раніше метеорологи використовували метеорологічні моделі, а матеріалознавці — матеріальні моделі; зараз Accelerated Understanding повідомляє світу: фізичні закони на основному рівні є єдиними, і одного загального фізичного великої моделі достатньо, щоб вирішити всі задачі.

Прискорене розуміння найбільш революційна ключова функція полягає у створенні ідеального замкненого циклу «моделювання → покращення → моделювання». Він є не просто «генератором», а справжнім «валідатором реальності» (Reality Validator).

Крім того, ця цільова відповідь також задіяла навчання Іллі під час тестування.

Фізичний ІІ

«Трансформер мертв?» Пробудження фізичного ІІ

Якщо сьогодні ви запитаєте будь-кого зі сфері ШІ: «Яка зараз найпопулярніша архітектура ШІ?», відповідь буде 100%: Transformer.

Від ChatGPT до численних моделей генерації відео, ця архітектура, винайдена Google, домінувала в світі ШІ останні кілька років (саме той «T» у ChatGPT).

Але, на думку Anima, шлях Transformerів відійшов від правильного.

«Мовно-орієнтовані інтелектуальні погляди є „людино-орієнтованими“,» — відзначив Аніма в ексклюзивному інтерв’ю перед презентацією, — «а постановка фізики в центр — це „природо-орієнтований“ погляд.»

Як працюють сучасні LLM та відео-моделі світу? Вони суттєво грають у «гру ймовірностей».

ChatGPT передбачає найбільш ймовірне наступне слово.

А ті вражаючі генеративні AI для відео суттєво використовують візуальні скорочення — вони просто роблять згенеровані зображення «на вигляд» відповідними фізичним законам, але якщо ретельно проаналізувати гравітацію, гідродинаміку або напруження матеріалів, виявиться, що все це абсолютно неправильно.

Вони зовсім не розуміють фізики, вони лише високорівневі «піксельні повторювачі».

А текст має лише один вимір, відео — три виміри, тоді як реальний простір-час — це 3 виміри простору + 1 вимір часу.

Фізичний ІІ

Крім того, багато моделей використовують авторегресивний підхід — прогнозування по кадрах, при якому помилки накопичуються на кожному етапі.

Фізичний ІІ

Тоже саме, Accelerated Understanding повністю відкинув Transformer, а також візуальні скорочення.

Їхнім остаточним засобом є революційна технологія, яку Anima брала участь у розробці ще кілька років тому — нейроператори (Neural Operators).

На відміну від обробки тексту, нейронні оператори створені спеціально для обробки складних, невидимих фізичних даних. Вони не потребують примусового зменшення розмірності фізичного світу до тексту чи пікселів, а замість цього безпосередньо розуміють багатофізичні явища в повному 4D-вимірі (3D-простір + часовий вимір).

Невидимі потоки повітря, турбулентність плазми в реакторах ядерного синтезу, мікроскопічний тепловий розподіл всередині чіпів… Ці фізичні процеси, які непомітні для людського ока і не можуть бути передбачені традиційним ШІ за допомогою «візуального досвіду», у цій новій архітектурі стають чітко видимими та обчислюваними.

Шокував Хуан Юн, відмовився від Безоса

Дійшовши сюди, ви, можливо, запитаєте: яка потужність потрібна для навчання такої жахливої моделі? Звідки беруться гроші?

Хоча відмовилися розкривати поточні деталі фінансування, співзасновник лише натякнув, що «вже уклали партнерство з постачальниками обчислювальних ресурсів, які надали апаратні кластери для розробки та запуску ШІ».

Але всі вулички вказували на її колишнього роботодавця — NVIDIA, та на Дженнсена Хуанга, який проголошував: «ШІ — це майбутнє».

Повернемося до 2018 року, коли Anima була найнята NVIDIA на посаду директора з досліджень у галузі штучного інтелекту.

Протягом п’яти років вона керувала командою провідних вчених, досліджуючи, як застосувати обчислювальну потужність GPU від NVIDIA до передових галузей штучного інтелекту.

Фізичний ІІ

Тоді команда розробила ранній вражаючий проект: використання ШІ для прискорення прогнозування погоди. Результати показали, що точність прогнозування за допомогою ШІ була такою ж високою, як і у метеорологів, які використовували надзвичайно складні традиційні моделі обчислювальної гідродинаміки, але швидкість була вищою на кілька порядків.

Цей результат прямо «зруйнував» Хуан Ренсюна.

На конференції GTC від NVIDIA 2021 року Хуан Ренсюнь особисто вийшов на сцену і представив світові дослідження команди Anima щодо «нейронних операторів». «Він тоді був надто збуджений», — згадує Дженнсен Хуан.

Фізичний ІІ

Коли Аніма напівжартома сказала старому Хуану: «Штучний інтелект може викрасти обід у теоретичних фізиків».

Тоді Хуан Ренсюнь з величезними очима впевнено відповів: «Я хочу, щоб він з’їв їхній обід!»

За словами Anima, сам Хуан Ренсюнь спочатку закликав її втілити цю схожу на безглузду ідею «фізичного ІІ».

Хоча офіційно NVIDIA ще не відповіла Reuters на запитання щодо інвестування в цю компанію, у світі ШІ всі розуміють: без таємної підтримки топових обчислювальних потужностей неможливо було б створити такий монстр з контекстом у 5 трильйонів.

Старий Хуан накінці зробив свій хід.

Проте, щоб зрозуміти, наскільки потужний цей «фізичний великий модуль», нам потрібно повернутися до Лос-Анджелеса в кінці 2024 року.

У елітному ресторані відбувається таємний ужин, який може змінити сучасний ландшафт ШІ.

Одним із головних гостей вечірки був інвестор та підприємець у галузі біотехнологій Вік Баджадж (пізніше він спільно з Безосом заснував Project Prometheus з оцінкою понад 10 мільярдів доларів).

А напротив нього сиділа пара з найкращою підготовкою в галузі ШІ: професор обчислювальних та математичних наук Каліфорнійського технологічного інституту, колишній директор з досліджень у галузі ШІ у NVIDIA Аніма Анандкумар та її чоловік, висококваліфікований інженер інфраструктури ШІ Бенедикт Єнік.

Фізичний ІІ

Баджай прийшов з пропозицією під назвою «Проект Прометей». Угода, яку активно підтримує Безос, має надзвичайно вигідні умови:

Запрошувати Anima в якості співробітника компанії, члена ради директорів та лідера наукового бачення;

Подружжя отримає до 35% акцій компанії;

Базова річна заробітна плата — 1 000 000 доларів США, через три місяці після прийняття на роботу вона подвоюється до 2 000 000 доларів США;

Найбільш здивувало те, що в протоколі чітко зазначено, що інвестори, включаючи Безоса, забезпечать понад 2 мільярди доларів США «обіцяних коштів» для фінансування до серії B.

У сучасну епоху, коли фінансування великих моделей стає все складнішим, а витрати на обчислювальну потужність високі, це — супер-золотий квиток до фінансової свободи та галузевої влади.

Однак Anima та Jenik вибрали відмовитися.

Чому? Бо те, що вони мають у своїх руках, має потенціал, який значно перевищує можливості компанії, що «автоматизує виробництво складних фізичних систем». Вони не хочуть бути залежними від інших і тим більше не бажають, щоб їхнє технологічне бачення було підпорядковане капіталу. Їхнім завданням є створення «божественної моделі», здатної безпосередньо розуміти й симулювати фізичний всесвіт.

Нарешті, пара Аніма тихо приховалася, доки сьогодні не здивувала світ своїм самостійно розробленим Accelerated Understanding.

Заключення: зміна парадигми від «генерації інформації» до «оптимізації світу»

25 серпня 2026 року, це день, що відійде в історію розвитку ШІ.

Коли ми вітаємо величезні мовні моделі, які можуть написати гарну поезію або допомогти нам відредагувати робочі листи, Accelerated Understanding виглядає як персонаж із майбутнього, що з’явився, щоб розбити стіну, і холодно повідомляє нам: мова та зображення — це лише зовнішні прояви того, як люди розуміють світ; саме фізичні закони є справжнім базовим кодом всесвіту.

Відмовляйтесь від Безоса, від Transformer, від візуальних скорочень — прямо до суті 4D-часопростору. Аніма Анандкумар і Бенедикт Єнік за допомогою диких даних — 1 трильйона параметрів і 5 трильйонів контексту — оголошують світу про настання ери «Фізичного ІІ» (Physical AI).

Джерела:

https://x.com/AndrewCurran_/status/2092244031002771643

https://x.com/AnimaAnandkumar/status/2092236528898675014

https://x.com/daniel_mac8/status/2092303081287418277

https://www.reuters.com/business/ai-founders-who-walked-away-bezos-backed-prometheus-model-universe-2026-08-25/

https://acceleratedunderstanding.com/

Цей матеріал з іншого веб-сайту «Сіньчжіюань», автор: АСІ-Апокаліпсис, редактор: Девід

Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.