OpenAI запускає GPT-6 Astra, зосереджуючись на можливостях виконання ШІ та управління комп’ютером

iconMetaEra
Поділитися
AI summary iconКороткий зміст
OpenAI випустила GPT-6 Astra 3 вересня 2026 року з акцентом на виконання та можливості роботи з комп’ютером. Модель набрала 72,6% у OSWorld 2.0 та збільшила швидкість виконання завдань на 90% у тестах Mind2Web. Astra відповідає кібербезпековому порогу OpenAI, демонструючи сильні торгові сигнали на ланцюгу та потенціал для аналізу рівнів підтримки та опору в автоматизованих системах.
Справжнє значення GPT-6 Astra полягає не в балі в будь-якому рейтингу, а в тому, що ШІ перетворюється з інструменту на цифрового працівника, з яким можна довгостроково співпрацювати.

Автор статті, джерело: ME News

Коротко

  • Найбільшою зміною у GPT-6 Astra є не просто підвищення здатності моделі надавати відповіді, а перехід ШІ від «надання рекомендацій» до виконання завдань як виконавчого інтелекту.
  • Astra намагається вирішити довгострокові проблеми стабільності AI Agent, підвищуючи здатності до керування комп’ютером, виклику програмного забезпечення, розробки коду та управління довгостроковими завданнями.
  • OpenAI називає Astra найрозумнішою та найкраще вирівняною моделлю на сьогодні, але це твердження більше відображає стратегічну позицію компанії: незалежні тести показують, що інші моделі залишаються конкурентоспроможними.
  • Astra вперше досягла порогу критичних кібербезпекових здібностей, визначеного OpenAI, що означає, що передові AI-зможності входять у більш ризиковану фазу.
  • Справжнє значення GPT-6 Astra полягає не в балі в будь-якому рейтингу, а в тому, що ШІ перетворюється з інструменту на цифрового працівника, з яким можна довгостроково співпрацювати.

GPT-6 Astra: Конкуренція в галузі ШІ входить у еру «виконавчої здатності»

3 вересня OpenAI офіційно запустила GPT-6 Astra, визначивши її як найпотужнішу та найкраще вирівняну модель на сьогодні. Найбільша зміна Astra порівняно з попередніми поколіннями GPT — не вдосконалення здатності розуміння мови, а те, що ШІ починає наближатися до інтелектуального агента, здатного самостійно виконувати складні завдання.

Протягом останніх кількох років шлях розвитку генеративного ІІ був дуже чітким.

У еру GPT-3 люди вперше усвідомили, що ШІ може масово генерувати природну мову; у еру GPT-4 багатомодальні здібності дозволили ШІ починати розуміти зображення, файли та складну інформацію; подальший розвиток моделей міркування надав ШІ більш сильні здібності у математиці, кодуванні та логічних завданнях.

Але ці моделі завжди мають одну ключову обмеження: вони можуть повідомляти користувачам, «що слід робити», але важко справді виконувати дії за користувача.

Наприклад, AI-асистент може допомогти користувачеві написати бізнес-план, але користувачу все одно потрібно самому шукати інформацію, організовувати документи, відкривати інструменти, заповнювати форми та змінювати форматування; AI-асистент для програмування може генерувати код, але розробнику все одно потрібно самому запускати тести, виявляти помилки та розгортати додаток.

Астра намагається змінити саме цей рівень.

OpenAI прагне, щоб ШІ більше не був лише діалоговим вікном, а став виконавчою системою, здатною керувати комп’ютером, викликати інструменти, розуміти середовище та безперервно досягати цілей. За офіційним описом, Astra може самостійно виконувати послідовні завдання, такі як перегляд веб-сайтів, робота з програмами, організація даних, створення таблиць, написання коду та його тестування. (EdgeNet)

Це означає, що фокус конкуренції в галузі ШІ змінюється.

Майбутнє визначатиме вартість моделей не тим, хто зможе генерувати більш красиві тексти, а тим, хто зможе виконати більше роботи в реальному цифровому середовищі.

Найбільший прорив Astra: дозволити ШІ справді «використовувати комп’ютер»

Якщо раніше великі моделі переважно існували в чат-вікнах, то Astra намагається потрапити в середовище комп’ютера користувача.

Навички роботи з комп’ютером — це не просто оновлення функціоналу, а найважливіший крок у процесі комерціалізації AI Agent.

Оскільки у реальному світі є багато роботи, стандартизованого API не існує.

Інструменти, які щодня використовують працівники компаній, включаючи системи електронної пошти, офісні програми, фінансові системи, інструменти дизайну та платформи управління проектами, багато з яких залежать від кліків мишкою, переключення сторінок та ручного аналізу.

Традиційні автоматизовані системи зазвичай вимагають, щоб підприємства заздалегідь спроектували процеси, тоді як AI Agent прагне навпаки — зрозуміти мету людини, а потім самостійно знайти шлях до її досягнення.

Наприклад, користувач запитує:

Допоможіть мені зібрати ринкові дані за минулий квартал і підготувати аналітичний звіт.

Традиційне програмне забезпечення вимагає попередньої налаштованої інтеграції даних, шаблонів та процесів.

Ідеальна Astra може самостійно шукати інформацію, читати файли, відкривати Excel, обробляти дані, створювати діаграми та генерувати кінцевий звіт.

Тому вміння працювати з комп’ютером вважається важливою основою для входу ШІ у реальні робочі сценарії.

Згідно з даними, опублікованими OpenAI, Astra показала значне покращення у тестах, пов’язаних із керуванням комп’ютером, порівняно з попередньою моделлю GPT-5.6 Sol. Результати тесту OSWorld 2.0 зросли з 65,7% до 72,6%, а час, необхідний для виконання симульованих завдань, також значно скоротився. Нова версія Codex у поєднанні з Astra досягла швидкості приблизно в 1,9 рази вищої, ніж у попередніх системах, у завданні Mind2Web.

Ці дані свідчать, що покращення моделі відбувається не лише у вигляді «точності відповідей», а й у ефективності виконання завдань.

Це й є найбільша різниця між AI Agent та звичайним чат-ботом.

Чат-бот оптимізує одну взаємодію.

Агент оптимізує повний процес.

Від здатностей моделі до робочих здатностей, Astra переозначає «інтелект»

OpenAI повідомляє, що Astra показала лідируючі результати на кількох передових тестах.

За офіційно опублікованими даними, Astra досягла 97,6% у тесті FrontierMath Tier 4; у тесті ARC-AGI-3 з використанням механізму управління контекстом OpenAI — 99,9%, а за єдиною стандартною рамкою — 62,7%; у тесті Terminal-Bench 4.0 — 57,9%. (Розробник OpenAI)

Ці показники відображають тенденцію: моделі ШІ переходять від конкуренції за окремі здібності до конкуренції за здатність вирішувати комплексні завдання.

При оцінці моделей у минулому люди звертали увагу на обсяг знань, біглість мови та математичні результати.

Але з входженням у еру агентів модель повинна одночасно володіти кількома здібностями:

По-перше, розуміння складних цілей.

Користувачі зазвичай не надають AI дуже точних інструкцій, а описують нечіткі потреби. Наприклад, «допоможіть мені підготувати матеріали для залучення фінансування», що включає кілька етапів: дослідження ринку, аналіз конкуренції, збір даних, візуальний дизайн тощо.

Друге, здатність планувати шлях виконання завдань.

Складна робота не виконується за один крок, а вимагає розбиття завдань і постійної корекції на основі проміжних результатів.

Третє, потрібно викликати зовнішні інструменти.

Реальна робота рідко здійснюється лише за допомогою мови; потрібно підключити браузер, середовище коду, бази даних та різні програми.

Четверте: потрібно забезпечити довгострокове стабільне виконання.

Якщо ШІ може виконувати лише п’ятимінутні завдання, він більше схожий на висококваліфікованого асистента; лише тоді, коли він може працювати неперервно протягом кількох годин і зберігати цілеспрямованість протягом усього процесу, він наближається до цифрового працівника.

Важливість Astra полягає у спробі одночасно підвищити ці чотири аспекти.

За «найрозумнішими у світі»: конкуренція моделей все ще не має кінця

Проте варто зауважити, що формулювання «найрозумніша модель у світі» походить переважно з позиціонування OpenAI.

Згідно з незалежними тестами, конкуренція між моделями ШІ залишається надзвичайно напруженою.

Artificial Analysis показує, що у тесті Intelligence Index GPT-6 Astra max отримав 61 бал, а Claude Fable 5.1 max також залишається на високому рівні. Різні методи тестування, налаштування міркувань та типи завдань можуть призводити до змін у рейтингу моделей. (Artificial Analysis)

Це свідчить про те, що в індустрії ШІ поки що не з’явився абсолютної «кінцевої моделі».

Різні моделі формують різні переваги.

OpenAI зосереджується на універсальних здібностях, виклику інструментів та інтеграції екосистеми; Anthropic тривалий час підсилює кодові здібності, безпеку та корпоративні сценарії; Google продовжує свою стратегію, опираючись на пошук, хмарні обчислення та мультимодальні здібності.

Конкуренція між великими моделями в майбутньому, ймовірно, не буде такою, як у часи смартфонів, коли одна компанія повністю домінує.

Ймовірніше, що кілька супер AI-систем будуть конкурувати між собою в різних робочих сценаріях.

Тому справжня важливість Astra полягає не в тому, щоб довести, що OpenAI вже виграла всі конкуренти, а в тому, щоб показати, що критерії оцінки розвитку ШІ змінюються.

Раніше змагалися за те, хто краще відповідає.

Майбутнє — це змагання за те, хто зможе краще виконати.

Чим сильніші можливості ШІ, тим важливішою стає безпека

Ще одна важлива зміна у Astra — це те, що вона вперше досягла порогу критичних кібербезпекових здібностей у рамках Framework OpenAI Preparedness.

Це означає, що модель, маючи відповідні інструменти та дозволи, вже здатна виявляти невідомі вразливості та розробляти шляхи їх використання. (OpenAI)

Це має подвійне значення.

З одного боку, потужніший ШІ може допомогти дослідникам безпеки виявляти вразливості та підвищувати здатність до кіберзахисту.

З іншого боку, якщо такі можливості використовуватимуться зловмисно, це також може збільшити ризик кібератак.

Раніше виявлення вразливостей у програмному забезпеченні залежало від професійних команд безпеки та вимагало великої кількості ручного аналізу.

У майбутньому потужні ШІ можуть значно підвищити ефективність дослідження вразливостей.

Але одночасно сама AI-система повинна мати більш строгий контроль доступу, моніторинг поведінки та безпечну ізоляцію.

OpenAI повідомила, що для запуску Astra посилила внутрішні заходи безпеки, включаючи більш сувору ізоляцію моделей, моніторинг треків та процеси безпекової оцінки. (OpenAI)

Це відображає реальність:

Чим швидше зростає здатність ШІ, тим важливішим стає безпекова система.

Конкуренція між майбутніми компаніями з ІІ буде не лише у здатності моделей, а й у здатності забезпечення безпеки та управління.

Справжня цінність Astra: стати виконавчим рівнем у цифровому світі

Якщо дивитися з індустріальної точки зору, важливість GPT-6 Astra полягає не лише у оновленні моделі, а й у підтвердженні напрямку розвитку індустрії ШІ.

Протягом останніх кількох років у галузі активно обговорювалося, чи замінять великі моделі програмне забезпечення.

Але більш реалістичним шляхом може бути:

Штучний інтелект не замінить одразу всі програми, а стане інтелектуальним рівнем виконання, який з’єднує програми, дані та людей.

У майбутньому працівнику компанії може не знадобитися відкривати десятки додатків, щоб виконати роботу — достатньо просто сказати ціль штучному інтелекту.

Аналізуйте тренди продажів цього року.

Підготуйте бюджет на наступний квартал.

Шукайте потенційних клієнтів.

Оптимізувати код та розгорнути тестове середовище.

AI відповідає за розбиття завдань, виклик інструментів та виконання процесів, а людина — за визначення цілей та остаточне прийняття рішень.

Також саме це робить здатність Astra до операцій з комп’ютером більш цікавою, ніж просте збільшення розміру параметрів.

Розмір моделі визначає, скільки знає ШІ.

Здатності агента визначають, скільки може зробити ШІ.

З цієї точки зору GPT-6 Astra — це не ще один чат-бот, а новий спосіб взаємодії з обчисленнями.

У епоху інтернету люди шукають інформацію за допомогою пошукових систем; у епоху мобільного інтернету люди виконують сервіси через додатки; у епоху ШІ люди можуть виконувати завдання безпосередньо за допомогою розумних агентів.

Чи досягла Astra AGI, наразі залишається предметом суперечок.

Але можна з упевненістю сказати, що це стало важливим кроком у розвитку ШІ у напрямку «автономного виконання».

У найближчі роки справжнім змінювачем структури продуктивності може стати не модель, яка точніше відповідає на запитання, а інтелектуальна система, здатна довгостроково виконувати складні завдання замість людини.

Значення GPT-6 Astra полягає саме в тому, що воно робить це майбутнє першого разу більш конкретним.

Джерела

  1. OpenAI, «Огляд безпеки: GPT-6 Astra», 3 вересня 2026 року
  2. Платформа розробника OpenAI, «Документація моделі GPT-6 Astra», 2026
  3. OpenAI, «Шлях до Astra: критичні здібності та кордонні заходи безпеки», вересень 2026
  4. Reuters, «OpenAI запускає нову модель Astra на тлі зростаючого нагляду за безпекою агентів», вересень 2026 року
  5. The Verge, «Наступна велика модель ШІ від OpenAI „ввійшла в еру AGI“», вересень 2026
  6. Wired, «OpenAI стверджує, що GPT-6 краще використовує комп’ютер, ніж людина», вересень 2026
  7. Штучний аналіз, «Бенчмаркинг GPT-6 Astra», 2026
Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.