OpenAI випустила нову модель під назвою Ultrafast, яка характеризується вищою швидкістю відповідей моделі. Компанія стверджує, що цей режим дозволяє GPT 5.6 Sol працювати зі швидкістю в 14 разів вищою за стандартну, досягаючи максимальної швидкості виведення до 750 токенів на секунду. Наразі він доступний лише у вигляді попереднього перегляду для обмеженої кількості клієнтів.
Це оновлення спрямоване на задоволення потреб бізнесу у реальному часі з обробкою штучного інтелекту. OpenAI зазначає, що раніше для отримання відповідей, ближчих до реального часу, зазвичай потрібно було переключитися на менші моделі або вибрати системи, оптимізовані для конкретних завдань. Напрямок Ultrafast полягає у підвищенні кількості ефективних завдань, які можна виконати за одиницю часу, не залежачи виключно від малих моделей.
Збільшення швидкості виведення
Згідно з OpenAI, ключовою перевагою Ultrafast є значне скорочення часу очікування генерації.
- Максимальна швидкість виведення до 750 токенів за секунду
- Швидкість обробки приблизно в 14 разів вища, ніж у стандартному режимі
- Поточна версія все ще перебуває на етапі попереднього перегляду
TechCrunch зазначає, що такі конкуренти, як Anthropic, раніше також запускали прискорений режим. Наприклад, продукт Claude також пропонує швидкий режим, але OpenAI оголосила вищі показники швидкості.
Для корпоративних робочих процесів
OpenAI спрямовує застосування Ultrafast на різноманітні корпоративні завдання, зокрема реагування на події, обслуговування клієнтів та підтримка, аналіз фінансових ринків та електронна комерція. Такі сценарії зазвичай більш чутливі до затримок, і час відповіді моделі безпосередньо впливає на ефективність взаємодії з людиною та продуктивність автоматизованих процесів.
З погляду позиціонування продукту, Ultrafast — це не окрема нова модель, а спосіб швидкого запуску, що базується на GPT 5.6 Sol. Для корпоративних клієнтів це означає збереження потужних можливостей моделі разом із спробою безпосередньо інтегрувати ШІ в реальні часові бізнес-процеси.
Підтримується Cerebras
OpenAI зазначила, що Ultrafast підтримується їхнім партнерством із чіповою компанією Cerebras. Перші доступи до попередньої версії зараз доступні лише для невеликої групи клієнтів, а потім доступ буде поступово розширюватися зі збільшенням обчислювальних потужностей.
Це також свідчить про те, що конкуренція між великими моделями розширюється від порівняння параметрів і здатностей до швидкості відповіді, ефективності розгортання та координації базової обчислювальної потужності. Для AI-продуктів, спрямованих на корпоративний ринок, швидкість стає ключовим показником, що поступається лише якості моделі.
