DeepSeek запускає найновішу модель V4-Flash, вартість виконання кожної задачі якої становить лише близько 3 центів — найнижчу серед основних глобальних моделей. Ціна V4-Flash: 0,14 долара за мільйон вхідних токенів і 0,28 долара за мільйон вихідних токенів; загальна вартість значно нижча, ніж у конкурентів, і становить лише приблизно 1/105 від Anthropic Claude Fable 5. DeepSeek підготоовується до IPO, щорічний повторюваний дохід від своїх API-сервісів у хмарі вже досяг 400–500 мільйонів доларів США, а маржа прибутку перевищує 50%. Конкуренція в галузі ШІ переходить від продуктивності моделей до боротьби за вартість інференсу та ефективність комерціалізації, що може призвести до кількісного зниження граничних витрат на розгортання ШІ-застосунків підприємствами.Автор статті, джерело: Wall Street Journal
DeepSeek випустила найновішу модель V4-Flash, знову вивівши конкуренцію з вартістю AI-моделей на перший план.
Останні розрахунки дослідницької компанії Artificial Analysis показують, що середня вартість виконання однієї задачі V4-Flash становить лише близько 3 центів — найнижчий показник серед сучасних глобальних великих моделей, що становить приблизно 1/105 від вартості Claude Fable 5 від Anthropic. Це означає, що в багатьох універсальних завданнях гранична вартість розгортання AI-застосунків підприємствами може далі знизитися, що знову викликає обговорення на ринку щодо рентабельності великих капітальних витрат у сфері ШІ.
Варто звернути увагу, що випуск V4-Flash припадає на період прискорення комерціалізації DeepSeek. За повідомленнями з посиланням на осіб, знайомих із ситуацією, DeepSeek підготоовує потенційне IPO. Їхній річний повторюваний дохід (ARR) від API-сервісів хмари з AI-моделями досяг 400–500 мільйонів доларів США, а маржа прибутку перевищує 50%.
V4-Flash, представлений у цьому випуску, продовжує традиційний підхід компанії до низьких витрат і високої ефективності, ще більше посилюючи стратегію конкуренції на ринку за ціною та ефективністю.
V4-Flash: вартість кожної задачі лише 3 центи, найкраще співвідношення ціни та якості серед глобальних головних моделей
За даними Artificial Analysis, ціна V4-Flash становить 0,14 долара за мільйон вхідних токенів і 0,28 долара за мільйон вихідних токенів.
Проте, зауважує організація, що показник «вартість за завдання» (Cost per Task) краще відображає реальні витрати на використання моделі, ніж просто ціна за запит. Цей показник враховує загальну кількість вхідних та вихідних токенів, витрачених моделлю при виконанні одного завдання, і тому є більш інформативним.
За цим розрахунком, середня вартість однієї задачі V4-Flash становить близько 3 центів США, що є найнижчим рівнем серед глобальних основних моделей.
Для порівняння, Moonshot AI Kimi K3 коштує приблизно 86 центів, OpenAI GPT-5.6 Sol — приблизно 1,86 долара, а Anthropic Claude Fable 5 — приблизно 3,15 долара. Вартість V4-Flash становить лише близько 1/105 від ціни останніх.
Artificial Analysis додає, що моделі з низькою ціною за токен можуть мати вищі загальні витрати, якщо для виконання завдання потрібно генерувати більше контенту або проходити більше інтерактивних кроків. Тому «вартість завершення кожного завдання» краще відображає співвідношення ціни та якості, ніж одиничний показник ціни.
Пробившись на низьких цінах, конкуренція в ІІ від «боротьби за продуктивність» переходить до «боротьби за співвідношення ціни та якості»
На відміну від рейтингу продуктивності, на цей раз ринок більше звертає увагу на переваги V4-Flash у витратах.
За останній рік фокус конкуренції в галузі ШІ поступово змістився від здатності моделей до витрат на виведення та ефективності комерціалізації. Зі зростанням масштабів корпоративного застосування ШІ витрати на запуск моделей стають важливим фактором при прийнятті рішень про закупівлю.
Коли модель може виконати завдання за приблизно 3 центи, тоді як вартість деяких висококласних моделей досягає кількох доларів, витрати на впровадження високочастотних сценаріїв, таких як служба підтримки клієнтів, автоматизація офісних процесів та допомога у написанні коду, можуть зменшитися на порядок.
Це знову стосується питання, яке тривалий час цікавить Стен-Стрит: чи зможуть великі інвестиції в ШІ принести достатній комерційний прибуток.
На початку 2025 року після запуску DeepSeek моделі R1 ринок переглянув необхідність інвестицій у глобальну інфраструктуру ШІ, що викликало значні коливання на ринку технологічних акцій. Зараз V4-Flash знову піднімає низькі витрати на роботу як ключову перевагу, що означає, що конкуренція в галузі ШІ все більше зміщується з питання «яка модель сильніша» на питання «хто зможе надати достатньо добру продуктивність за нижчою ціною». Обговорення ефективності інвестицій у ШІ, ймовірно, знову набуде гостроти.
