DeepSeek выпустила новейшую модель V4-Flash, стоимость выполнения каждой задачи которой составляет всего около 3 центов — самую низкую среди ведущих глобальных моделей. Цены на V4-Flash установлены на уровне 0,14 доллара США за миллион входных токенов и 0,28 доллара США за миллион выходных токенов; общая стоимость значительно ниже, чем у конкурентов, и составляет примерно 1/105 от стоимости Anthropic Claude Fable 5. DeepSeek готовится к IPO, годовой повторяющийся доход от ее облачных API-сервисов уже достиг 400–500 миллионов долларов США, а маржа прибыли превышает 50%. Конкуренция в индустрии ИИ переходит от производительности моделей к соревнованию в стоимости вывода и коммерческой эффективности, что обещает снижение предельных затрат на внедрение ИИ-приложений в разы.Автор статьи, источник: Wall Street Journal
DeepSeek выпустила новую модель V4-Flash, снова выдвинув на первый план конкуренцию по стоимости AI-моделей.
Согласно последним расчетам исследовательской компании Artificial Analysis, средняя стоимость выполнения одной задачи V4-Flash составляет всего около 3 центов — это самый низкий показатель среди всех текущих глобальных крупных моделей и примерно в 105 раз ниже, чем у Claude Fable 5 от Anthropic. Это означает, что в ряде универсальных задач предельные затраты компаний на развертывание AI-приложений могут进一步 снизиться, а также вновь вызвали обсуждение на рынке эффективности возврата на огромные капитальные затраты в области ИИ.
Стоит отметить, что выпуск V4-Flash совпал с ускорением процесса коммерциализации DeepSeek. Согласно сообщениям со ссылкой на осведомленные источники, DeepSeek готовится к потенциальному IPO. Годовой повторяющийся доход (ARR), получаемый через облачные сервисы API моделей ИИ, уже достиг 400–500 миллионов долларов США, а валовая маржа превышает 50%.
V4-Flash продолжает традиционный подход компании к низким затратам и высокой эффективности, еще больше укрепляя стратегию конкуренции на рынке, основанную на цене и эффективности.
Стоимость каждой задачи в V4-Flash — всего 3 цента, лучшее соотношение цены и качества среди ведущих мировых моделей
Согласно данным Artificial Analysis, цена V4-Flash составляет 0,14 доллара США за миллион входящих токенов и 0,28 доллара США за миллион исходящих токенов.
Однако организация отмечает, что показатель «стоимость за выполненную задачу (Cost per Task)» более точно отражает фактические затраты на использование модели по сравнению с простой ценой. Этот показатель учитывает общее количество входных и выходных токенов, потребляемых моделью при выполнении одной и той же задачи, и поэтому более информативен.
По этим расчетам, средняя стоимость выполнения задачи для V4-Flash составляет около 3 центов, что является самым низким уровнем среди ведущих мировых моделей.
Для сравнения, Moonshot AI Kimi K3 стоит около 86 центов, OpenAI GPT-5.6 Sol — около 1,86 доллара, а Anthropic Claude Fable 5 — около 3,15 доллара. Стоимость V4-Flash составляет всего около 1/105 от стоимости последних.
Artificial Analysis дополнительно подчеркивает, что модели с низкой ценой за токен могут в конечном итоге иметь более высокую общую стоимость использования, если для выполнения задачи требуется генерировать больше контента или проходить больше интерактивных шагов. Таким образом, «стоимость завершения каждой задачи» лучше отражает соотношение цены и качества модели, чем единственный показатель цены.
Выход на рынок по низкой цене: конкуренция в области ИИ смещается с «сравнения производительности» на «сравнение соотношения цены и качества»
Вместо рейтинга производительности, на этот раз рыночное внимание сосредоточено на преимуществах V4-Flash по стоимости.
За последний год фокус конкуренции в индустрии ИИ постепенно сместился от способностей моделей к стоимости их вывода и эффективности коммерциализации. По мере постоянного роста масштабов применения ИИ в бизнесе, стоимость эксплуатации моделей становится важным фактором при принятии решений о закупках.
Когда модель может выполнять задачу примерно за 3 цента, в то время как стоимость некоторых высокопроизводительных моделей достигает нескольких долларов, общие затраты на внедрение в частых сценариях, таких как клиентская поддержка, автоматизация офисных процессов и помощь в написании кода, могут снизиться на порядок.
Это снова затрагивает вопрос, который продолжает интересовать Уолл-стрит: смогут ли огромные капиталовложения в ИИ в конечном итоге принести достаточную коммерческую отдачу.
В начале 2025 года после выпуска модели DeepSeek R1 рынок пересмотрел необходимость инвестиций в глобальную инфраструктуру ИИ, что вызвало значительную волатильность акций технологических компаний. Сегодня V4-Flash вновь выдвигает чрезвычайно низкие эксплуатационные расходы в качестве ключевого преимущества, что означает, что конкуренция в сфере ИИ все больше смещается с вопроса «какая модель сильнее» на вопрос «кто сможет предоставить достаточную производительность по более низкой цене». Обсуждение рентабельности инвестиций в ИИ, вероятно, снова активизируется.
