Alibaba анонсирует Qwen 3.8-Flash-Next с 125 млрд параметров и 6 млрд параметров на токен с использованием MoE

iconChainGPT
Поделиться
AI summary iconСводка
Alibaba объявила о запуске токена для Qwen 3.8-Flash-Next, который будет выпущен в эту среду. Модель имеет 125 млрд параметров, но использует MoE для активации 6 млрд на токен. Hugging Face и Alibaba называют её превью Qwen 4. Пока нет никаких тестовых показателей. Открытая архитектура с весами может поддержать новые списки токенов и ончейн-инструменты. Производительность и эффективность затрат пока не подтверждены.

Заголовок: Alibaba анонсирует Qwen 3.8-Flash-Next — предварительную версию с 125 млрд параметров, активирующую всего 6 млрд на токен, намекая на Qwen 4 Alibaba представит Qwen 3.8-Flash-Next в эту среду — компания позиционирует его как ранний обзор архитектуры следующего поколения Qwen 4, а не как готовую флагманскую модель. Согласно команде Alibaba и циркулирующему твиту, модель содержит 125 миллиардов параметров, но, как сообщается, активирует лишь около 6 миллиардов параметров на токен (в твите также упоминался компонент «+51B N-gram»). Эти цифры и реальная производительность модели пока не подтверждены; Alibaba и Hugging Face описывают релиз как предварительный обзор архитектуры и не опубликовали сравнительные бенчмарки. Почему эти цифры важны: - Параметры — это «ручки», которые модель использует для обучения и адаптации. Больше параметров обычно означает большую способность, но и более высокие вычислительные затраты. - Суть в архитектуре mixture-of-experts (MoE): вместо запуска всей огромной сети на каждом входе модель направляет каждый запрос на небольшую подгруппу специализированных «экспертных» подмоделей. Это позволяет модели с 125 млрд параметров вести себя по вычислительным затратам так, как будто она намного меньше, активируя только релевантных экспертов для каждого токена. Коротко: потенциально фронтовая производительность при стоимости вычислений уровня массового рынка — если заявленное поведение MoE подтвердится. Что говорит Alibaba и что остается неясным: - Alibaba представляет Qwen 3.8-Flash-Next как мультимодальную модель, построенную на новой архитектуре Qwen 4, выпущенную заранее, чтобы разработчики могли подготовиться к полному семейству. - Hugging Face, где ожидаются веса модели, также называет её предварительным обзором архитектуры Qwen 4. - Независимые бенчмарки или прямые сравнения с линейкой Qwen 3 или западными конкурентами пока не опубликованы, поэтому производительность и компромиссы по ресурсам остаются спекулятивными. Контекст: Китайский импульс открытых весов Китайская экосистема открытых весов активно развивается. Недавние анонимные и институциональные релизы (загадочная модель Ox Alpha, превзошедшая Fable от Anthropic в некоторых тестах по программированию, а также открытые веса от Alibaba, DeepSeek и Moonshot) делают мощные модели доступными для скачивания, дообучения и локального запуска. Открытые веса снижают зависимость от закрытых API, уменьшают расходы на хостинг и позволяют разработчикам избегать отправки конфиденциальных данных на сторонние сервисы — важные факторы как для общего ИИ, так и для криптопроектов. Почему криптосообществу это важно: - Ончейн-инструменты и боты: более дешёвые, локально запускаемые крупные модели могут обеспечивать более умные ончейн-агенты, инструменты аудита, стратегии торговли и MEV без постоянных плат за API. - Конфиденциальность и хранение: локальное размещение моделей снижает риск утечки данных о приватных ключах, графах транзакций или проприетарных торговых сигналах. - Децентрализованная ИИ-инфраструктура: открытые веса могут ускорить развитие децентрализованных слоёв вывода и минимизированных по доверию оракулов, избегающих привязки к одному провайдеру. - Оговорка: пока не появятся бенчмарки и реальные цифры стоимости, преждевременно предполагать, что модель обеспечивает фронтовые возможности при низкой цене. Итог: Qwen 3.8-Flash-Next позиционируется как предварительный взгляд на философию дизайна Qwen 4 — с обещанием эффективности mixture-of-experts и мультимодальных возможностей. Релиз примечателен тем, что если заявления подтвердятся, открытые веса модели с 125 млрд параметров MoE, активирующей всего ~6 млрд на токен, могут демократизировать мощный ИИ для разработчиков и криптопроектов. Но нам нужны подтверждённые бенчмарки и практические тесты, чтобы проверить гиперболу. Следите за официальным релизом, весами на Hugging Face и независимыми оценками.

Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации. Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.