Бразильская ИТ-компания IplanRIO, принадлежащая городскому правительству Рио-де-Жанейро, после дообучения на модели Alibaba Tongyi Qwen 3.5-397B-A17B выпустила открытую большую модель под названием Rio 3.5 Open 397B, неожиданно попав в первую десятку мировых ИИ-моделей.Автор статьи, источник: Machine Learning China
Сегодня AI-сообщество также охвачено открытым моделью, помимо заблокированного в мире (не в США) Claude Fable 5.

Блогер в Twitter обнаружил, что модель Rio 3.5 397B, открытая компанией по информационным технологиям муниципалитета Рио-де-Жанейро, Бразилия, превзошла такие открытые модели, как Qwen 3.7 Plus, по нескольким тестовым наборам, при этом базовой моделью для неё является Qwen3.5-397B-A17B.


Другой твиттер-блогер «Chubby» выразил недоумение: «Модель, о которой раньше никто не слышал, теперь стала открытой SOTA и даже превзошла Qwen 3.7».


Это уже вторая модель этой недели, прошедшая дообучение на основе Qwen3.5 и вышедшая на передовой уровень. Другая — Nex-N2-Pro 397B, также построенная на основе Qwen3.5-397B-A17B, чья производительность сопоставима с такими топовыми моделями, как GPT-5.5 и Opus 4.7.

Возрождение Rio 3.5 вызвало восклицание сооснователя и генерального директора Hugging Face Клема Деланга: «Будущее ИИ ничем не предопределено. То, что произойдет дальше, зависит от наших выборов и действий: Путь один — закрытые API, централизация власти, будущее определяется небольшой группой людей из Силиконовой долины и Вашингтона. Путь два — открытый ИИ, в котором каждый может участвовать, владеть и совместно создавать, включая такие организации, как Рио-де-Жанейро. Выбирайте свой путь, друг».


Далее давайте ознакомимся с техническими деталями модели Rio 3.5 397B.

Rio 3.5 Open 397B — это передовая универсальная ИИ-модель, разработанная городской ИТ-компанией IplanRIO, принадлежащей городскому правительству Рио-де-Жанейро.
Модель прошла дообучение на основе Qwen 3.5 397B и достигла лидирующих позиций среди открытых моделей по стандартным тестам в области программирования агентов, математики, STEM, многоязычности и мультимодальности, продемонстрировав значительное улучшение по сравнению с базовой моделью, а также способность конкурировать с лучшими открытыми и закрытыми моделями в мире.

Основные характеристики модели включают следующее:
- 397 млрд общих параметров, 17 млрд активных параметров, архитектура смешанных экспертов (MoE);
- 1 010 000 токенов, то есть контекстное окно уровня 1 миллиона;
- Интеграция SwiReasoning: возможность динамически переключаться между явным выводом и выводом в латентном пространстве для достижения оптимального баланса между точностью и эффективностью;
- Высокая универсальная способность: отличные результаты в программировании агентов, рассуждении, выполнении команд и многомодальных задачах;
- Хорошо владеет несколькими языками: демонстрирует хорошие результаты на португальском, английском, китайском и десятках других языков;
- Используется лицензия MIT: полностью открытый код, допускается использование в коммерческих и исследовательских целях.
SwiReasoning — это обучающаяся инференс-система, основанная на исследовании Shi и др. 2025 года, которая динамически переключается между явным цепочечным рассуждением и скрытым пространственным рассуждением на основе энтропийных сигналов уверенности. Это повышает точность и значительно улучшает эффективность использования токенов. Модель также оптимизирована при обучении для максимизации эффективности, достигаемой за счет скрытого пространственного рассуждения.

Тестирование программирования агентов и программной инженерии:

Тесты знаний и логического вывода:

Математический бенчмарк:

Многоязычный бенчмаркинг:

Тестирование агентов и выполнения инструкций:

Ссылка для справки:
https://x.com/kimmonismus/status/2065911865390063791
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
https://x.com/ZenMagnets/status/2065796012820848699
https://x.com/SemiAnalysis_/status/2065894494935933191
