Міська IT-компанія IplanRIO з Ріо-де-Жанейро, Бразилія, після до навчання на моделі Alibaba Tongyi Qwen 3.5-397B-A17B, відкрила код великій моделі під назвою Rio 3.5 Open 397B, яка несподівано потрапила до першої п’ятірки світових AI-моделей.Автор статті, джерело: Machine Learning News
Сьогодні AI-спільнота також охоплена відкритим моделем, крім забороненого в усьому світі (крім США) Claude Fable 5.

Блогер у Твіттері виявив, що відкрита модель Rio 3.5 397B, розроблена ІТ-компанією міської адміністрації Ріо-де-Жанейро, Бразилія, перевершила кілька відкритих моделей, зокрема Qwen 3.7 Plus, при цьому базовою моделлю для неї є Qwen3.5-397B-A17B.


Інший твіттер-блогер «Chubby» висловив неповіру: «Модель, про яку раніше ніколи не чули, тепер стала відкритою SOTA, навіть перевершивши Qwen 3.7».


Це вже друга модель цього тижня, яка була доопрацьована на основі Qwen3.5 і вийшла на передовий рівень. Інша — Nex-N2-Pro 397B, яка також побудована на основі Qwen3.5-397B-A17B і має продуктивність, що поступається лише таким топовим моделям, як GPT-5.5 і Opus 4.7.

Захоплення Rio 3.5 спонукало співзасновника та генерального директора Hugging Face Клема Деланга висловити таке: «Майбутнє ШІ нічого не передбачено. Те, що відбудеться далі, — це вибір і дії кожного з нас: шлях один — закриті API, централізація влади, майбутнє вирішують кілька осіб з Сіліконової долини та Вашингтона. Шлях два — відкритий ШІ, який дозволяє кожному брати участь, володіти та спільно будувати, включаючи такі установи, як Ріо. Вибирайте свій шлях, друге».


Далі розглянемо технічні деталі моделі Rio 3.5 397B.

Rio 3.5 Open 397B — це передовий універсальний AI-модель, розроблений муніципальною IT-компанією IplanRIO, що належить міській адміністрації Ріо-де-Жанейро.
Ця модель була доопрацьована на основі Qwen 3.5 397B і досягла лідерських позицій серед відкритих моделей за результатами тестів з програмування агентів, математики, STEM, багатомовності та багатомодальності, показавши значне покращення порівняно з базовою моделлю, а також здатна конкурувати з найсильнішими відкритими та закритими моделями світу.

Основні характеристики моделі включають наступне:
- 397 мільярдів загальних параметрів, 17 мільярдів активованих параметрів, архітектура змішаних експертів (MoE);
- 1 010 000 токенів, тобто контекстне вікно рівня 1 мільйона;
- Інтеграція SwiReasoning: динамічний переключення між явним виведенням та виведенням у латентному просторі для оптимального балансу між точністю та ефективністю;
- Висока універсальна здатність: відмінно виконує завдання з програмування агентів, міркування, виконання інструкцій та багатомодальних завдань;
- Володіє мультимовністю: добре виявляє себе в португальській, англійській, китайській та десятках інших мов;
- Ліцензія MIT: повна відкритість, призначена для комерційного та наукового використання.
SwiReasoning — це безтренувальна інференсна рамка, заснована на дослідженні Ші та інших 2025 року, яка динамічно переключається між експліцитним ланцюжком міркувань та латентним просторовим міркуванням на основі ентропійного сигналу впевненості. Це дозволяє підвищити точність та значно збільшити ефективність токенів. Під час навчання модель також оптимізована для отримання ефективності завдяки латентному просторовому міркуванню.

Тестування програмування агентів та інженерії програмного забезпечення:

Тест на знання та логічне мислення:

Математичний тест:

Багатомовне тестування:

Тестування виконання інструкцій та агентів:

Посилання для довідки:
https://x.com/kimmonismus/status/2065911865390063791
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
https://x.com/ZenMagnets/status/2065796012820848699
https://x.com/SemiAnalysis_/status/2065894494935933191
