La société informatique IplanRIO, dépendant de la mairie de Rio de Janeiro au Brésil, a effectué un fine-tuning sur le modèle Alibaba Qwen 3.5-397B-A17B et a open-sourcé un grand modèle nommé Rio 3.5 Open 397B, pénétrant ainsi inopinément les premiers rangs mondiaux de l'IA.Auteur de l'article, source : Machine Heart
Aujourd'hui, en plus de Claude Fable 5 interdit dans le monde entier (hors États-Unis), la communauté IA est inondée par un modèle open source.

Un blogueur sur Twitter a découvert que le modèle open source Rio 3.5 397B, développé par l'entreprise informatique de la ville de Rio de Janeiro au Brésil, a surpassé plusieurs modèles open source, notamment Qwen 3.7 Plus, lors de divers tests de référence, alors que ce modèle est basé sur Qwen3.5-397B-A17B.


Un autre tweeteur, « Chubby », a exprimé son étonnement : « Un modèle dont on n'avait jamais entendu parler devient maintenant le SOTA open source, dépassant même Qwen 3.7. »


C'est déjà le deuxième modèle de cette semaine à avoir été fine-tuné à partir de Qwen3.5 et à atteindre un niveau de pointe. L'autre est Nex-N2-Pro 397B, également construit à partir de Qwen3.5-397B-A17B, avec des performances comparables à celles de modèles de premier plan comme GPT-5.5 et Opus 4.7.

La montée de Rio 3.5 a poussé Clem Delangue, cofondateur et PDG de Hugging Face, à déclarer : « L'avenir de l'IA n'est pas écrit. Ce qui va se produire ensuite dépend de nos choix et de nos actions : Chemin 1 : des API propriétaires, un pouvoir centralisé, un avenir déterminé par quelques-uns à Silicon Valley et à Washington. Chemin 2 : une IA open source, accessible, possédée et co-construite par tous, y compris par des institutions comme la ville de Rio. Choisissez votre chemin, ami. »


Ensuite, examinons les détails techniques du modèle Rio 3.5 397B.

Rio 3.5 Open 397B est un modèle d'IA général de pointe développé par IplanRIO, l'entreprise municipale de TI de la ville de Rio de Janeiro.
Ce modèle a été fine-tuné à partir de Qwen 3.5 397B et atteint un niveau de pointe parmi les modèles open source sur les benchmarks d'agent de programmation, de mathématiques, de STEM, de multilinguisme et de multimodalité, avec une amélioration significative par rapport au modèle de base, et est capable de rivaliser avec les modèles open source et closed source les plus performants au monde.

Les caractéristiques principales du modèle incluent :
- 397 milliards de paramètres totaux, 17 milliards de paramètres actifs, avec une architecture d'experts mélangés (MoE) ;
- 1 010 000 jetons, soit une fenêtre de contexte de 1 million ;
- Intégration de SwiReasoning : bascule dynamique entre raisonnement explicite et raisonnement dans l'espace latent pour un meilleur équilibre entre précision et efficacité ;
- Capacités générales élevées : excellente performance dans la programmation d'agents, le raisonnement, le respect des instructions et les tâches multimodales ;
- Fort en plusieurs langues : bonnes performances en portugais, anglais, chinois et dizaines d'autres langues ;
- Licence MIT : entièrement ouverte, utilisable à des fins commerciales et de recherche.
SwiReasoning est un cadre d'inférence sans entraînement, basé sur la recherche de Shi et al. en 2025, qui permet de basculer dynamiquement entre l'inférence explicite par chaîne de pensée et l'inférence dans l'espace latent, en se fondant sur des signaux de confiance basés sur l'entropie. Cela améliore à la fois la précision et l'efficacité en termes de tokens. Le modèle a été optimisé pendant l'entraînement pour tirer parti des gains d'efficacité apportés par l'inférence dans l'espace latent.

Benchmark d'algorithmes et d'ingénierie logicielle :

Évaluation des connaissances et du raisonnement :

Test de performance mathématique :

Évaluation multilingue :

Benchmark d’agents et de suivi d’instructions :

Lien de référence :
https://x.com/kimmonismus/status/2065911865390063791
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
https://x.com/ZenMagnets/status/2065796012820848699
https://x.com/SemiAnalysis_/status/2065894494935933191
