Perusahaan TI IplanRIO milik pemerintah kota Rio de Janeiro, Brasil, setelah melakukan fine-tuning pada model Alibaba Tongyi Qwen 3.5-397B-A17B, telah melepaskan model besar bernama Rio 3.5 Open 397B secara open source, dan secara tak terduga masuk ke dalam kelompok teratas AI global.Penulis artikel, sumber: Machine Heart
Hari ini, selain Claude Fable 5 yang dilarang di luar Amerika Serikat, komunitas AI juga dibanjiri oleh model open-source.

Seorang pengguna Twitter menemukan bahwa model Rio 3.5 397B, yang di-open-source oleh perusahaan TI milik pemerintah kota Rio de Janeiro, Brasil, unggul dalam berbagai uji benchmark dibandingkan model open-source seperti Qwen 3.7 Plus, sementara model dasarnya tetap Qwen3.5-397B-A17B.


Seorang pengguna Twitter lainnya, "Chubby", menyatakan tak percaya, "Model yang sebelumnya tidak pernah saya dengar sekarang menjadi SOTA open-source, bahkan melampaui Qwen 3.7."


Ini sudah menjadi model kedua minggu ini yang dilatih ulang berdasarkan Qwen3.5 dan masuk ke tingkat terdepan. Yang lainnya adalah Nex-N2-Pro 397B, yang juga dibangun berdasarkan Qwen3.5-397B-A17B, dengan kinerja sebanding dengan model unggulan seperti GPT-5.5 dan Opus 4.7.

Kenaikan Rio 3.5 membuat Clem Delangue, co-founder dan CEO Huggingface, berkomentar, "Masa depan AI tidak ada yang sudah ditakdirkan. Yang akan terjadi selanjutnya, kita semua memiliki pilihan dan ruang untuk bertindak: Jalur satu: API tertutup, kekuasaan terkonsentrasi, masa depan ditentukan oleh sejumlah kecil orang di Silicon Valley dan Washington. Jalur dua: AI open source, memungkinkan setiap orang untuk berpartisipasi, memiliki, dan bersama-sama membangun, termasuk institusi seperti Rio. Pilih jalurmu, teman."


Selanjutnya, mari kita pelajari detail teknis dari model Rio 3.5 397B.

Rio 3.5 Open 397B adalah model AI umum tingkat lanjut yang dikembangkan oleh IplanRIO, perusahaan TI milik pemerintah kota Rio de Janeiro.
Model ini dilatih ulang berdasarkan Qwen 3.5 397B, mencapai tingkat terdepan di antara model open-source dalam berbagai benchmark seperti pemrograman agen, matematika, STEM, multibahasa, dan multimodal, dengan peningkatan signifikan dibandingkan model dasar, serta mampu bersaing dengan model open-source dan closed-source terkuat di dunia.

Fitur inti model meliputi:
- 397B parameter total, 17B activated parameters, using Mixture of Experts (MoE) architecture;
- 1.010.000 token, yaitu jendela konteks level 1 juta;
- Integrasi SwiReasoning: memungkinkan peralihan dinamis antara inferensi eksplisit dan inferensi ruang laten untuk mencapai keseimbangan yang lebih optimal antara akurasi dan efisiensi;
- Kemampuan umum kuat: berkinerja unggul dalam pemrograman agen, penalaran, kepatuhan terhadap perintah, dan tugas multimodal;
- Mampu berbahasa banyak: memiliki kinerja yang baik dalam bahasa Portugis, Inggris, Cina, dan puluhan bahasa lainnya;
- Menggunakan lisensi MIT: sepenuhnya terbuka, dapat digunakan untuk tujuan komersial dan penelitian.
Di antaranya, SwiReasoning adalah kerangka inferensi tanpa pelatihan yang didasarkan pada penelitian Shi dkk. tahun 2025, yang dapat secara dinamis beralih antara inferensi rantai pemikiran eksplisit dan inferensi ruang laten berdasarkan sinyal kepercayaan berbasis entropi. Hal ini meningkatkan akurasi sekaligus secara signifikan meningkatkan efisiensi token. Model ini juga dioptimalkan secara khusus selama pelatihan untuk memanfaatkan peningkatan efisiensi yang dihasilkan dari inferensi ruang laten.

Pengujian Benchmark Pemrograman Agen dan Rekayasa Perangkat Lunak:

Knowledge and Reasoning Benchmark:

Math benchmark:

Pengujian berbasis multibahasa:

Benchmark Agent dan Kepatuhan Instruksi:

Tautan referensi:
https://x.com/kimmonismus/status/2065911865390063791
https://huggingface.co/prefeitura-rio/Rio-3.5-Open-397B
https://x.com/ZenMagnets/status/2065796012820848699
https://x.com/SemiAnalysis_/status/2065894494935933191
