Headline: Alibaba memperkenalkan Qwen 3.8-Flash-Next — pra-pandangan 125B parameter yang hanya mengaktifkan 6B per token, menunjuk ke Qwen 4 Alibaba akan melancarkan Qwen 3.8-Flash-Next pada Rabu ini — digambarkan oleh syarikat sebagai pra-pandangan awal arsitektur Qwen 4 generasi seterusnya, bukan model unggulan yang siap sepenuhnya. Menurut pasukan Alibaba dan satu tweet yang beredar, model ini mengandungi 125 bilion parameter tetapi dilaporkan hanya mengaktifkan sekitar 6 bilion parameter setiap token (tweet tersebut juga merujuk kepada komponen “+51B N-gram”). Angka-angka ini dan prestasi model dalam dunia nyata masih belum disahkan; Alibaba dan Hugging Face menggambarkan pelancaran ini sebagai pra-pandangan arsitektur dan tidak menerbitkan skor perbandingan sisi-ke-sisi. Mengapa nombor-nombor ini penting - Parameter adalah kawalan yang digunakan model untuk belajar dan beradaptasi. Lebih banyak parameter biasanya bermakna lebih banyak kemampuan tetapi juga kos komputasi yang lebih tinggi. - Trik di sini ialah arsitektur mixture-of-experts (MoE): bukannya menjalankan setiap bahagian rangkaian besar pada setiap input, model ini menghala setiap permintaan kepada subset kecil sub-model “pakar” yang berspesialisasi. Ini boleh membuat model 125B parameter berkelakuan, dari segi kos komputasi, seperti model yang jauh lebih kecil dengan hanya mengaktifkan pakar yang relevan untuk setiap token. Dengan kata lain: kapasiti hampir terkini berpotensi pada kos komputasi biasa — jika perilaku MoE yang diklaim berkesan. Apa yang Alibaba katakan dan apa yang masih tidak jelas - Alibaba menggambarkan Qwen 3.8-Flash-Next sebagai multimodal dan dibina berdasarkan reka bentuk Qwen 4 yang akan datang, dilancarkan awal supaya pembangun boleh bersedia untuk keseluruhan keluarga. - Hugging Face, di mana timbangan dijangka akan muncul, juga menyebutnya sebagai pra-pandangan arsitektur Qwen 4. - Tiada penilaian bebas atau perbandingan langsung dengan siri Qwen 3 atau pesaing Barat telah dikeluarkan, jadi prestasi dan perdagangan sumber masih spekulatif. Konteks: Momentum terbuka-bobot China Adegan terbuka-bobot China telah sangat aktif. Pelancaran anonim dan institusi baru-baru ini (model Ox Alpha yang misterius yang melebihi Fable Anthropic dalam beberapa ujian pengaturcaraan, dan timbangan terbuka dari Alibaba, DeepSeek dan Moonshot) menjadikan model berkuasa boleh dimuat turun, disesuaikan semula, dan dijalankan secara tempatan. Timbangan terbuka mengurangkan ketergantungan pada API tertutup, menurunkan kos hosting, dan membolehkan pembangun mengelakkan penghantaran data sensitif ke perkhidmatan pihak ketiga — faktor penting untuk AI umum dan projek kripto. Mengapa penonton kripto perlu ambil perhatian - Peralatan dan bot di rantai: model besar yang lebih murah dan boleh dijalankan secara tempatan boleh kuasakan agen di rantai yang lebih pintar, alat audit, strategi perdagangan dan MEV tanpa yuran API berterusan. - Privasi dan penyimpanan: mengendalikan model sendiri mengurangkan risiko kebocoran data untuk kunci peribadi, graf transaksi, atau isyarat perdagangan milik. - Infrastruktur AI terdesentralisasi: timbangan terbuka boleh mempercepatkan pembangunan lapisan inferens terdesentralisasi dan orakel yang meminimumkan kepercayaan serta mengelakkan ketergantungan pada penyedia tunggal. - Peringatan: sehingga penilaian dan angka kos sebenar muncul, terlalu awal untuk mengandaikan model ini memberikan kualiti terkini dengan kos rendah. Kesimpulan Qwen 3.8-Flash-Next sedang diposisikan sebagai penglihatan awal falsafah reka bentuk Qwen 4 — menjanjikan kecekapan mixture-of-experts dan kemampuan multimodal. Pelancaran ini penting kerana, jika dakwaan itu benar, timbangan terbuka daripada model MoE 125B parameter yang hanya mengaktifkan ~6B setiap token boleh mendedahkan AI berkuasa kepada pembangun dan projek kripto. Tetapi kita memerlukan penilaian yang disahkan dan ujian langsung untuk mengesahkan hingar-bingar ini. Pantau pelancaran rasmi, timbangan Hugging Face, dan penilaian bebas.
Alibaba Menggoda Qwen 3.8-Flash-Next 125B dengan 6B Parameter Setiap Token Melalui MoE
ChainGPTKongsi
Alibaba mengumumkan berita pelancaran token untuk Qwen 3.8-Flash-Next, yang dijadwalkan dilancarkan pada Rabu ini. Model ini memiliki 125B parameter tetapi menggunakan MoE untuk mengaktifkan 6B setiap token. Hugging Face dan Alibaba menyebutnya sebagai pra-pandangan Qwen 4. Belum ada benchmark yang tersedia. Reka bentuk berbobot terbuka mungkin menyokong pelancaran token baru dan alat berbasis rantai. Prestasi dan kecekapan kos masih belum disahkan.
Sumber:Tunjukkan artikel asal
Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini.
Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.