Zhipu Melancarkan GLM-5.3-Flash, Model Multimodal Pertama Secara Native di Cip Cina

iconCryptoBriefing
Kongsi
AI summary iconRingkasan
Zhipu AI melancarkan GLM-5.3-Flash pada 26 Ogos, model multimodal asli pertama dalam siri GLM-5. Berita AI + kripto ini menandakan satu titik penting kerana model ini berjalan sepenuhnya pada akselerator AI buatan China dengan 320 bilion parameter. Ia menyokong 1 juta token dan input imej/video asli. Model ini mendapat skor 63.4 pada tolok pengkodean DeepSWE v1.1 dan tersedia di bawah lesen MIT di Hugging Face dan ModelScope. Berita di atas blok rantai ini menonjolkan integrasi yang semakin meningkat antara teknologi AI dan blok rantai.

Z.ai China, syarikat yang sebelumnya dikenali sebagai Zhipu AI, melancarkan GLM-5.3-Flash pada 26 Ogos, menjadikannya model multimodal asli pertama dalam siri GLM-5. Pelancaran ini penting bukan sahaja kerana modelnya sendiri: ia berjalan sepenuhnya pada akselerator AI buatan tempatan, satu demonstrasi jelas bahawa peranti keras Cina mampu menangani beban kerja berskala besar.

Masa penting. Kawalan eksport dari AS telah menghadkan akses kepada cip paling canggih NVIDIA untuk pembeli China, mendorong syarikat seperti Z.ai untuk membina berdasarkan apa yang mereka ada.

Apa yang sebenarnya dilakukan model tersebut

GLM-5.3-Flash menggunakan arsitektur hibrida yang menggabungkan perhatian jarang dan linear, yang merupakan pilihan reka bentuk untuk mengurangkan keperluan pengiraan secara ketara. Model ini membawa 320 bilion parameter keseluruhan tetapi hanya mengaktifkan 18 bilion setiap token, bermakna ia memanfaatkan pangkalan pengetahuan yang besar tanpa menanggung kos pengiraan penuh pada setiap inferens.

Iklan

Tingkap konteks berada pada 1 juta token, menjadikannya salah satu yang paling panjang yang tersedia dalam mana-mana model terbuka. Sokongan asli untuk input gambar dan video menjadikannya benar-benar multimodal dari peringkat arkaitekturnya, bukan sebagai kemampuan yang ditambahkan secara luaran.

Pada ujian pengkodean DeepSWE v1.1, GLM-5.3-Flash mendapat skor 63.4, berbanding 46.2 untuk pendahulunya, GLM-5.2. Model ini juga mendapat skor 57 pada Indeks Kecerdasan Analisis Artifisial.

Harga agresif. Akses API berharga $0.15 setiap sejuta token input dan $0.50 setiap sejuta token output, dengan input yang disimpan dalam cache tersedia pada harga $0.03. Z.ai menggambarkan kos ini sebagai kira-kira sepuluh kali lebih rendah daripada beberapa pilihan pesaing.

Cip Cina melakukan kerja sebenar

Z.ai melaksanakan GLM-5.3-Flash merentasi cluster akselerator AI buatan tempatan, kemudian membina tapis perkhidmatan tersuai dan mengaplikasikan teknik kuantisasi yang disesuaikan dengan peranti tersebut. Hasilnya ialah peningkatan tiga kali ganda dalam prestasi end-to-end berbanding pendekatan pelaksanaan yang lebih genrik.

Model ini dilengkapi dengan berat terbuka di bawah lesen MIT, tersedia dalam format FP8 dan BF16 di Hugging Face dan ModelScope. MIT adalah salah satu lesen yang paling longgar: pembangun dan syarikat boleh menggunakan, memodifikasi, dan mengedarkan berat tersebut secara komersial tanpa sekatan.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.