Tencent Hunyuan melancarkan versi ringan Hy4 pra-pelancaran dengan kompresi model 214GB

iconKuCoinFlash
Kongsi
AI summary iconRingkasan
Tencent Hunyuan telah melancarkan versi ringan pra-pandangan Hy4, mengompres berat model daripada 1.5 TB kepada 214 GB menggunakan algoritma kuantisasi jarang tersier Sherry dan strategi MIX-STQ1_0. Versi Hy4 mengekalkan prestasi yang kuat dalam pemahaman teks panjang, pengambilan konteks pelbagai giliran, dan bantuan pengkodean, serupa dengan versi asal BF16. Pedagang yang menilai pembaruan ini mungkin mempertimbangkan tahap sokongan dan rintangan dalam keuntungan kecekapan model. Nisbah risiko-ke-keuntungan untuk mengadopsi model yang dioptimalkan seperti ini kelihatan menguntungkan, mengingat kompromi prestasi yang minimum.
ME AI Berita, Tencent Hunyuan melancarkan versi ringan Hy4 preview, menggunakan algoritma kuantisasi jarang-trit Sherry buatan sendiri dan strategi kuantisasi per tingkat MIX-STQ1_0, mengurangkan berat model dari 1.5 TB kepada sekitar 214 GB. Versi kuantisasi Hy4 preview menunjukkan prestasi hampir setara dengan versi asal BF16 dalam tugas-tugas seperti pemahaman teks panjang, carian konteks berbilang peringkat, dan bantuan pengkodean. Sumber: Tencent Hunyuan (Sumber: MLion)
Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.