Tencent Hunyuan Meluncurkan Versi Ringan Hy4 Preview dengan Kompresi Model 214GB

iconKuCoinFlash
Bagikan
AI summary iconRingkasan
Tencent Hunyuan telah meluncurkan versi ringan Hy4, mengompresi bobot model dari 1,5 TB menjadi 214 GB menggunakan algoritma Sherry sparse ternary quantization dan strategi MIX-STQ1_0. Versi Hy4 mempertahankan kinerja kuat dalam pemahaman teks panjang, pengambilan konteks multi-putaran, dan bantuan pemrograman, sebagaimana model asli BF16. Pedagang yang mengevaluasi pembaruan ini dapat mempertimbangkan level support dan resistance dalam peningkatan efisiensi model. Rasio risiko-terhadap-imbal hasil untuk mengadopsi model yang dioptimalkan ini tampak menguntungkan, mengingat kompromi kinerja yang minimal.
ME AI Berita, Tencent Hunyuan meluncurkan versi preview Hy4 ringan, yang menggunakan algoritma kuantisasi jarang-trit Sherry buatan sendiri dan strategi kuantisasi lapisan-per-lapis MIX-STQ1_0 untuk mengompres bobot model dari 1,5 TB menjadi sekitar 214 GB. Versi terkuantisasi Hy4 preview menunjukkan kinerja yang mendekati versi asli BF16 dalam tugas-tugas seperti pemahaman teks panjang, pencarian konteks multi-putaran, dan bantuan pemrograman. Sumber: Tencent Hunyuan (Sumber: MLion)
Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.