Tencent telah melancarkan Hy4 Preview, model Mixture-of-Experts (MoE) sumber terbuka. Pelancaran ini menandakan peningkatan besar dalam perlumbaan senjata AI yang semakin ketat di China, di mana syarikat teknologi terbesar negara itu sedang berlumba untuk membina model asas yang semakin besar.
Sebagai konteks, model Hy3 sebelumnya dari Tencent memiliki jumlah parameter keseluruhan sebanyak 295 bilion. Anggaplah parameter sebagai tombol dan suis yang boleh disetel semasa latihan: lebih banyak parameter biasanya bermakna model boleh mempelajari corak yang lebih halus, walaupun kecekapan penggunaan parameter tersebut sama pentingnya.
Dari Hy3 ke Hy4: evolusi pantas
Build preview Hy4 membina atas asas yang sudah kuat. Model Hy3 Tencent, arsitektur MoE dengan jumlah parameter 295B dan 21B parameter aktif serta jendela konteks 256K, telah dibuka sumbernya di bawah lesen Apache 2.0 pada April 2026 sebelum dilancarkan secara rasmi pada Julai.
Penggunaan mingguan Hy3 meningkat lebih daripada 68 kali selepas ia berpindah dari pra-pelancaran ke pelancaran rasmi.
Hy3 menjadi enjin di sebalik satu set produk Tencent yang semakin berkembang, menggerakkan ciri-ciri di seluruh Yuanbao (aplikasi pembantu AI Tencent), CodeBuddy (pembantu pengkodeannya), dan WorkBuddy (alat produktiviti perniagaannya). Model ini memberikan peningkatan ketara dalam penaakulan, pengkodean, dan penanganan tugas pelbagai langkah yang kompleks.
Pengujian Gray dan jalan menuju pelancaran penuh
Semasa laporan keuntungan Q2 sekitar 12-13 Ogos 2026, Tencent mengumumkan rancangan untuk melancarkan model Hy4 dengan parameter yang lebih besar dalam masa terdekat, dengan fokus pada peningkatan prestasi dan kemampuan multimodal.
Pada 20-21 Ogos, ujian awal warna kelabu bagi model Hy4 dilihat dalam aplikasi Tencent Yuanbao, di mana ia diletakkan sebagai "model peringkat pakar." Tiada spesifikasi rasmi, termasuk jumlah parameter tepat dan butiran arsitektur, telah diumumkan.
Siri Hy dipimpin oleh saintis AI utama Tencent, Yao Shunyu. Tencent telah mengamalkan strategi dwi: membangun model milik sendiri seperti Siri Hy sambil secara serentak memanfaatkan alternatif sumber terbuka terkemuka, termasuk model dari DeepSeek.
