Sapient Melepaskan Model HRM-Text Secara Open-Source dengan Biaya Pelatihan $1.500

iconCryptoBriefing
Bagikan
AI summary iconRingkasan
Sapient Intelligence, sebuah perusahaan riset AGI berbasis di Singapura, telah melepaskan model HRM-Text dengan arsitektur penalaran hierarkis sebagai sumber terbuka. Model dengan 1 miliar parameter ini dilatih pada 40 miliar token dengan biaya $1.000 hingga $1.500 menggunakan perangkat keras sederhana. Tersedia di bawah lisensi Apache 2.0 di Hugging Face dan GitHub, model ini mendapatkan skor 56,2% pada MATH dan 82,2% pada DROP dalam evaluasi April 2026. Data on-chain menunjukkan peningkatan minat terbuka terhadap alat-alat berbasis AI seperti ini.

Sebuah perusahaan riset AGI berbasis Singapura bernama Sapient Intelligence telah merilis bobot penuh, kode pretraining, dan pipeline data untuk HRM-Text, sebuah model bahasa yang dibangun berdasarkan arsitektur yang disebut Hierarchical Reasoning Model. Seluruh paket tersedia di bawah lisensi Apache 2.0 di Hugging Face dan GitHub, yang berarti siapa pun dapat menggunakannya, memodifikasinya, atau membangunnya secara komersial.

Bagian yang menonjol bukan hanya sikap open-source. Tetapi ekonominya. HRM-Text, yang memiliki sekitar 1 miliar parameter, telah dipratrein pada sekitar 40 miliar token dengan biaya perkiraan $1.000 hingga $1.500 pada perangkat keras sederhana. Sebagai perbandingan, model terdepan dari laboratorium utama biasanya dilatih pada triliunan token menggunakan anggaran komputasi yang mencapai puluhan hingga ratusan juta dolar.

Iklan

Bagaimana cara kerjanya sebenarnya

Model ini menggunakan arsitektur laten berulang hierarkis yang digambarkan oleh perusahaan. Modul tingkat tinggi menangani penalaran abstrak yang lambat, berputar melalui 2 "H-siklus" per sesi. Modul tingkat rendah menangani pemrosesan cepat dan rinci, menjalankan 3 hingga 6 "L-siklus" per sesi. Bersama-sama, modul-modul ini memungkinkan model untuk mengulang penalarannya sendiri beberapa kali sebelum menghasilkan output, sambil tetap menjaga jumlah parameter tetap.

Alih-alih menghasilkan token rantai pemikiran yang terlihat yang memakan ruang konteks dan biaya inferensi, HRM-Text melakukan pemikiran iteratifnya secara internal. Penalaran terjadi dalam keadaan tersembunyi model, bukan dalam teks output.

Kinerja benchmark yang lebih unggul

Evaluasi independen yang dilakukan pada April 2026 menceritakan kisahnya dalam angka. HRM-Text mendapatkan skor 56,2% pada benchmark MATH, 82,2% pada DROP, 81,9% pada ARC-Challenge, dan 60,7% pada MMLU. Pra-pelatihan dilaporkan selesai dalam sekitar satu hari.

HRM-Text membangun pekerjaan sebelumnya oleh Sapient. Model HRM asli, yang di-open-source pada Juli 2025, hanya memiliki 27 juta parameter dan menunjukkan kinerja kuat pada tugas penalaran kompleks dengan hanya 1.000 contoh pelatihan. HRM-Text mewakili peningkatan skala sekitar 37 kali dalam jumlah parameter sambil mempertahankan filosofi arsitektur yang sama.

Sapient telah membuat saluran Discord untuk pengembang yang tertarik menjelajahi arsitektur. Lisensi Apache 2.0 menghilangkan hambatan hukum. Biaya pelatihan $1.500 menghilangkan sebagian besar hambatan finansial.

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.