Model Baru OpenAI, Astra, Memicu Perdebatan Mengenai Kinerja dan Keamanan

iconMetaEra
Bagikan
AI summary iconRingkasan
OpenAI akan meluncurkan model AI barunya, Astra, yang memperkenalkan pendekatan 'recurrent depth' baru untuk meningkatkan penalaran kompleks. Model ini bisa menandai lompatan kinerja besar sejak GPT-4, kemungkinan melebihi GPT-5. Berita on-chain menunjukkan desain baru ini memungkinkan penalaran yang lebih dalam tanpa output chain-of-thought penuh, memicu kekhawatiran mengenai transparansi dan keamanan. OpenAI membatasi loop internal untuk mempertahankan visibilitas, tetapi komunitas penelitian AI tetap terpecah mengenai dampak jangka panjangnya. Pencatatan token baru di bursa mungkin mencerminkan meningkatnya minat terhadap proyek blockchain yang didorong oleh AI.
OpenAI akan meluncurkan model baru "Astra", yang memicu perhatian luas dan kontroversi di kalangan komunitas penelitian AI—model ini berpotensi membawa lompatan terbesar sejak GPT-4 dalam hal kinerja, tetapi teknik penalaran baru di baliknya juga menimbulkan kekhawatiran tentang penurunan kemampuan pemantauan keamanan AI.

Penulis artikel, sumber: The Information

Menurut laporan media teknologi The Information pada 2 September, Astra mengusung teknologi inovatif yang intinya mampu melampaui batas kemampuan model dalam "memikirkan" masalah kompleks. Sebagian peneliti percaya bahwa peningkatan kemampuan Astra dalam pemrograman dan penggunaan komputer mungkin sebanding dengan lonjakan kinerja yang dibawa oleh peluncuran GPT-4 oleh OpenAI pada 2023, jauh melebihi performa yang ditunjukkan saat peluncuran GPT-5 musim panas lalu. Ini merupakan sinyal positif bagi seluruh industri yang bergantung pada peningkatan produktivitas AI untuk mendukung investasi besar-besaran dalam pembangunan pusat data.

Namun, terobosan teknologi ini juga membawa risiko yang tidak bisa diabaikan. Teknologi baru memungkinkan model menyelesaikan penalaran mendalam tanpa menghasilkan "rantai pemikiran" yang lengkap, yang berarti para peneliti mungkin tidak lagi dapat memantau proses penalaran model seefektif sebelumnya, sehingga melemahkan mekanisme tinjauan keamanan yang ada. Saat ini, OpenAI sedang mengambil langkah-langkah untuk memastikan rantai pemikiran Astra tetap terlihat, tetapi industri masih memiliki perbedaan pendapat mengenai dampak jangka panjang dari kompromi ini.

Peningkatan kinerja: Teknik inferensi baru atau replikasi lompatan setara GPT-4 terkait erat dengan konsep-konsep seperti "recurrent depth" dan "loop transformers" dalam terobosan teknis Astra.

Menurut The Information, teknologi ini memproses pertanyaan dengan mengirimkannya berulang kali melalui berbagai "lapisan" operasi matematis model, lalu menghasilkan kata berikutnya dalam jawaban, sehingga model dapat menunjukkan kemampuan penalaran yang jauh melampaui ukurannya sendiri tanpa meningkatkan signifikan jumlah parameter—efeknya setara dengan model yang jauh lebih besar.

Beberapa peneliti percaya bahwa peningkatan kinerja Astra, berkat kemampuan pemrograman dan penggunaan komputer yang lebih unggul, mungkin sebanding dengan kemajuan lompatan besar saat peluncuran GPT-4 pada 2023, jauh melebihi respons pasar yang relatif tenang saat peluncuran GPT-5 musim panas lalu.

Perkembangan ini memiliki signifikansi penting bagi seluruh rantai industri AI. Saat ini, pembangunan skala besar pusat data global didasarkan pada asumsi bahwa peningkatan berkelanjutan kemampuan AI akan mendorong pertumbuhan produktivitas, yang selanjutnya berubah menjadi keuntungan bisnis yang lebih tinggi. Jika kinerja Astra mencapai harapan, hal ini akan memberikan dukungan kuat terhadap logika investasi ini.

Perlu dicatat bahwa teknologi ini bukan konsep baru. Ahli riset AI Jürgen Schmidhuber menunjukkan di platform sosial X bahwa gagasan inti dari "depth recurrent" sebenarnya sudah ada dalam makalahnya tahun 2015 berjudul "On Learning to Think" (arXiv:1511.09249).

Dia menyatakan bahwa jaringan kontrol C dalam makalah tersebut pada dasarnya adalah seorang prompt engineer yang belajar untuk mengajukan pertanyaan ke model dunia saraf independen guna melakukan penalaran abstrak, di mana prompt dan jawaban yang dihasilkan adalah urutan vektor yang dihasilkan secara internal, tanpa perlu ditampilkan dalam bahasa alami.

Keamanan yang rentan: Mekanisme pemantauan rantai pemikiran menghadapi tantangan; teknologi baru, sambil meningkatkan kinerja, juga menimbulkan dampak potensial terhadap kerangka pemantauan keamanan AI yang ada.

Laporan tersebut menyatakan bahwa saat ini, model AI utama biasanya menghasilkan proses penalarannya dalam bentuk teks, dikenal sebagai "chain of thought," saat menangani masalah kompleks. Mekanisme ini tidak hanya meningkatkan interpretabilitas model, tetapi juga merupakan alat penting bagi peneliti untuk memantau perilaku model dan mencegah operasi yang tidak normal.

Menurut The Information, pemantauan rantai pemikiran adalah salah satu solusi utama yang diajukan OpenAI setelah insiden peretasan Hugging Face pada Juli tahun ini untuk mencegah kejadian keamanan serupa terulang.

Namun, teknik inferensi baru yang digunakan oleh Astra mungkin tidak menghasilkan seluruh langkah inferensi secara lengkap saat model “berpikir” mendalam, melainkan menyelesaikan perhitungan secara “tenang” di dalam model. Ini berarti, semakin banyak model bergantung pada teknologi baru ini, semakin tidak transparan proses inferensinya bagi pengamat eksternal.

Untuk ini, OpenAI saat ini sedang mengambil langkah untuk menyeimbangkannya. Perusahaan tersebut sedang membimbing model untuk mengurangi jumlah siklus perhitungan dalam masalah, guna memastikan rantai pemikiran Astra tetap mempertahankan tingkat visibilitas tertentu—semakin sedikit siklus, semakin kecil ruang bagi model untuk "berpikir diam-diam".

Berbagai laboratorium besar telah mengikuti perkembangan ini, namun dampak dari tren teknologi ini masih perlu dipantau dalam jangka panjang—dampaknya kemungkinan besar tidak hanya terbatas pada OpenAI. Menurut The Information, teknik inferensi baru ini telah menjadi topik pembahasan utama di dalam berbagai laboratorium AI utama, dan kemungkinan bahwa institusi seperti Anthropic dan Google mengadopsi jalur teknologi serupa tidak bisa diabaikan.

Beberapa peneliti menunjukkan bahwa pemantauan rantai pemikiran bukanlah solusi akhir untuk pemantauan perilaku AI. Seiring dengan terus berkembangnya kemampuan model, fitur di mana model mengeluarkan proses berpikir dalam bentuk teks sebagian besar hanyalah produk sampingan dari metode pelatihan saat ini.

Seiring dengan para pengembang model yang mengeksplorasi arah optimasi dan desain arsitektur baru, kecenderungan model untuk secara spontan menghasilkan rantai pemikiran mungkin secara bertahap berkurang, sehingga para peneliti nantinya harus mengembangkan metode pemantauan baru.

Laporan menunjukkan bahwa masalah inti saat ini adalah: di bawah tekanan persaingan kinerja yang semakin ketat, apakah pengembang AI besar akan secara sengaja melepaskan langkah-langkah keamanan yang ada demi mengejar kemampuan inferensi yang lebih kuat? Jawaban atas pertanyaan ini akan sangat menentukan arah tata kelola keamanan AI pada tahap berikutnya.

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.