Model Baru OpenAI, Astra, Mencetuskan Perdebatan Mengenai Prestasi dan Keselamatan

iconMetaEra
Kongsi
AI summary iconRingkasan
OpenAI akan melancarkan model AI baharu bernama Astra, yang memperkenalkan pendekatan 'recurrent depth' yang baru untuk meningkatkan penaakulan kompleks. Model ini mungkin menandakan lompatan prestasi besar sejak GPT-4, berpotensi mengatasi GPT-5. Berita di blok rantai menunjukkan rekabentuk baharu ini membolehkan penaakulan yang lebih mendalam tanpa output jalan pemikiran penuh, menimbulkan kebimbangan mengenai transparansi dan keselamatan. OpenAI menghadkan gelung dalaman untuk mengekalkan kejelasan, tetapi komuniti penyelidikan AI masih berpecah mengenai kesan jangka panjang. Senarai token baharu di bursa mungkin mencerminkan minat yang semakin meningkat terhadap projek blok rantai yang didorong AI.
OpenAI akan melancarkan model baharu "Astra", yang sedang menarik perhatian dan perdebatan luas dalam kalangan komuniti penyelidikan AI—ia mungkin membawa lompatan terbesar sejak GPT-4 dari segi prestasi, tetapi teknik penalaran baharu di sebaliknya juga menimbulkan kebimbangan terhadap penurunan kemampuan pemantauan keselamatan AI.

Penulis artikel, sumber: The Information

Menurut laporan The Information pada 2 September, Astra membawa teknologi inovatif yang intinya menerobos hadapan model dalam "memikirkan" masalah kompleks. Sebahagian penyelidik percaya bahawa peningkatan kemampuan Astra dalam pengkodean dan penggunaan komputer mungkin sebanding dengan lompatan prestasi yang dibawa oleh OpenAI apabila melancarkan GPT-4 pada 2023, jauh melebihi prestasi ketika GPT-5 dilancarkan pada musim panas lepas. Ini merupakan isyarat positif bagi seluruh industri yang bergantung kepada peningkatan produktiviti AI untuk menyokong pelaburan besar-besaran dalam pembinaan pusat data.

Namun, terobosan teknologi ini juga membawa risiko yang tidak boleh diabaikan. Teknologi baru membolehkan model menyelesaikan penalaran mendalam tanpa menghasilkan "rantai pemikiran" yang lengkap, bermakna penyelidik mungkin tidak dapat memantau proses penalaran model seefektif dahulu, sehingga melemahkan mekanisme semakan keselamatan yang sedia ada. Semasa ini, OpenAI sedang mengambil langkah untuk memastikan rantai pemikiran Astra masih kelihatan, tetapi industri masih berbeza pendapat mengenai arah jangka panjang kompromi ini.

Penerobosan prestasi: Teknik inferensian baru atau peniruan lompatan setaraf GPT-4 berkait rapat dengan konsep-konsep seperti "kedalaman berulang" (recurrent depth) dan "transformer berulang" (loop transformers).

Menurut The Information, teknologi ini memproses soalan dengan menghantar soalan berulang-ulang melalui pelbagai "lapisan" operasi matematik model, kemudian menghasilkan perkataan seterusnya dalam jawapan, membolehkan model menunjukkan kemampuan penalaran yang jauh melebihi ukurannya sendiri tanpa meningkatkan skala parameter secara ketara—kesannya seolah-olah ia adalah model yang jauh lebih besar.

Sebahagian penyelidik percaya bahawa Astra, dengan kemampuan pengkodan dan penggunaan komputer yang lebih kuat, peningkatan prestasinya mungkin sebanding dengan kemajuan lompatan besar semasa pelancaran GPT-4 pada 2023, jauh melebihi tindak balas pasaran yang relatif tenang semasa pelancaran GPT-5 pada musim panas lepas.

Perkembangan ini mempunyai kepentingan besar terhadap keseluruhan rantai industri AI. Pembinaan besar-besaran pusat data global semasa ini berasaskan logik bahawa peningkatan berterusan dalam kemampuan AI akan mendorong pertumbuhan produktiviti, yang seterusnya berubah menjadi keuntungan perniagaan yang lebih tinggi. Jika prestasi Astra mencapai jangkaan, ia akan memberi sokongan kuat kepada logik pelaburan ini.

Perlu diperhatikan bahawa teknologi ini bukan konsep baharu. Perintis penyelidikan AI, Jürgen Schmidhuber, menunjukkan di platform sosial X bahawa "kedalaman berulang" pada dasarnya telah dinyatakan dalam kertas kerjanya tahun 2015, "On Learning to Think" (arXiv:1511.09249).

Beliau menyatakan bahawa rangkaian kawalan C dalam kertas ini pada dasarnya adalah seorang juru penerangan petunjuk yang belajar untuk mengkuasai model dunia saraf yang berdiri sendiri bagi melakukan penalaran abstrak, di mana petunjuk dan jawapan yang dihasilkan adalah urutan vektor yang dihasilkan secara dalaman, tanpa perlu ditunjukkan dalam bahasa semula jadi.

Keselamatan yang lemah: Mekanisme pemantauan rantai pemikiran menghadapi cabaran; teknologi baharu yang membawa peningkatan prestasi juga memberi kesan potensi terhadap kerangka pemantauan keselamatan AI yang sedia ada.

Laporan tersebut menyatakan bahawa, pada masa kini, model AI utama biasanya mengeluarkan proses penalaran mereka dalam bentuk teks, iaitu "rantai pemikiran" (chain of thought). Mekanisme ini tidak hanya meningkatkan kebolehterangansan model, tetapi juga merupakan alat penting bagi penyelidik untuk memantau tingkah laku model dan mencegah operasi yang tidak normal.

Menurut The Information, pemantauan rantai pemikiran adalah salah satu penyelesaian utama yang diajukan oleh OpenAI selepas peristiwa peretasan Hugging Face pada Julai tahun ini untuk mencegah keselamatan serupa berulang.

Namun, teknik penalaran baru yang digunakan oleh Astra mungkin tidak menghasilkan langkah-langkah penalaran secara lengkap semasa model “berfikir” mendalam, tetapi sebaliknya menyelesaikan pengiraan secara “senyap” di dalam model. Ini bermakna, semakin banyak model bergantung kepada teknologi baru ini, semakin kurang telus proses penalarannya kepada pemerhati luar.

Untuk ini, OpenAI sedang mengambil langkah-langkah untuk menyeimbangkannya. Perusahaan ini sedang membimbing model untuk mengurangi jumlah perulangan masalah di tingkat pengiraan, memastikan rantai pemikiran Astra masih mempertahankan sejauh tertentu kebolehlihatannya—semakin sedikit perulangan, semakin kecil ruang bagi model untuk "berfikir secara senyap".

Pelbagai makmal utama telah mengikuti perkembangan ini, dan kesan jangka panjang terhadap teknologi ini masih belum dipahami sepenuhnya—kesannya mungkin tidak terhad kepada OpenAI sahaja. Menurut The Information, teknik inferens baru ini telah menjadi topik perbincangan utama di kalangan makmal AI utama, dan kemungkinan institusi seperti Anthropic dan Google mengikuti jalan teknologi yang serupa tidak boleh diabaikan.

Beberapa penyelidik menunjukkan bahawa pemantauan rantai pemikiran bukanlah penyelesaian akhir untuk pemantauan tingkah laku AI. Seiring dengan perkembangan berterusan kemampuan model, ciri model yang mengeluarkan proses pemikiran dalam bentuk teks sebahagian besarnya hanyalah produk sampingan kepada cara latihan semasa.

Seiring dengan para pembangun model yang menjelajahi arah pengoptimuman dan reka bentuk arsitektur baru, kecenderungan model untuk menghasilkan rantai pemikiran secara spontan mungkin perlahan-lahan berkurang, dan para penyelidik pada masa itu akan terpaksa mengembangkan kaedah pemantauan baru.

Laporan tersebut menunjukkan bahawa masalah utama semasa ialah: di bawah tekanan persaingan prestasi yang semakin sengit, adakah pembangun AI besar akan secara aktif meninggalkan langkah-langkah keselamatan semasa demi mengejar kemampuan inferens yang lebih kuat? Jawapan kepada soalan ini akan menentukan arah pengurusan keselamatan AI pada peringkat seterusnya.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.