Presiden OpenAI mencadangkan AGI telah tiba dengan pelancaran GPT-6 Astra

iconTechFlow
Kongsi
AI summary iconRingkasan
Presiden OpenAI, Greg Brockman, mengumumkan pada 3 September 2026 bahawa syarikat mungkin telah mencapai AGI dengan pelancaran GPT-6 Astra. Model ini menunjukkan prestasi yang kuat dalam automasi dan tugas berdasarkan skrin, mencapai skor tinggi dalam tolok ukur seperti ARC-AGI-3. Astra kini tersedia kepada pengguna perniagaan dan premium. Kemas kini ini membawa berita rangkaian terkini dan berita kripto untuk sektor teknologi dan blok rantai.

Penulis | Hua Lin Wu Wang

Suntingan | Jingyu

Pada 3 September 2026, selepas sidang akhbar, Presiden OpenAI, Greg Brockman, mengatakan satu perkataan yang sangat jarang berlaku dalam industri AI: "Secara peribadi, saya rasa kita mungkin telah mencapai AGI, dan saya rasa model inilah yang dimaksudkan."

Dia berbicara dengan hati-hati, menggunakan orang pertama, menambahkan kata "mungkin", dan sengaja menyediakan jalan keluar dengan mengatakan, "Jika anda ingin mengatakan ini yang pertama, saya rasa ini masuk akal."

Ini bukan pengumuman rasmi OpenAI mengenai kedatangan AGI, tetapi seorang presiden syarikat yang mengutarakan penilaian beliau di hadapan kamera.

Pada 3 September, masa tempatan, GPT-6 Astra secara rasmi dilancarkan. Geek Park menguraikan semua butiran teknikal dan bahan demonstrasi yang boleh diperoleh, cuba menjawab soalan paling asas: model ini sebenarnya boleh lakukan apa, dan sejauh mana ia boleh lakukan? Adakah ia benar-benar mewakili kedatangan AGI?

"Mengendalikan komputer" cenderung menjadi mitos

Dalam bahan pengumuman, OpenAI memberikan slogan ringkas kepada Astra: «Anything you can do on a computer, Astra can do for you.»

Ini bukanlah slogan pemasaran yang berlebihan, tetapi penyataan arah.

Dalam beberapa tahun terakhir, lintasan utama AI untuk mengendalikan komputer adalah dengan memanggil API. Pembangun perisian terlebih dahulu menulis antaramuka, kemudian AI menggunakan antaramuka tersebut untuk menyelesaikan tindakan. Logik ini pada dasarnya memerlukan setiap perisian disesuaikan secara khusus untuk AI; jika tidak, AI tidak akan mampu berbuat apa-apa.

Astra mengambil jalan yang sama sekali berbeza: ia secara langsung "melihat" piksel di skrin, seperti manusia, kemudian menggerakkan tetikus dan menekan papan kekunci untuk menyelesaikan tugas.

Perbezaan ini bermakna dalam lingkup cakupan. KiCad (perisian reka bentuk papan litar tercetak) tidak akan menulis API untuk AI, FreeCAD juga tidak, dan sistem ERP lama yang telah digunakan selama sepuluh tahun di dalam syarikat pun tidak akan. Tetapi jika AI mampu melihat skrin dan mengendalikan secara langsung, ia boleh menggunakan semua perisian ini—seperti seorang pekerja baharu yang tidak perlu memahami kod di sebalik perisian, hanya perlu mampu memahami antaramuka.

OpenAI menunjukkan beberapa kes spesifik dalam bahan pelancarannya, yang membolehkan anda merasakan bagaimana "mengendalikan komputer" dilaksanakan.

GPT-6 Astra menyelesaikan susunan dan trek PCB sendiri|Sumber gambar: OpenAI

Berikan kepada Astra satu gambar skema litar, ia menyelesaikan susunan komponen dan trek tembaga di KiCad, keseluruhan proses mengambil masa 2 minit 54 saat. Satu demonstrasi lain ialah pemodelan 3D, di mana Astra membina model rumah di Blender, kemudian mengimportnya ke Unreal Engine 5 untuk menghasilkan satu adegan bangunan yang boleh dilalui secara masa nyata. Satu demonstrasi yang lebih harian pula ialah pengguna hanya berbicara kepada Astra, dan ia menyelesaikan keseluruhan proses pemasangan barang di eBay, dari mengisi maklumat hingga menghantar untuk diterbitkan.

Model bangunan yang dihasilkan oleh Astra dalam Blender|Sumber gambar: OpenAI

Dalam hal peningkatan kecekapan, data perbandingan yang diberikan oleh OpenAI juga sangat jelas. Dalam ujian piawai OSWorld 2.0, Astra mendapat skor 72.6% dalam menyelesaikan tugas penggunaan komputer, manakala GPT-5.6 Sol generasi sebelumnya mendapat 65.7%; sementara itu, untuk menyelesaikan tugas yang sama, Astra memerlukan purata sekitar 40 minit, manakala Sol memerlukan sekitar 75 minit, iaitu lebih cepat hampir separuhnya.

https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800

Astra mencapai tugas mencari apartmen dalam 9 minit (kiri), 2 minit mencapai tugas mencari klinik paediatric|Sumber gambar: OpenAI

OpenAI juga mengumumkan dua kes kesemasa dalaman. Tugas yang memerlukan banyak carian web, perbandingan maklumat, dan penghimpunan menjadi dokumen seperti "Mencari penjaga sementara kucing", Astra mengambil masa 5 minit 27 saat, manakala garis dasar manusia yang diberikan oleh OpenAI ialah 30 minit. Untuk tugas komprehensif seperti "Persiapan mencari pekerjaan" yang memerlukan carian jawatan, pencocokan resume, dan pengurusan proses permohonan, Astra mengambil masa 2 minit 51 saat, manakala garis dasar manusia ialah 5 jam.

Nombor-nombor ini adalah hasil demonstrasi sendiri oleh OpenAI, bukan ujian bebas pihak ketiga, dan perlu dikekalkan dengan keraguan yang munasabah. Namun, arah produk yang mereka tunjukkan adalah jelas: Astra tidak direka untuk membantu anda menulis e-mel, tetapi direka untuk menyelesaikan alur kerja penuh yang memerlukan “membuka beberapa perisian dan melalui banyak langkah”. Mengisi borang, memperbaharui rekod CRM, menyusun kalender, serta membuat laporan selepas penyelidikan dalam talian—semuanya sudah disenaraikan secara jelas oleh OpenAI sebagai aplikasi perniagaan.

Kemampuan «Next Level»

Setiap pelancaran model besar akan membawa sekumpulan nombor ujian piawai. Paling sering, dari 80 hingga 85, pembaca melihatnya hampir sama, tetapi kali ini benar-benar berbeza.

ARC-AGI-3 merupakan salah satu ujian AI yang dianggap paling sukar untuk "dipalsukan". Reka bentuknya secara khusus bertujuan untuk mencegah model menggunakan ingatan data latihan untuk menjawab, serta menguji kemampuan penalaran sebenar apabila menghadapi soalan baharu, serupa dengan ujian IQ untuk AI.

Astra mendapat skor hampir ilahi di ARC-AGI-3|Sumber gambar: OpenAI

Astra mendapat skor 98.6% pada ARC-AGI-3. GPT-5.6 Sol mendapat skor 7.8%. Claude Opus 5 daripada Anthropic ialah 30%.

Ini bukan sekadar kemajuan dari skor 80 ke 90, tetapi lompatan dalam skala. Pendiri ARC-AGI, François Chollet, telah beberapa kali meningkatkan kesukaran ujian kerana AI selalu cepat "menyelesaikan sepenuhnya", tetapi Astra masih hampir mendapat skor sempurna pada kesukaran Tier 3.

Astra juga memimpin jauh dalam ujian kemampuan penelitian matematik terkemuka|Sumber gambar: OpenAI

Keadaan beberapa tolok ukur utama lainnya: FrontierMath Tier 4 (keupayaan penyelidikan matematik tertinggi) 97.6%, GPQA Diamond (soal jawab lintas disiplin peringkat pascasiswazah) 96%, DeepSWE (tugasan kejuruteraan perisian sebenar) 74.1%, ExploitBench (pemanfaatan lubang keamanan siber) 100%.

Satu dimensi di mana Astra tidak mendapat tempat pertama. Dalam 「Humanity's Last Exam」 (versi dengan pemanggilan alat), Astra mendapat 57.2%, manakala Anthropic Claude Fable 5.1 yang dilancarkan dua hari yang lalu mendapat 65.0%. Bukan penguasaan mutlak, persaingan masih wujud.

Masih ada butir penting yang perlu dinyatakan. Skor tinggi ARC-AGI-3 bergantung pada "kerangka ujian berstatus" OpenAI, yang membolehkan model mengumpulkan maklumat konteks melalui beberapa percubaan; dalam keadaan panggilan API biasa tanpa status, skor akan jauh lebih rendah daripada nombor ini. Semasa perbandingan lintas model, perhatikan prasyarat ini.

Secara keseluruhan, Astra membuka jarak yang besar dibandingkan model generasi sebelumnya, yang jarang dilihat dalam iterasi model AI dua tahun terakhir.

Dalam ujian honeypot ExploitGym, kemungkinan Astra ditipu telah dipadamkan|Sumber gambar: OpenAI

Tempat yang paling jelas berbeza bukanlah dalam kecerdasan, tetapi dalam keselarasan. OpenAI mengumumkan data ujian dalaman, di mana tanpa sekatan keselamatan persekitaran pengeluaran, GPT-5.6 Sol akan melanggar had kuasa dalam 48.2% kes, manakala Astra ialah 0%.

Lebih pintar, sambil lebih mematuhi peraturan, itulah sebenarnya isyarat yang ingin OpenAI sampaikan kali ini.

Kamu belum perlukan

Sekarang, Astra menggunakan strategi pembukaan bertahap.

Pertama kali dibuka kepada pengguna perusahaan projek 'Daybreak', kemudian akan diperluas kepada pengguna langganannya ChatGPT Plus, Pro, Business, dan Enterprise, serta menyokong pemanggilan melalui OpenAI API, AWS Bedrock, dan Microsoft Azure.

Versi Astra dengan kemampuan keselamatan siber yang lebih kuat hanya dibuka kepada pengguna utama yang telah disahkan, seperti agensi keselamatan pertahanan dan infrastruktur penting. Ini kerana Astra merupakan model pertama dalam sejarah OpenAI yang mencapai ambang keselamatan siber dalaman 'Critical', mampu mengesan kelemahan zero-day yang tidak diketahui dan membina rantai eksploitasi penuh hampir tanpa panduan manusia. Semasa penilaian, Astra bahkan mengesan dua kelemahan yang sebelum ini tidak pernah diumumkan, yang kemudian diumumkan oleh OpenAI kepada pemerhati perisian yang berkaitan.

Dalam hal penentuan harga API, Astra menetapkan harga $10 dan $50 untuk setiap sejuta token masukan dan keluaran. Untuk pengguna langganan ChatGPT, penggunaan Astra termasuk dalam kuota langganan yang ada.

Pemilihan masa pelancaran itu sendiri juga merupakan konteks. Baru bulan lalu, OpenAI mengalami insiden keselamatan serius, di mana dua model yang sedang diuji dalaman melarikan diri daripada persekitaran sandbox dan menyerang sistem syarikat AI Hugging Face, menyebabkan OpenAI menghentikan sebahagian kerja penyelidikan dan latihan. Brockman secara aktif menyebut insiden ini dalam sidang penerangan, menekankan kadar pelanggaran yang rendah dan reka bentuk keselamatan Astra, serta pelancaran ini membawa misi «pembinaan semula kepercayaan».

Pelancaran Astra adalah demonstrasi kemampuan dan satu pernyataan percayaan secara terbuka.

Adakah AGI telah tiba, akhirnya mungkin bergantung pada definisi mana yang setiap orang pilih. Tetapi model yang boleh duduk langsung di hadapan komputer anda dan menyelesaikan alur kerja silang perisian secara autonomi, hari ini sudah menjadi kenyataan.

Masalah yang benar-benar menarik seterusnya ialah di mana pengguna perniagaan dan peribadi akan menggunakannya terlebih dahulu, dan bidang pekerjaan mana yang akan merasai rasa "penggantian" ini terlebih dahulu.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.