OpenAI Melancarkan GPT-6 Astra, Menekankan Keupayaan Pelaksanaan AI dan Operasi Komputer

iconMetaEra
Kongsi
AI summary iconRingkasan
OpenAI melancarkan GPT-6 Astra pada 3 September 2026, dengan fokus pada kemampuan eksekusi dan pengendalian komputer. Model ini mendapat skor 72.6% dalam OSWorld 2.0 dan meningkatkan kelajuan tugas sebanyak 90% dalam ujian Mind2Web. Astra memenuhi ambang keselamatan siber OpenAI, menunjukkan isyarat perdagangan atas rantai yang kuat dan potensi untuk analisis sokongan dan rintangan dalam sistem automatik.
Makna sebenar GPT-6 Astra bukan terletak pada skor dalam senarai peringkat tertentu, tetapi pada fakta bahawa AI sedang berubah daripada alat menjadi pekerja digital yang boleh bekerjasama secara jangka panjang.

Penulis artikel, sumber: ME News

TL;DR

  • Perubahan terbesar pada GPT-6 Astra bukan sekadar meningkatkan kemampuan model dalam memberikan jawapan, tetapi membawa AI dari "memberi cadangan" kepada kecerdasan pelaksana yang mampu "menyelesaikan tugas secara langsung".
  • Astra mencuba menyelesaikan masalah kestabilan jangka panjang AI Agent dengan memperkuat kemampuan pengendalian komputer, pemanggilan perisian, pembangunan kod, dan pengurusan tugas jangka panjang.
  • OpenAI menyebut Astra sebagai model "paling pintar dan paling selaras" di dunia pada masa ini, tetapi penilaian ini lebih mencerminkan penempatan strategik syarikat, dan ujian bebas menunjukkan bahawa model-model lain masih bersaing.
  • Astra pertama kali mencapai ambang kemampuan keselamatan siber Kritikal yang ditakrifkan oleh OpenAI, bermakna kemampuan AI terkini sedang memasuki peringkat risiko yang lebih tinggi.
  • Makna sebenar GPT-6 Astra bukan terletak pada skor dalam senarai peringkat tertentu, tetapi pada fakta bahawa AI sedang berubah daripada alat menjadi pekerja digital yang boleh bekerjasama secara jangka panjang.

GPT-6 Astra: Perlawanan AI memasuki era "keupayaan pelaksanaan"

Pada 3 September, OpenAI secara rasmi melancarkan GPT-6 Astra dan mentakrifkannya sebagai model paling berkuasa dan paling selaras hingga kini. Berbeza dengan generasi GPT sebelumnya, perubahan utama Astra bukanlah peningkatan kecil dalam keupayaan pemahaman bahasa, tetapi AI kini mula lebih hampir kepada agen pintar yang mampu menyelesaikan tugas kompleks secara berdiri sendiri.

Dalam beberapa tahun terakhir, lintasan perkembangan AI generatif sangat jelas.

Pada era GPT-3, manusia pertama kali menyedari bahawa AI mampu menghasilkan kandungan bahasa semula jadi dalam skala besar; pada era GPT-4, kemampuan multimodal membolehkan AI memahami gambar, fail, dan maklumat kompleks; seterusnya, perkembangan model penalaran membuatkan AI menunjukkan kemampuan yang lebih kuat dalam matematik, kod, dan tugas logik.

Namun, model-model ini sentiasa mempunyai satu batasan utama: mereka boleh memberitahu pengguna “apa yang perlu dilakukan”, tetapi sukar benar-benar melakukan perkara tersebut untuk pengguna.

Sebagai contoh, seorang pembantu AI boleh membantu pengguna menulis satu rancangan perniagaan, tetapi pengguna masih perlu mencari maklumat sendiri, menyusun fail, membuka alat, mengisi borang, dan memperbaiki format; seorang pembantu AI pemrograman boleh menghasilkan kod, tetapi pembangun masih perlu menjalankan ujian, mengesan ralat, dan menghantar aplikasi.

Astra cuba mengubah lapisan ini.

OpenAI berharap AI bukan sekadar jendela perbualan, tetapi menjadi sistem pelaksana yang mampu mengendalikan komputer, memanggil alat, memahami persekitaran, dan meneruskan matlamat secara berterusan. Menurut perkenalan rasmi, Astra mampu menyelesaikan tugas berterusan secara autonomi seperti menjelajah web, mengendalikan perisian, mengatur dokumen, membuat jadual, menulis kod, serta menguji dan menjalankan program. (Edge Network)

Ini bermakna fokus persaingan AI sedang berubah.

Nilai model masa depan tidak ditentukan oleh siapa yang dapat menghasilkan teks yang lebih cantik, tetapi oleh siapa yang dapat menyelesaikan lebih banyak kerja dalam persekitaran nombor nyata.

Terobosan terbesar Astra: Membuat AI benar-benar "menggunakan komputer"

Jika model besar sebelumnya terutama hidup dalam kotak chating, maka Astra sedang mencuba memasuki persekitaran komputer pengguna.

Kemampuan pengendalian komputer bukan sekadar peningkatan fungsi ringkas, tetapi langkah paling penting dalam proses komersialisasi AI Agent.

Kerana banyak kerja di dunia nyata, tiada API standard.

Alat yang digunakan oleh pekerja syarikat setiap hari, termasuk sistem e-mel, perisian pejabat, sistem kewangan, alat reka bentuk, dan platform pengurusan projek, banyak bergantung kepada klik tetikus, pertukaran halaman, dan penilaian manusia.

Sistem automatik tradisional biasanya memerlukan syarikat untuk merekabentuk proses terlebih dahulu, manakala AI Agent ingin memahami matlamat manusia secara sebaliknya, kemudian mencari jalan sendiri untuk mencapainya.

Sebagai contoh, seorang pengguna meminta:

Sila aturkan data pasaran untuk kuartal lepas dan sediakan laporan analisis.

Perisian tradisional memerlukan konfigurasi awal antaramuka data, templat, dan proses.

Dalam keadaan ideal, Astra boleh mencari maklumat sendiri, membaca fail, membuka Excel, memproses data, menghasilkan grafik, dan kemudian mengeluarkan laporan akhir.

Inilah sebabnya kemampuan mengendalikan komputer dianggap sebagai asas penting bagi AI untuk memasuki skenario kerja sebenar.

Berdasarkan data yang diumumkan oleh OpenAI, Astra menunjukkan peningkatan yang ketara berbanding model sebelumnya, GPT-5.6 Sol, dalam ujian yang berkaitan dengan pengendalian komputer. Skor ujian OSWorld 2.0 meningkat dari 65.7% kepada 72.6%, dan masa yang diperlukan untuk menyelesaikan tugas simulasi juga berkurang secara ketara. Versi terkini Codex yang digabungkan dengan Astra mencapai kelajuan sebanyak kira-kira 1.9 kali ganda berbanding sistem sebelumnya dalam tugas Mind2Web.

Data ini menunjukkan bahawa peningkatan model tidak hanya terlihat dalam "ketepatan jawapan", tetapi juga dalam kecekapan menyelesaikan tugas.

Ini juga merupakan perbezaan terbesar antara Agen AI dan chatbot biasa.

Pengoptimuman chatbot adalah sekali interaksi.

Agen mengoptimumkan satu proses penuh.

Dari kemampuan model hingga kemampuan kerja, Astra mentakrif semula “kecerdasan”

OpenAI menyatakan bahawa Astra mencapai prestasi terdepan dalam beberapa ujian terkini.

Berdasarkan data rasmi yang diumumkan, Astra mencapai 97.6% dalam ujian FrontierMath Tier 4; dalam ujian pengesahan ARC-AGI-3, dengan menggabungkan mekanisme pengurusan konteks OpenAI, ia mencapai 99.9%, dan skor 62.7% dalam kerangka piawai seragam; serta mendapat 57.9% dalam ujian Terminal-Bench 4.0. (Pembangun OpenAI)

Indikator-indikator ini mencerminkan satu tren: model AI sedang berpindah daripada persaingan kemampuan tunggal kepada persaingan kemampuan tugas komprehensif.

Semasa menilai model sebelum ini, orang memperhatikan jumlah pengetahuan, kelancaran bahasa, dan pencapaian matematik.

Namun, memasuki era Agen, model perlu mempunyai beberapa kemampuan secara serentak:

Pertama, fahami sasaran yang kompleks.

Pengguna biasanya tidak memberikan arahan yang sangat tepat kepada AI, tetapi menggambarkan keperluan yang kabur. Sebagai contoh, “Bantu saya menyediakan bahan pembiayaan”, yang merangkumi beberapa langkah seperti penyelidikan pasaran, analisis pesaing, pengumpulan data, dan reka bentuk visual.

Kedua, mampu merancang laluan tugas.

Kerja yang sebenarnya kompleks tidak boleh diselesaikan dalam satu langkah, tetapi memerlukan pemecahan tugas dan penyesuaian berterusan berdasarkan keputusan sementara.

Ketiga, perlu memanggil alat luar.

Kerja sebenar jarang hanya dilakukan dengan bahasa sahaja, ia mesti disambungkan ke pelayar, persekitaran kod, pangkalan data, dan pelbagai perisian.

Keempat, perlu mengeksekusi secara stabil dalam jangka panjang.

Jika sebuah AI hanya mampu menyelesaikan tugas lima minit, ia lebih seperti pembantu tinggi; jika ia mampu bekerja berterusan selama berjam-jam dan mempertahankan konsistensi tujuan sepanjang proses, barulah ia lebih mendekati pekerja digital.

Kepentingan Astra ialah mencuba meningkatkan keempat-empat dimensi ini secara serentak.

Di sebalik "yang paling pintar di dunia": Perjuangan model masih belum berakhir

Namun, perlu diperhatikan bahawa istilah "model paling pintar di dunia" ini terutamanya datang dari penempatan diri OpenAI.

Berdasarkan ujian bebas, persaingan antara model AI masih sangat sengit.

Data Artificial Analysis menunjukkan bahawa dalam ujian Intelligence Index-nya, GPT-6 Astra max memperoleh 61 mata, sementara Claude Fable 5.1 max juga mengekalkan tahap yang tinggi. Kaedah ujian, pengaturan penalaran, dan jenis tugas yang berbeza mungkin menyebabkan perubahan dalam peringkat model. (Analisis Kecerdasan Buatan)

Ini menunjukkan bahawa industri AI belum menghasilkan model "akhir" yang mutlak pada masa ini.

Model yang berbeza sedang membentuk kelebihan yang berbeza.

OpenAI lebih menekankan kemampuan umum, pemanggilan alat, dan integrasi ekosistem; Anthropic secara berterusan memperkuat kemampuan kod, keselamatan, dan skenario perniagaan; Google pula memanfaatkan carian, awan komputasi, dan kemampuan multimodal untuk memajukan jalan mereka sendiri.

Pertandingan model besar di masa depan tidak mungkin dikuasai sepenuhnya oleh satu syarikat seperti semasa era telefon pintar.

Lebih mungkin terjadi beberapa sistem AI super bersaing dalam skenario kerja yang berbeza.

Oleh itu, yang benar-benar penting tentang Astra bukanlah membuktikan bahawa OpenAI telah memenangi semua persaingan, tetapi membuktikan bahawa standard penilaian perkembangan AI sedang berubah.

Dahulu, pertandingannya adalah "siapa yang lebih pandai menjawab".

Masa depan adalah perbandingan siapa yang paling mampu menyelesaikan.

Semakin kuat keupayaan AI, semakin penting isu keselamatan

Perubahan lain yang perlu diperhatikan oleh Astra ialah ia mencapai ambang kemampuan keselamatan siber Kritikal dalam Kerangka Kesiapan OpenAI untuk pertama kalinya.

Ini bermakna, model telah memiliki kemampuan untuk mengesan dan memanfaatkan kelemahan yang tidak diketahui apabila mempunyai alat dan kebenaran yang sesuai. (OpenAI)

Ini adalah perkara yang mempunyai dua maksud.

Di satu sisi, AI yang lebih canggih boleh membantu penyelidik keselamatan mengesan lubang keamanan dan meningkatkan kemampuan pertahanan maya.

Di sisi lain, jika kemampuan seperti ini disalahgunakan, ia juga boleh meningkatkan risiko serangan siber.

Penemuan lubang kelemahan perisian sebelum ini bergantung kepada pasukan keselamatan profesional dan memerlukan analisis manual yang banyak.

Di masa depan, AI berkeupayaan tinggi mungkin meningkatkan kecekapan penyelidikan lubang keamanan secara besar-besaran.

Namun, pada masa yang sama, sistem AI itu sendiri mesti mempunyai kawalan kebenaran yang lebih ketat, pemantauan tingkah laku, dan pengasingan keselamatan.

OpenAI menyatakan bahawa untuk melaksanakan Astra, langkah keselamatan dalaman telah diperkukuh, termasuk pengasingan model yang lebih ketat, pemantauan jejak, dan proses penilaian keselamatan. (OpenAI)

Ini mencerminkan satu realiti:

Semakin pantas kemampuan AI meningkat, semakin penting kepentingan sistem keselamatan.

Perjuangan antara syarikat AI masa depan bukan hanya tentang keupayaan model, tetapi juga tentang keupayaan tatacara keselamatan.

Nilai sebenar Astra: Menjadi lapisan pelaksanaan di dunia digital

Jika dilihat dari sudut industri, kepentingan GPT-6 Astra bukan sekadar peningkatan model, tetapi pengesahan arah perkembangan industri AI.

Dalam beberapa tahun terakhir, industri telah membincangkan secara meluas sama ada model besar akan menggantikan perisian.

Tetapi jalan yang lebih realistik mungkin:

AI tidak akan menggantikan semua perisian secara serta-merta, tetapi akan menjadi lapisan pelaksanaan pintar yang menghubungkan perisian, data, dan manusia.

Di masa depan, seorang pekerja syarikat mungkin tidak perlu membuka selusin aplikasi untuk menyelesaikan kerja, tetapi hanya perlu memberitahu AI tentang tujuannya.

Analyze this year's sales trends.

Sediakan bajet untuk kuartal seterusnya.

Cari pelanggan potensial.

Optimise kod dan deploy persekitaran ujian.

AI bertanggung jawab untuk memecah tugas, memanggil alat, dan menjalankan proses, manakala manusia bertanggung jawab untuk menetapkan matlamat dan membuat keputusan akhir.

Ini juga sebab kemampuan pengendalian komputer Astra lebih patut diperhatikan berbanding sekadar meningkatkan skala parameter.

Ukuran model menentukan sejauh mana AI mengetahui.

Kemampuan agen menentukan sejauh mana AI dapat melakukan.

Dari sudut pandang ini, GPT-6 Astra bukan sekadar chatbot lagi, tetapi satu cara interaksi komputasi yang baharu.

Pada era internet, orang mencari maklumat melalui enjin carian; pada era internet mudah alih, orang menyelesaikan perkhidmatan melalui apl; pada era AI, orang mungkin menyelesaikan tugas secara langsung melalui agen pintar.

Adakah Astra telah mencapai AGI, masih menjadi perdebatan.

Namun, ia pasti membawa AI melangkah penting ke arah "pelaksanaan autonomi".

Dalam beberapa tahun ke depan, yang mungkin benar-benar mengubah struktur produktiviti bukanlah model yang lebih tepat dalam menjawab soalan, tetapi sistem pintar yang mampu menyelesaikan tugas kompleks secara berterusan atas nama manusia.

Makna GPT-6 Astra ialah ia menjadikan masa depan ini lebih nyata buat pertama kalinya.

Rujukan

  1. OpenAI, "Gambaran Keselamatan: GPT-6 Astra", 3 September 2026
  2. Platform Pembangun OpenAI, “Dokumentasi Model GPT-6 Astra”, 2026
  3. OpenAI, "Jalan ke Astra: kemampuan penting dan pengawalan hadapan", September 2026
  4. Reuters, “OpenAI melancarkan model Astra baharu di tengah semakan yang semakin meningkat terhadap keselamatan agen”, September 2026
  5. The Verge, “Model AI seterusnya OpenAI telah 'memasuki era AGI'”, September 2026
  6. Wired, “OpenAI mengatakan GPT-6 boleh menggunakan komputer lebih baik daripada manusia”, September 2026
  7. Analisis Buatan, “Pembandingan GPT-6 Astra”, 2026
Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.