OpenAI melancarkan GPT-6 Astra, tersedia untuk pengguna Pro, Enterprise, dan Business Premium, API dilancarkan serentak.Penulis artikel, sumber: XinZhiYuan
GPT-6 Astra, dibuka sepenuhnya!
Baru sahaja, OpenAI mengumumkan bahawa semua pengguna Pro, Enterprise, dan Business Premium kini boleh menggunakan GPT-6 Astra secara langsung di ChatGPT Work dan Codex, dengan API yang dilancarkan serentak.

Namun, pengguna Plus dan pengguna Business biasa masih perlu menunggu beberapa hari lagi.
Pada 3 September, OpenAI mengumumkan pelancaran bertahap Astra. Dua hari kemudian, pengguna langganannya kini dibuka sepenuhnya.
Delete the prompt first.
Sebagai pengumuman sebesar ini, nasihat pertama yang diberikan oleh jurutera OpenAI, Victor Nunez, kepada semua orang ialah hapuskan petikan anda.
Dia berkata: Manfaatkan peluang ketika Astra mulai dilancarkan, semak semula fail AGENTS.md dan Skills anda, serta pertimbangkan semula bagaimana cara menggunakan tahap penalaran.

AGENTS.md, ialah panduan pekerja untuk AI: siapa anda, apa yang perlu dilakukan, dan apa yang tidak boleh dilakukan. Skills, ialah panduan pengajaran untuk melaksanakan tugas: apabila menghadapi situasi ini, ikuti prosedur ini.
Dalam beberapa tahun terakhir, cara pengembang menghadapi model adalah secara sederhana dan kasar: terus menambahkan perkara ke manual. Jika ia tidak faham, jelaskan satu langkah lagi. Jika ia sering membuat kesilapan, tambah satu sekatan lagi. Jika ia masih membuat kesilapan, tambah satu contoh lagi.
Seperti menempelkan nota pada pekerja baru yang selalu lupa. Seiring masa, nota-nota itu memenuhi seluruh meja.
Tetapi selepas Astra datang, kesemua stiker di atas meja itu malah menjadi beban.
OpenAI menulis dalam panduan model Astra: Astra menjadi lebih peka terhadap arahan di skill dan AGENTS.md.
Peraturan lama yang dahulu hanya hiasan, sekarang akan dilaksanakan satu per satu. Satu peraturan yang kabur akan membuatnya berhenti untuk mengesahkan berulang kali; dua peraturan yang bertentangan akan membuatnya bingung.
Sebagai contoh. Dahulu anda menulis "Semua cadangan mesti melalui persetujuan", model lama melihatnya tetapi seolah-olah tidak melihatnya dan terus melanjutkan.
Astra tidak akan. Ia benar-benar akan berhenti dan bertanya: "Silakan beritahu saya siapa yang perlu menyetujui rancangan ini?" lalu... menunggu.
Oleh itu, panduan menggunakan empat perkataan "disarankan kuat" untuk memastikan setiap fail skill yang boleh dibaca oleh model audit pembangun.
Selain itu, Astra juga lebih suka bertanya daripada generasi sebelumnya.
Kamu suruh dia buat kerja, dia berhenti separuh jalan: "Ada dua cara, kamu nak yang mana?" Tolonglah, tak bolehkah kamu pilih satu sendiri dan teruskan? Menulis kod pun sama, belum lagi buat, dah lari test dulu, ubah warna butang pun kena tulis ujian unit dahulu.
Semuanya perlu disesuaikan melalui petunjuk. Arah penyesuaian kebanyakannya adalah untuk menarik balik.
Lebih lagi, panduan tersebut bahkan menyertakan petikan petunjuk siap pakai yang melarang Astra menggunakan frasa seperti "delve" atau "perlu diperhatikan", serta secara khusus melarang struktur kalimat "menyangkal lalu membalikkan" (contohnya, "Ini bukan tentang X, tetapi tentang Y").
Model yang menulis frasa-frasa ini juga merupakan pihak yang mengajar anda cara mengelakkan frasa-frasa tersebut. Ia memiliki kejujuran semacam "Lubang yang saya gali sendiri, saya ajarkan anda untuk mengisinya."
Katakanlah di sini, mungkin ada yang bertanya: Apa kaitannya ini dengan saya?
Terlalu besar hubungannya.
Logik Astra berubah, bermakna cara anda berinteraksi dengan AI juga perlu berubah.
Sebelum ini, apabila anda berbual dengan ChatGPT dan mendapati jawapannya tidak baik, tindakan insting anda ialah menambahkan sekatan dan permintaan. Satu tidak cukup, tambah dua; dua tidak cukup, tambah lima.
Ini adalah pemikiran penambahan—semakin bodoh modelnya, semakin banyak peraturan yang anda tulis.
Sekarang Astra memberitahu kamu: Jangan tulis terlalu banyak.
Ia sudah mampu menarik kesimpulan niat anda dari konteks, secara aktif bertanya apabila arahan tidak jelas, dan mampu mengingat matlamat keseluruhan dalam tugas berlangkah banyak.
Prompt patch yang anda tulis itu tidak hanya berlebihan, tetapi juga mungkin membuatnya tersesat.
Oleh itu, perkataan yang ditekankan berulang-ulang dalam panduan migrasi rasmi OpenAI ialah: audit. Audit semua arahan yang anda berikan kepadanya, dan buang semua yang sudah usang, berlebihan, atau bertentangan.
Semakin kuat model, semakin sedikit peraturan yang perlu anda tulis.
Prinsip ini berlaku sama, sama ada anda seorang pembangun atau pengguna biasa.
Sehebat apa
Setelah membincangkan banyak 「pengurangan」, berapa banyak kemampuan yang sebenarnya ditambahkan oleh Astra?
Pembangun yang mendapat akses awal telah menyerahkan jawapan mereka.
Pembangun Matt Shumer membina Manhattan di Unreal Engine, satu jalan demi satu jalan, dalam masa seminggu.
Dia mencipta permainan bernama "Litar Pengurus": satu Astra bertindak sebagai pengurus, membahagikan keseluruhan tugas kepada senarai dan peringkat; kemudian membuka satu Astra lagi sebagai pelaksana.
Pengurus hanya memberikan satu tugas pada satu masa, dan hanya akan memberikan tugas seterusnya setelah tugas sebelumnya selesai, tanpa pernah memberikan bocoran awal. Di pihak pelaksana, pada masa paling sibuk, 96 agen pintar beroperasi serentak, mendorong proses seperti garis pengeluaran.
Shumer juga menemui butiran perenggan yang sangat menarik: apabila model diminta untuk mencapai setiap peringkat secara "sangat baik", ia akan bergerak maju dengan tenang; tetapi sekali diubah menjadi "sempurna", ia segera terperangkap dalam butiran kecil dan tidak dapat keluar. Perbezaan satu perkataan sahaja menentukan sama ada projek bergerak maju atau terhenti.
Pembangun Anshu berseru: Astra benar-benar dewa mesin AGI super di bidang permainan 3D.
Astra hanya memerlukan 45 minit untuk mencipta dunia permainan terbuka dengan kualiti grafik yang luar biasa.
Immunologist Derya Unutmaz hanya memasukkan satu ayat—“Buat video pengajaran sel T selama 5 minit.”
Astra menulis sendiri narasi, membuat animasi dengan Remotion, menghasilkan gambar dengan Imagegen, dan secara aktif mencadangkan menggunakan HeyGen untuk narasi, sekaligus menghasilkan video.
Seorang saintis yang telah meneliti sel T selama 35 tahun berkata setelah menonton: "Saya pasti tidak bisa menjelaskannya sebaik ini." Beliau kini berencana membuat serangkaian video kuliah imunologi dan memuatnya ke laman web.
Tom Krcha memberikan kepada Astra satu gambar lama lokomotif stim.
Beberapa minit kemudian, Blender menghasilkan 3,295 objek yang boleh diedit, setiap bahagian boleh dibuka dan diubah secara berasingan.
Tweet ini telah mendapat lebih daripada 750,000 tayangan.
Dia juga mencuba kereta api Commodore Vanderbilt yang kurang popular, di mana bentuk lokomotif perlu diperbaiki secara manual, tetapi titik permulaannya sudah sangat tinggi.
Nombor yang diperlihatkan oleh OpenAI sendiri juga cukup kuat.
Di OSWorld 2.0 (yang membolehkan model mengendalikan desktop komputer seperti manusia), Astra mencapai 72.6%, manakala generasi sebelumnya GPT-5.6 Sol berada pada 65.7%; masa yang diambil untuk setiap tugas diturunkan dari 75 minit kepada 40 minit—ketepatan meningkat, dan kelajuan meningkat hampir dua kali ganda.
Tentu, Astra juga tidak mengungguli sepenuhnya. Dalam Indeks Kecerdasan Komprehensif Independen Artificial Analysis, Astra mendapat skor 61.2, sementara Claude Fable 5.1 yang baru dilancarkan oleh Anthropic minggu ini mendapat skor 65.7.
Pertandingan ini antara dua raksasa belum lagi menentukan pemenang.
Era Pengurangan
Dalam beberapa tahun terakhir, cerita pembangunan AI adalah penambahan.
Model tidak cukup pintar, maka gunakan peraturan untuk melengkapinya, semakin banyak peraturan yang ditambahkan, semakin tebal ia menjadi.
Sekarang, kelemahan telah dipenuhi. Peraturan itu sendiri menjadi sumber kesalahan yang baru.
OpenAI menggunakan panduan model untuk secara halus mengubah arah rekabentuk AI: dahulu, ia diajar bagaimana melakukan setiap langkah, sekarang, peraturan lama yang menghalang dihapuskan sedikit demi sedikit untuk memberikan ruang kepadanya.
Hubungan antara manusia dan model juga berubah.
Dahulu mengajarinya. Sekarang—jangan halanginya.
