Baru sahaja, OpenAI berubah lagi.
Sekarang, ChatGPT Sites yang ditunggu-tunggu telah secara rasmi dibuka untuk ujian awam!
Walaupun anda tidak tahu menulis sebaris kod pun, anda hanya perlu beberapa petunjuk bahasa semula jadi atau muat naik satu lakaran, dan anda boleh menjana laman web interaktif yang sangat profesional dan kompleks dalam masa kurang daripada lima belas minit, sebagaimana menulis dokumen Google.

Pembangunan antaramuka boleh dilakukan hanya dengan bahasa semula jadi, industri SaaS pembinaan laman web tradisional sedang mengalami gangguan besar.
Selain itu, ada berita baharu yang muncul.
Di sisi teknologi asas, GPT-6 menunjukkan kemampuan lintas modality yang menakjubkan.
Dalam keadaan tanpa pemutaran audio dan tanpa sambungan internet, GPT-6 mampu mengenal suara paus biru laut dalam hanya berdasarkan satu gambar spektrum Mel (visualisasi gelombang suara), bahkan mampu mengenal kesan suara pedang cahaya dari Star Wars.

Ini menunjukkan bahawa pemahaman multimodal AI telah menghancurkan rintangan inderawi manusia sepenuhnya.
Ia bukan lagi secara kikuk "meniru" penglihatan dan pendengaran manusia, tetapi berevolusi menjadi kemampuan "mendekod asli" terhadap struktur data dunia fizikal!
ChatGPT Sites dalam ujian percubaan, membina laman web kini seringan menulis dokumen
Pada suatu masa, memiliki laman web peribadi yang cemerlang adalah hak istimewa para pengatur cara dan reka bentuk profesional.
Kemudian, Dreamweaver muncul, dan selepas itu, alat-alat SaaS pembinaan laman web seret dan lepas seperti Wix, Squarespace, dan bahkan Tilda muncul.
Tetapi hari ini, ujian percubaan ChatGPT Sites secara langsung meruntuhkan halangan untuk membina laman web.
Setelah diuji oleh Jeremy Caplan, pengendali media teknologi terkenal Fast Company dan Wonder Tools, pengalaman yang dibawa oleh ChatGPT Sites sangat revolusioner!
Sekarang, membuat laman web yang cantik sebegitu mudah seperti mencipta Google Doc.

Sekarang, fungsi ini telah dibuka sepenuhnya kepada pengguna ChatGPT Plus, Pro, Business, Enterprise dan Edu.
Bagaimana ia berfungsi? Prosesnya sangat mudah.
1. Terangkan visi anda: Tulis beberapa ayat mengenai jenis laman web yang anda inginkan, serta sasaran pengguna.
2. Berikan bahan: Jika anda mempunyai tangkapan skrin laman web atau lakaran tangan yang disukai, muat naik terus.
3. Nyatakan keperluan fungsi: Mahukan butang pautan? Kesannya terbenam? Atau elemen interaktif yang kompleks? Beritahu secara langsung.
4. Minum secawan kopi dan tunggu: Bergantung kepada kekompleksannya, laman web yang lengkap akan tercipta dalam masa sekitar 10 hingga 15 minit.
Perhatian, ini bukan lagi sekadar "menggunakan templat", tetapi Vibe Coding yang sebenarnya!
Pengguna awal telah menciptakan banyak projek hebat dengannya.
Pertama, adalah halaman praktikal.
Seseorang menggunakannya untuk membuat halaman penyertaan media yang sempurna, panduan acara San Francisco yang berdesain moden, dan bahkan sebuah kedai dalam talian moden untuk peralikan piknik yang menyokong seret dan letakkan barang ke dalam troli belian.
Selain itu, artis Drue Kataoka menggunakannya untuk menghasilkan alat seni bernama GoalFlow.
Selepas pengguna memilih bendera, mereka boleh melukis menggunakan warna bendera di atas kanvas simulasi cairan, di mana cat akan berputar dan terapung secara semula jadi seperti warna dalam air.

Laman web depan yang melibatkan enjin fizik cairan kompleks dahulu memerlukan kejuruteraan depan tingkat lanjut menghabiskan berminggu-minggu, kini hanya memerlukan beberapa petunjuk.
Akhirnya, ada permainan enjin fizikal.
Anda bahkan boleh membuat permainan seperti Jenga bernama Glass Towers dengan efek fizikal yang realistik hanya dalam beberapa baris; atau membuat permainan arcade kecil bernama Paper Glider yang mengawal kapal kertas melalui lingkaran.

Yang lebih menakutkan ialah kemampuannya untuk beriterasi.
Selepas ChatGPT memberikan draf awal, anda boleh terus menggunakan「alat komen」di sisi, seperti memeriksa kerja rumah, dengan melingkari di atas laman web:「tukar warna butang ini」、「ganti fon di sini dengan fon tanpa kaki」、「gantikan gambar ini».
Ia tidak hanya boleh memahami, tetapi juga boleh mengubah dengan lancar.
Jelas bahawa penyesuaian industri sudah tidak dapat dielakkan.
Walaupun alat pembangunan laman web AI awal (seperti Lovable, Bolt) masih mempunyai fleksibilitasnya, Artifacts Claude dan Claude Design juga menunjukkan kecemerlangan dalam antaramuka interaktif, kekuatan utama ChatGPT Sites terletak pada integrasinya dengan ekosistem yang sangat besar.
Jika anda bekerja dalam sebuah "ChatGPT Project", ia akan membaca secara automatik panduan gaya jenama dan perpustakaan logo anda, dan laman web yang dihasilkan secara semula jadi membawa DNA jenama anda.
Sekarang, jurutera antara muka telah diturunkan peranannya menjadi «produk pengendali petunjuk», dan syarikat SaaS tradisional yang masih bergantung pada «pembinaan laman web seret dan lepas» untuk mengenakan yuran bulanan tinggi, jika tidak berubah dengan cepat, mungkin tidak akan bertahan melalui musim sejuk tahun ini!
Pengurangan dimensi sisi aplikasi: Menghapus sepenuhnya「tindakan」, hanya meninggalkan「niat」
Ingat semula, dari baris arahan (CLI) pada era PC, ke antaramuka grafik (GUI) pada era Windows, hingga antaramuka bahasa semula jadi (LUI) pada era model besar hari ini, sejarah interaksi manusia-komputer adalah sejarah penurunan rintangan penggunaan yang berterusan.
Hakikat laman web ChatGPT ialah menurunkan pembangunan antara muka dari «kejuruteraan» kepada «seni ekspresi».
Dahulu, apabila anda ingin membina laman web, otak anda perlu melalui pelbagai peringkat terjemahan.
Saya ingin menjual sesuatu (niat) → Saya memerlukan troli belian dan sistem pembayaran (logik produk) → Saya perlu menulis HTML/CSS/JS (kod depan) → Saya perlu mengintegrasikan pangkalan data (logik belakang)
Sekarang, ChatGPT Sites telah menghapus semua kerumitan di tengah.
Input pengguna telah direduksi sepenuhnya kepada bahasa semula jadi semata-mata, iaitu "niat" paling asli.
Rintangan utama perisian SaaS tradisional ialah “kami mengemas kod menjadi butang yang cantik untuk anda klik”, manakala serangan rendah dimensi model besar ialah: anda hanya perlu berbicara.
Dari sini, semua alat sementara yang berpusat pada "bagaimana membuat penulisan kod/membina laman web lebih mudah untuk bukan jurucakap" akan kehilangan ruang untuk bertahan dalam era penghasilan "end-to-end" yang menghasilkan hasil secara langsung.
GPT-6 memahami spektrum dengan sekilas, memecahkan halangan indera manusia
Selain itu, hari ini, satu set ujian yang diumumkan oleh penyelidik AI, ChrisGPT dan Max Rubin, telah mengejutkan ramai jurutera audio dan profesional AI.

Ujian ini mudah: tukar suara menjadi gambar, biarkan GPT-6 baca gambar secara langsung.
ChrisGPT menghantar satu gambar spektrum Mel kepada GPT-6, iaitu teknik yang memvisualisasikan frekuensi, masa, dan tenaga bunyi sebagai imej dua dimensi.
Dalam prosesnya, dia tidak memainkan sebarang audio sebenar, dan model besar berada dalam keadaan tidak terhubung ke internet.
Satu-satunya petunjuk ialah 「Suara ini berasal daripada satu haiwan/mamalia di alam semula jadi.」
GPT-6 menjawab: "Ikan paus, mungkin seekor paus biru."

Seluruh dunia terkejut.
Kerana ia tidak hanya menjawab dengan betul, tetapi juga melampaui pemahaman kami—logik penalaran di sebaliknya telah melampaui keserasian imej yang mudah!
Perlu diketahui, paus biru mengeluarkan suara dengan frekuensi sangat rendah.
Namun, dalam alam semula jadi, suara singa, harimau, dan gajah juga berada dalam julat frekuensi rendah 40-200 Hz. Hanya berdasarkan satu kumpulan tenaga di sekitar 50 Hz pada spektrogram, tidak mungkin untuk menyimpulkan bahawa ia adalah paus.
Bagaimana GPT-6 melakukannya? Ahli audio menganalisis bahawa GPT-6 berjaya menangkap ciri bentuk "tenaga yang berterusan seiring masa".
Ia bukan sekadar memerhatikan satu titik, tetapi memahami bagaimana gelombang suara mengalir dan meredap seiring masa dalam ruang fizikal tertentu ini.
Kemampuan untuk menebak kelas haiwan secara langsung daripada 'gambar suara' tanpa konteks yang sedikit pun sangat menakjubkan.

Pertunjukan oleh peserta ujian lain, Max Rubin, juga sangat mengesankan.
Dia menguji kesan suara bukan semula jadi, dan hasilnya menunjukkan bahawa Astra mampu mengenal pasti suara pedang cahaya dari Star Wars secara zero-shot langsung daripada spektrogram Mel!
Max terkejut: "Kita bahkan belum menyentuh permukaan sekalipun."
Walaupun dalam bidang penyelidikan, akademik telah lama mencuba menggunakan spektrogram bersama model visual untuk pengesanan suara paus, bahkan melatih LLM khas untuk membaca gambar Mel bagi tugas suara.
Namun, ini adalah pertama kalinya model besar umum secara terbuka dibuktikan mampu melakukan penalaran multimodal selevel ini tanpa penyesuaian khusus apa pun.
Ia seakan-akan seperti anda tidak pernah mengajar seseorang bagaimana membaca notasi muzik, tetapi hanya menunjukkan kepada mereka satu skor simfoni.
Akibatnya, dia tidak hanya dapat "mendengar" suara dalam fikirannya, tetapi juga dapat memberitahu anda dengan tepat bahawa tiub kedua telah memainkan nada yang salah.
Model besar sedang melepaskan diri dari ikatan biologi manusia
Penglibatan manusia terhadap dunia mempunyai batasan yang besar.
Kita bergantung pada getaran udara yang menggetarkan gegendang telinga, supaya otak dapat menukar getaran fizikal menjadi isyarat elektrik yang dikenali sebagai 'suara'. Dalam alam bawah sedar manusia, suara didengar melalui telinga, dan imej dilihat melalui mata. Ini adalah 'halangan inderawi' yang telah ditetapkan oleh evolusi selama jutaan tahun.
AI multimodal awal sebenarnya sedang "meniru" manusia. Kita memberinya audio, menunjukkan gambar, dan berusaha membuatnya memahami seperti manusia.
Namun, kepentingan GPT-6 Astra dalam mengenali spektrum ialah: model besar sedang melepaskan diri daripada ikatan organ biologi manusia!
Bagi GPT-6, sebutan panjang seekor paus biru laut dalam dan suara robekan ketika seorang Jedi mengayunkan pedang cahaya pada dasarnya tidak berbeza—keduanya hanyalah bentuk fluktuasi tenaga dalam dunia fizikal.
Apabila fluktuasi ini ditukar menjadi representasi matematik dan geometri seperti spektrogram Mel, GPT-6 boleh secara langsung “membaca” hukum fizikal itu sendiri.
Ia tidak memerlukan telinga panjang, ia tidak perlu 'mendengar' suara, ia boleh secara langsung 'melihat' formula fizikal suara.
Ini bermakna, pemahaman multimodal AI telah berubah dari "meniru indera manusia" kepada "dekod asli" terhadap struktur data dunia fizikal.
Hari ini, ia boleh mengenali paus biru melalui spektrogram; esok, jika diberi gambar gelombang gempa, adakah ia boleh secara langsung meramalkan kegagalan sesar seterusnya? Jika diberi gambar gelombang otak, adakah ia boleh secara langsung membaca apa yang anda fikirkan?
Manusia merasakan projeksi alam semesta melalui jasmani, dan sekarang, AI sedang membaca kod sumber alam semesta secara langsung.
Rujukan:
https://x.com/ChrisGPT/status/2097047569520115800
https://x.com/maxxrubin_/status/2096892510241268094
https://www.fastcompany.com/91602695/chatgpt-sites-makes-building-a-website-feel-like-making-a-google-doc
Artikel ini berasal daripada akaun微信公众号 "Sinzhiyuan", penulis: ASI Revelation, penyunting: Aeneas David
