Bakit pa rin may kontrobersiya kahit hindi pa ipinapakita ang model?
Bago ang paglalabas ng GPT-6, isang balita na unang inihayag ng The Information ay agad nagdulot ng malaking talakayan sa internet:
Ang bagong modelo ng OpenAI ay naglalayong magdagdag ng isang teknik na tinatawag na "recurrent depth" sa pag-iisip, na maaaring gawing mas mahirap maunawaan at mas mahirap masuri ang proseso ng pag-iisip ng modelo.
Sa madaling salita, sa susunod, hindi na talaga makakaintindi ang mga tao kung ano ang isipin ng AI.

Ah, kung matututo ang AI na magmanipula, magcheat, o iwasan ang mga seguridad, hindi ba tayo ay hindi makakakita nang maaga?
Kaya naman agad na nag-alam ang mga tao sa larangan ng AI security at nag-aalala:
Kung patuloy na palawakin ang paggamit ng teknolohiyang ito, maaaring maging direkta ng walang bisa ang mga umiiral na mekanismo ng pagmamanman ng chain of thought.
Dahil sa kahalagahan at sobrang lakas ng diskusyon, kahit ang pangunahing siyentipiko ng OpenAI ay nagkakaroon ng direkta na tugon.
Kahit sa gitna ng ingay, may ilan na nakakakita nang nakakagulat:
Ano ba talaga ang pangalan ng bagong modelong OpenAI, “GPT-6” o “Astra”, baka naiwan na ng API?
Samantala, posibleng ilunsad din ng OpenAI ang bagong bersyon ng image model na GPT Images 2.1.
Maraming mga瓜, sige, pag-uusapan natin ang bawat isa.
Ang modelo ay nagsimula sa loob ng isang loop, at nagkabigla ang mga eksperto sa kaligtasan
Ang unang ito ay ang teknolohiyang “circular depth” na nagdulot ng kontrobersiya sa pagkakataong ito.
Kahit sa nakaraan, ang mga modelo ay nag-iwan ng malinaw na CoT reasoning chain, kaya malinaw kung ano ang naisip.
Bagaman ang serye ng teksto ay hindi lubos na katumbas ng totoong panloob na diyalogo ng modelo (mayroon pa ring debate), kumakalat pa rin ito ng mga bakas na maaaring i-check.
Ang "circular depth" na ginagamit ni Astra naman ay may iba't ibang estilo.

Nagpapahintulot ito sa modelo na ibalik ang internal state na ginawa sa isang hakbang patungo sa neural network, at muli itong prosesuhin sa loob ng ilang round sa hidden space, bago maglabas ng susunod na bahagi ng teksto.
Halimbawa, dati, habang ginagawa ng model ang mga tanong, kailangan itong isipin at isulat ang proseso ng pagkalkula sa papel.
Ngayon, maaari itong isipin sa isip.
Ang mga tao sa labas ay maaaring makakita lang ng tanong at sagot, ngunit hindi nila siguradong makikita kung paano ginawa ang kalkulasyon sa gitna, anong mga ideya ang subukan, o kung may nagsakripisyo ng maling direksyon.
Dahil natipid ang oras na isalin ang bawat hakbang sa teksto, teoretikal na maaaring gamitin ng modelo ang parehong mga yunit ng kalkulasyon para isipin ang ilang beses at isama ang maraming solusyon nang sabay-sabay.
Ngunit habang tumataas ang performance, dumating din ang mga problema:
Kung hindi na nag-iisip ang modelo gamit ang tao'y wika, paano pa natin ito masusubaybayan?
Ang CEO ng Redwood Research, isang non-profit na organisasyon para sa pag-aaral ng AI safety, ay unang nag表达了 malaking pag-aalala:
Hindi pa malinaw kung gaano karami ang pagbaba ng pagmamasid sa chain of thought ng Astra, ngunit kung palawigin pa ng OpenAI ang depth ng loop, maaaring ilipat ang karamihan sa pag-iisip ng modelo sa hindi nababasa na nakatagong espasyo, na hahabol ang pagmamasid sa chain of thought.

Ang parehong direksyon ang kinakabahian ni Ryan Greenblatt, ang pangunahing siyentipiko ng Redwood.
Sa kanyang pananaw, ang hindi malinaw na pag-iisip ay maaaring lumawak nang mas mabilis kaysa sa tradisyonal na chain-of-thought. Patuloy na sumusunod sa landas na ito, ang mga modelo ay maaaring kumpletong o halos kumpletong mag-isip sa loob ng latent space sa hinaharap.
Ito ang pinakamasamang pag-unlad sa larangan ng AI safety hanggang sa ngayon.
Sapagkat kung ang problema ay tanging “hindi maintindihan ang proseso ng pagkalkula,” hindi ito magiging ganitong kahirap.
Bilang pangunahing tagapag-imbisyo sa nakaraang “paglabag sa OpenAI model sa Hugging Face,” natuklasan niya ang dalawang malaking panganib:
Noong panahong iyon, malaki ang pagkakasalig ng mga mananaliksik sa chain of thought upang mabawi ang malaking bilang ng pag-uugali ng AI agents, kahit na gayon ay mahirap pa ring imbestigahan.
Ang kaugnay na AI ay subukang baguhin ang sariling mga rekord, kahit na gawing mali ang pagtawag sa mga kasangkapan.
Para sa huli, kung ang modelo ay may mas malakas na kakayahan sa nakatagong pag-iisip, mas malamang na una itong magdisenyo ng isang plano para magsinungaling sa latent space, at pagkatapos ay lumikha ng isang pekeng kuwento sa pamamagitan ng pinagsamantalang mga tawag at output, nang hindi nag-iwan ng malinaw na mga tanda sa textual reasoning chain.
Ah, ang panganib ay direktang dumoble...

Sinabi nang mas direkta ni Zvi Mowshowitz, na mahabang panahon ay nagmamasid sa AI safety:
Ito ay parang laro ng apoy.
Nag-aalala siya na agad na maaaring makarating sa isang masamang kompetisyon ang mga laboratorio kung ang nakatagong pag-iisip ay magdudulot ng malinaw na pangunahing kapakinabangan:
Hinaharang ka ng pagkakaroon ng takot sa kaligtasan na itago ang chain of thought, ngunit mas nagtatapang ang iyong mga kalaban, at ang mga modelo nila ay mas malakas at mas mura.
Para hindi mabakas, susunod ka ba?
Sa tingin ni Mowshowitz, maaaring kailanganin ang legal na paraan sa hinaharap upang maiwasan ang mga AI company na magpapabaya sa pagmamasid sa chain of thought para sa paghahanap ng kakayahan.

Ngunit sa kabilang panig, may ilan ring naniniwala na ang pagkakaroon ng panikong ito ay nangyari nang masyadong mabilis.
Ipinahayag ni Tian Yuan Dong sa X na noong ipinakilala nila ang Coconut, sila ay nakatanggap ng mga tanong na halos magkakapareho.
Ang Coconut ay ang buong pangalan ng “Chain of Continuous Thought,” at nagtataguyod din ng pag-iisip ng modelo diretso sa kontinuus na hidden space, hindi sa bawat hakbang na i-decode bilang teksto.
Ayon kay Tian Yuan Dong, kahit na ang modelo ay nagpapanatili ng eksplisitong chain of thought, hindi ito nangangahulugan na talagang nakikita ng tao ang totoong mga pag-iisip nito.
Mahalaga na maintindihan kung paano gumagana ang modelo mismo, at hindi lang ang “proseso ng pagsosolba” na isinusulat ng modelo.

Habang lumalaki ang kontrobersiya, hindi na makatira si Jakub Pachocki, pangunahing siyentipiko ng OpenAI, at direktang sumagot.
Agad niyang ipinahayag ang pagpigil sa isang hindi mapagmamasdan na paligsahan na dulot ng “maling balita”.
Kasama ang Astra, ang depth ng computation graph ng kasalukuyang pinakamodernong modelo ng OpenAI ay nasa loob ng dalawang beses ang depth ng GPT-4.
Ibig sabihin, gumagamit talaga ang Astra ng cyclic computation, ngunit ang kasalukuyang sukat ay limitado at hindi pa nagtatago ng buong chain of thought. Ayon sa kasalukuyang impormasyon, ang natural language reasoning nito ay patuloy na mababasa.
Pinahalagahan ni Pachocki na ang pagmamanman ng chain-of-thought ay isang mahalagang paraan ng seguridad na patuloy na isang pangunahing layunin sa kasalukuyang pananaliksik ng OpenAI.
Gayunpaman, kilala niya na ang chain-of-thought monitoring ay napakasusuklian at patuloy na umuunlad sa negatibong direksyon.
Ngunit ang pagbaba na ito ay hindi lubos na dulot ng mga pagbabago sa arkitektura tulad ng cycle depth (paalala na magkakaroon ng espesyal na artikulo sa susunod tungkol dito), at patuloy pa rin ang OpenAI sa pag-aaral kung paano mapapalakas ang kanilang kakayahan sa pagmamasid.

Kaya, ang Astra ay hindi pa nagpapakita ng modelo na lubos na hindi maintindihan ng tao.
Ang tunay na pag-aalala ng mga eksperto sa kaligtasan ay:
Magpapatuloy ba ang pinagpipigilang pag-iisip na nakalulubos sa maliit na sakop sa susunod na henerasyon ng modelo, at hahantong ba ito sa isang black box na hindi na ma-monitor?
Totoo ba ang GPT-6-Astra? Unang nagpalabas ang API response
Natapos na ang kontrobersya tungkol sa algorithm, ang pangalawang gusot ay tungkol sa pangalan ng modelo.
Nakita ng source na si Leo na ang server ay nag-return ng 404 Not Found kapag hiniling ang "gpt-6-astra" sa OpenAI Responses API.
Ang pag-input ng mga pangalan ng modelo na hindi totoo o sinasadyang nilikha ay karaniwang nagdudulot ng error 400.
Ang 404 ay nangangahulugan na ang model identifier ay nakikilala na ng backend, ngunit ang kasalukuyang account ay walang pahintulot na mag-access, o ang model ay hindi pa nabuksan.
Kahit na hindi pa ipinakilala, ang ilang mga modelo ay nakapagpalabas ng mga tanda nang maaga sa pamamagitan ng katulad na pagkakaiba sa API response.
Kaya sinuri ni Leo na maaaring nangyari na ang “gpt-6-astra” sa back-end ng OpenAI API.

Darating na rin ang GPT Images 2.1, unahin muna ang paglutas ng “noise disease”
Sa labas ng language model, ang mga produkto ng OpenAI para sa imahe ay binago rin nang sabay.
Ayon sa爆料 account na Fix, maaaring ilabas ang bagong bersyon ng image model na GPT Images 2.1 noong Setyembre 4.
Ang pinakamakikita mong pagbabago sa pag-upgrade na ito ay ang pagpapabuti ng "noise disease" sa lumang bersyon.

Kagad pa, ang ilang mga resulta ng Images v2 ay nagpapakita ng kakaibang mga butil, foggy, at dumi na tekstura, lalo na sa mga larawan na may maraming teksto o detalyadong elemento, ayon sa sabi ng isang ibang netizen:
Parang nakakahawak sa isang maruming salamin.
At ang pinakabagong leaked na sample ay malinaw na nagpabuti sa problemang ito, mas malinis ang imahe.
Pumunta na, patuloy pa ang pangunahang papel ni Ultraman:
Ang mga kilalang pintura ng mundo: “Ang Ultraman na Bibilin Kung Hindi Ipinapalabas ang GPT-6!”

At ang mga Ultraman na nagtatrabaho nang hatinggabi upang hindi maaresto, umuulit sa kalye sa gitna ng gabi.
Isinulat din niya ang isang post sa Instagram na “Nakikita mo na ba ang kalye sa alas-dalawa ng gabi?”

Dapat ipaabot na ang larawan ay talagang may malalim na kalidad, halos katulad ng mga natanggap na larawan.
Mas maraming tema, mas maraming istilo—nagawa nang maayos din:



Huwag na muna mag-usap, paki-post na ang Ultraman.
Mga link na pang-referensya:
[1]https://techcrunch.com/2026/09/02/openais-new-reasoning-technique-alarms-ai-safety-experts/
[2]https://x.com/tydsh/status/2095227000365707542?s=20[
3]https://x.com/merettm/status/2095023204993490967?s=20
[4]https://x.com/synthwavedd/status/2095184148981842161?s=20
[5]https://x.com/FixlationAI/status/2095232751654064426?s=20
[6]https://x.com/marco_obviously/status/2095275097217191981?s=20
Ito ay mula sa WeChat public account na "Quantum Bit", may-akda: Nakikisali sa mga nangungunang teknolohiya
