Ipinakilala ng OpenAI ang mga kakayahan ng Astra (GPT-6), kasali ang mga alumni ng Zhejiang at Tongji sa pag-unlad

icon MarsBit
I-share
AI summary iconSummary
Ipinakita ng OpenAI ang mga advanced na kakayahan ng Astra (GPT-6), kabilang ang pagdetekta ng DeFi exploit at autonomaong pagkilala sa mga vulnerability. Ang modelo ay nakakabypass kahit sa pinakamalakas na mga sistema. Nakatulong si Jiawei Liu (Tongji) at Xiangyu Qi (Zhejiang) sa proyekto. Dinagdagan ng OpenAI ang mga safety protocol upang maiwasan ang maling paggamit. Ang update na ito ay nagdudulot ng malaking balita sa crypto habang umuunlad ang mga AI tool kasabay ng pangangailangan sa blockchain security.

Kasalukuyang nangyari, naglabas ng maraming pagpapalaganap ang OpenAI upang maghanda para sa susunod na modelo, Astra (ang legendariyong GPT-6):

Biglang inilabas ng opisyal ang teknikal na artikulo, una naming ipinakita ang mga kakayahan ng Astra;

Agad pagkatapos ay pumunta si Ultraman upang isulat ang “maikling sanaysay” tungkol sa bakit hindi pa nabuo ang Astra;

Pagkatapos ay nagbigay ng pahayag ang dalawang Chinese researcher, na nagpakita ng mga detalye mula sa unang kamay ng mga pribadong resulta ng pagsubok na dating hindi pa nababahagi.

OpenAI

Sa ilang kaunting oras, lahat ng signal ay tumuturo sa iisang direksyon:

Ang susunod na henerasyon ng flagship model ni OpenAI ay nasa dulo na ng pana.

OpenAI

Inihayag ni Ultraman sa maikling sanaysay na ang Astra ay nagsagawa na ng pagsasanay, at ang pagkakaroon ng pagkakatigil ay hindi dahil sa kakulangan ng lakas ng modelo.

Bilang kabila, dahil dito ay ang Astra ay naging malakas na kaya ang kumpanya ay kinailangang aktibong magpahinga.

Ipinahayag ni Ultraman ang karanasang ito bilang isang patuloy na pagtutol:

Nakakaligaya ang pagtaas ng kakayahan na dala ng Astra, ngunit nakakapagod ang pagkabalisa dahil walang makakapaghula nang buo sa mga epekto ng mga kakayahang ito.

Kaya sa buong nakaraang tag-init, ang OpenAI ay halos nagpapabuti ng seguridad, nagpapalakas ng pagkakaayos, at nagdaragdag ng mga pagsasalba sa Astra.

Kahit na sinabi niya na ang mga modelo pagkatapos ng Astra ay kailangang umabot sa mas mababang bilis kung kinakailangan, upang magbigay ng sapat na oras para sa pag-aaral ng kaligtasan at pagkakasundo.

? ? Ano nga ba ang antas ng lakas ng Astra? Bakit naniniwala ang OpenAI na kayang ilabas na ito ngayon?

Ang public technical blog na ito ay maaaring magbigay sa atin ng isang tingin.

Higit sa GPT-5.6 Sol ang kakayahan sa pagkakakilanlan ng mga vulnerability, perpektong resulta sa panloob na pagsubok

Ayon sa opisyal na pahayag, ang pangunahing dahilan kung bakit pinapalabas si Astra sa pagkakataong ito ay dahil natutugunan na nito ang antas ng kakayahan sa “Cyber-Critical”.

Ito ang unang modelo ng OpenAI na opisyal na nakakategorya sa antas na ito.

OpenAI

Ang terminong "critical level" ay nangangahulugan na matapos makakuha ng mga kaukulang kasangkapan at pahintulot sa kapaligiran, nakakapag-iiwan na ang Astra ng sarili nitong paghahanap ng mga hindi kilalang vulnerabilities, pagpapaunlad ng mga paraan ng paggamit, at pag-atake sa mga sistema na espesyal na pinagsanay, nang hindi na kailangan ng patuloy na gabay mula sa tao.

Ang pinakamadaling maintindihang tagumpay ay ang 100% na tagumpay na natanggap ni Astra sa public exploit benchmark na ExploitBench.

OpenAI

Hindi nakakapagpapahuli sa kanya ang pampublikong tanong, kaya pinagsikapan ng OpenAI na bigyan ito ng isang bagong set ng tanong.

Kinolekta ng team ang 20 mataas na panganib na V8 vulnerability na itinataguyod noong Hunyo hanggang Agosto 2026.

Lahat ng mga butas na ito ay lumabas pagkatapos ng cutoff date ng kaalaman ni Astra, kaya malamang ay hindi ito nagmula sa pagkakatanda ng modelo sa mga data ng pagtuturo.

Sa pagharap sa mga bagong tanong na panloob na ito, patuloy na nangunguna ang Astra sa GPT-5.6 Sol, at gamit ang mas kaunting Token.

OpenAI

Ang Jiawei Liu, na nakikilahak sa pag-unlad ng Astra, ay naglalahad ng pagkakaiba nang mas direkta:

Sa loob ng panloob na pagsubok, ang kakayahan ng Astra sa网络安全 ay humigit-kumulang 4 beses ang laki ng GPT-5.6 Sol.

OpenAI

Mas nakakagulat ay sa isang pagsubok, natuklasan at ginamit ng Astra nang sarili nito ang dalawang zero-day vulnerabilities at isinambong nito ang mga ito sa isang buong attack chain:

Sa harap ng pinagpapalakas na browser, nagtagumpay ang Astra sa pagpapalaganap ng pagsasamantala, paglalabas sa sandbox ng browser, at sa huli ay pagpapatakbo ng mga utos sa host machine.

Sa harap ng pinagpapalakas na operating system, natapos nito ang local privilege escalation, mula sa isang karaniwang account na may mababang pahintulot patungo sa root access.

Ibig sabihin, ang Astra ay hindi na lamang tumutulong sa mga programmer na suriin ang code at hanapin ang mga bug.

Nagsimula itong makapagtapos ng isang mahirap na red team attack nang mag-isa.

Ito rin ang dahilan kung bakit hindi pa pinapayagan ng OpenAI ang Astra sa nakaraan.

Kapag ginamit ang kakayahang ito para sa depensa, makakatulong ito sa mga security team na mabilis na makahanap at i-fix ang mga vulnerabilities na hindi pa nakikita ng mga tao, ngunit kung makakarating sa kamay ng mga attacker, maaari rin itong mapababa nang malaki ang hadlang sa pagpapatakbo ng mga komplikadong cyber attack.

OpenAI

Subalit, kailangan idagdag ang isang limitasyon sa resultang ito.

Ang Astra sa pagsubok ay may access sa advanced tools at environment na Daybreak Blue, ngunit ito ay hindi nangangahulugan na ang default version na makukuha ng karaniwang user sa hinaharap ay may katumbas na kondisyon sa pag-atake.

Ang mga kaugnay na resulta ay karamihan ay mula sa panloob na pagtataya ng OpenAI at kailangan pa ng pagpapatotoo mula sa mga third-party.

Ngunit isa na ang tiyak:

Sa antas ng Astra na ito, ang hindi isyu na harapin ni OpenAI ay ang kakayahan.

Ang mga isyu sa kaligtasan ay naging kamay ng Diokles.

Dalawang seguridad na gate: para pigilan ang masamang paggamit at ang pagkawala ng kontrol ng modelo

Paano upang maiwasan ang pagkakasala ng espada na ito?

Ang solusyon na ibinigay ng OpenAI ay ang pagpapanatili ng parehong dalawang ruta ng panganib: isa para sa mga tao, at isa para sa modelo.

Unang patakaran, pigilan ang pagmamalabis ng mga user sa Astra.

Bukod sa espesyalisadong pagsasanay sa kaligtasan, gumagamit din ang OpenAI ng mga classifier ng sistema, patuloy na pagmamanman, at paghahanap ng banta upang matukoy ang mga sosyal na gawain sa maraming pagkakataon at mahabang gawain.

Sa penetration testing ng cybersecurity, ang Astra ay nakamit ang 91.5% na rate ng pagtanggi sa mapanganib na mga hiling, samantalang ang GPT-5.6 Sol ay 59%.

OpenAI

Habang ang mga advanced na kakayahan sa cybersecurity ng Astra ay hindi direktang magagamit ng lahat ng mga user, ito ay muna ibibigay sa ilang mga Alpha tester, at pagkatapos ay ipapalabas nang paunti-unti sa pamamagitan ng mga kontroladong proyekto tulad ng Daybreak Blue.

OpenAI

Ikalawa, pigilan ang model na magsira sa sarili nito.

Mas nakatagong ang panganib dito:

Kahit walang masamang intensyon ang user, baka ba mag-expand ang modelo nang walang pahintulot sa saklaw ng gawain? Baka ba ito ay maggamit ng mga kasangkapan na hindi pinapahintulutan, o kaya ay mabubypass ang mga pagsusuri sa kaligtasan?

Nilikha ng OpenAI ang isang "honeypot" test para dito.

Sa harap ng mga gawain na sobrang mahirap o walang solusyon, ang test environment ay sadyang iniiwan ang isang “cheat” na shortcut na may labas na pagsasaklaw; ang model ay maaaring maging matapat at sirain ang tinukoy na layunin, o maaari ring lumabas sa hangganan ng pagsasaklaw at sumakop sa mga kapitbahay na test facility upang matapos ang gawain.

Bilang resulta, sinubukan ng GPT-5.6 Sol ang paglalakbay ng shortcut sa 56% ng mga pagsubok, habang hindi nagawa ng Astra ang anumang pagkakataon.

Sa isang iba pang pagsubok, hindi nag-try ang Astra na muli mong i-trial ang mapanganib na utos o subukang i-bypass ang mga limitasyon pagkatapos ay tinanggihan ng automated review system.

OpenAI

Dagdag pa, sinusubaybayan ng OpenAI ang proseso ng pag-iisip ng modelo.

Kapag natutukoy ang anumang anomalous trend, maaaring mabawasan ang bilis, ipaantay, o direktang pagsisimulan ang gawain.

Bagaman may gastos talaga (maaaring maging mas mabagal ang ilang normal na gawain, o maaaring maliing ilarawan bilang ipinagbawal), sa pananaw ng OpenAI, ito ay ang kinakailangang gastos sa kaligtasan para sa pagpapahintulot sa Astra.

Gayunpaman, kilala rin ng OpenAI na ang mga hakbang na ito ay kung ano lamang panlabas na “brake” at hindi makapalit ng sariling alignment ng modelo:

Ang tunay na kaligtasan ay ang pagtitiyak na ang modelo ay hindi magsisimula pang lumabas sa hangganan.

Mga alumni ng Zhejiang at Tongji sa frontline ng pag-unlad ng Astra

Upang gawing totoo ang pangungusap na ito, kailangan pa rin itong bumalik sa mga gumagawa ng modelo.

Bagaman hindi pa inilabas ng OpenAI ang listahan ng koponan ng Astra, ang pagkakaroon ng pampublikong pahayag sa ilalim ng seryeng ito ay nagdulot ng pagkakakilanlan ng kahit dalawang mga Chinese researcher na malalim na nakikilahok dito.

Isang isa ay ang nabanggit na Jiawei Liu.

Siya ay kasalukuyang researcher sa OpenAI at nakatapos ng bachelor's degree sa Computer Science mula sa Tongji University noong 2021.

Sa kanyang pag-aaral sa undergraduate, kanyang nasali ang pagbuo ng high-performance human pose estimation framework na HyperPose, kung saan siya ang pangunahing responsable sa model inference engine, at ang mga resulta ay napili sa ACM Multimedia 2021, at ang proyekto ay nakakuha na ng higit sa 1,000 stars sa GitHub.

Pagkatapos ay pumunta siya sa University of Illinois Urbana-Champaign upang mag-aral ng doktorado sa kompyuter, kung saan siya ay naging iskolar ni Lingming Zhang, isang eksperto sa software engineering, at tumungo ang kanyang pag-aaral mula sa mga mataas na performance na visual system patungo sa code models at software reliability.

Sa panahon ng kanyang doktorado, ang mga kasangkapan na kanyang naging bahagi ng pagbuo ay nagtuklas ng higit sa 300 malubhang Bug sa mga sistema ng machine learning tulad ng PyTorch at TensorFlow;

Ang code model na Magicoder ay ginagamit din ng Meta Llama 3.1, Google CodeGemma, at IBM Granite.

Pagkatapos makatapos sa doktorado noong 2025 at sumali sa OpenAI, patuloy niyang sinuri ang mga tanong na may parehong pagkakasunod-sunod:

Paano gawing mas mahusay ang AI sa pagsulat ng code at sa pagkilala sa mga butas sa code.

OpenAI

Ang isa pa ay Xiangyu Qi (Qi Xiangyu).

Nakumpleto ni Qi Xiangyu ang kanyang bachelor's degree sa Computer Science and Technology ng Zhejiang University, at pumunta sa Princeton University noong 2021 upang mag-aral ng PhD sa Electrical and Computer Engineering, na nakatuon sa pagiging matatag ng malalaking modelo, mga pag-atake na "jailbreak," at safety alignment.

Ang kanyang pinakamalaking gawa ay ang “Safety Alignment Should Be Made More Than Just a Few Tokens Deep”.

Ang papel na ito ay nagtuturo na ang seguridad na pagkakasundo ng malalaking modelo ay hindi maaaring mag-asa lamang sa ilang unang token sa sagot, dahil habang patuloy ang pagbuo, ang dating mga pader ng seguridad ay maaaring pa ring sirain ng mga hacker.

Nakilala ang papel na ito sa huli bilang isa sa mga 3 na katangi-tanging papel sa ICLR 2025 mula sa 11,672 mga pagpapadala.

Pagkatapos magkamit ng doktorado noong 2025, sumali si Qi Xiangyu sa OpenAI bilang miyembro ng teknikal na tim, patuloy na nag-aaral ng robustness ng malalaking modelo at nakikilahok sa mga gawain kaugnay ng cybersecurity model.

Mula sa Zhejiang University papunta sa Princeton, at pagkatapos ay sa OpenAI, ang tanong na patuloy niyang itinatanong ay ang problema na kailangang harapin ng Astra ngayon:

Ang kakayahan ay maaaring maging mas malakas nang patuloy, ngunit ang hangganan ay hindi dapat maging mas malabo.

OpenAI

Sa kabilang banda, hindi ko alam kung ipapahayag ng OpenAI ang buong listahan pagkatapos ng opisyal na paglabas ng Astra.

Bago ang GPT-4, tinakda ng OpenAI ang mga nagmamalasakit na may higit sa isang daan, ngunit sa GPT-5 at GPT-5.5, lalong lumalaki ang System Card, samantalang ang listahan ng mga mananaliksik ay lalong pinipilit na itago.

Ang dahilan ay kilala sa lahat—ito ay para pigilan ang mga tulad ni Meta’s Zuckerberg na palaging humahabol ng talento.

Isa rin ito sa uri ng PTSD...

Isang Bagay Pa

Samantalang nag-uusap ang OpenAI tungkol sa pagmamasid sa Astra at pag-iwas sa pagkawala ng kontrol sa modelo, sinira ng The Information:

Gamit ng Astra ang isang teknolohiya na tinatawag na "Recurrent Depth".

OpenAI

Sa tradisyonal na modelo, dumadaan ang impormasyon sa isang fixed bilang ng network layers bago mabuo ang susunod na Token, habang ang looped depth ay nagpapabalik-balik sa impormasyon sa iisang grupo ng network layers, katulad ng pagpapakita ng “maraming pag-iisip” sa loob ng modelo.

Inaasahan na magpapabuti ng kakayahan at magpapababa ng gastos, samantala ay maaaring magkaroon ng higit pang pag-iisip sa loob ng modelo, hindi na buo na ipinapakita bilang teksto na maunawaan ng tao.

Sa ibang salita, ang modelo ay maaaring mag-isip nang mas malalim, ngunit ang mga tao ay patuloy na nagiging mahirap maintindihan.

Bilang isang matagal nang nagmamasid sa patakaran sa pagkakasiguro ng AI, nagbaba ang Nathan Calvin na maaaring sirain ng teknolohiyang ito ang pagmamasid sa chain of thought.

Ito ay medyo delikado:

Sinasabi ng OpenAI na dapat suriin kung ano ang isipin ng Astra, ngunit ang kanilang bagong teknolohiya ay maaaring gawing mas hindi nagpapahayag ng kanilang mga isip.

Ah, ganyan...

OpenAI

Mas mainam na sinabi ng The Information na limitahan na ng OpenAI ang paggamit ng teknolohiyang ito sa Astra.

Isalin, ngayon ay maunawaan, pero sa hinaharap ay hindi na maaaring sabihin.

Bukod dito, palaging may alalahanin na malamang ipapalabas ng Astra sa nakaraang Huwebes (Setyembre 3).

Dahil sa paglalabas ng huling henerasyon ng 5.1 model ni Company A, mas tumataas ang katuwiran ng pahayag na ito.

Ang mantis ay humahabol sa kulisap, samantalang ang ibon ay nasa likod.

Sino ang muli ay naintindihan!

Mga link na pang-referensya:

[1]https://x.com/xiangyuqi_pton/status/2094891059038069236?s=20

[2]https://xiangyuqi.com

[3]https://x.com/JiaweiLiu_/status/2094901279239921816?s=20

[4]https://jw-liu.xyz/

[5]https://x.com/sama/status/2094934592062959832?s=20

Nakapost sa WeChat public account na "Quantum Bit", may-akda: Nakikisali sa mga unang teknolohiya

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.