Buong-pagsisimula na ni OpenAI ang GPT-6 Astra para sa mga premium user

iconMetaEra
I-share
AI summary iconSummary
Lumabas na ng OpenAI ang GPT-6 Astra para sa mga user ng Pro, Enterprise, at Business Premium, at ngayon ay available na ang API access. Ang modelong ito, na derived mula sa MetaEra, ay mas responsive sa mga instruksyon at nangangailangan ng pagpapabuti ng mga prompt ng mga user. Ang mga maagang ulat ay nagpapakita na ang Astra ay nangunguna sa 3D modeling at edukasyonal na nilalaman. Ang mga kugnay sa crypto news ay sinusubaybayan kung paano ito nakakaapekto sa mga AI-driven na tool sa larangan ng cryptocurrency news.
Ipinapakilala ng OpenAI ang GPT-6 Astra, na available para sa mga user ng Pro, Enterprise, at Business Premium, kasama ang API na naglalabas nang sabay.

May-akda ng artikulo, pinagkukunan: XinZhiYuan

GPT-6 Astra, bukas na ang buong bersyon!

Kasalukuyang idinirekta ng OpenAI, ang lahat ng mga user ng Pro, Enterprise, at Business Premium, ay maaari na gamitin ang GPT-6 Astra nang direkta sa ChatGPT Work at Codex, kasama ang API na nagsimula nang sabay.

Ngunit kailangan pa lang maghintay ng ilang araw ang Plus at karaniwang Business users.

Noong Septiyembre 3, ipinahayag ng OpenAI ang pagpapalabas ng Astra sa mga yugto. Ngayon, dalawang araw pagkatapos, buong pag-access na para sa mga user ng premium.

Unang-una, ipaalam mo sa akin na tanggalin ang prompt.

Sa ganitong malaking pagpapahayag, ang unang payo ni Victor Nunez, engineer ng OpenAI, ay ang mag-delete ng iyong prompt.

Sinabi niya: Habang nag-uumpisa ang Astra, i-ayos muli ang iyong AGENTS.md at Skills, at isipin muli kung paano gamitin ang reasoning level.

AGENTS.md, ang mga panuntunan para sa AI: Sino ka, ano ang dapat gawin, at ano ang hindi dapat gawin. Skills, ang mga tagubilin kung paano gawin ang trabaho: Kapag makakaroon ng ganitong sitwasyon, sundin ang proseso na ito.

Sa mga nakalipas na taon, ang paraan ng mga developer sa pagharap sa mga modelo ay simpleng at walang komplikasyon: patuloy na idaragdag ang mga bagay sa manual. Kung hindi ito nauunawaan, dagdagan ang paliwanag. Kung ito ay paulit-ulit na nagkakamali, idagdag ang isang limitasyon. Kung patuloy pa ring nagkakamali, idagdag ang isang halimbawa.

Tulad ng pagpapalagay ng mga tala sa isang bagong empleyado na laging nakakalimot. Sa paglipas ng panahon, puno na ng mga tala ang buong mesa.

Ngunit noong dumating ang Astra, ang mga ito ay naging bigat.

Isinulat ng OpenAI sa gabay ng modelo ng Astra: Mas sensitibo ang Astra sa mga utos sa skill at AGENTS.md.

Ang mga lumang patakaran na dati ay galing lamang sa pagpapakita, ngayon ay ipapatupad nito nang buong detalye. Isang malabo na patakaran ay magpapahinto sa iyo upang muling i-verify; dalawang patakaran na magkakasalungat ay direktang magpapalito sa iyo.

Halimbawa. dati mo isinulat ang “kailangang ma-approve ang lahat ng plano,” ngunit ang lumang model ay parang hindi nakakakita at patuloy lang sa paggawa.

Hindi ito gagawin ng Astra. Ito ay talagang magpapahinga at magtatanong sa iyo: “Sino ang dapat mag-apruba sa solusyong ito?” tapos saka…… maghihintay.

Kaya ginamit ng gabay ang mga salitang “strongly recommended” para sa bawat skill file na mababasa ng auditor ng model.

Hindi lang iyon. Mas masipag din si Astra sa pagtatanong kumpara sa nakaraang bersyon.

Ibinigay mo sa kanya ang isang gawain, tapos habang nasa gitna pa lang, biglang tumigil: “May dalawang paraan dito, alin ang gusto mo?” Pakiusap, hindi ba pwede mong piliin ang isang paraan at patuloy lang? Ganun din sa pag-code, bago pa man mag-shoot, bigla na siyang nagpapatakbo ng mga pagsubok—kahit pagbabago ng kulay ng button, kailangan muna ng unit test.

Ang lahat ng ito ay kailangang ayusin sa pamamagitan ng mga prompt. At ang direksyon ng pag-aayos ay karaniwang pabalik.

Mas malala pa, kasama sa gabay ang isang pre-made prompt na humihingi sa Astra na huwag gamitin ang mga karaniwang pariralang tulad ng "delve" o "it should be noted," at eksplisitong bawal ang mga pahayag na may anyong "deny-then-reverse" (tulad ng "It's not about X, it's about Y").

Ang modelo ang sumulat ng mga pahayag na ito, at ang tagagawa ng modelo ang nagtuturo sa iyo kung paano maiwasan ang mga pahayag na ito. Mayroon itong katotohanang "sarili kong ginawa ang libingan, at sarili kong ituturo sa iyo kung paano ito mapupuno."

Sa point na ito, maaaring magtanong ang ilan: Ano ang uugnay nito sa akin?

Too big of a relationship.

Bago na ang lohika ng Astra, ibig sabihin ay dapat mong baguhin ang paraan kung paano ka nakikipag-ugnayan sa AI.

Kahit na dati kang nakikipag-usap sa ChatGPT at nakita mong mali ang mga sagot nito, ang natural mong reaksyon ay idagdag ang mga limitasyon at mga hiling. Kung isang tala ay hindi sapat, idagdag ang isa pa; kung dalawa ay hindi sapat, idagdag ang lima.

Ito ang pag-iisip ng pagdaragdag—ang mas bulol ang modelo, mas maraming patakaran ang isusulat mo.

Ngayon sinasabi ng Astra sa iyo: Huwag na masyadong mag-isulat.

Nakakakita na ito ng iyong intensyon mula sa konteksto, aktibong magtatanong kapag may kahulugang ambiguo sa utos, at nakakalabas ng pangkabuuang layunin sa maraming hakbang na gawain.

Ang mga prompt na gawa mo ay hindi lamang labis kundi maaari ring magdulot ng pagkakamali.

Kaya ang isang salitang paulit-ulit na binanggit sa opisyal na gabay ng OpenAI ay: audit. Auditin ang lahat ng iyong mga utos sa ito, at tanggalin ang lahat ng obsoletong, redundant, at magkakasalungat.

Mas malakas ang modelo, mas kaunti ang mga patakaran na dapat isulat mo.

Ang prinsipyong ito, kahit developer ka o karaniwang user, pareho lang.

Gaano kalakas

Nang sabihin na ang maraming «pang减», ilan ba talaga ang kakayahan na idinagdag ng Astra?

Ang mga developer na nakakuha ng early access ay nagsumite na ng kanilang sagot.

Ang developer na si Matt Shumer ay nagtayo ng Manhattan sa Unreal Engine, isang kalye sa isang kalye, at nagtrabaho nito sa loob ng isang linggo.

Nilikha niya ang isang gameplay na tinatawag na “Manager Cycle”: isang Astra bilang manager, na hihiwalay ang buong gawain sa mga listahan at mga yugto; at isang iba pang Astra bilang tagapagpaganap.

Ang manager ay nagpapadala ng isang gawain lamang sa isang pagkakataon, at kung tapos na, magkakaroon ng susunod—hindi nagpapakita ng anumang preview. Habang sa kabilang dulo, sa pinakamalakas na punto, 96 na sub-agent ang nagtatrabaho nang sabay-sabay, parang isang assembly line na umaabot patungo sa harap.

Natuklasan din ni Shumer ang isang napakagiliw na detalye sa pagpili ng salita: kapag pinayuhan ang modelo na gawin ang bawat yugto nang "napakagaling," ito ay sumusunod nang maayos; ngunit kapag binago sa "perpekto," agad itong nagsisipil sa mga maliit na detalye at hindi makalabas. Ang pagkakaiba ng isang salita lamang ang nagpasya kung papalawakin o papahingahan ang proyekto.

Ang developer na si Anshu ay nagkomento: Ang Astra ay tila isang diyos na machine na AGI sa larangan ng 3D games.

Ang Astra ay natapos ang isang malawak na mundo ng laro na may mataas na kalidad ng imahe sa loob ng 45 minuto lamang.

Ang imunologo na si Derya Unutmaz ay nag-type lamang ng isang pangungusap—“Gumawa ng isang 5-minutong video na nagtuturo tungkol sa T cells.”

Isinulat ng Astra ang sariling解说, ginamit ang Remotion para sa animation, ang Imagegen para sa mga larawan, at aktibong inirerekumenda ang HeyGen para sa voiceover, isang pagkakataon lang para makagawa ng video.

Sinabi ng siyentipiko na nag-aaral ng T cells ng 35 taon pagkatapos makita ito: “Hindi ko kayang ipaliwanag nang mas mabuti.” Ngayon, plano niyang gumawa ng buong serye ng mga video lecture sa imunolohiya at i-upload sa website.

Binigyan ni Tom Krcha si Astra ng isang lumang disenyo ng steam locomotive.

Sa loob ng ilang minuto, may 3,295 na editable na object na lumabas sa Blender, kung saan bawat parte ay maaaring hiwalayin at baguhin nang magkahiwalay.

Ang tweet na ito ay may higit sa 750,000 na pagtingin.

Bumisik siya ulit ng isang mas hindi karaniwang tren na Commodore Vanderbilt, kung saan kailangan ng kamay na pagpapabuti sa curve ng lokomotiba, ngunit ang simula ay naiwan na sa isang nakakatakot na antas.

Ang mga numero na ipinakita ng OpenAI ay sapat na malakas.

Sa OSWorld 2.0 (na nagpapahintulot sa mga modelo na mag-operate ng desktop tulad ng tao), nakamit ni Astra ang 72.6%, habang ang nakaraang henerasyon na GPT-5.6 Sol ay 65.7%; ang oras sa bawat gawain ay bawasan mula sa 75 minuto hanggang 40 minuto—tumaas ang akurasyon, at mas mabilis naman ang bilis nang halos dalawang beses.

Hindi rin ganap na lalong nangunguna ang Astra. Sa Independent Integrated Intelligence Index ng Artificial Analysis, ang Astra ay nakakuha ng 61.2 puntos, habang ang bagong inilabas ni Anthropic na Claude Fable 5.1 ay 65.7 puntos.

Hindi pa natutukoy ang tagumpay sa laban na ito ng dalawang pangunahin.

Era ng Pagbabawas

Sa mga nakalipas na taon, ang kuwento ng pag-unlad ng AI ay pagdaragdag.

Kung hindi sapat ang intelihensya ng modelo, gamitin ang mga patakaran upang kumpletoan—ang mga patakaran ay lalalim habang dinadagdagan.

Ngayon, na补上了 ang kahinaan. Ang sariling patakaran ay naging bagong pinagkukunan ng pagkakamali.

Ginamit ng OpenAI ang isang model guide upang mahinto nang tahimik ang direksyon ng AI engineering: dating tinuturuan ito kung paano gawin ang bawat hakbang, ngayon ay tinatanggal ang mga lumang patakaran na nagpapalit sa daan, upang bigyan ito ng espasyo.

Nagbago rin ang ugnayan ng tao at ng modelo.

Kanina ay itinuturo ito. Ngayon ay—huwag pansinin ito.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.