Binawasan ni OpenAI ang mga presyo ng GPT-5.6 Luna at Terra API, ipinakilala ang mas mabilis na Sol Mode

icon MarsBit
I-share
AI summary iconSummary
Nilabas ng OpenAI ang mga gastos sa API ng GPT-5.6 Luna at Terra, na bumaba ang mga bayarin sa input at output ng Luna ng 80% bawat isa, at bumaba ng 20% ang Terra. Ang Sol model ay nag-aalok ng 2.5x mas mabilis na Fast mode sa parehong presyo. Ang mga pagpapabuti sa efficiency mula sa Sol, kabilang ang speculative decoding at mga pagpapabuti sa GPU Kernel, ay tumutulong upang bawasan ang mga gastos. Habang ipinapakita ng mga trend ng fear and greed index ang paglago ng tiwala sa merkado, maaaring magbigay-daan ang mga pagbaba na ito sa pagtaas ng paggamit ng AI agent at makaaapekto sa dinamika ng presyo ng crypto sa high-frequency trading.

Agent

Ang entry-level na Luna ay may malaking diskwento: ang presyo ng input bawat milyong token ay bumaba mula sa $1 hanggang $0.20, at ang presyo ng output ay bumaba mula sa $6 hanggang $1.20.

Converted to CNY, the input price decreased from approximately ¥6.8 to ¥1.35, and the output price decreased from approximately ¥40.6 to ¥8.1.

Bumaba rin ang presyo ng Terra, na "pangunahing tagapag-akda ng araw-araw," ng 20%, na bumaba ang presyo ng pag-input at pag-output sa $2 at $12.

Converted to CNY, approximately ¥13.5 and ¥81.2.

Ang tanging flagship model na Sol ay nananatili sa orihinal na presyo, ngunit ipinakilala ang Fast mode na maaaring magdala ng bilis hanggang 2.5 beses ang standard mode, nang walang dagdag na gastos.

Agent

Pagkatapos ng malakas na pag-reset ng paggamit ng Codex, agad din nilang bawasan ang presyo—OpenAI, sino ang iyong gustong patayin sa pagkikita…

Direktang nagiging mainit ang digmaan ng presyo.

Sinabi ng OpenAI na ang pagbaba ng presyo ay dahil sa GPT-5.6 Sol na mismo ang nag-save ng pera para sa kanya mismo.

Ang GPT-5.6 ay sumasali sa sariling pagpapabuti, at ang kanyang efisensya ay nakamtan ang malaking pag-unlad, kaya inirerelease namin ito para sa mga bagong at lumalabas na user~

Ang sistema na iwasan ang paglipad sa lugar sa pamamagitan ng pagpapakatok ng kaliwang paa sa kanang paa, OpenAI, ikaw ay nagsimula na rin.

Agent

.

Dalawang binebenta ng bawas, isang pinapabilis

Ngayon, ang mga presyo ng API para sa tatlong modelo ng GPT-5.6 ay:

GPT-5.6 Luna: $0.20 bawat milyong token sa input, $1.20 sa output;

GPT-5.6 Terra: $2 bawat milyong token sa input, $12 sa output;

GPT-5.6 Sol: $5 bawat milyong token sa input, $30 sa output.

Agent

Pagkatapos ng pagbaba ng presyo, ang Luna ay isang malaking pagbaba.

Ang presyo ng input ay nasa parehong antas na ng nakaraang henerasyon ng GPT-5.4 nano, habang ang presyo ng output ay mas mura pa ng $0.05.

Ngunit hindi ganap na pareho ang mga gawain ng dalawang modelo; ang GPT-5.4 nano ay pangunahing nakatuon sa mga simpleng, karaniwang gawain tulad ng klasipikasyon, pagkuha ng impormasyon, at pag-uri-uri.

Ang GPT-5.6 Luna ay inilalagay ng OpenAI bilang isang modelo na nakatuon sa mga workload na sensitibo sa gastos, na makakapag-call ng mga tool, magproseso ng mahabang konteksto, at magexecute ng multi-step workflow.

Sa madaling salita, binibenta ng OpenAI ang mga modelo na nagpapagana sa mga Agent sa presyo na dati ay para sa mga simpleng maliit na modelo.

Terra ay relatif na mapagpahinga, bumaba ng 20%.

Ang Sol ay nananatili sa parehong presyo, at nagdagdag ng Fast mode na may maximum na bilis na 2.5 beses ang standard mode, ngunit ang presyo nito ay dalawang beses ang standard mode, habang nananatili ang antas ng智能化 ng model.

Ito ay magpapalit sa Dating Priority Processing. Ang mga API request na gumagamit ng priority label ay awtomatikong magkakaroon ng Fast mode.

Sinabi ng opisyal na ang pag-aayos na ito ay magkakaroon din ng epekto sa Codex at ChatGPT Work.

Hindi bababa ang presyo ng subscription, at hindi dadami ang kabuuang quota ng user, ngunit ang quota na ginagamit kapag tinatawag ang Terra at Luna ay magkakaroon ng kaugnay na pagbawas.

Sa parehong bayad sa pag-subscribe, maaaring gawin ng model nang higit pang beses.

Inilipat din ng OpenAI ang auto-review model sa ChatGPT at Codex CLI mula sa GPT-5.4 patungo sa GPT-5.6 Luna.

Ang Auto-review ay naglalayong suriin ang code at mga resulta ng pagbabago sa background, isang klasikong mataas na kadalian na gawain ng Agent.

Sa pamamagitan ng pagpapalawig ng modelo at pagbaba ng presyo ng Luna, inaasahan ni OpenAI na bababa ang kanilang gastos sa halos isang-sampu ng dating halaga.

Hindi na lamang naglalayong mag-classify o mag-extract ang mga murang model, kundi nagsisimula na ring pumasok sa mga proseso tulad ng code review at backend monitoring na nangangailangan ng pagpapasya at paggamit ng mga tool.

Ang kasalukuyang posisyon ng tatlong modelo ay:

Ibigay ang mga gawain na sensitibo sa budget at may malaking dami ng paggamit sa Luna;

Ibinigay ang karaniwang araw-araw na gawain sa Terra;

Magpatuloy sa paggamit ng Sol para sa mga mahirap na gawain;

Kung ang paghihintay ay masyadong mabagal, magbili ng dalawang beses ang halaga para sa mas mabilis na paglilingkod.

Ang GPT-5.6 ay nagsisimula na magkaisa sa pagbaba ng gastos sa sarili

Bakit biglang bumaba ang presyo?

Sinabi ng OpenAI na ang dahilan ay ang pagkakaaliw ng GPT-5.6 Sol sa pagpapabuti ng kanilang sariling production system.

Ang efficiency na itinaguyod nito ay naging mga numero sa discount sa price list.

Sa partikular, gin-rewrite at gin-optimize ng GPT-5.6 Sol ang ilang GPU Kernel sa production environment, dinisenyo at pinagana ang mga eksperimento sa token generation na higit sa isang daan, at nakilahok sa pagmamonitor ng pagtatrabaho, at nag-intervene kapag may problema.

Ang huling resulta ay napakalakas: ang pag-optimize ng GPU Kernel ay nagbawas ng 20% sa gastos ng end-to-end na serbisyo ng GPT-5.6; ang pagpapabuti ng speculative decoding ay nagpataas ng efficiency ng token generation ng higit sa 15%.

Agent

Ang GPU Kernel ay maaaring maunawaan bilang ang panao na programa na nagpapatupad ng mga partikular na computasyonal na gawain sa GPU.

Hindi kailangang baguhin ang modelo mismo; kung mas epektibo ang mga programa, mas mabilis na matatapos ang pagkalkula sa parehong GPU, mas maraming kahilingan ang maipaproseso, at bababa rin ang gastos bawat pagtawag.

Ang pagtataya ng pag-decode ay nangyayari habang nagbuo ng sagot, kung saan muna itong binabawasan ang mga susunod na posibleng Token, at ipinapasa sa pangunahing modelo para sa pag-verify. Mas tama ang pagtataya, mas kaunti ang mga hakbang na kailangang gawin at hintayin nang isahan.

Hindi nagbaba ang kakayahan ng modelo ng dalawang pagpapabuti, ngunit mas mabilis at mas mura itong ipapatakbo.

Ngunit hindi pa ito ang ganap na awtomatikong pag-upgrade ng sarili ng GPT-5.6.

Pinapahalagahan ng OpenAI na ang buong proseso ay patuloy na pinangungunahan ng tao.

Ang model ay maaaring sumulat ng code, jalurin ang mga eksperimento, at monitor ang mga anomaliya, ngunit kung paano matukoy ang layunin, kung maaaring gamitin ang mga resulta, at kung ang code ay papasok sa production environment, ay nangangailangan pa rin ng “Human in the Loop”.

OMT

Sa huli, may isang bagong pagbabago pa.

May espesipikong punto sa pagbaba ng presyo na ito: Ang Agent workflow.

Ang Luna na may pinakamalaking discount ay hindi lamang ginagamit bilang tradisyonal na maliit na modelo para sa paghahati at pagkuha.

Batay sa posisyon ng OpenAI, maaari itong mag-call ng mga tool at mag-execute ng marami-lalawigang gawain, na pangunahing nakatuon sa mga mataas-na-pagkakataon at cost-sensitive na workload.

Kaya, ang pagbaba ng Luna ng 80% ay nagpapababa rin sa hadlang para sa matagalang pagpapatakbo ng Agent.

Gawing karaniwang hakbang sa workflow ang mga gawain sa pagsusuri, pagpapatotoo, at pagmamasid na dati ay hindi maaaring gawin nang madalos dahil sa sobrang gastos.

Habang pinagsasama ang GPT-5.6 upang mapabuti ang sariling produksyon na sistema, isang bagong siklo ang lumabas:

Ang pagkakasali ng modelo ay nagpapataas ng efficiency ng operasyon at bumababa ang gastos; pagkatapos bumaba ang presyo, pumasok ang modelo sa mas maraming high-frequency workflow; ang paglalawak ng pagtawag ay nagpapalakas sa susunod na pagpapabuti ng efficiency.

Ang sikat na pagsabog ng pagbaba ng presyo ng OpenAI ay nagsisimula nang makita.

Pagkatapos ng lahat ng mga ito, ang presyon ay direktang napupunta sa A:

Sarili mo na ang pagkakataon.

Agent

Mga link na pang-referensya: [1] https://x.com/OpenAI/status/2082878156483219672 [2] https://x.com/sama/status/2082880720989532597

Ang artikulong ito ay galing sa WeChat public account na “Quantum Bit”, may-akda: Nagmamalasakit sa mga nangungunang teknolohiya

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.