OpenAI Mengurangkan Harga API GPT-5.6 Luna dan Terra, Memperkenalkan Mod Sol yang Lebih Cepat

icon MarsBit
Kongsi
AI summary iconRingkasan
OpenAI mengurangkan kos API GPT-5.6 Luna dan Terra, dengan yuran input dan output Luna turun sebanyak 80% masing-masing, manakala Terra dikurangkan sebanyak 20%. Model Sol kini menawarkan mod Cepat 2.5x lebih pantas pada harga yang sama. Peningkatan kecekapan daripada Sol, termasuk penyalinan spekulatif dan peningkatan GPU Kernel, membantu mengurangkan kos. Seiring dengan trend indeks ketakutan dan keserakahan yang menunjukkan keyakinan pasaran yang semakin meningkat, pengurangan ini boleh meningkatkan penggunaan agen AI dan memberi kesan terhadap dinamik harga kripto dalam perdagangan frekuensi tinggi.

Agen

Harga model permulaan Luna diskaun besar, harga input per juta token turun dari $1 kepada $0.20, dan harga output turun dari $6 kepada $1.20.

Ditukar kepada yuan Tiongkok, harga masukan turun dari sekitar 6.8 yuan ke 1.35 yuan, manakala harga keluaran turun dari sekitar 40.6 yuan ke 8.1 yuan.

Terra yang dikenal sebagai "kekuatan utama harian" juga turun 20%, dengan harga masuk dan keluar masing-masing diturunkan menjadi $2 dan $12.

Ditukar kepada yuan Tiongkok, masing-masing kira-kira 13.5 yuan dan 81.2 yuan.

Hanya model unggulan Sol, tetap pada harga asal, tetapi telah melancarkan mod Fast, dengan kelajuan sehingga 2.5 kali lebih pantas daripada mod biasa, pantas tanpa tambahan kos.

Agen

Selepas Codex menetapkan semula penggunaan dengan ketat, penurunan harga juga segera diperkenalkan—OpenAI, awak nak bersaing sampai mati siapa pula…

Perang harga ini telah menjadi semakin sengit.

OpenAI menyatakan bahawa penurunan harga disebabkan GPT-5.6 Sol berjaya menghemat dana sendiri.

GPT-5.6 Sol terlibat dalam peningkatan dirinya sendiri, menghasilkan peningkatan drastik dalam kecekapan, maka kami memberi balasan kepada pengguna baru dan lama~

OpenAI, anda pun main juga dengan trik naik dengan menjejak kaki kiri ke kaki kanan di tempat ini

Agen

Dua produk diskaun, satu dipercepat

Sekarang, harga API untuk tiga model GPT-5.6 adalah:

GPT-5.6 Luna: Input $0.2 per million tokens, output $1.2;

GPT-5.6 Terra: $2 masukan per juta token, $12 keluaran;

GPT-5.6 Sol: $5 masukan per juta token, $30 keluaran per juta token.

Agen

Selepas penurunan harga, Luna mengalami jatuh bebas yang besar.

Harga inputnya sudah sejajar dengan generasi sebelumnya GPT-5.4 nano, dan harga outputnya bahkan lebih murah 0.05 dolar.

Namun, kedua-dua model ini tidak melakukan tugas yang sama sepenuhnya; GPT-5.4 nano terutama ditujukan untuk tugas-tugas sederhana dan berfrekuensi tinggi seperti pengelasan, penarikan maklumat, dan pengurutan.

GPT-5.6 Luna diletakkan oleh OpenAI sebagai model yang ditujukan untuk beban kerja yang peka terhadap kos, yang mampu memanggil alat, mengendalikan konteks panjang, dan menjalankan alur kerja berbilang langkah.

Secara ringkas, OpenAI sedang menjual model yang menyokong tugas Agent pada harga yang sebelumnya hanya berlaku untuk model kecil sederhana.

Terra relatif berhati-hati, turun 20%.

Sol tetap pada harga asal, dengan penambahan mod Fast, yang mencapai kelajuan sehingga 2.5 kali ganda mod standard, dengan harga dua kali ganda mod standard, sementara tahap kecerdasan model tetap sama.

Ia juga akan menggantikan Pengolahan Prioriti sebelum ini. Permintaan API yang sebelumnya menggunakan tag priority akan secara automatik beralih ke mod Cepat.

Pihak berkuasa menyatakan bahawa penyesuaian ini juga akan memasuki Codex dan ChatGPT Work.

Harga langganan tidak akan diturunkan, jumlah kuota pengguna juga tidak akan bertambah, tetapi kuota yang digunakan apabila memanggil Terra dan Luna akan berkurang secara sepadan.

Dengan bayaran langganan yang sama, model boleh melakukan lebih banyak tugas.

OpenAI juga secara tidak sengaja menukar model auto-review di ChatGPT dan Codex CLI dari GPT-5.4 ke GPT-5.6 Luna.

Auto-review bertanggung jawab untuk memeriksa kod dan hasil modifikasi secara latar belakang, merupakan tugas Agent frekuensi tinggi yang typikal.

Dengan menggabungkan peningkatan model dan penurunan harga Luna, OpenAI menganggarkan kosnya akan turun kepada sekitar sepertiga daripada asalnya.

Model yang murah tidak lagi hanya bertanggung jawab atas tugas tradisional seperti pengklasifikasian dan penarikan, tetapi kini mulai memasuki tahap seperti pemeriksaan kod dan pemantauan latar belakang yang memerlukan penilaian dan pemanggilan alat.

Saat ini, ketiga model tersebut diletakkan sebagai:

Tugasan yang sensitif terhadap bajet dan memerlukan penggunaan permintaan tinggi serahkan kepada Luna;

Terra menangani tugas harian biasa;

Tugas sukar terus menggunakan Sol;

Jika menunggu pun terasa perlahan, beli kecepatan dengan harga dua kali ganda.

GPT-5.6 mula menyertai pengurangan kos sendiri

Mengapa harga turun tiba-tiba?

OpenAI menyatakan bahawa sebabnya ialah GPT-5.6 Sol terlibat dalam pengoptimuman sistem penghasilan sendiri.

Kecekapan yang ditingkatkan telah berubah menjadi nombor diskaun dalam senarai harga.

Secara khusus, GPT-5.6 Sol menulis semula dan mengoptimumkan sebahagian GPU Kernel persekitaran pengeluaran, mereka dan menjalankan ratusan eksperimen penghasilan Token, serta menyertai pemantauan latihan dan terlibat apabila berlaku masalah.

Pencapaian akhir juga sangat menonjol: mengoptimumkan GPU Kernel untuk mengurangkan kos perkhidmatan end-to-end GPT-5.6 sebanyak 20%; memperbaiki tekaan dekod, meningkatkan kecekapan penghasilan Token lebih daripada 15%.

Agen

GPU Kernel boleh difahami sebagai program asas yang menjalankan tugas pengiraan spesifik model di GPU.

Model itu sendiri tidak perlu diubah, selama program-program ini ditulis dengan lebih cekap, GPU yang sama akan dapat menyelesaikan pengiraan lebih pantas, menangani lebih banyak permintaan, dan kos setiap panggilan juga akan turun.

Penghuraian spekulatif ialah proses di mana, semasa menghasilkan jawapan, sejumlah besar Token yang mungkin muncul seterusnya akan diteka secara serentak, kemudian disahkan oleh model utama. Semakin tepat tekaan itu, semakin sedikit langkah yang diperlukan untuk menghasilkan dan menunggu secara berurutan.

Kedua-dua pengoptimuman ini tidak mengurangkan kapasiti model, tetapi membolehkan model yang sama berjalan lebih pantas dan lebih murah.

Namun, ini bukanlah peningkatan sepenuhnya sendiri oleh GPT-5.6.

OpenAI secara khusus menekankan bahawa keseluruhan proses masih dipimpin oleh manusia.

Model boleh menulis kod, menjalankan eksperimen, dan memantau anomali, tetapi bagaimana tujuan ditetapkan, sama ada hasilnya boleh digunakan, dan sama ada kod dimasukkan ke persekitaran pengeluaran, masih memerlukan ‘Human in the Loop’.

OMT

Akhirnya, ada satu perubahan baru lagi.

Penurunan harga ini mempunyai titik fokus yang spesifik: alur kerja Agent.

Luna yang diskaun paling besar bukan sekadar model kecil tradisional untuk pengelasan dan penarikan.

Mengikut penempatan OpenAI, ia boleh memanggil alat dan menjalankan tugas berbilang langkah, terutama untuk beban kerja frekuensi tinggi dan sensitif kos.

Oleh itu, penurunan Luna sebanyak 80% juga mengurangkan had untuk operasi jangka panjang Agent.

Membuat tugas-tugas semakan, pengesahan, dan pemantauan yang sebelumnya tidak boleh dilakukan kerap kerana kos yang terlalu tinggi menjadi langkah biasa dalam alur kerja.

Dengan menggabungkan GPT-5.6 untuk mengoptimumkan sistem penghasilan sendiri, satu kitaran baharu muncul:

Penglibatan model meningkatkan kecekapan operasi dan mengurangkan kos; selepas penurunan harga, model memasuki lebih banyak alur kerja frekuensi tinggi; skala panggilan membesar, mendorong peningkatan kecekapan seterusnya.

Roda penurunan harga OpenAI ini telah muncul bentuk awalnya.

Setelah semua tindakan ini, tekanan kini berpindah kepada A:

Giliran anda.

Agen

Pautan rujukan: [1] https://x.com/OpenAI/status/2082878156483219672 [2] https://x.com/sama/status/2082880720989532597

Artikel ini berasal daripada akaun微信公众号 "Quantum Bit", penulis: Mengekori teknologi terkini

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.