Selasa malam minggu ini, DeepSeek Platform Terbuka mengumumkan perancangan semula harga API model besar, dan kali ini adalah penurunan harga yang disambut baik.

Harga masa lapang adalah seragam: input (cache berjaya) 0.02 yuan, input (cache gagal) 1 yuan, output 4 yuan (semua unit dalam yuan / juta token). Harga masa puncak tetap dua kali ganda harga masa lapang, iaitu cache berjaya 0.04 yuan, cache gagal 2 yuan, output 8 yuan.

Penyesuaian ini hanya melibatkan siri V4-Flash, manakala harga V4-Pro yang lebih tinggi tetap tidak berubah. Harga baharu akan berkuat kuasa pada 12:00 Waktu Beijing, 10 September.
Pihak rasmi juga menetapkan waktu sibuk sebagai jam 9:00–12:00 dan 14:00–18:00, Senin hingga Jumat, waktu Beijing, dengan waktu lainnya sebagai masa lapang.
Sebelum ini, DeepSeek Kenaikan harga telah memicu perbincangan luas. Penjelasan rasmi diberikan untuk mengalokasikan sumber daya dengan lebih munasabah dan mendorong pengguna menyesuaikan masa pelaksanaan tugas. Pihak luar secara umum percaya bahawa DeepSeek V4 Flash 0731 memiliki nilai yang sangat tinggi, menarik panggilan besar daripada pengguna global, serta DeepSeek Kekurangan kuasa pengiraan yang mencukupi.
Bandingkan secara vertikal, sebelum kenaikan harga pada 00:00 pada 17 Ogos, Flash mempunyai harga seragam 0.02 yuan (cache berjaya) / 1 yuan (cache gagal) / 2 yuan (output). Masukkan harga baharu ini:

Dengan kata lain, dua harga di sisi masuk kembali ke tahap sebelum kenaikan, sementara output tetap dua kali ganda dari sebelum kenaikan. Jika dihitung berdasarkan masa puncak, perbezaannya lebih besar: harga puncak baharu 0.04 / 2 / 8 yuan, berbanding dengan 0.02 / 1 / 2 yuan sebelum kenaikan, masing-masing adalah 2 kali, 2 kali, dan 4 kali.
Oleh itu, sama ada pengguna benar-benar boleh kembali ke keadaan "guna sebebas mungkin" di masa lalu, bergantung kepada tiga pemboleh ubah dalam aplikasi mereka: kadar kejayaan cache, nisbah input-ke-output, dan tahap kebolehan tugas untuk dijadualkan secara berasingan. Untuk skenario dengan kadar kejayaan cache tinggi seperti konteks panjang, petunjuk sistem tetap, dan panggilan berulang Agent, penurunan akan ketara; manakala untuk skenario yang berfokus pada pengeluaran output, kesannya terhad. Seperti yang diketahui umum DeepSeek Cache hit rate bagi API adalah tinggi, jadi tindak balas yang diberikan oleh semua pihak pada masa ini agak optimis.
Penurunan harga ini bukan peristiwa yang berdiri sendiri, semalam petang, DeepSeek Mengumumkan dalam grup komunitas rasmi bahawa ujian dalaman untuk versi sementara V4.1 Flash telah dibuka: Nama model ialah deepseek-v4.1-flash-expires-on-0910, base_url tidak berubah, had aliran 20 perakaun, dan penagihan masih sama seperti V4 Flash.
Selain multimodal asli dan kelajuan inferens yang sangat pantas, pihak rasmi juga menyatakan bahawa kos lebih rendah melalui peningkatan arsitektur. Jelas bahawa melalui pengoptimuman kejuruteraan dan teknikal model besar itu sendiri, DeepSeek Terus berusaha memperbaiki masalah kos inferens.
expires-on-0910 nama model ini menunjukkan bahawa model baharu akan tamat tempoh dan ditarik secara automatik pada 10 September — bersamaan dengan tarikh penurunan harga berkuat kuasa.
Bulan ini, syarikat-syarikat AI terkini telah mengemas kini model besar mereka, DeepSeek Jika versi rasmi V4.1 dapat membawa lompatan kemampuan yang ketara, disertai dengan penurunan harga kali ini, mungkin boleh menghasilkan satu gelombang besar lagi.
Artikel ini berasal daripada akaun微信公众号 "Machine Heart" (ID: almosthuman2014), penulis: Machine Heart yang memperhatikan model besar, penyunting: Jawatankuasa penyunting Machine Heart
