DeepSeek Mengumumkan Pemotongan Harga API Hingga 60%

icon MarsBit
Bagikan
AI summary iconRingkasan
DeepSeek memangkas harga API hingga 60% untuk seri V4-Flash, berlaku mulai 10 September 2026. Input waktu idle (cache hit) turun menjadi 0,02 RMB per juta token, sementara input (cache miss) dan output masing-masing sebesar 1 RMB dan 4 RMB. Harga pada waktu puncak menggandakan tarif ini. Harga V4-Pro tetap tidak berubah. Langkah ini menyusul kenaikan sebelumnya dan optimasi biaya yang sedang berlangsung. Altcoin yang perlu diawasi mungkin akan mendapat minat kembali seiring perubahan dinamika harga kripto akibat perkembangan ini.

Selasa malam minggu ini, DeepSeek Platform Terbuka mengumumkan rencana untuk kembali menyesuaikan harga API model besar, kali ini dengan penurunan harga yang disambut baik.

DeepSeek

Harga saat waktu sepi: input (cache hit) 0,02 yuan, input (cache miss) 1 yuan, output 4 yuan (semua satuan dalam yuan per juta token). Harga saat jam sibuk tetap dua kali lipat dari harga waktu sepi, yaitu cache hit 0,04 yuan, cache miss 2 yuan, output 8 yuan.

DeepSeek

Penyesuaian ini hanya berlaku untuk seri V4-Flash, sementara harga V4-Pro yang lebih tinggi tetap tidak berubah. Harga baru akan berlaku pada pukul 12:00 WIB tanggal 10 September.

Pihak resmi juga secara jelas menyatakan bahwa jam sibuk adalah jam 9:00–12:00 dan 14:00–18:00 waktu Beijing, Senin hingga Jumat, sedangkan waktu lainnya adalah periode sepi.

Sebelumnya, DeepSeek Kenaikan harga memicu diskusi luas. Penjelasan resmi menyatakan bahwa hal ini dilakukan untuk mengalokasikan sumber daya secara lebih masuk akal dan mendorong pengguna menyesuaikan waktu pelaksanaan tugas. Pihak luar secara umum percaya bahwa DeepSeek V4 Flash 0731 memiliki rasio nilai terhadap harga yang sangat tinggi, menarik panggilan besar dari pengguna global, serta DeepSeek Kekurangan daya komputasi yang cukup.

Bandingkan secara vertikal, sebelum kenaikan harga pukul 00:00 pada 17 Agustus, Flash memiliki harga seragam 0,02 yuan (cache hit)/1 yuan (cache miss)/2 yuan (output). Masukkan harga baru ini:

DeepSeek

Artinya, dua harga di sisi input kembali ke level sebelum kenaikan, sementara output tetap dua kali lipat dari sebelum kenaikan. Jika dihitung berdasarkan harga puncak, selisihnya lebih besar lagi: harga puncak baru 0,04 / 2 / 8 yuan, dibandingkan dengan harga sebelum kenaikan 0,02 / 1 / 2 yuan, masing-masing adalah 2 kali, 2 kali, dan 4 kali.

Oleh karena itu, apakah pengguna benar-benar dapat kembali ke keadaan "menggunakan secara bebas" di masa lalu, bergantung pada tiga variabel aplikasi mereka: tingkat cache hit, rasio input-output, dan tingkat kemampuan tugas untuk dijadwalkan secara bergiliran. Pada skenario dengan tingkat cache hit tinggi seperti konteks panjang, prompt sistem tetap, dan pemanggilan berulang Agent, penurunan akan sangat jelas; sedangkan pada skenario yang berfokus pada penghasilan output, dampaknya terbatas. Seperti diketahui umum DeepSeek Cache hit rate API cukup tinggi, sehingga respons yang diberikan saat ini cukup optimis.

Penurunan harga ini bukan kejadian terpisah, kemarin siang, DeepSeek Diumumkan di grup komunitas resmi bahwa versi internal V4.1 Flash telah dimulai: nama model adalah deepseek-v4.1-flash-expires-on-0910, base_url tetap sama, batas koneksi paralel per akun sebanyak 20, dan penagihan sementara tetap sama dengan V4 Flash.

Selain multimodal asli dan kecepatan inferensi yang sangat cepat, pihak resmi juga menyatakan bahwa biaya lebih rendah berkat peningkatan arsitektur. Jelas bahwa melalui optimasi teknis dan teknik pada model besar itu sendiri, DeepSeek Terus berusaha memperbaiki masalah biaya inferensi.

Nama model ini menunjukkan bahwa model baru akan kedaluwarsa dan ditarik secara otomatis pada 10 September — sama dengan hari efektif penurunan harga.

Bulan ini, perusahaan-perusahaan AI mutakhir memperbarui model besar mereka, DeepSeek Jika versi resmi V4.1 dapat membawa peningkatan kemampuan yang signifikan, dikombinasikan dengan penurunan harga kali ini, mungkin bisa memicu gelombang besar berikutnya.

Artikel ini berasal dari akun WeChat "Machine Heart" (ID: almosthuman2014), penulis: Machine Heart yang fokus pada model besar, editor: Tim Editor Machine Heart

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.