Model AI terkini DeepSeek adalah yang paling murah untuk dijalankan di antara model-model terkenal. Perbezaan kos bukanlah kecil.
Nombor-nombor yang menakutkan Wall Street
Model R1 DeepSeek, yang dilancarkan pada Januari 2025, beroperasi pada kira-kira $0.14 per juta token. Sebagai perbandingan, tawaran sepadan OpenAI pada masa itu dihargai pada $7.50 per juta token. Itu adalah pengurangan kos sebanyak 98%.
Model V4-Pro yang lebih baru, yang dilancarkan pada April 2026, berharga $0.87 setiap juta token untuk output dan $0.435 untuk input. Nombor-nombor ini mewakili penurunan 34x berbanding pesaing terkemuka. Syarikat tersebut telah mengunci harga-harga tersebut secara tetap pada akhir Mei 2026.
Kemudian terdapat varian V4-Flash, yang menargetkan beban kerja yang hemat bajet pada sekitar $0.14 per juta token. Ini diklaim 35 kali lebih murah daripada alternatif GPT-5.5. Analisis pihak ketiga telah mengesahkan bahawa model DeepSeek secara umum berjalan 20 hingga 50 kali lebih murah berbanding model tertutup terkemuka.
V4-Pro Max berada di segmen premium dalam jajaran DeepSeek dengan harga campuran kira-kira $2.17 per juta token, disahkan oleh beberapa penyedia benchmarking.
Pengukuran prestasi V4-Pro bersaing dengan Claude Opus 4.6 dan GPT-5.5, dua model paling cekap di pasaran.
Bagaimana mereka melakukannya
DeepSeek menggunakan pendekatan Mixture-of-Experts (MoE). Alih-alih mengaktifkan semua parameter model untuk setiap permintaan, arsitektur MoE mengarahkan setiap permintaan hanya kepada subset paling relevan dari keahlian model. Ini bermaksud kurang pengiraan setiap permintaan, yang bermaksud kos yang lebih rendah setiap permintaan.
Model V3 sebelumnya DeepSeek dilaporkan menelan kos sewa GPU sebanyak $5,576,000 untuk dilatih, berbanding dengan ratusan juta (dan kadang-kadang miliaran) yang telah dibelanjakan oleh makmal berbasis AS dalam sesi latihan.
Model ini juga sepenuhnya sumber terbuka di bawah lesen MIT, yang bermakna sesiapa sahaja boleh menghuraikannya, memodifikasinya, atau membina di atasnya tanpa membayar yuran lesen.
Mengapa kripto dan pasaran yang lebih luas perlu peduli
Impak pasaran yang paling segera dirasakan pada Januari 2025, apabila saham Nvidia mengalami penurunan ketara kerana pelabur menyesuaikan semula jangkaan mereka terhadap permintaan masa depan untuk peralatan pengiraan kelas tinggi.
Khusus untuk sektor kripto, projek AI terdesentralisasi secara historis terbatas oleh ekonomi kos inferens. Apabila menjalankan model berkos $7.50 setiap sejuta token, rangkaian komputasi terdesentralisasi kesulitan bersaing dengan penyedia awan terpusat. Pada $0.14 setiap sejuta token, perhitungannya berubah secara dramatik.
Rangkaian DePIN yang berfokus pada pengiraan GPU, seperti Render, Akash, dan io.net, mungkin melihat nilai mereka berubah. AI yang lebih murah akan mengurangkan premium yang dibayar pengguna untuk pengiraan, sambil memperluas pasaran yang boleh dituju dengan menjadikan aplikasi berkuasa AI boleh dilaksanakan untuk pelbagai kes penggunaan yang lebih luas.

