Seluruh rangkaian menunggu hampir tiga bulan!
DeepSeek Versi rasmi V4, mungkin dikeluarkan paling awal esok, paling lewat dalam beberapa hari ini.

Sekarang, sebahagian orang telah menerima lebih awal DeepSeek Akses ujian abu-abu V4 (GA).
Terdapat dua versi: DeepSeek V4 Flash, DeepSeek V4 Pro.

DeepSeek V4 "Versi Penuh"
Akhirnya tiba
Yang paling diperhatikan oleh semua orang ialah, bagaimana cara mengetahui sama ada anda telah dimasukkan ke dalam senarai kelabu?
Pengulas AiBattle memberikan "petua pengesahan rakyat": perhatikan orang pertama dalam rantai pemikiran (CoT).
Jika proses pemikiran model bermula dengan "I'm" atau "I'll", bukan versi lama "Let me".
Maka, selamat! Anda kemungkinan besar telah menggunakan versi GA V4!
Semasa Fable 5 dan GPT-5.6 Sol terus berperang, harapan seluruh rangkaian terhadap terobosan AI sumber terbuka telah mencapai tahap tertinggi.

Seorang pembangun, Pankaj Kumar, setelah mencuba, memberikan kesimpulan yang jujur mengenai prestasi V4:
Pencapaian keseluruhan hampir setara dengan Opus 4.8, pengkodan segera mengejar GPT-5.6 Sol;
Kemampuan agen ditingkatkan secara besar-besaran, penghasilan 3D dan SVG menjadi jauh lebih baik;
Untuk tugas yang sama, bilangan lelaran yang diperlukan oleh V4 lebih banyak daripada Fable 5.
Dia menyatakan, berdasarkan posisi ekosistem semasa, V4 kemungkinan besar tidak mampu mengalahkan yang baru dilancarkan Kimi K3, tetapi harga akan jauh lebih rendah.
Jika prestasi ini benar-benar sepadan dengan harga ini, mungkin ini akan menjadi satu lagi DeepSeek Waktu.
Ujian pertama telah selesai
Sekarang, DeepSeek Demo ujian pertama V4 (GA) telah bocor.
Boleh dikatakan, respons luaran berbeza-beza:
Sebahagian orang percaya ia sudah mampu menyamai Claude 5, tetapi beberapa pembangun juga menunjukkan bahawa versi Pro tidak jauh lebih unggul daripada versi Flash.
Berikut adalah permainan simulasi tembakan 3D yang dihasilkan oleh V4 Pro, dengan mekanik utama mengendalikan ballista untuk latihan menembak sasaran, dan fungsi UI dasar juga telah lengkap.

Versi rasmi V4 mencipta permainan gabungan Minecraft + No Man's Sky dalam HTML, dengan tahap keterlibatan yang agak tinggi.
 
Permainan klasik "Cut the Rope" ini juga dijalankan sekali oleh V4.

Berikut juga beberapa demo yang dihasilkan oleh V4, ujian SVG untuk pengendali Xbox, dan penghasilan permainan.



Pengenalan pertama kepada "penagihan puncak-lembah"
Masih sedap benar
Rebuild 「 DeepSeek Waktu」, faktor utama yang berubah ialah harga.
Semua bocoran menunjuk kepada satu pernyataan yang sama: prestasi mungkin bukan yang utama, tetapi harganya akan jauh lebih rendah.
Pada akhir bulan lalu, DeepSeek Menghantar e-mel kepada semua pengguna API bahawa versi rasmi V4 akan dilancarkan pada pertengahan Julai.
Selepas pelancaran GA, sesuaikan harga API secara serentak dan perkenalkan "penagihan puncak-lembah".
deepseek-v4-pro: Output token sejuta biasanya $0.87, puncak $1.74; input tanpa cache biasanya $0.435.
deepseek-v4-flash lebih ganas: jutaan output pada $0.28, puncak $0.56, input dengan cache hit pada $0.0028.
Dengan kata lain, "pembantai harga" yang tidak pernah menaikkan harga, untuk pertama kalinya memasang pengukur harga pada daya pengiraannya.
Kesan kepada pengguna peribadi adalah kecil, tetapi bagi pasukan yang menjalankan Agent tanpa henti semasa jam kerja, ini adalah perhitungan semula yang nyata.

Untungnya, harga yang di-cache masih sangat rendah; dengan memindahkan tugas berbatch, ujian penilaian, dan penghasilan data ke luar jam puncak, kos masih boleh dikurangkan.
Namun, berbanding dengan Fable yang menetapkan harga $50 untuk 5 juta output, V4 masih tetap yang paling bernilai.
Setelah semua, prestasi juga mencapai tahap Opus. Semasa pelancaran versi pra-tinjauan V4, ujian dalaman rasmi dalam SWE-bench Verified—
DeepSeek -V4-Pro-Max hanya 0.2 peratus lebih rendah daripada Claude Opus 4.6 Max, tetapi harganya hanya satu per tujuh.
Namun, dalam penilaian pencarian konteks panjang, rekabentuk perisian profesional, dan sebahagian penilaian penarikan pengetahuan, Opus masih mempertahankan kepimpinannya.

Sebagai tambahan, dua model lama, deepseek-chat dan deepseek-reasoner, akan ditarik pada 24 Julai.
Bagaimanapun, kasut yang telah ditunggu selama tiga bulan di seluruh rangkaian akhirnya akan jatuh.
Berdasarkan maklumat yang telah bocor, V4 kemungkinan besar bukan model yang "semua aspek pertama".
Fable 5 dan GPT-5.6 Sol berada di hadapan, Kimi K3 di sisi, V4 ingin bergantung pada prestasi tulen sahaja untuk menggulingkan meja, sukar dilakukan.
tetapi DeepSeek Bukan kad ini yang selalu dimainkan.
Titik perhatian sebenarnya ialah laluan lama yang telah berulang kali diuji: menurunkan harga ke satu per tujuh sambil mempertahankan kemampuan kelas Opus.
Setelah semua, di hadapan raksasa-raksasa yang memiliki jutaan token dengan harga puluhan dolar, walaupun telah dipasang "pengukur tarif puncak-lembah", V4 tetap menjadi "pembantai harga" yang mengganas.
Rujukan:
https://x.com/pankajkumar_dev/status/2078536231026372846
Artikel ini berasal dari akaun WeChat "Sinzhiyuan", disunting oleh Peach
