DeepSeek V4 Flash Melampaui Penggunaan OpenRouter, Memicu Perubahan Harga AI Global

iconMetaEra
Kongsi
AI summary iconRingkasan
DeepSeek V4 Flash telah melampaui OpenRouter dalam volum panggilan model, mendorong pembangun global ke arah model AI Cina. Penggunaan OpenCode meningkat 30% sehari, sementara permulaan AS mengurangkan kos inferens sebanyak 60% hingga 85%. Model tempatan kini mengungguli model tertutup AS dari segi trafik, dengan 45% daripada pembangun Amerika dan Eropah. Altcoin yang perlu diperhatikan mungkin mengalami perubahan apabila dinamik kos AI berubah. Bacaan indeks takut dan serakah menunjukkan optimisme yang semakin meningkat dalam sektor ini.
Setelah DeepSeek V4 Flash dilancarkan, ia menduduki puncak penggunaan di platform OpenRouter, dengan pengembang global beralih secara besar-besaran ke model AI China. Platform seperti OpenCode melihat peningkatan penggunaan harian sebanyak 30%, sementara kos inferens bulanan perusahaan rintisan AI luar negara turun 60% hingga 85% selepas beralih. Jumlah panggilan keseluruhan model tempatan terus melebihi jumlah keseluruhan model tertutup pengeluar AS selama berminggu-minggu, dengan pengembang AS dan Eropah mewakili hampir separuh daripada jumlah tersebut. Pergeseran global dalam model besar yang dipicu oleh nilai berbanding harga ini sedang menghancurkan struktur penetapan harga yang telah lama dikuasai oleh Silicon Valley.

Penulis artikel, sumber: Phoenix Tech Net

Ringkasan: Selama ini, pengeluar硅谷 menguasai kuasa penetapan harga model besar global. DeepSeek, dengan keunggulan prestasi dan harga, menciptakan kesan penekanan di pasaran pembangun luar negara.

Beberapa hari ini, satu gambar komik AI sangat popular di media sosial; walaupun tokoh tersebut adalah Liang Wenheng, ia telah diproses secara komik, dengan penampilan fizikal yang sangat menyerupai tokoh komik seperti Superman, dan dinilai oleh pengguna internet sebagai gambaran Liang Wenheng menurut pembangun luar negara.

Komik ini ingin menyampaikan bahawa pada akhir pekan lepas (31 Julai), versi rasmi DeepSeek V4 Flash dilancarkan dan berjaya mengubah landskap penggunaan AI di seluruh dunia dengan harga yang sangat berpatutan.

Komuniti penilaian model besar luar negara yang berdiri sendiri, Artificial analysis, setelah menguji ratusan model besar, secara beransur-ansur menghasilkan satu grafik, di mana DeepSeek-V4-Flash menjadi garis pemisah dalam grafik tersebut.

Data statistik mingguan terkini dari OpenRouter menunjukkan bahawa DeepSeek-V4-Flash menduduki tempat pertama dalam jumlah panggilan model, sementara V4-Pro terus berada dalam lima besar, dengan pembangun global secara berterusan memindahkan laluan inferens persekitaran pengeluaran dalam jumlah besar ke antaramuka model syarikat AI China ini.

CEO OpenCode, Jay (Jaya Kumar), juga menulis pada 1 Ogos bahawa penggunaan DeepSeek V4 Flash meningkat sebanyak 30% dalam sehari, dan pelanggan baru berlanggan OpenCode Go juga meningkat sebanyak 30%.

Selama masa yang panjang, peraturan pasaran model besar global ditulis oleh raksasa Silicon Valley. OpenAI, Anthropic, dan Google menetapkan ukuran prestasi, sambil mengawal kuat kuasa penetapan harga; kos inferens yang terus tinggi membina penghalang tinggi untuk usahawan AI. Pembangun luar negara yang ingin perkhidmatan model besar yang stabil dan berkualiti kelihatan hanya mampu menerima tawaran daripada syarikat tertutup.

Kini, struktur industri mengalami titik balik yang tak boleh dipulihkan. Dengan memanfaatkan kemampuan model yang terus diperbaharui dan harga API awan yang dikompresi secara ekstrem, DeepSeek telah menetapkan garis “pembunuhan (Kill Line)” yang jelas di pasaran pengembang global.

DeepSeek V4 Flash kembali menduduki puncak, model besar China menguasai lima besar

Apa yang disebut garis pemotongan bukan sekadar titik pemisah prestasi, tetapi titik keseimbangan antara prestasi dan harga: model yang harganya jauh lebih tinggi daripada DeepSeek dalam kelas kemampuan yang sama akan terus kehilangan pengembang kecil dan menengah; produk yang prestasinya lebih lemah daripada DeepSeek tetapi berbiaya lebih tinggi akan mengalami penyusutan ruang hidup dengan cepat.

Data panggilan Token terbuka OpenRouter untuk kitaran terkini menunjukkan bahawa DeepSeek-V4-Flash mendapat tempat pertama dalam jumlah panggilan model tunggal, diikuti oleh Xiaomi MiMo-V2.5, Tencent Hy3, DeepSeek V4 Pro, dan Zhipu GLM5.2 secara berturut-turut dari tempat kedua hingga kelima. Apabila dijumlahkan, jumlah panggilan keseluruhan model tempatan bahkan terus melebihi jumlah keseluruhan model tertutup pengeluar Amerika selama beberapa minggu berturut-turut. Di antara trafik akses, pembangun dari Amerika dan Eropah mewakili hampir separuh, dengan banyak projek automatik Agent, alat bantuan kod, dan aplikasi pemprosesan teks panjang secara aktif menukar model lalai kepada DeepSeek.

Sebaliknya, penggunaan versi utama Claude dan model unggulan Gemini terus melambat, dengan pangsa pasaran model tertutup terkemuka luar negara terus menyusut. Beberapa pendiri permulaan AI luar negara secara terbuka mereview di platform X: selepas pindah sepenuhnya ke DeepSeek, kos inferens bulanan mereka turun sebanyak 60% hingga 85%. Bagi syarikat AI kecil yang belum untung dan mengalami tekanan arus tunai, perbezaan kos yang besar ini cukup untuk menentukan sama ada projek mereka boleh bertahan atau tidak.

Pasar secara beransur-ansur terbahagi kepada dua kumpulan: syarikat antarabangsa besar masih cenderung membeli perkhidmatan daripada pembangun tempatan seperti OpenAI dan Google kerana pertimbangan kesesuaian data dan risiko rantaian bekalan; tetapi golongan pembangun kecil dan sederhana yang lebih fleksibel dan sangat peka terhadap kos telah memulakan perpindahan besar-besaran.

Banyak pemerhati industri percaya bahawa data OpenRouter telah membongkar satu lapisan tirai industri: sebelum ini, banyak pasukan memilih model daripada syarikat besar Silicon Valley bukan kerana mereka menganggap prestasinya tidak boleh digantikan, tetapi kerana kekurangan pilihan alternatif yang cukup berkesan dari segi kos. Apabila model berharga rendah dengan kemampuan golongan teratas muncul, pilihan di sisi permintaan segera berubah.

Tentu, data dari platform pengumpul pihak ketiga mempunyai batasan semula. Ketinggian trafik tidak sama dengan skala pendapatan perusahaan, kerana sejumlah besar panggilan berpusat pada versi Flash ringan yang murah; selain itu, sampel platform tidak mewakili pasaran pelanggan korporat dan kerajaan. Namun, tidak dapat dinafikan bahawa komuniti pembangun adalah sumber inovasi industri AI; dengan menangkap pembangun, anda menangkap asas pertumbuhan ekosistem aplikasi masa depan.

Masih raja nilai berbanding harga

Pada hari yang sama DeepSeek melancarkan V4 Flash, Artificial analysis menguji 128 model besar. Istilah "garis pemotongan" berasal daripada sini; pembangun secara umum percaya bahawa harga rendah semata-mata tidak kompetitif, dan prestasi tinggi semata-mata sukar untuk menggoyahkan pasaran sedia ada; hanya apabila model mencapai prestasi setara dengan kelas atas, sambil membentuk keunggulan harga yang ketara, ia dapat terus memberi tekanan terhadap pesaing.

Mengulas semula evolusi strategi penetapan harga DeepSeek, jelas kelihatan bagaimana ia secara berperingkat membina halangan harga. Pada Mei 2026, DeepSeek-V4-Pro mengumumkan penurunan harga kekal sebanyak 75%, menukar promosi jangka pendek menjadi harga asas jangka panjang, menembusi garis bawah harga model inferensi premium global pada masa itu; selepas itu, V4-Flash secara rasmi dilancarkan, dengan penambahan mekanisme cache perbualan dan strategi penetapan harga berbeza berdasarkan puncak dan lembah, menyebabkan kos input Token dalam skenario cache berjaya turun lebih lanjut.

Perbandingan mendatar harga API awan terbuka untuk model besar utama semasa (berdasarkan jutaan token, dalam dolar AS), perbezaannya jelas: Harga output DeepSeek V4-Flash ialah 0.28 dolar / juta token; walaupun telah mengalami beberapa penyesuaian harga, harga output GPT-5.6 Luna kira-kira 1.2 dolar / juta token. Model unggulan setaraf seperti Claude Sonnet dan Gemini memiliki harga yang biasanya lebih tinggi beberapa kali ganda, bahkan hampir sepuluh kali ganda berbanding DeepSeek.

Data ini mendorong komuniti pembangun luar negara mencapai konsensus: sebahagian besar skenario perniagaan yang ditujukan kepada pengguna akhir dan usaha kecil-menengah, tidak mempunyai kebolehjayaan perniagaan jika menanggung kos inferens puluhan kali ganda demi peningkatan prestasi yang sedikit. Sebarang pesaing yang berada di atas “garis pemotongan” ini hanya mempunyai dua jalan keluar: menurunkan harga secara agresif, atau sepenuhnya meninggalkan pasaran pembangun inklusif dan fokus kepada pelanggan korporat高端 yang mempunyai bajet mencukupi dan mengutamakan kestabilan rantaian bekalan.

Menghadapi pembahagian trafik yang berterusan, OpenAI segera menurunkan harga model siri GPT; pengeluar Eropah Mistral menyesuaikan semula strategi komersialnya, mengandalkan strategi sumber terbuka percuma disertai tawaran awan untuk mempertahankan pangkalan pembangun; pelbagai penyedia model sumber terbuka berskala kecil dan sederhana terpaksa mengira semula kos mereka dan melepaskan khayalan untuk mendapat keuntungan melalui margin API yang tinggi.

Lebih penting lagi, DeepSeek telah lama dikenal dalam industri ini kerana harganya yang rendah. Ia tidak menggunakan strategi subsidi perang harga, tetapi menurunkan kos inferensian setiap Token melalui pengoptimuman kejuruteraan berterusan di peringkat asas, seperti arsitektur inferensian yang cekap, cache KV dinamik, pengagihan lalu lintas puncak dan lembah, serta penyelesaian pengoptimuman teks panjang. Liang Wenheng menyatakan di dalam syarikat bahawa strategi harga rendah membolehkan lebih ramai pembangun menggunakan DeepSeek, yang mendapat sambutan hangat di dalam syarikat.

Garis pemotongan nilai terbaik membawa kepada persoalan industri baharu: ukuran utama persaingan model besar sedang berpindah. Dahulu, industri bersaing berdasarkan jumlah parameter, kuasa pengiraan latihan, dan skor Benchmark; kini, indikator pertama yang dihitung oleh pembangun ialah “berapa banyak output berkesan yang boleh diperoleh per unit kos”.

48 jam yang menggemparkan media sosial

Data mengenai prestasi dan harga akhirnya berubah menjadi reputasi komuniti sebenar. Platform X, bahagian r/LocalLLaMA di Reddit, HackerNews, dan Arena LMSYS membentuk medan utama opini luar negara, di mana banyak pembangun dan usahawan AI terkemuka di platform X terus memuatkan kandungan ujian sebenar, mendorong populariti DeepSeek terus meningkat, dengan opini yang menunjukkan pengelasan yang jelas.

Yang menariknya, sehari sebelum versi rasmi DeepSeek V4 Flash dilancarkan, OpenAI baru sahaja mengumumkan penurunan harga API GPT5.6 Luna sebanyak 80%. Pada hari berikutnya, seseorang memuatkan gambar DeepSeek di ruang komen, dan ada juga yang mengucapkan terima kasih kepada model besar China, kerana model besar China telah menyebabkan OpenAI berasa cemas, yang memberi kesan positif kepada pembangun.

Banyak pembangun peribadi juga menyatakan kegemaran terhadap DeepSeek, bukan sahaja kerana nilai baik, tetapi juga kerana kelajuan respons yang pantas dan pengalaman penggunaan yang “licin”.

Pandangan analis Wall Street agak berbeza. Pihak optimis percaya bahawa persaingan harga yang dibangkitkan oleh DeepSeek mempercepatkan pelaksanaan aplikasi AI dan menurunkan rintangan inovasi global; manakala pihak pesimis risau bahawa perang harga yang berterusan akan mengurangkan keuntungan seluruh industri dan melemahkan dana perusahaan untuk pelaburan jangka panjang dalam pembangunan model.

Garis pemotongan nilai terbaik yang ditarik oleh DeepSeek pada dasarnya mewakili perlanggaran terus-menerus antara dua jalan perkembangan model besar global.

Satu jalan diwakili oleh raksasa Silicon Valley: melabur banyak dana untuk melatih model unggulan tertutup, mempertahankan margin keuntungan yang tinggi, fokus pada pelanggan korporat besar, memperoleh pendapatan melalui pesanan B2B bernilai tinggi, dan mengutamakan pendorongan batas kemampuan, dengan respons yang relatif perlahan terhadap perubahan harga di pasaran pengembang yang inklusif. Jalan lain diwakili oleh DeepSeek: mengandalkan pengoptimuman kejuruteraan untuk mengurangkan kos inferens, menyeimbangkan ekosistem sumber terbuka dengan perkhidmatan awan, mengikuti strategi keuntungan rendah tetapi volum tinggi, mengutamakan penguasaan pasaran pengembang, mengurangkan kos melalui kesan skala, dan memperluaskan pangsa pasaran global dengan cepat melalui nilai berbanding harga.

Dua lintasan ini tidak ada yang benar atau salah mutlak, tetapi kebangkitan DeepSeek membuktikan satu fakta penting: persaingan model besar tidak lagi semata-mata membandingkan skala pengeluaran. Pengeluaran kekuatan komputasi hanyalah dasar, efisiensi inferensi, penetapan harga komersial, dan strategi ekosistem juga mampu menulis semula pangsa pasaran.

Pergeseran global dalam model besar yang dimulai dengan nilai terbaik belum berakhir. Persaingan harga hanyalah pembuka; yang akan menentukan siapa yang dapat bertahan ialah persaingan jangka panjang dalam pengembangan kemampuan model, layanan global, penyelesaian kepatuhan, dan model pendapatan komersial. Pada hari Senin minggu ini (3 Ogos), MiniMax secara rasmi membuka sumber model video generik H3, dengan niat meniru kesan DeepSeek dalam bidang multimodal; pada hari yang sama, model besar Qwen3.8-Max dari Alibaba Qwen juga secara rasmi dilancarkan, dengan jumlah parameter keseluruhan 2.4 trilion, menjadikannya model paling kuat dalam keluarga Qwen hingga kini. Bobot model akan dibuka sumbernya minggu depan.

Bagi jutaan pembangun AI di seluruh dunia, perubahan paling ketara telah berlaku: pilihan yang lebih banyak, kos yang lebih rendah, dan rintangan inovasi terus diturunkan.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.