Qwen 3.8 Flash, maliyetleri DeepSeek-V4-Flash'ın üçte birine düşürüyor

iconMetaEra
Paylaş
AI summary iconÖzet
Alibaba'nın Qwen 3.8 Flash, artık Qwen Office platformunda mevcut; her token için 125B MoE ve 6B aktif parametre sunuyor. Doğrudan 262.144 token destekliyor ve 4090 GPU’da çalışıyor. Girdi token başına maliyeti 0,8 RMB/milyon token ve DeepSeek-V4-Flash’ın üçte biri kadar. Altcoin’leri takip eden trader’lar bu gelişmeyi önemli bulabilir. Model, karmaşık görevleri dört dakikadan kısa sürede gerçekleştiriyor ve API’ye hazır. Aynı gün, Zhipu, GLM-5.3-Flash’ı açık kaynak olarak yayınladı ve maliyeti Claude Opus 4.8’in kırkta biri. Piyasa duygunun, korku ve açgözlülük endeksi dahil olmak üzere, bu maliyet verimli modellerin piyasaya girmesiyle değişmesi mümkün.
Ali, Qwen 3.8 Flash modelini yayınladı ve açık kaynak yaptı; 125B MoE mimarisini kullanıyor, her token için yaklaşık 6B parametre aktif hale geliyor, native olarak 262144 token bağlamı destekliyor ve YaRN ile 1M token'a kadar genişletilebiliyor. Bu modelin yenilikçi özelliği, tüketici seviyesindeki 4090 GPU’da çalışabilmesidir ve veri merkezi düzeyindeki uzun metin modellerini tüketici donanımına taşımayı başarıyor. Daha da rekabetçi olan fiyatı: milyon token girdi başına 0,8 yuan, çıktı başına 2,7 yuan; bu fiyat, DeepSeek-V4-Flash’ın üçte biridir. Gerçek testlerde, model dört farklı platform için metinleri 2 dakikada, toplantı notlarını çıkarmayı, tabloları düzenlemeyi ve e-posta oluşturmaya 4 dakikada tamamlayabiliyor. Qwen 3.8 Flash, Qwen Ofis platformunda hizmete girdi ve API arayüzü aynı anda açıldı. Aynı gün Zhipu, GLM-5.3-Flash’i açık kaynak yaptı ve performansı Claude Opus 4.8 ile eşitlendi, fiyatı ise onun kırkta biri.

Makale yazarı, kaynak: Quantum Bit

AliQwen'in yeni modeli, yeniden yeni bir seviyeye çıktı.

Yayınladıkları ve açık kaynak hale getirdikleri Qwen 3.8 Flash-Next, DeepSeek-V4-Flash'ı fiyat olarak doğrudan geride bıraktı ve yayımlandığı anda Huggingface'de birinci oldu!

Resim

Twitter'daki kullanıcılar da heyecanla tepki verdi ve bazı mühendisler, test videolarını paylaşarak harika dedi:

Qwen 3.8 Flash, VRAM engelini ortadan kaldırdı,veri merkezi düzeyindeki uzun metinli büyük model, tüketici seviyesindeki 4090 ekran kartında da çalıştırılabiliyor!

Resim

Bazıları bunu zaten işlerinde kullanmaya başlamıştır.

8 dakikadan az bir sürede, Python programlama, çoklu tablo analizi ve rapor oluşturma içeren tam bir iş akışını tamamladı:

Resim

Büyük kule efekti de sorun değil:

Resim

Vay canına, gerçekten bu kadar harika mi? Elbette biz de denemeliyiz.

Resim

Her milyon token girişi yalnızca 0,8 yuan

Qwen3.8-Flash, 125B MoE mimarisi kullanır ve her token için yaklaşık 6B parametre aktif hale gelir; doğrudan 262144 token bağlamı destekler ve YaRN ile 1M token'e kadar genişletilebilir.

Aynı zamanda, Qwen4 yeni mimarisinin erken bir ön izlemesidir.

Qwen 3.7 Plus'a kıyasla Qwen 3.8 Flash, aktif parametreleri üçte birine indirirken, eğitim maliyetini sadece dokuzda birine düşürdü ve genel, matematiksel akıl yürütme, programlama gibi yeteneklerde daha güçlü hale geldi.

Daha da önemlisi fiyat: Qwen 3.8 Flash, her milyon token girdi için sadece 0,8 yuan, çıktı için 2,7 yuan, önbellek uyumu için 0,1 yuan; fiyat, DeepSeek-V4-Flash'ın %33'üne kadar düşüyor.

Pinduoduo'nun bir kez kesme gücüne göre gerçekten çok daha fazla (bushi)

Resim

Pekala, fiyat bu kadar düştüyse, artık çekinmeden, Qwen 3.8 Flash'ın ofis senaryolarındaki gerçek iş performansını iki testle ölçelim.

Gerçek test 1: Kamera ürünleri için farklı platform stillerine uygun dört metin tasarlayın

Qwen 3.8 Flash'e 1 yuan'lık bir bütçeyle binlerce kelimeye yakın bir kamera ürün bilgisi dosyasını Xiaohongshu, Weibo, Douyin ve WeChat Moments metinlerine dönüştürmesi için bir "Yazışma Yarışması" tasarladık ve tam olarak kaç görevi tamamlayabileceğini gördük.

İpucu şu:

Resim

İpucunu gönderdikten hemen sonra kantinde su doldurdum, tamamen 2 dakikadan az sürdü.

Geri döndüğümde, dört farklı platformun metinleri tamamen yazılmıştı ve @marka, tarz, konu etiketleri tam olarak doğru şekilde ayarlanmıştı (benim o kadar uzun bir朋友圈 gönderemeyeceğim dışında hhh):

Resim

Resim

Resim

Resim

Dört metni 2 dakikadan azda tamamlamak, "siber çalışan"ın hızı yeterli düzeyde.

Ancak iş yerinde gerçekten can sıkıcı olan, metin yazmak değil, toplantıdan sonra karışıklığı kimin toplayacağıdır.

Bu nedenle, ona ikinci bir görev verdik ve pratik ofis becerilerini test ettik.

Gerçek test 2: Bir ürün haftalık toplantısını uygulanabilir bir plana dönüştürmek

“Akıllı Müşteri Hizmetleri Agent V2.0 Gereksinim ve Teknik İnceleme Toplantısı” temasıyla, haftalık toplantıdan hemen sonra alınabilecek, homonim yazım hatalarıyla dolu ve sıradan sohbetlerle karışık on binlerce kelimelik orijinal toplantı transkriptini tamamen koruyarak hazırladık ve Qwen3.8-Flash, özet çıkarma, tablo düzenleme ve toplantı sonrası e-posta gönderme üç görevini tek seferde tamamladı.

Resim△ Görsel AI tarafından oluşturulmuştur, "token"ı "偷啃" olarak duymak gerçekten çok hayat dolu.

İpucu şu:

Resim

Varsayılan modda, 4 dakikadan kısa bir sürede Qwen3.8-Flash tüm görevleri başarıyla tamamladı ve beş temel sonuç özeti, tablo görev dağılımı tamamen doğru, e-posta formatı standartlara uygun ve alıcılar toplantı içeriğiyle tamamen eşleşti.

Resim

Resim

Resim

Resim△ Kısmi test sonuçları grafiği

İstenmesine rağmen, toplantıda henüz sonuçlanmayan konuları bize özetleyerek, bir sonraki toplantıda tartışmaya devam etmemizi kolaylaştırıyor, be like:

Resim

Ama bu aşamaya kadar hala kotasımda para kaldı!

Ahaha, bu sınırsız hissi çok güzel.

Qwen 3.8 Flash, şimdi "Qianwen Ofis" platformunda ilk kez başlatıldı ve API arayüzü de aynı anda açıldı, deneyebilirsiniz!

Resim

Bir Şey Daha

Yerli büyük modellerin fiyat savaşı daha da şiddetleniyor.

Qwen 3.8 Flash'in açık kaynak haline gelmesinin neredeyse aynı zamanında, ZhiPu, GLM-5 serisinin ilk yerel çok modelli modeli olan GLM-5.3-Flash'ı, daha önce internette büyük popülerlik kazanan "Niu Lai" büyük modeli Ox Alpha'yı da açık kaynak hale getirdi.

Değerlendirmede, bu modelin performansı Claude Opus 4.8 ile eşitlenirken, fiyatı GLM-5.3'ün onda birine düşürüldü.

Resim

Ayrıca GLM-5.3-Flash, iki haftalık yarı fiyatlı kampanyayı da hayata geçirdi; bu da kampanya süresince GLM-5.3-Flash fiyatının GLM-5.3'ün yirmide biri, Opus4.8'in kırkta biri olduğu anlamına gelir.

Resim

Ayrıca, Qwen 3.8 Flash ve GLM-5.3-Flash'in ortak bir noktası da, bu sefer ikisi de DeepSeek-V4-Flash'i çok düşük fiyata şaşırtmış olmaları (DeepSeek, mırıldanarak uzaklaştı):

Resim△DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash fiyat karşılaştırma grafiği

Söz yok, çok rekabetçi.

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.