Ali, Qwen 3.8 Flash modelini yayınladı ve açık kaynak yaptı; 125B MoE mimarisini kullanıyor, her token için yaklaşık 6B parametre aktif hale geliyor, native olarak 262144 token bağlamı destekliyor ve YaRN ile 1M token'a kadar genişletilebiliyor. Bu modelin yenilikçi özelliği, tüketici seviyesindeki 4090 GPU’da çalışabilmesidir ve veri merkezi düzeyindeki uzun metin modellerini tüketici donanımına taşımayı başarıyor. Daha da rekabetçi olan fiyatı: milyon token girdi başına 0,8 yuan, çıktı başına 2,7 yuan; bu fiyat, DeepSeek-V4-Flash’ın üçte biridir. Gerçek testlerde, model dört farklı platform için metinleri 2 dakikada, toplantı notlarını çıkarmayı, tabloları düzenlemeyi ve e-posta oluşturmaya 4 dakikada tamamlayabiliyor. Qwen 3.8 Flash, Qwen Ofis platformunda hizmete girdi ve API arayüzü aynı anda açıldı. Aynı gün Zhipu, GLM-5.3-Flash’i açık kaynak yaptı ve performansı Claude Opus 4.8 ile eşitlendi, fiyatı ise onun kırkta biri.Makale yazarı, kaynak: Quantum Bit
AliQwen'in yeni modeli, yeniden yeni bir seviyeye çıktı.
Yayınladıkları ve açık kaynak hale getirdikleri Qwen 3.8 Flash-Next, DeepSeek-V4-Flash'ı fiyat olarak doğrudan geride bıraktı ve yayımlandığı anda Huggingface'de birinci oldu!

Twitter'daki kullanıcılar da heyecanla tepki verdi ve bazı mühendisler, test videolarını paylaşarak harika dedi:
Qwen 3.8 Flash, VRAM engelini ortadan kaldırdı,veri merkezi düzeyindeki uzun metinli büyük model, tüketici seviyesindeki 4090 ekran kartında da çalıştırılabiliyor!
Bazıları bunu zaten işlerinde kullanmaya başlamıştır.
8 dakikadan az bir sürede, Python programlama, çoklu tablo analizi ve rapor oluşturma içeren tam bir iş akışını tamamladı:

Büyük kule efekti de sorun değil:

Vay canına, gerçekten bu kadar harika mi? Elbette biz de denemeliyiz.

Her milyon token girişi yalnızca 0,8 yuan
Qwen3.8-Flash, 125B MoE mimarisi kullanır ve her token için yaklaşık 6B parametre aktif hale gelir; doğrudan 262144 token bağlamı destekler ve YaRN ile 1M token'e kadar genişletilebilir.
Aynı zamanda, Qwen4 yeni mimarisinin erken bir ön izlemesidir.
Qwen 3.7 Plus'a kıyasla Qwen 3.8 Flash, aktif parametreleri üçte birine indirirken, eğitim maliyetini sadece dokuzda birine düşürdü ve genel, matematiksel akıl yürütme, programlama gibi yeteneklerde daha güçlü hale geldi.
Daha da önemlisi fiyat: Qwen 3.8 Flash, her milyon token girdi için sadece 0,8 yuan, çıktı için 2,7 yuan, önbellek uyumu için 0,1 yuan; fiyat, DeepSeek-V4-Flash'ın %33'üne kadar düşüyor.
Pinduoduo'nun bir kez kesme gücüne göre gerçekten çok daha fazla (bushi)

Pekala, fiyat bu kadar düştüyse, artık çekinmeden, Qwen 3.8 Flash'ın ofis senaryolarındaki gerçek iş performansını iki testle ölçelim.
Gerçek test 1: Kamera ürünleri için farklı platform stillerine uygun dört metin tasarlayın
Qwen 3.8 Flash'e 1 yuan'lık bir bütçeyle binlerce kelimeye yakın bir kamera ürün bilgisi dosyasını Xiaohongshu, Weibo, Douyin ve WeChat Moments metinlerine dönüştürmesi için bir "Yazışma Yarışması" tasarladık ve tam olarak kaç görevi tamamlayabileceğini gördük.
İpucu şu:

İpucunu gönderdikten hemen sonra kantinde su doldurdum, tamamen 2 dakikadan az sürdü.
Geri döndüğümde, dört farklı platformun metinleri tamamen yazılmıştı ve @marka, tarz, konu etiketleri tam olarak doğru şekilde ayarlanmıştı (benim o kadar uzun bir朋友圈 gönderemeyeceğim dışında hhh):




Dört metni 2 dakikadan azda tamamlamak, "siber çalışan"ın hızı yeterli düzeyde.
Ancak iş yerinde gerçekten can sıkıcı olan, metin yazmak değil, toplantıdan sonra karışıklığı kimin toplayacağıdır.
Bu nedenle, ona ikinci bir görev verdik ve pratik ofis becerilerini test ettik.
Gerçek test 2: Bir ürün haftalık toplantısını uygulanabilir bir plana dönüştürmek
“Akıllı Müşteri Hizmetleri Agent V2.0 Gereksinim ve Teknik İnceleme Toplantısı” temasıyla, haftalık toplantıdan hemen sonra alınabilecek, homonim yazım hatalarıyla dolu ve sıradan sohbetlerle karışık on binlerce kelimelik orijinal toplantı transkriptini tamamen koruyarak hazırladık ve Qwen3.8-Flash, özet çıkarma, tablo düzenleme ve toplantı sonrası e-posta gönderme üç görevini tek seferde tamamladı.
△ Görsel AI tarafından oluşturulmuştur, "token"ı "偷啃" olarak duymak gerçekten çok hayat dolu.
İpucu şu:

Varsayılan modda, 4 dakikadan kısa bir sürede Qwen3.8-Flash tüm görevleri başarıyla tamamladı ve beş temel sonuç özeti, tablo görev dağılımı tamamen doğru, e-posta formatı standartlara uygun ve alıcılar toplantı içeriğiyle tamamen eşleşti.



△ Kısmi test sonuçları grafiği
İstenmesine rağmen, toplantıda henüz sonuçlanmayan konuları bize özetleyerek, bir sonraki toplantıda tartışmaya devam etmemizi kolaylaştırıyor, be like:

Ama bu aşamaya kadar hala kotasımda para kaldı!
Ahaha, bu sınırsız hissi çok güzel.
Qwen 3.8 Flash, şimdi "Qianwen Ofis" platformunda ilk kez başlatıldı ve API arayüzü de aynı anda açıldı, deneyebilirsiniz!

Bir Şey Daha
Yerli büyük modellerin fiyat savaşı daha da şiddetleniyor.
Qwen 3.8 Flash'in açık kaynak haline gelmesinin neredeyse aynı zamanında, ZhiPu, GLM-5 serisinin ilk yerel çok modelli modeli olan GLM-5.3-Flash'ı, daha önce internette büyük popülerlik kazanan "Niu Lai" büyük modeli Ox Alpha'yı da açık kaynak hale getirdi.
Değerlendirmede, bu modelin performansı Claude Opus 4.8 ile eşitlenirken, fiyatı GLM-5.3'ün onda birine düşürüldü.

Ayrıca GLM-5.3-Flash, iki haftalık yarı fiyatlı kampanyayı da hayata geçirdi; bu da kampanya süresince GLM-5.3-Flash fiyatının GLM-5.3'ün yirmide biri, Opus4.8'in kırkta biri olduğu anlamına gelir.

Ayrıca, Qwen 3.8 Flash ve GLM-5.3-Flash'in ortak bir noktası da, bu sefer ikisi de DeepSeek-V4-Flash'i çok düşük fiyata şaşırtmış olmaları (DeepSeek, mırıldanarak uzaklaştı):
△DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash fiyat karşılaştırma grafiği
Söz yok, çok rekabetçi.
