Qwen 3.8 Flash ลดต้นทุนเหลือหนึ่งในสามของ DeepSeek-V4-Flash

iconMetaEra
แชร์
AI summary iconสรุป
Qwen 3.8 Flash ของ Alibaba ซึ่งตอนนี้มีให้ใช้งานบนแพลตฟอร์ม Qwen Office นำเสนอโมเดล 125B MoE ด้วยพารามิเตอร์ที่ใช้งาน 6B ต่อโทเค็น รองรับโทเค็นแบบตรงไปตรงมาถึง 262,144 โทเค็น และทำงานได้บน GPU รุ่น 4090 ราคาอยู่ที่ 0.8 หยวนต่อล้านโทเค็นอินพุต ถูกกว่า DeepSeek-V4-Flash หนึ่งในสาม ผู้ค้าที่ติดตาม altcoin ที่ควรจับตาอาจพบว่านี่เป็นการพัฒนาที่สำคัญ โมเดลนี้จัดการงานที่ซับซ้อนได้ในเวลาไม่เกินสี่นาที และพร้อมใช้งานผ่าน API ในวันเดียวกันนั้น Zhipu เปิดรหัสแหล่งที่มาของ GLM-5.3-Flash โดยมีราคาเพียงหนึ่งในสี่สิบของ Claude Opus 4.8 ความรู้สึกของตลาด รวมถึงดัชนีความกลัวและความโลภ อาจเปลี่ยนแปลงเมื่อโมเดลที่มีประสิทธิภาพด้านต้นทุนเหล่านี้เข้าสู่พื้นที่นี้
อาลีบาบาเปิดตัวและเปิดซอร์สโมเดล Qwen 3.8 Flash ที่ใช้สถาปัตยกรรม MoE ขนาด 125B โดยเปิดใช้งานพารามิเตอร์ประมาณ 6B ต่อโทเค็น รองรับบริบทโทเค็น 262144 โดยตรง และสามารถขยายผ่าน YaRN ได้ถึง 1 ล้านโทเค็น จุดเด่นของโมเดลนี้คือสามารถรันได้บนการ์ดจอระดับผู้บริโภค 4090 ทำให้โมเดลข้อความยาวระดับศูนย์ข้อมูลสามารถย้ายมาใช้งานบนฮาร์ดแวร์ระดับผู้บริโภคได้ ยิ่งไปกว่านั้น ราคาของมันมีความน่าสนใจมาก: ราคาการป้อนข้อมูล 0.8 หยวนต่อล้านโทเค็น และราคาการส่งออก 2.7 หยวนต่อล้านโทเค็น ซึ่งถูกกว่า DeepSeek-V4-Flash เพียงหนึ่งในสาม การทดสอบจริงแสดงให้เห็นว่าโมเดลสามารถสร้างข้อความสำหรับแพลตฟอร์มสี่แห่งภายในสองนาที และดึงข้อมูลบันทึกการประชุม จัดระเบียบตาราง และสร้างอีเมลภายในสี่นาที Qwen 3.8 Flash มีให้บริการแล้วบนแพลตฟอร์ม Qwen Office และเปิดให้ใช้งานผ่าน API ในวันเดียวกัน Zhipu ก็เปิดซอร์ส GLM-5.3-Flash โดยผลการประเมินแสดงว่าประสิทธิภาพเทียบเท่า Claude Opus 4.8 ในราคาเพียงหนึ่งในสี่สิบ

ผู้เขียนบทความ แหล่งที่มา: Quantum Bit

โมเดลใหม่ของ Alibaba Qwen ได้ยกมาตรฐานขึ้นอีกครั้ง

พวกเขาเปิดตัวและเปิดซอร์สโค้ด Qwen 3.8 Flash-Next ซึ่งไม่เพียงแต่ราคาถูกกว่า DeepSeek-V4-Flash อย่างถล่มทลาย แต่ยังครองอันดับหนึ่งบน Huggingface ทันทีที่เปิดตัว!

รูปภาพ

ผู้ใช้บน Twitter ก็ตื่นเต้นเช่นกัน บางรายแม้แต่ช่างเทคนิคยังปล่อยวิดีโอทดสอบจริงออกมาและตะโกนว่าเจ๋งมาก:

Qwen 3.8 Flash ลดขีดจำกัดของ VRAM ลงอย่างมาก,โมเดลขนาดใหญ่สำหรับข้อความยาวระดับศูนย์ข้อมูล สามารถรันได้บนการ์ดจอ 4090 สำหรับผู้ใช้ทั่วไป!

รูปภาพ

ยังมีคนที่ตื่นเต้นนำมันไปใช้งานในที่ทำงานแล้ว

ใช้เวลาไม่ถึง 8 นาที มันก็ดำเนินการทั้งกระบวนการงานที่ครอบคลุมการเขียนโปรแกรม Python การวิเคราะห์หลายตาราง และการสร้างรายงานการวิจัย:

รูปภาพ

แม้แต่เอฟเฟกต์เพิงก็ไม่ใช่ปัญหา:

รูปภาพ

ว้าว จริงๆ แล้วเจ๋งขนาดนั้นเหรอ? เราต้องลองใช้งานบ้างแล้วล่ะ

รูปภาพ

เพียง 0.8 หยวนต่อการป้อนข้อมูลหนึ่งล้านโทเค็น

Qwen3.8-Flash ใช้สถาปัตยกรรม MoE ขนาด 125B โดยเปิดใช้งานพารามิเตอร์ประมาณ 6B ต่อ Token โดยสามารถรองรับบริบท 262144 Token โดยตรง และสามารถขยายเป็น 1M Token ผ่าน YaRN

同时,它也是Qwen4新架构的提前预演。

เมื่อเปรียบเทียบกับ Qwen 3.7 Plus, Qwen 3.8 Flash ไม่เพียงแต่ลดพารามิเตอร์ที่ใช้งานลงเหลือหนึ่งในสาม แต่ยังลดต้นทุนการฝึกอบรมเหลือเพียงหนึ่งในเก้าของ Qwen 3.7 Plus พร้อมทั้งเพิ่มความสามารถด้านทั่วไป การให้เหตุผลทางคณิตศาสตร์ และการเขียนโปรแกรมอย่างแข็งแกร่งยิ่งขึ้น

ที่รุนแรงกว่านั้นคือราคา คิวเวิร์น 3.8 แฟลช ราคาเพียง 0.8 หยวนต่อล้านโทเค็นสำหรับการป้อนข้อมูล และ 2.7 หยวนสำหรับการส่งออก , ค่าการเข้าถึงแคชเพียง 0.1 หยวน ราคาต่ำสุดถึงหนึ่งในสามของ DeepSeek-V4-Flash

หนักกว่าการตัดหนึ่งใบของ Pinduoduo มากเลย (bushi

รูปภาพ

โอเค โอเค 既然ราคาได้ลดลงมาถึงระดับนี้แล้ว เราก็ไม่ต้องเกรงใจอีกต่อไป ขอเพิ่มความเข้มข้นทันที โดยใช้การทดสอบจริงสองครั้งเพื่อตรวจสอบความสามารถจริงของ Qwen 3.8 Flash ในสถานการณ์การทำงาน

การทดสอบจริงครั้งที่ 1: ออกแบบข้อความสี่แบบสำหรับผลิตภัณฑ์กล้องที่เหมาะกับแพลตฟอร์มที่มีสไตล์ต่างกัน

เราได้ออกแบบการแข่งขันเขียนเนื้อหาแบบ “赛博文案挑战赛” โดยให้ Qwen 3.8 Flash เขียนเนื้อหาสำหรับ Xiaohongshu, Weibo, Douyin และ Moments จากข้อมูลผลิตภัณฑ์กล้องที่มีความยาวเกือบหมื่นคำ โดยมีงบเพียง 1 หยวน เพื่อดูว่ามันสามารถทำภารกิจได้กี่ข้อ

คำแนะนำดังต่อไปนี้:

รูปภาพ

หลังจากส่งคำแนะนำแล้ว ฉันก็ไปเติมน้ำที่ห้องน้ำของบริษัท ใช้เวลาไม่เกิน 2 นาที

กลับมาดู ร่างข้อความจากแพลตฟอร์มทั้งสี่แห่งเสร็จเรียบร้อยแล้ว และ @ แบรนด์ สไตล์ และแฮชแท็กต่างๆ ตรงเป๊ะ (ยกเว้นฉันจะไม่โพสต์ข้อความยาวแบบนั้นบนเพจส่วนตัวนะ hhh):

รูปภาพ

รูปภาพ

รูปภาพ

รูปภาพ

ใช้เวลาไม่ถึงสองนาทีในการเขียนเนื้อหาสี่ชิ้น ความเร็วของ “แรงงานไซเบอร์” ถือว่าผ่านแล้ว

แต่ในที่ทำงาน สิ่งที่ทำให้ปวดหัวจริงๆ มักไม่ใช่การเขียนเนื้อหา แต่เป็นการจัดการกับความยุ่งเหยิงที่เหลืออยู่หลังการประชุมเสร็จสิ้น

ดังนั้น เราจึงมอบงานที่สองให้มัน เพื่อทดสอบความสามารถในการทำงานจริง

การทดสอบจริงครั้งที่สอง: เปลี่ยนการประชุมผลิตภัณฑ์รายสัปดาห์ให้เป็นแผนการดำเนินการ

เราได้สร้างเอกสารบันทึกการประชุมต้นฉบับขนาดหมื่นคำ ซึ่งมีข้อผิดพลาดจากการพิมพ์คล้ายเสียงและมีการพูดคุยเรื่องทั่วไปปนอยู่ ตามหัวข้อ “การทบทวนความต้องการและเทคโนโลยีสำหรับตัวแทนบริการอัจฉริยะ V2.0” จากนั้นให้ Qwen3.8-Flash ดำเนินการดึงสรุป จัดตาราง และเขียนอีเมลแจ้งผลการประชุมทั้งสามงานในครั้งเดียว

รูปภาพ△ รูปภาพสร้างโดย AI การได้ยินคำว่า “token” เป็น “偷啃” นั้นจริงๆ แล้วมีชีวิตชีวามาก

คำแนะนำดังต่อไปนี้:

รูปภาพ

ในโหมดเริ่มต้น Qwen3.8-Flash ได้ hoàn thiệnภารกิจทั้งหมดภายในเวลาไม่ถึง 4 นาที โดยสรุปข้อสรุปหลัก 5 ข้อ งานแบ่งตามตาราง และรูปแบบอีเมลถูกต้องตามมาตรฐาน ผู้รับอีเมลสอดคล้องกับเนื้อหาการประชุมทุกข้อ

รูปภาพ

รูปภาพ

รูปภาพ

รูปภาพ△ รูปผลการทดสอบบางส่วน

แม้ไม่ได้ร้องขอ มันก็ยังช่วยจัดระเบียบสิ่งที่ยังไม่ได้สรุปในการประชุมให้เราอย่างใส่ใจ เพื่อให้เราสามารถดำเนินการต่อในการประชุมครั้งหน้า เช่น:

รูปภาพ

และถึงขั้นนี้ เงินโควตาของฉันยังไม่หมดเลย!

ฮ่าฮ่า รู้สึกดีมากที่ไม่มีข้อจำกัดแบบนี้

ตอนนี้ Qwen 3.8 Flash ได้เปิดตัวอย่างเป็นทางการบนแพลตฟอร์ม “Qianwen Office” และอินเทอร์เฟซ API ก็เปิดให้ใช้งานแล้ว ลองใช้งานกันได้เลย!

รูปภาพ

อีกสิ่งหนึ่ง

การแข่งขันด้านราคาของโมเดลขนาดใหญ่ของจีนรุนแรงขึ้นอีก

ในเวลาเดียวกับที่ Qwen 3.8 Flash เปิดแหล่งที่มา ซีซูยังเปิดแหล่งที่มาของโมเดลหลายโมดัลตัวแรกของซีรีส์ GLM-5 คือ GLM-5.3-Flash ซึ่งก็คือโมเดลขนาดใหญ่ “นิวไหล” Ox Alpha ที่เคยโด่งดังบนอินเทอร์เน็ต

ในการทดสอบ ประสิทธิภาพของโมเดลนี้เทียบเท่ากับ Claude Opus 4.8 แต่ราคาลดลงเหลือเพียง 1/10 ของ GLM-5.3

รูปภาพ

นอกจากนี้ GLM-5.3-Flash ยังเสนอโปรโมชั่นลดราคาครึ่งหนึ่งเป็นเวลาสองสัปดาห์ ซึ่งหมายความว่าในช่วงโปรโมชั่น ราคาของ GLM-5.3-Flash จะอยู่ที่เพียง 1/20 ของราคา GLM-5.3 และ 1/40 ของราคา Opus4.8

รูปภาพ

นอกจากนี้ Qwen 3.8 Flash และ GLM-5.3-Flash ยังมีจุดร่วมอีกอย่างหนึ่ง นั่นคือพวกเขาทั้งคู่ได้เข้ามาทำลาย DeepSeek-V4-Flash ด้วยราคาที่ต่ำมาก (DeepSeek บ่นกรุบกริบแล้วเดินจากไป):

รูปภาพ△กราฟเปรียบเทียบราคาของ DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash

ไม่มีอะไรจะพูด แข่งขันกันหนักมาก

คำปฏิเสธความรับผิดชอบ: ข้อมูลในหน้านี้อาจได้รับจากบุคคลที่สาม และไม่จำเป็นต้องสะท้อนถึงมุมมองหรือความคิดเห็นของ KuCoin เนื้อหานี้จัดทำขึ้นเพื่อวัตถุประสงค์ในการให้ข้อมูลทั่วไปเท่านั้น โดยไม่มีการรับรองหรือการรับประกัน และจะไม่ถูกตีความว่าเป็นคำแนะนำทางการเงินหรือการลงทุน KuCoin จะไม่รับผิดชอบต่อความผิดพลาดหรือการละเว้นในเนื้อหา หรือผลลัพธ์ใดๆ ที่เกิดจากการใช้ข้อมูลนี้ การลงทุนในสินทรัพย์ดิจิทัลอาจมีความเสี่ยง โปรดประเมินความเสี่ยงของผลิตภัณฑ์และความเสี่ยงที่คุณยอมรับได้อย่างรอบคอบตามสถานการณ์ทางการเงินของคุณเอง โปรดดูข้อมูลเพิ่มเติมได้ที่ข้อกำหนดการใช้งานและเอกสารเปิดเผยข้อมูลความเสี่ยงของเรา