อาลีบาบาเปิดตัวและเปิดซอร์สโมเดล Qwen 3.8 Flash ที่ใช้สถาปัตยกรรม MoE ขนาด 125B โดยเปิดใช้งานพารามิเตอร์ประมาณ 6B ต่อโทเค็น รองรับบริบทโทเค็น 262144 โดยตรง และสามารถขยายผ่าน YaRN ได้ถึง 1 ล้านโทเค็น จุดเด่นของโมเดลนี้คือสามารถรันได้บนการ์ดจอระดับผู้บริโภค 4090 ทำให้โมเดลข้อความยาวระดับศูนย์ข้อมูลสามารถย้ายมาใช้งานบนฮาร์ดแวร์ระดับผู้บริโภคได้ ยิ่งไปกว่านั้น ราคาของมันมีความน่าสนใจมาก: ราคาการป้อนข้อมูล 0.8 หยวนต่อล้านโทเค็น และราคาการส่งออก 2.7 หยวนต่อล้านโทเค็น ซึ่งถูกกว่า DeepSeek-V4-Flash เพียงหนึ่งในสาม การทดสอบจริงแสดงให้เห็นว่าโมเดลสามารถสร้างข้อความสำหรับแพลตฟอร์มสี่แห่งภายในสองนาที และดึงข้อมูลบันทึกการประชุม จัดระเบียบตาราง และสร้างอีเมลภายในสี่นาที Qwen 3.8 Flash มีให้บริการแล้วบนแพลตฟอร์ม Qwen Office และเปิดให้ใช้งานผ่าน API ในวันเดียวกัน Zhipu ก็เปิดซอร์ส GLM-5.3-Flash โดยผลการประเมินแสดงว่าประสิทธิภาพเทียบเท่า Claude Opus 4.8 ในราคาเพียงหนึ่งในสี่สิบผู้เขียนบทความ แหล่งที่มา: Quantum Bit
โมเดลใหม่ของ Alibaba Qwen ได้ยกมาตรฐานขึ้นอีกครั้ง
พวกเขาเปิดตัวและเปิดซอร์สโค้ด Qwen 3.8 Flash-Next ซึ่งไม่เพียงแต่ราคาถูกกว่า DeepSeek-V4-Flash อย่างถล่มทลาย แต่ยังครองอันดับหนึ่งบน Huggingface ทันทีที่เปิดตัว!

ผู้ใช้บน Twitter ก็ตื่นเต้นเช่นกัน บางรายแม้แต่ช่างเทคนิคยังปล่อยวิดีโอทดสอบจริงออกมาและตะโกนว่าเจ๋งมาก:
Qwen 3.8 Flash ลดขีดจำกัดของ VRAM ลงอย่างมาก,โมเดลขนาดใหญ่สำหรับข้อความยาวระดับศูนย์ข้อมูล สามารถรันได้บนการ์ดจอ 4090 สำหรับผู้ใช้ทั่วไป!
ยังมีคนที่ตื่นเต้นนำมันไปใช้งานในที่ทำงานแล้ว
ใช้เวลาไม่ถึง 8 นาที มันก็ดำเนินการทั้งกระบวนการงานที่ครอบคลุมการเขียนโปรแกรม Python การวิเคราะห์หลายตาราง และการสร้างรายงานการวิจัย:

แม้แต่เอฟเฟกต์เพิงก็ไม่ใช่ปัญหา:

ว้าว จริงๆ แล้วเจ๋งขนาดนั้นเหรอ? เราต้องลองใช้งานบ้างแล้วล่ะ

เพียง 0.8 หยวนต่อการป้อนข้อมูลหนึ่งล้านโทเค็น
Qwen3.8-Flash ใช้สถาปัตยกรรม MoE ขนาด 125B โดยเปิดใช้งานพารามิเตอร์ประมาณ 6B ต่อ Token โดยสามารถรองรับบริบท 262144 Token โดยตรง และสามารถขยายเป็น 1M Token ผ่าน YaRN
同时,它也是Qwen4新架构的提前预演。
เมื่อเปรียบเทียบกับ Qwen 3.7 Plus, Qwen 3.8 Flash ไม่เพียงแต่ลดพารามิเตอร์ที่ใช้งานลงเหลือหนึ่งในสาม แต่ยังลดต้นทุนการฝึกอบรมเหลือเพียงหนึ่งในเก้าของ Qwen 3.7 Plus พร้อมทั้งเพิ่มความสามารถด้านทั่วไป การให้เหตุผลทางคณิตศาสตร์ และการเขียนโปรแกรมอย่างแข็งแกร่งยิ่งขึ้น
ที่รุนแรงกว่านั้นคือราคา คิวเวิร์น 3.8 แฟลช ราคาเพียง 0.8 หยวนต่อล้านโทเค็นสำหรับการป้อนข้อมูล และ 2.7 หยวนสำหรับการส่งออก , ค่าการเข้าถึงแคชเพียง 0.1 หยวน ราคาต่ำสุดถึงหนึ่งในสามของ DeepSeek-V4-Flash
หนักกว่าการตัดหนึ่งใบของ Pinduoduo มากเลย (bushi

โอเค โอเค 既然ราคาได้ลดลงมาถึงระดับนี้แล้ว เราก็ไม่ต้องเกรงใจอีกต่อไป ขอเพิ่มความเข้มข้นทันที โดยใช้การทดสอบจริงสองครั้งเพื่อตรวจสอบความสามารถจริงของ Qwen 3.8 Flash ในสถานการณ์การทำงาน
การทดสอบจริงครั้งที่ 1: ออกแบบข้อความสี่แบบสำหรับผลิตภัณฑ์กล้องที่เหมาะกับแพลตฟอร์มที่มีสไตล์ต่างกัน
เราได้ออกแบบการแข่งขันเขียนเนื้อหาแบบ “赛博文案挑战赛” โดยให้ Qwen 3.8 Flash เขียนเนื้อหาสำหรับ Xiaohongshu, Weibo, Douyin และ Moments จากข้อมูลผลิตภัณฑ์กล้องที่มีความยาวเกือบหมื่นคำ โดยมีงบเพียง 1 หยวน เพื่อดูว่ามันสามารถทำภารกิจได้กี่ข้อ
คำแนะนำดังต่อไปนี้:

หลังจากส่งคำแนะนำแล้ว ฉันก็ไปเติมน้ำที่ห้องน้ำของบริษัท ใช้เวลาไม่เกิน 2 นาที
กลับมาดู ร่างข้อความจากแพลตฟอร์มทั้งสี่แห่งเสร็จเรียบร้อยแล้ว และ @ แบรนด์ สไตล์ และแฮชแท็กต่างๆ ตรงเป๊ะ (ยกเว้นฉันจะไม่โพสต์ข้อความยาวแบบนั้นบนเพจส่วนตัวนะ hhh):




ใช้เวลาไม่ถึงสองนาทีในการเขียนเนื้อหาสี่ชิ้น ความเร็วของ “แรงงานไซเบอร์” ถือว่าผ่านแล้ว
แต่ในที่ทำงาน สิ่งที่ทำให้ปวดหัวจริงๆ มักไม่ใช่การเขียนเนื้อหา แต่เป็นการจัดการกับความยุ่งเหยิงที่เหลืออยู่หลังการประชุมเสร็จสิ้น
ดังนั้น เราจึงมอบงานที่สองให้มัน เพื่อทดสอบความสามารถในการทำงานจริง
การทดสอบจริงครั้งที่สอง: เปลี่ยนการประชุมผลิตภัณฑ์รายสัปดาห์ให้เป็นแผนการดำเนินการ
เราได้สร้างเอกสารบันทึกการประชุมต้นฉบับขนาดหมื่นคำ ซึ่งมีข้อผิดพลาดจากการพิมพ์คล้ายเสียงและมีการพูดคุยเรื่องทั่วไปปนอยู่ ตามหัวข้อ “การทบทวนความต้องการและเทคโนโลยีสำหรับตัวแทนบริการอัจฉริยะ V2.0” จากนั้นให้ Qwen3.8-Flash ดำเนินการดึงสรุป จัดตาราง และเขียนอีเมลแจ้งผลการประชุมทั้งสามงานในครั้งเดียว
△ รูปภาพสร้างโดย AI การได้ยินคำว่า “token” เป็น “偷啃” นั้นจริงๆ แล้วมีชีวิตชีวามาก
คำแนะนำดังต่อไปนี้:

ในโหมดเริ่มต้น Qwen3.8-Flash ได้ hoàn thiệnภารกิจทั้งหมดภายในเวลาไม่ถึง 4 นาที โดยสรุปข้อสรุปหลัก 5 ข้อ งานแบ่งตามตาราง และรูปแบบอีเมลถูกต้องตามมาตรฐาน ผู้รับอีเมลสอดคล้องกับเนื้อหาการประชุมทุกข้อ



△ รูปผลการทดสอบบางส่วน
แม้ไม่ได้ร้องขอ มันก็ยังช่วยจัดระเบียบสิ่งที่ยังไม่ได้สรุปในการประชุมให้เราอย่างใส่ใจ เพื่อให้เราสามารถดำเนินการต่อในการประชุมครั้งหน้า เช่น:

และถึงขั้นนี้ เงินโควตาของฉันยังไม่หมดเลย!
ฮ่าฮ่า รู้สึกดีมากที่ไม่มีข้อจำกัดแบบนี้
ตอนนี้ Qwen 3.8 Flash ได้เปิดตัวอย่างเป็นทางการบนแพลตฟอร์ม “Qianwen Office” และอินเทอร์เฟซ API ก็เปิดให้ใช้งานแล้ว ลองใช้งานกันได้เลย!

อีกสิ่งหนึ่ง
การแข่งขันด้านราคาของโมเดลขนาดใหญ่ของจีนรุนแรงขึ้นอีก
ในเวลาเดียวกับที่ Qwen 3.8 Flash เปิดแหล่งที่มา ซีซูยังเปิดแหล่งที่มาของโมเดลหลายโมดัลตัวแรกของซีรีส์ GLM-5 คือ GLM-5.3-Flash ซึ่งก็คือโมเดลขนาดใหญ่ “นิวไหล” Ox Alpha ที่เคยโด่งดังบนอินเทอร์เน็ต
ในการทดสอบ ประสิทธิภาพของโมเดลนี้เทียบเท่ากับ Claude Opus 4.8 แต่ราคาลดลงเหลือเพียง 1/10 ของ GLM-5.3

นอกจากนี้ GLM-5.3-Flash ยังเสนอโปรโมชั่นลดราคาครึ่งหนึ่งเป็นเวลาสองสัปดาห์ ซึ่งหมายความว่าในช่วงโปรโมชั่น ราคาของ GLM-5.3-Flash จะอยู่ที่เพียง 1/20 ของราคา GLM-5.3 และ 1/40 ของราคา Opus4.8

นอกจากนี้ Qwen 3.8 Flash และ GLM-5.3-Flash ยังมีจุดร่วมอีกอย่างหนึ่ง นั่นคือพวกเขาทั้งคู่ได้เข้ามาทำลาย DeepSeek-V4-Flash ด้วยราคาที่ต่ำมาก (DeepSeek บ่นกรุบกริบแล้วเดินจากไป):
△กราฟเปรียบเทียบราคาของ DeepSeek-V4-Flash, Qwen 3.8 Flash, GLM-5.3-Flash
ไม่มีอะไรจะพูด แข่งขันกันหนักมาก
