Zhipu เปิดตัว GLM-5.3-Flash โมเดลแบบมัลติมอดัลแบบแท้จริงชิปจีนรุ่นแรก

iconCryptoBriefing
แชร์
AI summary iconสรุป
Zhipu AI เปิดตัว GLM-5.3-Flash เมื่อวันที่ 26 สิงหาคม ซึ่งเป็นโมเดลแบบมัลติโมดัลแบบดั้งเดิมโมเดลแรกในซีรีส์ GLM-5 ข่าว AI + คริปโตนี้ถือเป็นจุดเปลี่ยนสำคัญ เนื่องจากโมเดลนี้ทำงานได้เต็มรูปแบบบนอุปกรณ์เร่งความเร็ว AI ที่ผลิตในจีน โดยมีพารามิเตอร์ 320 พันล้านตัว รองรับการประมวลผล 1 ล้านโทเค็นและการป้อนข้อมูลภาพ/วิดีโอแบบดั้งเดิม โมเดลนี้ได้คะแนน 63.4 จากการทดสอบการเขียนโค้ด DeepSWE v1.1 และสามารถเข้าถึงได้ภายใต้ใบอนุญาต MIT บน Hugging Face และ ModelScope ข่าวบนบล็อกเชนนี้เน้นย้ำถึงการผสานรวมที่เพิ่มขึ้นระหว่างเทคโนโลยี AI และบล็อกเชน

Z.ai ของจีน บริษัทที่เคยรู้จักในชื่อ Zhipu AI ได้เปิดตัว GLM-5.3-Flash เมื่อวันที่ 26 สิงหาคม ทำให้เป็นโมเดลแบบมัลติโมดัลแบบแท้จริงโมเดลแรกในซีรีส์ GLM-5 การเปิดตัวนี้มีความโดดเด่นไม่เพียงเพราะตัวโมเดลเท่านั้น: มันทำงานได้เต็มรูปแบบบนอุปกรณ์เร่งความเร็ว AI ที่ผลิตภายในประเทศ ซึ่งเป็นการพิสูจน์อย่างชัดเจนว่าฮาร์ดแวร์ของจีนสามารถจัดการกับภาระงานขนาดใหญ่ได้อย่างมีประสิทธิภาพ

เวลาเป็นสิ่งสำคัญ การควบคุมการส่งออกจากสหรัฐฯ ได้จำกัดการเข้าถึงชิปที่ทันสมัยที่สุดของ NVIDIA สำหรับผู้ซื้อจีน ทำให้บริษัทเช่น Z.ai ต้องพัฒนาสิ่งที่พวกเขามีอยู่

สิ่งที่โมเดลทำจริง

GLM-5.3-Flash ใช้สถาปัตยกรรมแบบไฮบริดที่รวมการให้ความสำคัญแบบกระจายและเชิงเส้น ซึ่งเป็นทางเลือกการออกแบบที่ลดความต้องการด้านการคำนวณอย่างมาก โมเดลนี้มีพารามิเตอร์ทั้งหมด 320 พันล้านพารามิเตอร์ แต่เปิดใช้งานเพียง 18 พันล้านพารามิเตอร์ต่อโทเค็น หมายความว่ามันใช้ฐานความรู้ขนาดใหญ่โดยไม่ต้องจ่ายค่าการคำนวณเต็มรูปแบบในทุกการอนุมาน

โฆษณา

หน้าต่างบริบทมีขนาด 1 ล้านโทเค็น ทำให้อยู่ในกลุ่มที่ยาวที่สุดที่มีในโมเดลเปิดใดๆ การรองรับแบบเนทีฟสำหรับอินพุตภาพและวิดีโอทำให้มันเป็นแบบมัลติโมดัลอย่างแท้จริงตั้งแต่ระดับสถาปัตยกรรม ไม่ใช่เพียงการเพิ่มเติมเข้ามาภายหลัง

บนการทดสอบการเขียนโค้ด DeepSWE v1.1, GLM-5.3-Flash ได้คะแนน 63.4 เมื่อเทียบกับ 46.2 ของรุ่นก่อนหน้า GLM-5.2 โมเดลนี้ยังได้คะแนน 57 บนดัชนีปัญญาการวิเคราะห์ประดิษฐ์

ราคาแข่งขันสูง การเข้าถึง API มีค่าใช้จ่าย $0.15 ต่อล้านโทเค็นขาเข้า และ $0.50 ต่อล้านโทเค็นขาออก โดยโทเค็นขาเข้าที่แคชไว้สามารถใช้ได้ในราคา $0.03 Z.ai ระบุว่าค่าใช้จ่ายนี้อยู่ที่ประมาณหนึ่งในสิบของตัวเลือกอื่นๆ ที่แข่งขัน

ชิปจีนกำลังทำงานจริง

Z.ai ได้ปรับใช้ GLM-5.3-Flash บนคลัสเตอร์ของอุปกรณ์เร่งความเร็วปัญญาประดิษฐ์ที่ผลิตในประเทศ จากนั้นจึงพัฒนาชุดการให้บริการแบบกำหนดเองและใช้เทคนิคการลดความละเอียดที่ออกแบบมาเฉพาะสำหรับฮาร์ดแวร์นั้น ผลลัพธ์คือการปรับปรุงประสิทธิภาพแบบ end-to-end สามเท่าเมื่อเทียบกับวิธีการปรับใช้แบบทั่วไป

โมเดลนี้มาพร้อมกับน้ำหนักเปิดภายใต้ใบอนุญาต MIT ซึ่งมีให้ในรูปแบบ FP8 และ BF16 บน Hugging Face และ ModelScope MIT เป็นใบอนุญาตที่เปิดกว้างที่สุดชนิดหนึ่ง: นักพัฒนาและบริษัทสามารถใช้ แก้ไข และแจกจ่ายน้ำหนักเหล่านี้เพื่อวัตถุประสงค์เชิงพาณิชย์ได้อย่างไม่มีข้อจำกัด

คำปฏิเสธความรับผิดชอบ: ข้อมูลในหน้านี้อาจได้รับจากบุคคลที่สาม และไม่จำเป็นต้องสะท้อนถึงมุมมองหรือความคิดเห็นของ KuCoin เนื้อหานี้จัดทำขึ้นเพื่อวัตถุประสงค์ในการให้ข้อมูลทั่วไปเท่านั้น โดยไม่มีการรับรองหรือการรับประกัน และจะไม่ถูกตีความว่าเป็นคำแนะนำทางการเงินหรือการลงทุน KuCoin จะไม่รับผิดชอบต่อความผิดพลาดหรือการละเว้นในเนื้อหา หรือผลลัพธ์ใดๆ ที่เกิดจากการใช้ข้อมูลนี้ การลงทุนในสินทรัพย์ดิจิทัลอาจมีความเสี่ยง โปรดประเมินความเสี่ยงของผลิตภัณฑ์และความเสี่ยงที่คุณยอมรับได้อย่างรอบคอบตามสถานการณ์ทางการเงินของคุณเอง โปรดดูข้อมูลเพิ่มเติมได้ที่ข้อกำหนดการใช้งานและเอกสารเปิดเผยข้อมูลความเสี่ยงของเรา