ตอนนี้ Nvidia กำลังเปิดตัวรุ่นใหม่ของโมเดล AI แบบเปิดน้ำหนักทุกๆ ประมาณหนึ่งเดือนครึ่ง ซึ่งเร็วขึ้นอย่างมากจากช่วงเวลาหกถึงแปดเดือนที่เคยใช้ก่อนหน้านี้ Bryan Catanzaro รองประธานฝ่ายวิจัยการเรียนรู้เชิงลึกเชิงประยุกต์ของบริษัท ได้เปิดเผยกำหนดการใหม่นี้ในการสัมภาษณ์เมื่อวันที่ 24 สิงหาคม 2026
อะไรกำลังขับเคลื่อนการเร่งตัว
การเร่งความเร็วไม่ใช่แค่ความทะเยอทะยาน แต่เป็นโครงสร้างพื้นฐาน NVIDIA ได้พัฒนาเครื่องมือภายในรอบการสร้างข้อมูลสังเคราะห์ เทคนิคที่เรียกว่า multi-teacher distillation (MOPD) และสภาพแวดล้อมการเรียนรู้ด้วยการเสริมแรง ซึ่งรวมกันแล้วบีบอัดงานพัฒนาที่เคยใช้เวลาหลายเดือนให้เหลือเพียงไม่กี่สัปดาห์
การสร้างข้อมูลเทียมคือการสอนโมเดลปัญญาประดิษฐ์โดยใช้ข้อมูลที่สร้างโดยโมเดลปัญญาประดิษฐ์อื่นๆ แทนการพึ่งพาชุดข้อมูลที่มนุษย์จัดเตรียมเพียงอย่างเดียว การถ่ายโอนความรู้จากผู้สอนหลายรายใช้ความรู้จากโมเดลขนาดใหญ่หลายตัวและบีบอัดให้เป็นโมเดลขนาดเล็กที่มีประสิทธิภาพมากขึ้น ร่วมกัน เทคนิคเหล่านี้ช่วยให้นิวไดร์สามารถพัฒนาอย่างต่อเนื่องโดยไม่ติดขัดกับกระบวนการรวบรวมและทำความสะอาดชุดข้อมูลใหม่ขนาดใหญ่สำหรับแต่ละรุ่น
ผลิตภัณฑ์ล่าสุดของสายการผลิตนี้คือ Nemotron 3.5 Lightning ซึ่งเปิดตัวเมื่อวันที่ 11 สิงหาคม 2026 มันเข้าร่วมครอบครัวที่กำลังเติบโตขึ้น: ซีรีส์ Nemotron 3 ได้แก่รุ่น Nano, Super และ Ultra แต่ละรุ่นออกแบบมาเพื่อตอบสนองการใช้งานและงบประมาณการประมวลผลที่ต่างกัน
รุ่น Nano ที่เปิดตัวเมื่อเดือนธันวาคม 2025 ใช้พารามิเตอร์ทั้งหมดประมาณ 30 พันล้าน แต่เปิดใช้งานเพียงประมาณ 3 พันล้านในแต่ละช่วงเวลา ซึ่งเกิดจากสถาปัตยกรรมแบบไฮบริดที่รวมการออกแบบ Mamba และ Transformer ในรูปแบบ mixture-of-experts (MoE) ตามด้วยรุ่น Super และ Ultra ในปี 2026 และทีมงานกำลังพัฒนาไปสู่ Nemotron 4 อยู่แล้ว
เปิดน้ำหนัก เปิดแผนการดำเนินงาน
การเปิดตัว Nemotron ทุกรุ่นมาพร้อมกับน้ำหนักเปิดเต็มรูปแบบ สูตรการฝึกอบรม และชุดข้อมูลภายใต้ใบอนุญาตที่ยืดหยุ่น ซึ่งหมายความว่า นักพัฒนาหรือบริษัทใดก็ตามสามารถดาวน์โหลด แก้ไข และปรับใช้โมเดลเหล่านี้ได้โดยไม่ต้องจ่ายค่าใบอนุญาตให้ Nvidia
การแจกจ่ายโมเดลทำให้นิวเดียสร้างความต้องการสำหรับฮาร์ดแวร์ที่โมเดลเหล่านั้นทำงานบน พัฒนาก็ยิ่งสร้างบนเนมโทรน พวกเขาจะยิ่งต้องการชิปที่ออกแบบมาเพื่อการอนุมานของนิวเดีย โครงสร้างพื้นฐาน NeMo และแพลตฟอร์มไมโครเซอร์วิส NIM เพื่อให้ทุกอย่างทำงานอย่างมีประสิทธิภาพ
กลยุทธ์แบบเปิดน้ำหนักยังทำหน้าที่เป็นอาวุธการแข่งขันต่อห้องปฏิบัติการปัญญาประดิษฐ์ของจีนที่เปิดตัวโมเดลเปิดที่มีความสามารถ และผู้ให้บริการโมเดลปิดเช่น OpenAI และ Anthropic
ฮาร์ดแวร์ยังคงทำงานด้วยนาฬิกาที่ต่างกัน
ความถี่ทุกสี่ถึงหกสัปดาห์ใช้ได้เฉพาะกับซอฟต์แวร์ โดยเฉพาะโมเดลปัญญาประดิษฐ์ของ Nvidia การเปิดตัวฮาร์ดแวร์ของบริษัท รวมถึงสถาปัตยกรรม Blackwell และแพลตฟอร์ม Vera Rubin ที่กำลังจะมา ยังคงอยู่บนตารางปีละหนึ่งครั้ง
สิ่งนี้หมายถึงอะไรต่อภูมิทัศน์ของปัญญาประดิษฐ์
Nvidia ได้ชัดเจนว่ารุ่น Nemotron ของพวกเขาได้รับการปรับแต่งให้เหมาะกับการใช้งานแบบเอเจนต์ หมายถึงระบบปัญญาประดิษฐ์ที่สามารถดำเนินการ ใช้เครื่องมือ และทำงานแบบกึ่งอัตโนมัติ แทนที่จะแค่สร้างข้อความ
