สเปกหลักจากค่าย
- โครงสร้างแบบ Mixture-of-Experts รวมราว 30–31.6 พันล้านพารามิเตอร์ แต่เปิดใช้จริงต่อคำราว 3–3.6 พันล้าน
- หน้าต่างบริบทยาวถึง 1 ล้านโทเคน
- ใบอนุญาต OpenMDW-1.1 ใช้เชิงพาณิชย์ได้
- NVIDIA อ้างความเร็วออกสูงสุดราว 4 เท่าในกลุ่มเดียวกัน และจบงาน PinchBench เร็วกว่า Qwen3.6 35B ประมาณ 30% ที่ความแม่นยำใกล้กัน

ตัวเลขที่น่าสนใจ
- Artificial Analysis ให้ดัชนีปัญญา 24 กระโดดจาก Nemotron 3 Nano ที่ 15
- SWE-bench Verified ราว 52% · Terminal-Bench 2.1 ราว 24%
- ทดสอบ endpoint ก่อนเปิดตัว วัดความเร็วออกใกล้ 670 โทเคนต่อวินาที
- Switchyard ช่วยส่งคำสั่งไปโมเดลที่เหมาะในแต่ละขั้น — ภายในค่ายอ้างต้นทุนงานเหลือราวหนึ่งในสามของ Claude Opus 4.8 อย่างเดียว
ใครได้อะไร
- องค์กรที่อยากรันเอเจนต์เยอะ ๆ โดยไม่ยิงโมเดลท็อปทุกขั้น
- น้ำหนักอยู่บน Hugging Face / ModelScope และมีบริการผ่านพาร์ทเนอร์หลายค่าย
- Switchyard เป็นโอเพนซอร์สบน GitHub ให้เสียบเข้าเครื่องมือเอเจนต์ที่มีอยู่
สรุป
วันก่อน Meta เปิด Muse Glimmer ขนาด 30B สำหรับรันเครื่องตัวเอง วันนี้ NVIDIA ย้ำอีกมุม — โมเดลเปิดที่เร็วและถูกพอจะเป็นแรงงานเอเจนต์ระยะยาว ไม่จำเป็นต้องเป็นแชมป์เบนช์ทุกข้อ
แหล่ง: NVIDIA Blog / Hugging Face / Artificial Analysis · 11 ส.ค. 2026
