ทำไมต้องรอสองสัปดาห์
- ทีมงานพบว่าฝีมือบุกรุกระบบคอมพิวเตอร์ของโมเดลโตเร็วกว่าที่คาดไว้ จึงต้องเช็กความปลอดภัยซ้ำเพิ่มก่อนปล่อยไฟล์ตัวเต็มออกมา
โหลดจากไหน ตัวใหญ่แค่ไหน
- ไฟล์อยู่บน Hugging Face กับ ModelScope เลือกได้สองแบบ คือ FP8 ไฟล์เบากว่า กับ BF16 เก็บตัวเลขละเอียดกว่า ลงเครื่องได้ด้วย vLLM หรือ SGLang
- พารามิเตอร์รวม 744 พันล้าน แต่ทำงานจริงครั้งละราว 40 พันล้านแบบ MoE คือเลือกปลุกเฉพาะส่วนที่จำเป็น ไม่ต้องตื่นทั้งก้อน
- รับบริบทยาวราว 1 ล้านโทเคน

เงื่อนไขการใช้
- เป็นใบอนุญาตเฉพาะของบริษัท ไม่ใช่ Apache
- ใช้ แก้ไข แจกต่อได้กว้าง ๆ ยกเว้นบริษัทที่มีรายได้เกิน 1 หมื่นล้านดอลลาร์ต่อปีจากบริการโมเดลแบบคลาวด์ กลุ่มนี้ต้องผ่านการตรวจของทาง Z.ai ก่อน
คะแนนที่เผยแพร่
- ทุกตัวเลขเป็นการวัดเองของบริษัทใส่ไว้ในหน้าโมเดล ยังไม่มีฝ่ายกลางเข้ามายืนยัน
- เก่งเรื่องโค้ดขึ้นราวครึ่งหนึ่งจากรุ่น 5.2 และครองอันดับกลุ่มเปิดในหลายตาราง
ไม่มีเครื่องแรงก็มีทางเลือก
- เรียกผ่าน API ราคาเดิมราว 1.40 ดอลลาร์ขาเข้า และ 4.40 ดอลลาร์ขาออกต่อล้านโทเคน
- รุ่นน้อง GLM-5.3-Flash เปิดให้โหลดมาใช้เองก่อนแล้วเมื่อ 26 ส.ค.
สรุป
โมเดลธงขนาดนี้ที่ใครก็โหลดมาใช้เองได้ฟรี ทำให้สนามโมเดลเปิดช่วงปลายปีดุขึ้นอีกรอบแน่นอน
แหล่ง: Z.ai / Hugging Face · 28 ส.ค. 2026
