หัวข้อ
- โมเดลเปิดน้ำหนักคือไฟล์สมองที่โหลดมาลงเครื่องตัวเองได้ ครั้งนี้แจกไฟล์ครบ ทั้งเวอร์ชันปกติและเวอร์ชัน FP8 ที่เก็บตัวเลขแบบสั้นกว่า ใช้ทรัพยากรน้อยลง
- เป็นแบบ Mixture-of-Experts คือมีผู้เชี่ยวชาญหลายชุดอยู่ในโมเดลเดียว แต่ละคำเรียกใช้เฉพาะชุดที่ถนัด ตัวเลขรวมทั้งหมด 125 พันล้านพารามิเตอร์ แต่ส่วนที่ทำงานจริงต่อหนึ่งคำราว 6 พันล้าน บวกส่วนฝังคำแบบเอ็นแกรม คือการจำกลุ่มคำที่มักมาเป็นชุดกัน อีก 51 พันล้าน และส่วน MTP อีก 4 พันล้าน
- อ่านรูปได้ด้วย ไม่ใช่แค่ข้อความ
- บริบทเริ่มต้น 262,144 โทเคน ขยายได้ถึง 1 ล้าน โทเคนคือหน่วยตัดคำที่โมเดลอ่าน ยิ่งเยอะยิ่งจำเนื้อหายาวได้มากขึ้น
- จุดใหม่ของโครงสมองที่ทีมยกมา มี QSA หรือ Qwen Sparse Attention ช่วยลดเวลารอตอนอ่านบริบทยาว นอกจากนี้ยังมี Hybrid Attention กับ Gated Residual และการฝังคำแบบเอ็นแกรม หรือ N-gram Embedding
- ทีมระบุในหน้าโมเดลว่ารันได้บน Hugging Face Transformers รวมถึงเครื่องมืออย่าง vLLM และ SGLang
- ใบอนุญาต Qwen Community License 1.0 คือกฎการใช้ฟรีที่มีเงื่อนไข ถ้าเอาไปทำธุรกิจให้เช่าโมเดลเป็นบริการ แบบ Model as a Service หรือผู้ช่วยทำงานอย่าง AI Work Assistant ต้องขอใบอนุญาตแยก และถ้าสินค้ามีผู้ใช้เกิน 100 ล้านคนต่อเดือน หรือรายได้เกิน 20 ล้านดอลลาร์ต่อเดือน ต้องแสดงชื่อโมเดลบนหน้าจอให้ชัด
- บนคลาวด์มีเวอร์ชันอย่างเป็นทางการชื่อ Qwen3.8-Flash ที่ต่อยอดจากตัวนี้ พร้อมบริบท 1 ล้านโทเคนตั้งแต่ค่าเริ่มต้น
- คะแนนจากชุดทดสอบงานโค้ดที่ทีมวัดเอง DeepSWE 1.1 ได้ 58.7 และ SWE-bench Pro ได้ 62.5

สรุป
ใครอยากชิมของใหม่ก่อนใคร โหลดมาใช้เองได้แล้ววันนี้ แต่จำไว้ว่าเป็นตัวทดลองที่ให้เห็นโครงสมองรุ่นหน้าก่อน ถ้าอยากได้ของพร้อมใช้เต็มรูปแบบ ทีมมี Qwen3.8-Flash บนคลาวด์ให้เลือกใช้แทน
แหล่ง: ทีม Qwen (Alibaba) หน้าโมเดล Hugging Face และบล็อก qwen.ai · 26 ส.ค. 2026
