หัวข้อ
- มีสามขนาด ตัว 397B กับ 35B เป็นแบบ MoE คือแบ่งโมเดลเป็นผู้เชี่ยวชาญหลายก้อนแล้วเรียกใช้เฉพาะก้อนที่จำเป็น ประหยัดแรงเครื่องกว่าแบบเดิม ส่วน 9B เป็นแบบหนาแน่น คือก้อนเดียวทำงานเองทั้งหมด
- ตัว 35B ตอนทำงานจริงแตะราว 3 พันล้านพารามิเตอร์ต่อคำ เบากว่าที่ตัวเลขหน้าชื่อบอก
- จุดขายคือวงวนสอนตัวเอง บริษัทออกแบบให้โมเดลสร้างโจทย์ใหม่ขึ้นมาเอง วางโครงวิธีแก้ แล้วเอาเฉลยที่ทำสำเร็จกลับไปเรียนต่อด้วยวิธีให้รางวัล
- พัฒนาต่อจาก Ornith-1.0 ซึ่งบริษัทเล่าว่าต่อยอดจาก Qwen3.5 และ Gemma 4
- ตัว 9B มีรุ่นย่อสำหรับมือถือ บริษัทบอกว่ารันบนไอโฟนและแอนดรอยด์ได้
- คะแนนทั้งหมดเป็นที่บริษัทวัดเองตามตารางในบล็อก ยังไม่มีผู้ทดสอบภายนอกเข้ามายืนยัน
- ตัว 397B บริษัทวัดได้ Terminal-Bench 2.1 ที่ 86.1 เทียบกับ 85.0 ของ Claude Opus 4.8 แต่ DeepSWE ได้ 56 ซึ่งต่ำกว่า 59 ของ Opus 4.8
- ตัว 35B บริษัทวัดได้ SWE-Bench Verified ที่ 79 และ Terminal-Bench 2.1 แบบ Claude Code ที่ 68.5 โดยเทียบกับ Muse Glimmer-30B ที่ 76.0 กับ 51.7
- ใช้ใบอนุญาต MIT คือสัญญาอนุญาตแบบเสรี เอาไปใช้ แก้ไข หรือไปต่อในเชิงพาณิชย์ก็ได้

สรุป
Ornith เอาโมเดลตัวใหญ่มาแจกฟรีพร้อมวิธีฝึกที่ให้โมเดลสร้างโจทย์ฝึกตัวเอง ใครมีเครื่องแรงพอลองโหลดไปเล่นได้เลย แค่จำไว้ว่าคะแนนตอนนี้เป็นที่บริษัทวัดเอง ฟังไว้ก่อนแล้วรอคนนอกทดสอบซ้ำ
แหล่ง: บล็อกทางการของ Ornith และ Hugging Face · 19 ส.ค. 2026
