หัวข้อ
- ตัวโมเดลสามขนาด 3B, 8B และ 30B โหลดได้จาก Hugging Face, Ollama และ GitHub ใช้สัญญาอนุญาตแบบเสรี Apache 2.0 เอาไปทำขายหรือแก้ไขต่อก็ได้ ไม่ต้องขออนุญาตพิเศษ
- มีโหมดคิดก่อนตอบในตัว IBM บอกว่าโมเดลจะวางแผนก่อนลงมือ เรียกใช้เครื่องมือภายนอก และทำงานต่อเนื่องแบบเอเจนต์ได้
- ฐานมาจาก Granite 4.1 แล้วฝึกเสริมหลายรอบด้วยวิธี RL คือให้คะแนนผลลัพธ์แล้วให้โมเดลปรับตัวเอง ตามที่บริษัทเล่า
- ความจำงานที่รับได้ในครั้งเดียว เริ่มที่ 128K และขยายได้ถึง 512K ตามการ์ดโมเดล
- IBM ระบุว่าทดสอบแล้ว 12 ภาษา รวมอังกฤษ จีน ญี่ปุ่น เกาหลี
- โมเดลเสียง Granite Speech 5.0 Turbo มีทั้งเวอร์ชัน CTC และ NC ขนาดราว 470 ล้านพารามิเตอร์ IBM บอกว่าข้างในไม่มี LLM ซ่อนอยู่ เลยตัวเล็กและถอดเสียงไว เหมาะรันบนแล็ปท็อปและมือถือ
- ตัวเลขความเร็วเป็นของบริษัท IBM อ้างว่ารันบนชิป H100 แล้วได้ราว 12,600 เทียบผู้นำบนกระดาน Open ASR ที่ราว 6,000 ส่วนคะแนนทดสอบในบล็อกทั้งหมดก็เป็นฝั่ง IBM วัดเอง ยังไม่มีฝั่งอื่นมายืนยัน


สรุป
อยากลองก็โหลดมาลงเครื่องเองได้เลยไม่มีค่าใช้จ่าย แต่พอเอาไปเล่าให้เพื่อนฟัง อย่าลืมบอกด้วยว่าตัวเลขสวยๆ พวกนี้เพิ่งมาจากปาก IBM เอง
แหล่ง: IBM Research / Hugging Face · 25 ส.ค. 2026
