หัวข้อ
- Jalapeño เป็นชิปตัวแรกที่ OpenAI ออกแบบเอง ทำร่วมกับ Broadcom ใช้เฉพาะงานตอบคำถามผู้ใช้ ไม่ได้เอาไปฝึกโมเดล
- ก่อนหน้านี้บอกแค่ว่าเร็วแต่ไม่เคยมีตัวเลข วันที่ 25 ส.ค. 2026 เพิ่งเปิดตัวเลขจริงชุดแรก พร้อมเล่าในงาน Hot Chips
- วัดด้วยชุดทดสอบชื่อ InferenceX ของ SemiAnalysis บนโมเดลเปิดสามตัว คือ GPT-OSS 120B, DeepSeek R1 670B และ Kimi K2.5 1T
- ภาพรวมที่ OpenAI เล่าคือ กินไฟเท่ากันแต่ทำงานได้มากกว่า 1.5 ถึง 1.9 เท่า และเวลาที่ผู้ใช้ต้องรอทั้งกระบวนการลดลง 1.7 ถึง 3.6 เท่า
- งานที่ต้องโต้ตอบกับผู้ใช้ไวมาก ได้ประสิทธิภาพสูงกว่า 2.1 ถึง 4.1 เท่า
- ตัวอย่างบน GPT-OSS 120B ตอบได้ราว 85,448 โทเคนต่อวินาทีต่อกิโลวัตต์ เทียบเครื่องคู่เทียบที่ราว 44,960 โทเคนคือชิ้นเล็กๆ ของคำตอบที่โมเดลค่อยๆ พ่นออกมา ส่วนเวลารออยู่ที่ 1.03 วินาที เทียบกับ 1.80 วินาที
- บน DeepSeek R1 รอ 1.65 วินาที เทียบ 5.99 วินาที ส่วน Kimi K2.5 รอ 1.56 วินาที เทียบ 5.31 วินาที
- เครื่องที่เอาไปเทียบคือระบบของ Nvidia รุ่น GB200 กับ GB300 โดย Jalapeño กินไฟ 700 วัตต์ ส่วน GB200 อยู่ที่ 1,200 วัตต์ ตัวเลขไฟมาจากกราฟที่ OpenAI เผยเอง
- ข้อควรรู้คือตัวเลขดิบทุกตัวมาจาก OpenAI SemiAnalysis แค่ไปนั่งดูตอนรันในแล็บของ OpenAI ยังไม่ได้รันชุดทดสอบเต็มด้วยตัวเอง และยังไม่ได้ลองชุดใหม่ชื่อ AgentX
- Richard Ho หัวหน้าฝ่ายฮาร์ดแวร์ของ OpenAI บอกว่าจะเริ่มใช้จริงปลายปี 2026 แต่จำนวนน้อยมาก แล้วค่อยขยายในปี 2027
- OpenAI ใช้เวลาเก้าเดือนจากเริ่มออกแบบจนส่งโรงงานผลิตได้ และมีโมเดลของตัวเองช่วยออกแบบด้วย

สรุป
เอาไปคุยต่อได้ว่า OpenAI ทำชิปของตัวเองได้ถึงขั้นมีตัวเลขออกมาโชว์แล้ว แต่ยังเป็นเจ้าของชิปวัดเองในบ้านตัวเอง ต้องรอให้ฝ่ายอื่นรันซ้ำเองก่อน ถึงจะรู้ว่าเร็วจริงแค่ไหน
แหล่ง: OpenAI, TechCrunch · 25 ส.ค. 2026
