ทำไมเรื่องนี้ถึงใหญ่
- ระบบตอบคำถามขนาดใหญ่ทุกวันนี้ชอบแยกชิปเป็นสองกอง เพื่อไม่ให้เครื่องว่างงาน
- จุดคอขวดคือต้องส่ง KV-cache จากกองอ่านไปกองตอบให้ทัน
- ฝั่ง Nvidia มีไลบรารีแนวเดียวกันชื่อ NIXL ที่ฝังในเครื่องมือเสิร์ฟยอดนิยมแล้ว
- Raiden คือของคู่แข่งฝั่ง TPU ที่ Google เปิดให้คนนอกดูและต่อยอดได้
ในโค้ดมีอะไรบ้าง
- ย้ายแคชชิปต่อชิปในเครื่องเดียวกัน
- ย้ายข้ามเครื่อง TPU ผ่านเครือข่าย
- เอาแคชที่ไม่ใช้ทันทีลงแรมของเครื่องโฮสต์ เพื่อไม่ต้องเริ่มใหม่ทั้งก้อน
- Google ย้ำว่าโปรเจกต์ยังพัฒนาอยู่ ยังไม่พร้อมใช้ผลิตทั่วไป
คนในวงการอ่านยังไง
- Google ยังไม่ขายชิป TPU ให้ซื้อเครื่องเปล่า ต้องใช้ผ่านคลาวด์เป็นหลัก
- แต่ยิ่งเปิดซอฟต์แวร์รอบ TPU มากเท่าไร ลูกค้าและค่ายโมเดลที่เช่า TPU จะต่อระบบง่ายขึ้น
- เป็นสัญญาณว่า Google อยากให้ TPU แข่งกับ GPU ได้ทั้งชิปและเครื่องมือรอบข้าง ไม่ใช่แค่แรงในบ้านตัวเอง

สรุป
Raiden ไม่ใช่โมเดลใหม่ แต่เป็นเครื่องมือพื้นฐานที่ทำให้ TPU ใช้งานจริงง่ายขึ้น — เปิดซอร์สแล้ว ยังบอกตรง ๆ ว่ายังไม่จบงาน
แหล่ง: SemiAnalysis / OfficeChai / GitHub Google · ส.ค. 2026
