คลังโมเดล

← คลังโมเดล

Muse Voice Transcribe

Meta · ใช้ได้แล้ว

Meta Superintelligence Labs เปิดตัวโมเดลถอดเสียงเรียลไทม์ที่แยกเสียงผู้พูดได้สูงสุด 20+ คน รองรับภาษาไทยและสลับภาษากลางประโยคได้ คนใช้ต่อ API ได้ที่ 0.18 ดอลลาร์ต่อชั่วโมงเสียง

ราคา0.18 ดอลลาร์ต่อชม.เสียง
หน้าต่างบริบทเสียงยาวเกิน 1 ชม.
งานหลักถอดเสียงสด แยกผู้พูด ตัดจบประโยค

วันนี้ใช้ได้ยังไง - ต่อ Meta Model API ด้วยรหัสโมเดล `muse-voice-transcribe-1.0` วิธีใช้อ่านได้ที่ https://dev.meta.ai/docs/speech-to-text/ - เปิด Meta AI บน Mac แล้วใช้งานได้เลย - บน Muse Code กด Fn ค้างไว้แล้วพูด ระบบพิมพ์ตามเสียงให้ทันที

จุดที่คนปนกันบ่อย - Gemini 3.5 Transcribe เป็นของ Google อย่าเอามาปนกับตัวนี้ที่เป็นของ Meta - Muse บน fal ที่คนพูดถึงกันตอนแต่งรูป คือโมเดลภาพ ไม่เกี่ยวกับโมเดลเสียงตัวนี้ - ถอดได้ทั้งสตรีมสดและไฟล์เสียงแบบคิดราคาเท่ากัน แต่ยังไม่มีน้ำหนักเปิดให้โหลดมาใช้เอง

เหตุผลที่น่าสนใจ - ประชุมใหญ่ เสียงยาวเกิน 1 ชั่วโมง คนพูดหลายสิบคน ก็ยังแยกเสียงได้ - ตัดจบประโยคให้เอง ซับที่ได้ออกมาพร้อมใช้ทันที - อ่านรายละเอียดเพิ่มเติมที่ https://research.meta.ai/blog/introducing-muse-voice-transcribe

ดูรุ่นอื่น