← คลังโมเดล
Muse Voice Transcribe
Meta · ใช้ได้แล้ว
Meta Superintelligence Labs เปิดตัวโมเดลถอดเสียงเรียลไทม์ที่แยกเสียงผู้พูดได้สูงสุด 20+ คน รองรับภาษาไทยและสลับภาษากลางประโยคได้ คนใช้ต่อ API ได้ที่ 0.18 ดอลลาร์ต่อชั่วโมงเสียง
| ราคา | 0.18 ดอลลาร์ต่อชม.เสียง |
|---|
| หน้าต่างบริบท | เสียงยาวเกิน 1 ชม. |
|---|
| งานหลัก | ถอดเสียงสด แยกผู้พูด ตัดจบประโยค |
|---|
วันนี้ใช้ได้ยังไง
- ต่อ Meta Model API ด้วยรหัสโมเดล `muse-voice-transcribe-1.0` วิธีใช้อ่านได้ที่ https://dev.meta.ai/docs/speech-to-text/
- เปิด Meta AI บน Mac แล้วใช้งานได้เลย
- บน Muse Code กด Fn ค้างไว้แล้วพูด ระบบพิมพ์ตามเสียงให้ทันที
จุดที่คนปนกันบ่อย
- Gemini 3.5 Transcribe เป็นของ Google อย่าเอามาปนกับตัวนี้ที่เป็นของ Meta
- Muse บน fal ที่คนพูดถึงกันตอนแต่งรูป คือโมเดลภาพ ไม่เกี่ยวกับโมเดลเสียงตัวนี้
- ถอดได้ทั้งสตรีมสดและไฟล์เสียงแบบคิดราคาเท่ากัน แต่ยังไม่มีน้ำหนักเปิดให้โหลดมาใช้เอง
เหตุผลที่น่าสนใจ
- ประชุมใหญ่ เสียงยาวเกิน 1 ชั่วโมง คนพูดหลายสิบคน ก็ยังแยกเสียงได้
- ตัดจบประโยคให้เอง ซับที่ได้ออกมาพร้อมใช้ทันที
- อ่านรายละเอียดเพิ่มเติมที่ https://research.meta.ai/blog/introducing-muse-voice-transcribe
ดูรุ่นอื่น