← คลังโมเดล
Gemini 3.5 Transcribe
Google · พรีวิว
Google เปิดโมเดลถอดเสียงเป็นตัวอักษรรุ่นใหม่เมื่อ 26 ส.ค. 2026 ผ่านบล็อกของบริษัท เดเวลอปเปอร์ลองพรีวิวได้ผ่าน Gemini API ใน Google AI Studio และ Gemini Enterprise Agent Platform คนทั่วไปเจอได้ในแอป Gemini บน macOS ภาษาอังกฤษ และ Rambler บน Android บางประเทศ มีให้เลือกสองแบบคือถอดไฟล์ที่อัดไว้กับถอดสด
| ราคา | 2 / 12 ดอลลาร์ต่อล้าน |
|---|
| หน้าต่างบริบท | เสียงยาวสุด 1 ชั่วโมงต่อคำขอ |
|---|
| งานหลัก | ถอดเสียงเป็นตัวอักษร |
|---|
สองเส้นทางที่บริษัทเขียน:
- gemini-3.5-transcribe ถอดไฟล์อัดผ่าน Interactions API แยกผู้พูดได้ ติดเวลาต่อคำได้
- gemini-3.5-transcribe-live ถอดสดผ่าน Live API
- เอกสารของบริษัทบอกรับเสียงยาวสุด 1 ชั่วโมงต่อคำขอ ถ้าเปิดแยกผู้พูดหรือเวลาต่อคำ เหลือ 30 นาที ตรวจภาษาอัตโนมัติกว่า 85 ภาษา
ราคากับความแม่น:
- หน้า Pricing ของ Gemini API ขั้นจ่ายต่อล้านโทเคน รุ่นถอดไฟล์ อินพุต 2 ดอลลาร์ เอาต์พุต 12 ดอลลาร์ รุ่นถอดสด อินพุต 3.50 เอาต์พุต 21 ดอลลาร์ ขั้นฟรีไม่คิดเงิน
- หน้าเดียวกันให้ตัวเลขเทียบราว 0.005 ดอลลาร์ต่อนาทีสำหรับถอดไฟล์ และ 0.009 ดอลลาร์ต่อนาทีสำหรับถอดสด
- Google อ้างคะแนนจาก Artificial Analysis ว่าผิดคำ 4.0% แบบสตรีม และ 2.6% แบบไม่ใช่สตรีม
อย่าสับสน:
- ตัวนี้คือโมเดลถอดเสียง ไม่ใช่ Gemini 3.5 Pro ที่ยังไม่ออก
ดูรุ่นอื่น