คลังโมเดล

← คลังโมเดล

Gemini 3.5 Transcribe

Google · พรีวิว

Google เปิดโมเดลถอดเสียงเป็นตัวอักษรรุ่นใหม่เมื่อ 26 ส.ค. 2026 ผ่านบล็อกของบริษัท เดเวลอปเปอร์ลองพรีวิวได้ผ่าน Gemini API ใน Google AI Studio และ Gemini Enterprise Agent Platform คนทั่วไปเจอได้ในแอป Gemini บน macOS ภาษาอังกฤษ และ Rambler บน Android บางประเทศ มีให้เลือกสองแบบคือถอดไฟล์ที่อัดไว้กับถอดสด

ราคา2 / 12 ดอลลาร์ต่อล้าน
หน้าต่างบริบทเสียงยาวสุด 1 ชั่วโมงต่อคำขอ
งานหลักถอดเสียงเป็นตัวอักษร

สองเส้นทางที่บริษัทเขียน: - gemini-3.5-transcribe ถอดไฟล์อัดผ่าน Interactions API แยกผู้พูดได้ ติดเวลาต่อคำได้ - gemini-3.5-transcribe-live ถอดสดผ่าน Live API - เอกสารของบริษัทบอกรับเสียงยาวสุด 1 ชั่วโมงต่อคำขอ ถ้าเปิดแยกผู้พูดหรือเวลาต่อคำ เหลือ 30 นาที ตรวจภาษาอัตโนมัติกว่า 85 ภาษา

ราคากับความแม่น: - หน้า Pricing ของ Gemini API ขั้นจ่ายต่อล้านโทเคน รุ่นถอดไฟล์ อินพุต 2 ดอลลาร์ เอาต์พุต 12 ดอลลาร์ รุ่นถอดสด อินพุต 3.50 เอาต์พุต 21 ดอลลาร์ ขั้นฟรีไม่คิดเงิน - หน้าเดียวกันให้ตัวเลขเทียบราว 0.005 ดอลลาร์ต่อนาทีสำหรับถอดไฟล์ และ 0.009 ดอลลาร์ต่อนาทีสำหรับถอดสด - Google อ้างคะแนนจาก Artificial Analysis ว่าผิดคำ 4.0% แบบสตรีม และ 2.6% แบบไม่ใช่สตรีม

อย่าสับสน: - ตัวนี้คือโมเดลถอดเสียง ไม่ใช่ Gemini 3.5 Pro ที่ยังไม่ออก

ดูรุ่นอื่น