News / รีวิว / Gemini
Gemini · รีวิว

Gemini 3.5 Transcribe คือโมเดลถอดเสียงพูดตัวใหม่ของ Google ที่…

ภีศเดช เพชรน้อย
ภีศเดช เพชรน้อย
28 ส.ค. 2026 · อ่าน 2 นาที
สรุปสั้น — Gemini 3.5 Transcribe คือโมเดลถอดเสียงพูดตัวใหม่ของ Google ที่ Sundar Pichai เพิ่งประกาศเองเมื่อวันนี้ จุดต่างจากถอดเสียงทั่วไปคือ
#Agent
Gemini 3.5 Transcribe คือโมเดลถอดเสียงพูดตัวใหม่ของ Google ที่…

จุดต่างจากถอดเสียงทั่วไปคือมันไม่ได้แค่แปลงเสียงเป็นตัวอักษร แต่ฉลาดพอจะตัดคำเติมอย่าง อืม อ่า ออกให้ แล้วยังจับได้ด้วยว่าเราพูดผิดแล้วแก้กลางประโยค เช่นพูดว่านัดวันอังคารแล้วพูดใหม่ว่าวันพุธ มันจะเข้าใจเจตนาแล้วเก็บวันพุธไว้เลย ไม่ใช่ถอดแบบคำต่อคำดิบๆ

รองรับภาษากว่า 85 ภาษา สลับภาษากลางประโยคได้ แยกผู้พูดได้สูงสุด 3 คนพร้อม timestamp ระดับคำ แถมยังใส่ custom vocabulary กันคำเฉพาะทางสะกดผิดได้ด้วย

ตัวเลขที่ Google อวดคือ Word Error Rate 2.6% แบบไม่สตรีมมิ่ง กับ 4.0% แบบสตรีมมิ่ง เร็วขึ้นจากรุ่นก่อนอย่าง Chirp 3 ประมาณ 70%

ตอนนี้ใช้ได้ผ่าน Gemini API ใน Google AI Studio, Gemini Enterprise Agent Platform, แอป Gemini บน macOS แล้วก็ Rambler ใน Gboard บน Android บางประเทศ กำลังจะตามไปที่ Chrome เร็วๆ นี้

ฟีดแบ็กช่วงชั่วโมงแรกส่วนใหญ่มาจากพาร์ทเนอร์ที่ได้ลองก่อนอย่าง Agora, Vivo, IntelliTek Health ชมเรื่องความหน่วงต่ำกับความแม่นยำเวลาเจอตัวเลขหรืออีเมล ยังไม่มีรีวิวผู้ใช้ทั่วไปแบบเจาะลึกเพราะเพิ่งเปิดตัววันนี้ ส่วนบน X มีคนแซวว่า Transcribe มาแล้ว แต่ Gemini 3.5 Pro ที่สัญญาไว้ตั้งแต่มิถุนายนยังไม่มาซะที

อยากใช้ AI กับงานจริงเป็นระบบ?

เรียน Claude Method — วิธีคิดและลงมือใช้ Claude/AI กับงานจริง ตั้งแต่วันแรก

ดูคอร์ส →

📍 โพสต้นฉบับบน Facebook: AI กับ Peesamac