Google เปิดตัว Gemini 3.5 Transcribe ยกระดับการพิมพ์ด้วยเสียงด้วย AI
Google ประกาศเปิดตัว Gemini 3.5 Transcribe โมเดล AI รุ่นใหม่สำหรับงานถอดเสียงเป็นข้อความ โดยตั้งใจยกระดับการพิมพ์ด้วยเสียงให้รวดเร็วและใช้งานได้ลื่นขึ้น โมเดลนี้ไม่ได้มุ่งแค่แปลงคำพูดเป็นตัวอักษรแบบ…

Google ประกาศเปิดตัว Gemini 3.5 Transcribe โมเดล AI รุ่นใหม่สำหรับงานถอดเสียงเป็นข้อความ โดยตั้งใจยกระดับการพิมพ์ด้วยเสียงให้รวดเร็วและใช้งานได้ลื่นขึ้น โมเดลนี้ไม่ได้มุ่งแค่แปลงคำพูดเป็นตัวอักษรแบบตรงตัว แต่ยังช่วยจัดการกับถ้อยคำที่พูดซ้ำ การแก้ประโยคกลางคัน และคำเติมอย่าง “um” หรือ “เอ่อ” เพื่อให้ผลลัพธ์ออกมาเป็นข้อความที่อ่านเป็นธรรมชาติมากขึ้น
Google ระบุว่า Gemini 3.5 Transcribe มีความเร็วจากเสียงไปสู่ข้อความสุดท้ายดีขึ้นราว 70% เมื่อเทียบกับเอนจินเดิมที่ชื่อ Chirp 3 ขณะเดียวกันอัตราความผิดพลาดในการถอดเสียงแบบเรียลไทม์ลดลงเหลือ 5.5% จากเดิมที่อยู่ที่ 7.32% แม้ตัวเลขดังกล่าวจะเป็นการปรับปรุงที่ไม่หวือหวามากนักในเชิงเปอร์เซ็นต์ แต่ในโลกของการพิมพ์ด้วยเสียง ความแม่นยำที่ดีขึ้นเพียงเล็กน้อยก็ช่วยลดภาระการแก้คำผิดและทำให้การใช้งานสะดวกขึ้นได้จริง
โมเดลใหม่นี้เริ่มถูกใช้แล้วในฟีเจอร์ Gboard ชื่อ Rambler บน Pixel 11 และ Google ระบุว่าจะทยอยนำไปใช้ในระบบนิเวศของบริษัทในวงกว้างมากขึ้น การเปิดตัวครั้งนี้สะท้อนว่าบริษัทกำลังผลักดัน AI ด้านเสียงให้เป็นส่วนหนึ่งของประสบการณ์ใช้งานประจำวัน มากกว่าจะจำกัดอยู่แค่โมเดลสนทนาอย่าง Gemini รุ่นหลัก
ภาพรวมแล้ว Gemini 3.5 Transcribe เป็นความพยายามของ Google ที่จะทำให้การป้อนข้อมูลด้วยเสียง “ฉลาด” ขึ้น ไม่ใช่เพียงฟังคำพูดแล้วถอดออกมา แต่ช่วยปรับให้เป็นข้อความที่พร้อมใช้งานมากกว่าเดิม สำหรับผู้ใช้ทั่วไปและผู้ที่พึ่งพาการพิมพ์ด้วยเสียงเป็นประจำ การอัปเกรดด้านนี้อาจไม่ใช่ฟีเจอร์หวือหวาที่สุด แต่มีโอกาสส่งผลต่อประสบการณ์ใช้งานในชีวิตประจำวันอย่างชัดเจน


