Google vừa công bố bộ mô hình AI giọng nói Gemini 3.5, bao gồm Gemini 3.5 Live, Live Experimental và Transcribe, vào ngày 26/8. Bản cập nhật này tập trung vào cải thiện khả năng xử lý ngôn ngữ tự nhiên và tăng tốc độ chuyển đổi giọng nói thành văn bản.
📌 Thông tin nhanh
- Chủ đề: Tính Năng Mới
- Đối chiếu: 2 nguồn
- Cập nhật: 28/08/2026
Google vừa công bố bộ mô hình AI giọng nói Gemini 3.5, bao gồm Gemini 3.5 Live, Live Experimental và Transcribe, vào ngày 26/8. Bản cập nhật này tập trung vào cải thiện khả năng xử lý ngôn ngữ tự nhiên và tăng tốc độ chuyển đổi giọng nói thành văn bản.
Diễn biến
Google giới thiệu Gemini 3.5 Live cho trợ lý hội thoại Gemini Live, phiên bản Live Experimental dành cho nhà phát triển và Gemini 3.5 Transcribe cho chuyển giọng nói thành văn bản Investing.com Việt Nam. Gemini 3.5 Live cải thiện khả năng xử lý khi người dùng ngắt lời và hỗ trợ xử lý thông tin hình ảnh theo thời gian thực, nhận diện tình huống đa ngôn ngữ và sử dụng các công cụ bên ngoài digitaltoday.co.kr.
Gemini 3.5 Transcribe thay thế Chirp 3, giảm 70% thời gian chuyển đổi giọng nói thành văn bản và giảm tỷ lệ lỗi nhận dạng xuống 5,5% từ 7,32% Investing.com Việt Nam. Mô hình này còn có khả năng lọc từ đệm, cập nhật theo thời gian thực khi người dùng chỉnh sửa và hỗ trợ 85 ngôn ngữ digitaltoday.co.kr.
Các nguồn nói gì
Cả Investing.com Việt Nam và digitaltoday.co.kr đều tập trung vào khả năng chuyển giọng nói thành văn bản của Gemini 3.5 Transcribe. digitaltoday.co.kr cung cấp nhiều chi tiết hơn về Gemini 3.5 Live, đặc biệt là khả năng xử lý khi bị ngắt lời và tích hợp các công cụ bên ngoài. Cả hai nguồn đều thống nhất rằng Gemini 3.5 cải thiện đáng kể độ chính xác và tốc độ so với các phiên bản trước.
Vì sao đáng chú ý
Gemini 3.5 thể hiện rõ xu hướng AI tập trung vào cải thiện trải nghiệm hội thoại tự nhiên. Khả năng xử lý ngắt lời và tích hợp công cụ mở rộng phạm vi ứng dụng của AI giọng nói, từ trợ lý ảo đến các công cụ hỗ trợ sáng tạo nội dung. Việc giảm tỷ lệ lỗi nhận dạng và tăng tốc độ chuyển đổi giọng nói thành văn bản đặc biệt quan trọng cho các ứng dụng thực tế như ghi chú cuộc họp, phiên dịch trực tiếp, hoặc tạo phụ đề video.
Với người đọc Việt Nam
Hiện chưa có thông tin chính thức về việc Gemini 3.5 được hỗ trợ trực tiếp tại Việt Nam. Người dùng có thể cần tài khoản Google và kết nối internet ổn định để sử dụng các dịch vụ tích hợp Gemini 3.5 khi có mặt. Các lập trình viên Việt Nam có thể tìm hiểu Gemini 3.5 Live Experimental để phát triển các ứng dụng AI giọng nói tùy chỉnh. Doanh nghiệp Việt Nam có thể tận dụng Gemini 3.5 Transcribe để cải thiện quy trình ghi chép, dịch thuật và hỗ trợ khách hàng. Người dùng nên theo dõi thông báo chính thức từ Google để biết khi nào các tính năng này chính thức khả dụng tại Việt Nam.
Nguồn tham khảo
- 디지털투데이 — Google ra mắt bộ mô hình AI giọng nói Gemini 3.5 hỗ trợ 85 ngôn ngữ
- Investing.com Việt Nam — Google ra mắt mô hình chuyển giọng nói thành văn bản Gemini 3.5 Transcribe