Trong bài này
Hai model Live mới
Google giới thiệu Gemini 3.8 Live và Gemini 3.8 Live Extended Thinking cho các trải nghiệm hội thoại gần thời gian thực. Gemini 3.8 Live hướng tới quy mô lớn và hiệu quả chi phí, còn bản Extended Thinking dành cho tác vụ phức tạp cần suy luận nhiều bước sâu hơn.
Khả năng nổi bật
Google nhấn mạnh khả năng duy trì hội thoại tự nhiên trong khi model vẫn có thể thực hiện tác vụ, dùng visual context và gọi công cụ theo cách không làm gián đoạn luồng thoại.
Bộ model này cũng được đưa vào Gemini API và Google AI Studio cho các ứng dụng voice-first.
Ứng dụng thực tế
Nhóm model Live phù hợp cho tổng đài AI, trợ lý giọng nói, hướng dẫn thao tác theo thời gian thực, chăm sóc khách hàng và các workflow cần vừa trò chuyện vừa truy cập công cụ hoặc dữ liệu.
Cần lưu ý
Khả năng thực tế còn phụ thuộc độ trễ mạng, chất lượng âm thanh, cách thiết kế tool calling và chính sách dữ liệu của từng ứng dụng. Việc “hội thoại tự nhiên hơn” không đồng nghĩa model luôn trả lời chính xác hơn trong mọi tình huống.
