# Google ra mắt Gemini 3.8 Live: Trải nghiệm hội thoại giọng nói thời gian thực

- Nguồn: Simon Willison Blog
- Thời gian phát hành: 2026-09-16 05:47 (giờ Việt Nam)
- Điểm AI: 67/100
- Link AIHOT.vn: https://aihot.vn/items/55fdd7af6dcc5452
- Nguồn dữ liệu AI HOT: https://aihot.news/items/cmu3c8qcp0j1brosa5g6ipz4p
- Link gốc: https://simonwillison.net/2026/Sep/15/gemini-live

## Tóm tắt AI

Google vừa giới thiệu bộ đôi mô hình Gemini 3.8 Live và Extended Thinking, mang đến khả năng tương tác giọng nói trực tiếp tương tự GPT-Live của OpenAI.

## Thân bài

![Tool: Gemini Live audio](https://static.simonwillison.net/static/2026/gemini-live-tool.webp)

Google hôm nay đã ra mắt Gemini 3.8 Live và 3.8 Live Extended Thinking - hai mô hình chuyển đổi giọng nói sang giọng nói (speech-to-speech) mới có cấu trúc tương tự như dòng GPT-Live của OpenAI.

Tôi đã hướng GPT-6 Astra Extra High vào tài liệu hướng dẫn và yêu cầu nó xây dựng giao diện web này để trải nghiệm các mô hình mới. Bạn có thể chọn mô hình và cài đặt giọng nói trước, nhập system prompt tùy chọn, sau đó bắt đầu cuộc trò chuyện bằng giọng nói ngay trên trình duyệt, bao gồm cả khả năng ngắt lời mô hình khi nó đang nói.

Bản triển khai này không sử dụng bất kỳ thư viện nào. Nó kết nối tới endpoint WebSocket wss://generativelanguage.googleapis.com/ws/google.ai.generativelanguage.v1alpha.GenerativeService.BidiGenerateContent?key=... và sử dụng Web Audio API AudioContext cho cả việc thu âm và phát lại.

Đây là hướng dẫn Gemini Live để bắt đầu làm quen với API WebSockets đó.
