BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%
lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
Trang chủ
AI AI
Tin nhanh
Bài viết
Sự kiện
BlockBeats Pro
Thêm
Thông tin tài chính
Chuyên đề
Hệ sinh thái chuỗi khối
Mục nhập
Podcast
Data
OPRR

Google Gemini 3.8 TTS: Chỉ cần mẫu 30 giây là có thể sao chép giọng nói

Động Sát Beating AI tin nhanh, Google ra mắt Gemini 3.8 Flash TTS và Flash-Lite TTS, hai mô hình chuyển văn bản thành giọng nói đã mở trên Gemini API và Google AI Studio. Flash tập trung vào chất lượng âm thanh, diễn xuất nhân vật và độ ổn định văn bản dài, Lite thiên về thông lượng cao, độ trễ thấp và chi phí thấp.


Hai mô hình đều có thể dùng văn bản để thiết kế giọng nói mới, cũng có thể dùng khoảng 30 giây âm thanh tham chiếu để nhân bản giọng của chính mình hoặc giọng đã được ủy quyền. Người dùng có thể kiểm soát cảm xúc, nhịp điệu và giọng điệu theo từng câu, còn có thể chèn tiếng cười, tiếng thở dài, tiếng ho và các âm thanh khác. Hội thoại hai người cũng có thể tạo trực tiếp bằng một kịch bản. Flash hỗ trợ 130 ngôn ngữ, Lite hỗ trợ 101 ngôn ngữ.


Giá cũng thấp hơn thế hệ trước. Đến ngày 31 tháng 12 năm 2026, đầu ra âm thanh của Flash là 9 USD mỗi triệu tokens, Lite là 6 USD; thế hệ trước Gemini 3.1 Flash TTS Preview là 20 USD. Từ ngày 1 tháng 1 năm 2027, giá tiêu chuẩn của hai mô hình sẽ tăng lên 18 USD và 12 USD.

Báo lỗi/Báo cáo
Gửi
Thêm mới thư viện
Chỉ mình tôi có thể nhìn thấy
Công khai
Lưu
Chọn thư viện
Thêm mới thư viện
Hủy
Hoàn thành