Cộng đồng lập trình mã nguồn mở đang dành sự quan tâm đặc biệt cho dự án NeuralVoice-Studio vừa xuất hiện trên GitHub. Đây là một bộ công cụ tổng hợp giọng nói sử dụng mạng thần kinh nhân tạo nhẹ, cho phép chạy mượt mà ngay trên các máy tính cá nhân có card đồ họa tầm trung mà không cần phụ thuộc vào dịch vụ đám mây đắt đỏ.
Điểm nổi bật của NeuralVoice-Studio là khả năng nắm bắt sắc thái cảm xúc, ngữ điệu và nhịp thở của người nói chỉ qua một đoạn ghi âm dài vỏn vẹn 3 giây. Dự án hỗ trợ hơn 40 ngôn ngữ khác nhau, bao gồm cả tiếng Việt với độ chính xác và tự nhiên rất cao, hạn chế tối đa cảm giác 'robot' thường thấy ở các hệ thống TTS cũ.
Sự ra đời của dự án này đang tạo ra làn sóng mới cho các nhà sáng tạo nội dung, nhà phát triển game độc lập và ngành công nghiệp làm phim hoạt hình trong việc tối ưu hóa chi phí lồng tiếng.