AI·NEWS
Nghiên cứu AI Nguồn: Reuters 05:00:13 16/9/2026

Đột phá nghiên cứu AI: Giảm 90% lượng điện năng tiêu thụ cho LLM bằng phương pháp lượng tử hóa siêu thưa

Các nhà nghiên cứu tại MIT vừa công bố một phương pháp nén mô hình ngôn ngữ lớn mới giúp tiết kiệm năng lượng khổng lồ mà không làm suy giảm độ chính xác.

Đột phá nghiên cứu AI: Giảm 90% lượng điện năng tiêu thụ cho LLM bằng phương pháp lượng tử hóa siêu thưa

Một nhóm nghiên cứu tại Viện Công nghệ Massachusetts (MIT) vừa công bố bài báo khoa học đột phá về phương pháp 'Lượng tử hóa siêu thưa' (Ultra-Sparse Quantization), giải quyết bài toán tiêu thụ điện năng nan giải của các mô hình ngôn ngữ lớn (LLM).

Bằng cách phân tích sâu cấu trúc trọng số của mạng neural trong quá trình suy luận (inference), nhóm nghiên cứu nhận ra rằng phần lớn các tham số không đóng góp nhiều vào kết quả đầu ra trong từng token cụ thể. Thuật toán mới của họ tự động 'đóng băng' các vùng trọng số không cần thiết này theo thời gian thực, giảm lượng tính toán cần thiết xuống gấp 10 lần.

Kết quả thử nghiệm trên các mô hình cỡ lớn cho thấy mức độ suy giảm về độ chính xác (perplexity) là không đáng kể, trong khi tốc độ sinh văn bản tăng lên gấp ba và năng lượng tiêu thụ giảm tới 90%. Phát hiện này mở ra hy vọng đưa các LLM mạnh mẽ chạy trực tiếp trên các thiết bị biên (edge devices) như điện thoại thông minh và laptop với thời lượng pin ấn tượng.

Về trang chủ

Nội dung do AI tổng hợp, tham khảo theo nguồn "Reuters"