Google DeepMind vừa công bố một công trình nghiên cứu mang tính bước ngoặt trong lĩnh vực học tăng cường trực quan (visual reinforcement learning). Bằng cách kết hợp mô hình nền tảng thị giác với thuật toán dự đoán động lực học, hệ thống mới có khả năng xem các video con người thực hiện công việc thực tế (như nấu ăn, lắp ráp linh kiện) và tự động chuyển đổi thành kỹ năng điều khiển robot.
Điểm cốt lõi của nghiên cứu này là khả năng tự khái quát hóa. Thay vì phải huấn luyện riêng cho từng thao tác cụ thể, mô hình AI của DeepMind có thể hiểu được mục đích của hành động và tự điều chỉnh cách thực hiện sao cho phù hợp với phần cứng robot sẵn có tại nhà xưởng hoặc phòng thí nghiệm.
Giới hàn lâm đánh giá đây là mảnh ghép quan trọng để đưa robot thông minh vào đời sống thực tế với tốc độ triển khai nhanh hơn nhiều so với trước đây, tiết kiệm hàng triệu giờ lao động gán nhãn dữ liệu thủ công.