Vào ngày 20/09/2026, dự án mã nguồn mở StableDiffusion‑X trên GitHub công bố phiên bản 2.0, bổ sung tính năng Text‑to‑3D (từ mô tả văn bản đến mô hình 3D). Tính năng này dựa trên mô hình diffusion mới, kết hợp với mạng neural implicit để sinh ra lưới đa giác có độ chi tiết cao.
Nhờ vào kiến trúc mới, người dùng chỉ cần nhập một mô tả như "một chiếc xe thể thao màu đỏ với ánh sáng phản chiếu" và hệ thống sẽ tạo ra mô hình 3D có thể xuất ra định dạng OBJ, GLTF hoặc FBX. Các nhà phát triển có thể tích hợp trực tiếp vào các công cụ thiết kế như Blender hoặc Unity thông qua plugin mới.
Dự án thu hút hơn 12.000 sao trên GitHub và đã nhận được hơn 800 pull request trong tháng qua, phản ánh mức độ quan tâm mạnh mẽ của cộng đồng. Các nhà nghiên cứu từ MIT và OpenAI đã đóng góp vào việc tối ưu hoá thuật toán, giảm thời gian sinh mô hình từ 30 giây xuống còn dưới 5 giây trên GPU tiêu chuẩn.
StableDiffusion‑X 2.0 được phát hành dưới giấy phép Creative Commons Attribution‑NonCommercial, cho phép sử dụng trong các dự án phi thương mại và giáo dục. Nhóm phát triển khuyến khích cộng đồng đóng góp thêm các mô-đun render và texture để mở rộng khả năng sáng tạo.