Nvidia đã công bố hôm nay kế hoạch ra mắt GPU mới, tên gọi Nvidia H100X, chuyên dụng cho các tác vụ inference AI. Được xây dựng trên kiến trúc Hopper 3.0, H100X hứa hẹn mang lại tốc độ xử lý gấp bốn lần so với GPU H100 hiện tại, đồng thời giảm tiêu thụ năng lượng tới 30% nhờ vào công nghệ chiplet mới và bộ nhớ HBM3e.
GPU này được tối ưu hoá cho các mô hình lớn như GPT‑5, Gemini 2.0 và các mô hình diffusion 3D, cho phép triển khai các dịch vụ AI thời gian thực trong môi trường đám mây và edge. Nvidia cũng giới thiệu phần mềm AI Stack mới, hỗ trợ tự động tối ưu hoá mô hình và phân phối tải công việc trên nhiều GPU.
Giá khởi điểm của H100X được công bố là 4.999 USD, hướng tới các doanh nghiệp vừa và lớn có nhu cầu triển khai AI inference ở quy mô cao. Nvidia dự kiến sẽ bắt đầu giao hàng vào cuối quý 2 năm 2027 và đã ký hợp đồng cung cấp hàng trăm ngàn đơn vị cho các nhà cung cấp dịch vụ đám mây lớn như AWS, Azure và Google Cloud.
Những cải tiến này được kỳ vọng sẽ thúc đẩy việc triển khai các ứng dụng AI phức tạp như chatbot thời gian thực, xử lý video AI và các hệ thống đề xuất quy mô lớn, đồng thời giảm chi phí vận hành cho các doanh nghiệp sử dụng AI.