OpenAI hôm nay đã công bố phiên bản mới nhất của dòng mô hình ngôn ngữ GPT, gọi là GPT‑5 Turbo. Theo công ty, mô hình này sử dụng kiến trúc Transformer nâng cấp với kỹ thuật Sparse Attention, giúp tăng tốc độ suy luận gấp đôi so với GPT‑4, đồng thời giảm chi phí tính toán khoảng 30% nhờ tối ưu hoá bộ nhớ và việc sử dụng các kernel GPU mới.
GPT‑5 Turbo hỗ trợ độ dài ngữ cảnh lên tới 8.000 token, cho phép các nhà phát triển xây dựng các ứng dụng hội thoại dài hơn và các công cụ tóm tắt tài liệu phức tạp mà không cần cắt ngắn nội dung. Ngoài ra, mô hình còn được đào tạo trên bộ dữ liệu đa ngôn ngữ mở rộng, cải thiện đáng kể độ chính xác trong các ngôn ngữ ít tài nguyên như tiếng Việt, Hausa và Khmer.
OpenAI cũng công bố bộ API mới, cho phép các doanh nghiệp tích hợp GPT‑5 Turbo vào các sản phẩm của mình với mức giá cạnh tranh hơn. Các đối tác đã thử nghiệm sớm cho biết tốc độ phản hồi giảm từ 800ms xuống còn 350ms cho các truy vấn trung bình, đồng thời chất lượng đáp án duy trì hoặc cải thiện so với GPT‑4.
Với sự ra mắt này, OpenAI đặt mục tiêu duy trì vị thế dẫn đầu trong thị trường LLM, đồng thời mở ra cơ hội cho các startup và nhà phát triển độc lập tận dụng sức mạnh của mô hình mới mà không phải gánh chịu chi phí hạ tầng quá cao.