AI·NEWS
Mô hình AI Nguồn: TechCrunch 18:10:58 14/9/2026

OpenAI chính thức phát hành GPT-5.5-Turbo: Tối ưu hóa suy luận thời gian thực và giảm 40% chi phí API

OpenAI vừa công bố phiên bản GPT-5.5-Turbo với khả năng xử lý đa phương thức thời gian thực, cải thiện vượt bậc về tốc độ suy luận toán học và lập trình với chi phí vận hành giảm đáng kể.

OpenAI chính thức phát hành GPT-5.5-Turbo: Tối ưu hóa suy luận thời gian thực và giảm 40% chi phí API

Sáng nay (14/09/2026), OpenAI đã chính thức ra mắt mô hình AI thế hệ mới mang tên GPT-5.5-Turbo. Đây được xem là bước đi chiến lược của công ty nhằm phổ cập hóa khả năng suy luận nâng cao tới cộng đồng các nhà phát triển toàn cầu với mức giá dễ tiếp cận hơn nhiều so với các phiên bản tiền nhiệm.

Điểm nổi bật nhất của GPT-5.5-Turbo nằm ở kiến trúc lai (hybrid architecture) kết hợp giữa mô hình ngôn ngữ lớn tiêu chuẩn và các mạng suy luận chuỗi tư duy (Chain-of-Thought) thế hệ mới. Điều này cho phép mô hình xử lý trực tiếp luồng video và âm thanh theo thời gian thực với độ trễ dưới 80 millisecond, mở ra tiềm năng lớn cho các ứng dụng trợ lý ảo tương tác tự nhiên và tự động hóa trong sản xuất.

Bên cạnh đó, OpenAI cho biết GPT-5.5-Turbo ghi nhận mức giảm chi phí token lên tới 40% so với GPT-5. Các bài kiểm tra hiệu năng (benchmark) độc lập cho thấy mô hình đạt điểm số vượt trội trong các thử nghiệm lập trình phần mềm phức tạp (SWE-bench) và giải quyết các bài toán cấp độ học thuật.

Hiện tại, API của GPT-5.5-Turbo đã chính thức mở cho tất cả tài khoản nhà phát triển trên hệ thống của OpenAI. Các tập đoàn công nghệ lớn như Microsoft và Salesforce cũng đã công bố kế hoạch tích hợp ngay mô hình này vào các nền tảng doanh nghiệp của họ trong vài tuần tới.

Về trang chủ

Nội dung do AI tổng hợp, tham khảo theo nguồn "TechCrunch"