OpenAI đã phát hành mô hình mới mang tên Ultrafast, nổi bật với tốc độ phản hồi mô hình cao hơn. Công ty cho biết, chế độ này cho phép GPT 5.6 Sol chạy với tốc độ nhanh gấp 14 lần so với tốc độ xử lý tiêu chuẩn, với tốc độ đầu ra tối đa lên đến 750 token mỗi giây, hiện đang được cung cấp dưới dạng bản xem trước cho một số ít khách hàng.
Cập nhật này nhắm vào nhu cầu của doanh nghiệp về xử lý AI thời gian thực. OpenAI cho biết, trước đây, nếu muốn có phản hồi gần như thời gian thực, thường phải chuyển sang sử dụng các mô hình nhỏ hơn hoặc chọn các hệ thống được tối ưu hóa cho các nhiệm vụ cụ thể. Hướng đi của Ultrafast là tăng lượng công việc hiệu quả có thể hoàn thành trong một đơn vị thời gian mà không chỉ đơn thuần dựa vào các mô hình nhỏ.
Tăng tốc độ đầu ra
Theo OpenAI, điểm bán chính của Ultrafast là giảm đáng kể thời gian chờ tạo ra nội dung.
- Tốc độ đầu ra tối đa lên đến 750 token mỗi giây
- Tốc độ xử lý khoảng 14 lần so với chế độ tiêu chuẩn
- Phiên bản hiện tại vẫn đang ở giai đoạn xem trước
TechCrunch nhắc đến rằng các đối thủ như Anthropic trước đây cũng đã ra mắt chế độ tăng tốc. Ví dụ về Claude, sản phẩm của họ cũng cung cấp chế độ nhanh, nhưng các chỉ số tốc độ mà OpenAI công bố lần này cao hơn.
Hướng đến quy trình doanh nghiệp
OpenAI hướng các ứng dụng của Ultrafast vào nhiều nhiệm vụ doanh nghiệp, với trọng tâm bao gồm phản ứng sự kiện, dịch vụ và hỗ trợ khách hàng, phân tích thị trường tài chính và các hoạt động thương mại điện tử. Các kịch bản này thường nhạy cảm hơn với độ trễ, thời gian phản hồi của mô hình sẽ直接影响 hiệu quả hợp tác của con người và hiệu suất của các quy trình tự động hóa.
Từ góc độ định vị sản phẩm, Ultrafast không phải là một mô hình mới độc lập, mà là một phương thức vận hành tốc độ cao được xây dựng xung quanh GPT 5.6 Sol. Đối với khách hàng doanh nghiệp, điều này có nghĩa là duy trì khả năng mạnh mẽ của mô hình trong khi cố gắng tích hợp AI trực tiếp hơn vào các quy trình kinh doanh thời gian thực.
Được hỗ trợ bởi Cerebras
OpenAI cho biết Ultrafast được hỗ trợ bởi sự hợp tác với công ty chip Cerebras. Các quyền truy cập bản xem trước đầu tiên hiện chỉ dành cho một nhóm nhỏ khách hàng, và sẽ được mở rộng dần khi năng lực tính toán tăng lên.
Điều này cũng cho thấy cuộc cạnh tranh giữa các mô hình lớn đang mở rộng từ việc so sánh tham số và khả năng sang tốc độ phản hồi, hiệu quả triển khai và sự phối hợp của sức mạnh tính toán nền tảng. Đối với các sản phẩm AI hướng đến thị trường doanh nghiệp, tốc độ đang trở thành một chỉ số quan trọng ngang hàng với chất lượng mô hình.
