OpenAI meluncurkan model baru bernama Ultrafast, yang menonjolkan kecepatan respons model yang lebih tinggi. Perusahaan menyatakan bahwa mode ini memungkinkan GPT 5.6 Sol berjalan dengan kecepatan 14 kali lebih cepat dari kecepatan pemrosesan standar, dengan kecepatan output hingga 750 token per detik, dan saat ini hanya tersedia dalam bentuk preview untuk sejumlah kecil pelanggan.
Pembaruan ini bertujuan untuk memenuhi kebutuhan perusahaan akan pemrosesan AI real-time. OpenAI menyatakan bahwa sebelumnya, untuk mendapatkan respons yang lebih mendekati real-time, biasanya diperlukan peralihan ke model yang lebih kecil, atau memilih sistem yang dioptimalkan untuk tugas tertentu. Pendekatan Ultrafast adalah meningkatkan jumlah pekerjaan efektif yang dapat diselesaikan per satuan waktu, tanpa hanya mengandalkan model kecil.
Kecepatan output meningkat
Menurut OpenAI, fitur utama Ultrafast adalah kompresi signifikan terhadap waktu tunggu generasi.
- Kecepatan output maksimum hingga 750 token per detik
- Kecepatan pemrosesan sekitar 14 kali lebih cepat daripada mode standar
- Versi saat ini masih dalam tahap pratinjau
TechCrunch menyebutkan bahwa pesaing seperti Anthropic sebelumnya juga telah meluncurkan mode percepatan. Sebagai contoh, produk Claude juga menyediakan mode cepat, tetapi indikator kecepatan yang diumumkan oleh OpenAI kali ini lebih tinggi.
Untuk alur kerja perusahaan
OpenAI mengarahkan aplikasi Ultrafast ke berbagai tugas perusahaan, dengan fokus utama pada respons insiden, layanan dan dukungan pelanggan, analisis pasar keuangan, serta bisnis e-commerce. Skenario-skenario ini biasanya lebih sensitif terhadap latensi, di mana waktu respons model secara langsung memengaruhi efisiensi kolaborasi manusia dan kinerja proses otomatisasi.
Dari sudut pandang posisi produk, Ultrafast bukanlah model baru yang terpisah, melainkan cara menjalankan dengan kecepatan tinggi yang mengelilingi GPT 5.6 Sol. Bagi pelanggan perusahaan, ini berarti mempertahankan kemampuan model yang kuat sekaligus mencoba menanamkan AI secara lebih langsung ke dalam proses bisnis real-time.
Didukung oleh Cerebras
OpenAI menyatakan bahwa Ultrafast didukung oleh kolaborasinya dengan perusahaan chip Cerebras. Kualifikasi pra-pandangan pertama saat ini hanya tersedia untuk sejumlah kecil pelanggan, dan akan diperluas secara bertahap seiring peningkatan kapasitas daya komputasi.
Ini juga menunjukkan bahwa persaingan model besar sedang berkembang dari perbandingan parameter dan kemampuan menjadi kecepatan respons, efisiensi deploy, dan kolaborasi daya komputasi dasar. Bagi produk AI yang ditujukan untuk pasar perusahaan, kecepatan kini menjadi indikator kunci yang sejajar dengan kualitas model.
