Cekricek.id — OpenAI membuka pratinjau mode baru bernama Ultrafast untuk model GPT-5.6 Sol, yang diklaim berjalan hingga 14 kali lebih cepat dibanding mode standar. Kecepatan itu dicapai bukan lewat model baru, melainkan lewat perangkat keras: seluruh proses inferensi dijalankan di atas cip berukuran satu wafer buatan Cerebras Systems.
Dikutip dari laman resmi OpenAI, openai.com, Kamis (13/8/2026), Ultrafast mampu mengeluarkan hingga 750 token keluaran per detik. Sebagai perbandingan, model bahasa besar kelas atas umumnya berada di kisaran puluhan hingga seratusan token per detik. Untuk sementara mode ini hanya dibuka bagi sebagian pelanggan terpilih, dan OpenAI belum mengumumkan harganya.
Kunci di Memori yang Menempel pada Cip
Cerebras menjelaskan bahwa lompatan kecepatan itu bersumber dari arsitektur memorinya. Setiap cip seukuran wafer yang dipakai perusahaan asal California itu membawa 44 gigabita memori SRAM di dalam kepingnya sendiri. Karena bobot model bisa disimpan langsung di sana, sistem tidak perlu bolak-balik menarik data dari memori eksternal, dan hambatan yang biasanya memperlambat inferensi bisa dipangkas.
Chief Executive Officer sekaligus salah satu pendiri Cerebras, Andrew Feldman, menyebut hasil itu membatalkan anggapan lama bahwa model yang pintar pasti lambat. “GPT-5.6 Sol on Ultrafast is proof that speed and intelligence are no longer mutually exclusive,” kata Feldman dalam siaran pers resmi perusahaan, Kamis (13/8/2026).
Baca juga: Brad Lightcap Mundur dari OpenAI Setelah Delapan Tahun
Dari sisi OpenAI, Vice President Compute Strategy and GPT-Infra, Sachin Katti, menempatkan kerja sama ini sebagai penjajakan. Dalam pernyataan berbahasa Inggris itu ia mengatakan perusahaannya sedang menguji apa yang menjadi mungkin ketika pelanggan bisa memperoleh kecerdasan model tercanggih mereka dengan latensi yang jauh lebih rendah. “By combining GPT-5.6 Sol with Cerebras’ inference technology, we’re exploring what becomes possible when customers can get the intelligence of our most capable models with significantly lower latency,” ujar Katti.
Angka Uji yang Diklaim Cerebras
Cerebras memaparkan sejumlah hasil pengujian internal. Pada set soal Humanity’s Last Exam yang berisi 2.500 pertanyaan, sistem disebut menyelesaikan seluruh soal dalam waktu lebih dari 11 jam, dibanding lebih dari tiga hari pada pembanding yang dipakai perusahaan. Pada tolok ukur GDP-Val, perusahaan mengklaim percepatan 5,6 kali dari ujung ke ujung tanpa penurunan kualitas jawaban.
Semua angka itu berasal dari pihak yang berkepentingan dan belum diverifikasi lembaga penguji independen. Cerebras juga membandingkan kecepatannya dengan model pesaing dari perusahaan lain, klaim yang lazim muncul dalam materi pemasaran cip inferensi dan perlu dibaca dengan hati-hati.
Yang Berubah bagi Pengguna
Kecepatan keluaran menentukan jenis produk yang bisa dibangun di atas sebuah model. Pada pekerjaan yang menuntut jawaban seketika — asisten suara, agen pemrograman yang menulis kode sembari ditunggu, atau riset yang menuntut banyak langkah berantai — jeda beberapa detik sudah cukup membuat pengalaman terasa patah.
Sejumlah pengguna awal yang dikutip OpenAI menggambarkan perubahan itu. John Crepezzi dari tim AI Assistants Jane Street menilai lonjakan kecepatan tersebut membuka cara pakai yang berbeda. “The increase in speed brought by Cerebras is impressive. It enables different ways of using the models, and makes it practical for developers to work in a more focused and productive way alongside them,” katanya.
Baca juga: Startup AI Igor Babuschkin, River AI, Raih Pendanaan 1,1 Miliar Dolar AS
Product Lead untuk Voice AI di Podium, Courtland Lykins, menyebut mode itu mengubah pengalaman panggilan telepon otomatis pada kasus yang rumit. “For us the Ultrafast has been invaluable in our voice stack. The speed completely changes the call experience for the more complex work,” tuturnya.
Ultrafast juga menandai posisi Cerebras yang makin menonjol di pasar inferensi. Perusahaan itu selama ini kalah jauh dari Nvidia dalam pangsa pasar cip kecerdasan buatan, tetapi memilih bertarung pada satu hal spesifik, yakni kecepatan menjalankan model yang sudah dilatih, bukan pada proses pelatihannya.
Baca juga: Wix Rilis Symphony, Sistem Multi-Agen AI untuk Usaha Kecil
OpenAI menyatakan akses akan diperluas seiring bertambahnya kapasitas komputasi dan membuka pendaftaran bagi pelanggan yang ingin mendapat pemberitahuan. Perusahaan belum menyebut kapan Ultrafast tersedia untuk seluruh pengguna berbayar maupun berapa tarif per token yang akan dikenakan.

















