OpenAI mengumumkan pada 1 Ogos bahawa model baharu mereka, Astra, telah menyelesaikan 10 masalah lama dalam matematik dan sains komputer teori. Tindak balas daripada komuniti matematik adalah pantas, dan ia bukan tepukan tangan.
Penyelidik terkemuka menuduh syarikat itu merendahkan kerja sebelumnya, gagal memberikan pengiktirafan yang sewajarnya terhadap sumbangan yang sedia ada, dan melebih-lebihkan kebaruan hasil yang dihasilkan oleh AI-nya.
Klaim dan penolakan
Menurut OpenAI, model Astra menangani masalah yang merangkumi batas pengepakan bola berdimensi tinggi, pembentukan kumpulan bukan-sofic, kemajuan dalam teori pengkodan, dan kerumitan litar aritmetik. Syarikat tersebut menggambarkan bidang-bidang ini sebagai kawasan yang “tidak ada kemajuan terhadap keputusan utama selama sekurang-kurangnya satu dekad.”
Steven Miller, seorang ahli matematik di Universiti Yeshiva, dan Francesco Fournier-Facio dari Universiti Cambridge adalah antara penyelidik yang menentang dengan tegas. Hujah mereka: keputusan Astra dibina atas kerja sebelumnya yang diabaikan atau direndahkan oleh OpenAI. Andreas Thom dan Miller sendiri telah menerbitkan kajian yang berkaitan seawal tahun 2016, kerja yang secara langsung membentuk wilayah yang kini diklaim oleh Astra sebagai telah ditakluki.
Kos komputasi keseluruhan untuk kesepuluh hasil dilaporkan sekitar $2,000 dalam penggunaan token.
Pada 6 Ogos, Scientific American telah menerbitkan laporan yang menggambarkan pengurusan pengumuman OpenAI sebagai “kesalahan penyelidikan” dan plagiari. OpenAI kemudian memperbetulkan beberapa pernyataannya.
Sebuah corak, bukan satu insiden
Ini bukan kali pertama OpenAI berhadapan dengan kontroversi berkenaan dakwaan matematik. Pada Oktober 2025, bekas VP Kevin Weil memuat naik bahawa GPT-5 telah menyelesaikan masalah berkaitan konjektur Paul Erdős. Pos itu telah dihapus tanpa pemberitahuan.
Kemudian pada 20 Mei 2026, OpenAI mengatakan modelnya telah membantah satu konjektur yang berasal dari tahun 1946. Pengumuman itu menerima sokongan daripada ahli matematik terkemuka termasuk Noga Alon dan Thomas Bloom, yang memberikan kredibiliti yang sebenar.
Mengapa ini penting melebihi akademik
Angka kos pengiraan $2,000 adalah contoh sempurna bagaimana konteks membentuk maksud. Secara berasingan, ia adalah data yang luar biasa yang menunjukkan bahawa penyelidikan matematik terkini mungkin akan menjadi jauh lebih murah. Dalam konteks, ia menimbulkan soalan yang berbeza: apakah sebenarnya yang dibeli dengan $2,000 itu? Jika Astra mensintesis puluhan tahun kerja manusia menjadi satu pakej yang rapi tanpa memberi pengiktirafan kepada manusia, kos pengiraan itu kurang merupakan ukuran kemampuan AI dan lebih merupakan ukuran betapa murahnya pengetahuan sedia ada boleh dirangkai semula.
