Pangram Mengklaim Akurasi 99,98% dalam Deteksi Konten AI, Memicu Perdebatan

iconCryptoBriefing
Bagikan
AI summary iconRingkasan
Pangram, sebuah startup berbasis di Brooklyn, mengklaim bahwa alat deteksi konten AI-nya mencapai akurasi 99,98% dalam mengidentifikasi teks yang dihasilkan AI. Alat ini, yang mendukung lebih dari 20 bahasa dan terintegrasi dengan platform seperti Canvas dan Google Classroom, telah menarik perhatian di kalangan berita AI + crypto. Uji independen oleh Universitas Chicago dan Universitas Maryland menunjukkan tingkat akurasi antara 99,8% hingga 100% pada model-model utama. Namun, diskusi akademis terbaru telah mempertanyakan perbedaan dalam tingkat false positive di dunia nyata. Seiring berlanjutnya berita suku bunga yang membentuk perilaku pasar, perdebatan mengenai alat deteksi AI tetap panas.

Sebuah startup berbasis Brooklyn bernama Pangram Labs mengatakan dapat menentukan apakah suatu teks ditulis oleh manusia atau mesin dengan presisi hampir sempurna. Perusahaan ini mengklaim alat deteksinya mampu mendeteksi teks yang dihasilkan AI dengan tingkat keberhasilan melebihi 99,98%, dengan tingkat false positive hanya 1 dalam 10.000 pada teks yang ditulis manusia.

Didirikan pada tahun 2023 oleh mantan peneliti Stanford, Max Spero dan Bradley Emi, Pangram telah menempatkan dirinya di pusat salah satu pertanyaan paling penting dalam media digital: apakah Anda dapat membuktikan secara andal bahwa suatu konten dibuat oleh manusia?

Apa yang sebenarnya dilakukan Pangram

Anda memberikannya sepotong tulisan, berapa pun panjangnya dari 75 kata hingga 75.000 karakter, dan ia akan menghasilkan hasil: Ditulis Manusia, Dibantu AI Ringan, Dibantu AI Sedang, atau Sepenuhnya Dihasilkan AI. Ia juga memberikan skor bantuan AI numerik untuk analisis yang lebih rinci.

Iklan

Alat ini mendukung lebih dari 20 bahasa dan terintegrasi dengan sistem manajemen pembelajaran seperti Canvas dan Google Classroom.

Pengujian independen telah memberikan hasil yang menggembirakan. Evaluasi oleh Sekolah Bisnis Booth Universitas Chicago dan Universitas Maryland menemukan tingkat akurasi antara 99,8% hingga 100% pada konten dari model bahasa utama, termasuk ChatGPT dan Claude. Pada benchmark RAID, sekumpulan uji yang banyak digunakan untuk alat deteksi, Pangram mencapai akurasi 99,44% dengan tingkat false positive 0,05%.

Perusahaan merilis Pangram 3.1 pada 16 Januari 2026, menambahkan kemampuan untuk skenario teks campuran di mana tulisan manusia dan output AI digabungkan. Pembaruan tersebut juga membawa dukungan multi-bahasa dan deteksi spesifik model yang disesuaikan dengan sistem AI individu.

Di sisi pendanaan, Pangram menutup putaran seed sekitar $4 juta pada Juni 2025, dipimpin oleh ScOp dengan partisipasi dari Script Capital, Cadenza, dan Haystack di tahap pre-seed.

Debat akurasi adalah tempat hal-hal menjadi menarik

Diskusi akademis sejak Maret 2026 baru-baru ini menyoroti kesenjangan antara tingkat false positive yang dipasarkan oleh Pangram dan apa yang sebenarnya ditemukan oleh beberapa evaluasi pihak ketiga. Meskipun perusahaan mengiklankan angka 1 banding 10.000, beberapa studi eksternal mencatat tingkat false positive rata-rata berkisar antara 0,48% hingga 2%.

Hasil uji independen Pangram pada kumpulan data akademik, berita, dan penulisan kreatif menunjukkan tingkat false positive antara 0% hingga 0,17%. Ketegangannya terletak pada apakah tolok ukur terkendali tersebut dapat diterapkan secara bersih ke dunia nyata yang kacau dan beragam.

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.