Google telah meluncurkan tiga model Gemini baru yang bertujuan membuat agen AI lebih cepat, lebih murah, dan lebih efisien seiring meningkatnya persaingan di bidang pemrograman, otomasi perusahaan, dan keamanan siber.
Lineup mencakup Gemini 3.6 Flash, Gemini 3.5 Flash Lite, dan Gemini 3.5 Flash Cyber. Google juga mengonfirmasi bahwa Gemini 3.5 Pro sedang diuji bersama mitra dan telah memulai proses pretraining paling ambisiusnya hingga kini untuk Gemini 4.
Gemini 3.6 Flash berfungsi sebagai model utama dalam rilis ini, menawarkan kinerja pemrograman, pekerjaan pengetahuan, dan multimodal yang lebih kuat sambil mengonsumsi lebih sedikit token dibandingkan Gemini 3.5 Flash.
Menurut Google, model ini menggunakan 17% lebih sedikit token keluaran pada Artificial Analysis Index. Perusahaan mengatakan pengurangan token mencapai hingga 65% dalam beberapa pengujian DeepSWE tertentu, dengan model juga memerlukan lebih sedikit langkah penalaran dan pemanggilan alat untuk menyelesaikan alur kerja multi-langkah.
Gemini 3.6 Flash berharga $1,50 per juta token masukan dan $7,50 per juta token keluaran, memberikan harga lebih rendah per tugas agen dibandingkan pendahulunya.
Model ini mendapat skor 49% di DeepSWE, dibandingkan dengan 37% untuk Gemini 3.5 Flash, mencerminkan presisi yang lebih tinggi dan lebih sedikit perubahan kode yang tidak perlu. Skor MLE Bench-nya meningkat menjadi 63,9% dari 49,7%.
Penggunaan komputer juga meningkat, dengan Gemini 3.6 Flash mencapai 83% di OSWorld Verified, dibandingkan 78,4% untuk model sebelumnya. Penggunaan komputer tersedia sebagai alat sisi klien bawaan melalui Gemini API dan Gemini Enterprise.
Google mengatakan model ini sangat cocok untuk alur kerja agen, tugas pemrograman, dan proses perusahaan berdurasi panjang. Model ini mendukung teks, gambar, audio, dan video, dengan jendela konteks hingga satu juta token.
Flash Lite menargetkan beban kerja AI bervolume tinggi
Gemini 3.5 Flash Lite dirancang untuk aplikasi di mana kecepatan, throughput, dan biaya lebih penting daripada menggunakan model yang lebih besar.
Model ini menghasilkan sekitar 350 token output per detik, menurut Artificial Analysis, menjadikannya model tercepat dalam jajaran Gemini 3.5.
Dihargai sebesar $0,30 per juta token masukan dan $2,50 per juta token keluaran. Google menempatkannya untuk beban kerja volume tinggi seperti pencarian agen, pemrosesan dokumen, ekstraksi data, terjemahan, dan ringkasan.
Pengembang dapat menyesuaikan tingkat pemikiran model tergantung pada tugasnya. Pengaturan minimal dan rendah memprioritaskan eksekusi yang lebih cepat dan lebih murah, sementara pengaturan lebih tinggi mendukung alur kerja subagen yang lebih kompleks.
Gemini 3.5 Flash Lite mendapat skor 54% di Terminal Bench 2.1, dibandingkan dengan 31% untuk Gemini 3.1 Flash Lite. Ini juga mencapai 72,2% di GDM MRCR v2, naik dari 60,1%, dan 1.140 di GDPval AA v2, dibandingkan dengan 642.
Google mengatakan Flash Lite juga unggul dibanding Gemini 3 Flash yang lebih besar pada beberapa benchmark pemrograman dan agen, termasuk SWE Bench Pro dan OSWorld Verified.
Google memposisikan Flash Cyber melawan Mythos milik Anthropic
Model ketiga, Gemini 3.5 Flash Cyber, dirancang khusus untuk menemukan, memvalidasi, dan memperbaiki kerentanan perangkat lunak.
Dibangun di atas Gemini 3.5 Flash, model ini beroperasi melalui CodeMender, agen keamanan kode milik Google. Beberapa agen Flash Cyber dapat bekerja sama untuk menganalisis kerentanan dan menghasilkan laporan gabungan.
Google mengatakan sistem tersebut mencapai kinerja yang kompetitif di CyberGym sambil beroperasi dengan harga per token lebih rendah daripada model keamanan siber yang lebih besar.
Posisi rilis ini menempatkan Flash Cyber sebagai pesaing berbiaya lebih rendah terhadap model keamanan canggih seperti Mythos dari Anthropic, yang dirancang untuk menemukan kerentanan dan penalaran siber kompleks.
Google mengambil pendekatan terbatas terhadap peluncuran model ini karena potensi penyalahgunaan siber. Flash Cyber awalnya hanya akan tersedia untuk pemerintah dan mitra terpercaya melalui pilot CodeMender terbatas.
Perusahaan mengatakan peluncuran ini dimaksudkan untuk memberi para pembela akses ke alat deteksi dan perbaikan kerentanan sebelum model tersebut tersedia secara lebih luas.
Pelatihan awal Gemini 4 dimulai
Gemini 3.6 Flash dan Gemini 3.5 Flash Lite tersedia melalui Gemini API, Google AI Studio, Android Studio, dan Gemini Enterprise.
Gemini 3.6 Flash juga tersedia melalui Google Antigravity dan aplikasi Gemini, sementara Flash Lite sedang diluncurkan melalui Google Search.
Rilisan tiba sementara Google terus menguji Gemini 3.5 Pro dengan mitra. Model unggulan belum menerima tanggal rilis luas.
Google juga mengonfirmasi bahwa pengembangan generasi berikutnya sedang berlangsung, dengan perusahaan memulai apa yang digambarkannya sebagai pelatihan awal paling ambisius hingga kini untuk Gemini 4.
