Google telah melancarkan tiga model Gemini baharu yang bertujuan menjadikan agen AI lebih pantas, lebih murah dan lebih cekap seiring meningkatnya persaingan dalam bidang pengkodean, automasi perniagaan dan keselamatan siber.
Senarai termasuk Gemini 3.6 Flash, Gemini 3.5 Flash Lite, dan Gemini 3.5 Flash Cyber. Google juga mengesahkan bahawa Gemini 3.5 Pro sedang diuji bersama rakan kongsi dan ia telah memulakan latihan pra-pelatihan paling ambisiusnya untuk Gemini 4.
Gemini 3.6 Flash berfungsi sebagai model utama dalam rilis ini, menawarkan prestasi pengkodean, kerja pengetahuan, dan multimodal yang lebih kuat sambil mengkonsumsi lebih sedikit token berbanding Gemini 3.5 Flash.
Menurut Google, model ini menggunakan 17% lebih sedikit token output pada Indeks Analisis Buatan. Syarikat tersebut mengatakan pengurangan token mencapai sehingga 65% dalam ujian DeepSWE tertentu, dengan model juga memerlukan lebih sedikit langkah penalaran dan panggilan alat untuk menyelesaikan alur kerja berbilang langkah.
Gemini 3.6 Flash berharga $1.50 setiap sejuta token input dan $7.50 setiap sejuta token output, memberikan harga yang lebih rendah setiap tugas agen berbanding pendahulunya.
Model ini mendapat skor 49% di DeepSWE, berbanding 37% untuk Gemini 3.5 Flash, mencerminkan ketepatan yang lebih tinggi dan lebih sedikit perubahan kod yang tidak perlu. Skor MLE Benchnya meningkat kepada 63.9% daripada 49.7%.
Penggunaan komputer juga meningkat, dengan Gemini 3.6 Flash mencapai 83% pada OSWorld Verified, berbanding 78.4% untuk model sebelumnya. Penggunaan komputer tersedia sebagai alat sisi klien bawaan melalui Gemini API dan Gemini Enterprise.
Google mengatakan model ini sesuai khusus untuk alur kerja agen, tugas pengkodean, dan proses perusahaan yang berpanjangan. Ia menyokong teks, gambar, audio, dan video, dengan jendela konteks sehingga satu juta token.
Flash Lite menargetkan beban kerja AI berisip tinggi
Gemini 3.5 Flash Lite direka untuk aplikasi di mana kelajuan, throughput dan kos lebih penting daripada menggunakan model yang lebih besar.
Model ini menghasilkan sekitar 350 token output per saat, menurut Artificial Analysis, menjadikannya model paling pantas dalam jajaran Gemini 3.5.
Harganya ialah $0.30 setiap juta token input dan $2.50 setiap juta token output. Google sedang menempatkannya untuk beban kerja berisip tinggi seperti carian agen, pemprosesan dokumen, pengekstrakan data, terjemahan dan ringkasan.
Pembangun boleh menyesuaikan tahap pemikiran model mengikut tugas. Tetapan minimum dan rendah mengutamakan pelaksanaan yang lebih pantas dan lebih murah, manakala tetapan yang lebih tinggi menyokong alur kerja subagen yang lebih kompleks.
Gemini 3.5 Flash Lite mendapat skor 54% pada Terminal Bench 2.1, berbanding 31% untuk Gemini 3.1 Flash Lite. Ia juga mencapai 72.2% pada GDM MRCR v2, meningkat dari 60.1%, dan 1,140 pada GDPval AA v2, berbanding 642.
Google mengatakan Flash Lite juga lebih unggul daripada Gemini 3 Flash yang lebih besar dalam beberapa ujian pengkodean dan agen, termasuk SWE Bench Pro dan OSWorld Verified.
Google menempatkan Flash Cyber melawan Mythos milik Anthropic
Model ketiga, Gemini 3.5 Flash Cyber, dikhususkan untuk mencari, mengesahkan, dan memperbaiki kerentanan perisian.
Dibina atas Gemini 3.5 Flash, model ini beroperasi melalui CodeMender, agen keselamatan kod Google. Beberapa agen Flash Cyber boleh bekerja bersama untuk menganalisis kerentanan dan menghasilkan laporan gabungan.
Google mengatakan sistem tersebut mencapai prestasi yang kompetitif di CyberGym sambil beroperasi pada harga yang lebih rendah setiap token berbanding model keselamatan siber yang lebih besar.
Kedudukan rilis ini menjadikan Flash Cyber sebagai pesaing berkos rendah kepada model keselamatan canggih seperti Mythos milik Anthropic, yang direka untuk penemuan kerentanan dan penaakulan siber yang kompleks.
Google mengambil pendekatan terhadap pelaksanaan model tersebut disebabkan potensi penyalahgunaan siber. Flash Cyber awalnya hanya akan tersedia kepada kerajaan dan rakan percaya melalui uji coba CodeMender yang terhad.
Syarikat tersebut mengatakan pelancaran ini bertujuan untuk memberikan akses kepada pertahanan kepada alat pengesan dan pembaikan kerentanan sebelum model tersebut dibuat tersedia secara lebih luas.
Pra-pelatihan Gemini 4 bermula
Gemini 3.6 Flash dan Gemini 3.5 Flash Lite tersedia melalui Gemini API, Google AI Studio, Android Studio, dan Gemini Enterprise.
Gemini 3.6 Flash juga tersedia melalui Google Antigravity dan aplikasi Gemini, manakala Flash Lite sedang dilancarkan melalui Google Search.
Pembebasan ini tiba semasa Google terus menguji Gemini 3.5 Pro dengan rakan kongsi. Model unggul belum menerima tarikh pelancaran luas.
Google juga mengesahkan bahawa pembangunan generasi seterusnya sedang berlangsung, dengan syarikat tersebut memulakan apa yang digambarkan sebagai siri pra-pelatihan paling ambisius hingga kini untuk Gemini 4.
