Google DeepMind meluncurkan tiga pembaruan model Gemini: model utama 3.6 Flash dapat menghemat hingga 65% Token dalam tugas pemrograman, dengan harga input $1,50 dan output $7,50 per juta Token, lebih murah, serta menunjukkan peningkatan signifikan dalam kinerja pada tes seperti DeepSWE; versi ringan 3.5 Flash-Lite mencapai kecepatan output hingga 350 Token per detik, dengan harga serendah input $0,30 dan output $2,50, dan dalam beberapa tes unggul atas Gemini 3 Flash yang lebih besar; model keamanan 3.5 Flash Cyber dirancang khusus untuk memperbaiki kerentanan. Google juga mengumumkan peluncuran pelatihan pra-pemrosesan "paling agresif sepanjang masa" dengan tujuan langsung menuju Gemini 4. Bagi pengguna, manfaat utamanya adalah penurunan menyeluruh dalam harga, konsumsi Token, dan biaya operasional Agent.Penulis artikel, sumber: XinZhiYuan
Bagi kami yang benar-benar mengeluarkan uang sungguhan untuk membeli Token dan membangun Agent, peluncuran hari ini sebenarnya hanya memiliki satu kata yang paling nyata—turun.
Tiga langkah berturut-turut, Google kali ini benar-benar tidak berpura-pura lagi.
Hari ini, Google DeepMind mengeluarkan tiga kartu andalan sekaligus:
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash Cyber

Sebuah kekuatan utama yang lebih kuat, sebuah versi ringan yang lebih cepat, dan seorang spesialis keamanan yang ahli dalam menutup celah.
Tiga Gemini ini merujuk pada hal yang sama: membuat AI Agent yang berjalan di lingkungan produksi lebih cepat, lebih cerdas, dan lebih murah.

Pada hari yang sama dengan rilis tersebut, Google juga melemparkan bom yang lebih besar—
Google DeepMind "pelatihan pra-terbesar dalam sejarah telah dimulai", dengan tujuan model generasi berikutnya, Gemini 4.

Di satu sisi, Gemini meluncurkan tiga produk berturut-turut, di sisi lain, Gemini 4 sudah dimulai.
Sinyal yang diberikan Google sangat jelas, permainan akhir AI baru saja dimulai.
Google larut malam mengeluarkan senjata andalan, meluncurkan tiga Gemini sekaligus
Tiga Gemini, akan kita bahas satu per satu.
Gemini 3.6 Flash, hemat 65% token
Mari kita lihat dulu "pusat perhatian" sebenarnya kali ini—Gemini 3.6 Flash.
Fitur utama kali ini adalah penghematan Token yang besar.
Menurut perhitungan Artificial Analysis Index, ia menggunakan 17% lebih sedikit Token output dibandingkan generasi sebelumnya 3.5 Flash.
Pada benchmark pengkodean seperti DeepSWE, penghematan maksimal mencapai 65%.

Selain lebih sedikit mengucapkan kata-kata, ia juga memerlukan lebih sedikit langkah penalaran dan pemanggilan alat untuk menyelesaikan tugas multi-langkah, sehingga jalur yang ditempuh lebih singkat, artinya lebih cepat dan lebih hemat.
Selain itu, Gemini 3.6 Flash juga lebih murah sambil menghemat Token:
Input $1.5, output $7.5 per million tokens, cheaper than 3.5 Flash.
Lebih hemat, lebih murah, dan lebih unggul—itulah yang disebut keseriusan. 3.6 Flash unggul dalam beberapa pengujian kunci dibanding pendahulunya—
- DeepSWE: Tes pemrograman 37% ➔ 49%
- MLE Bench: Uji coba penelitian machine learning 49,7% ➔ 63,9%
- OSWorld-Disertifikasi: Menguji model dengan operasi komputer langsung dari 78,4% ➔ 83%
- GDPVal-AA v2: 1.421 tugas kerja berbasis pengetahuan telah diselesaikan, 70 poin lebih tinggi dari generasi sebelumnya

Dalam demo berikut, 3.6 Flash memamerkan kemampuan orkestrasi agen cerdas ganda, tidak hanya dengan mudah menyelesaikan tugas migrasi kode yang kompleks, tetapi juga melakukan serangan multidimensi terhadap 3.5 Flash dalam hal kecepatan respons dan kualitas kode.

Dengan Gemini Canvas, 3.6 Flash mengintegrasikan alur kerja 3D, dalam hitungan menit menciptakan alat ekstraksi tekstur profesional setara fotografi.
Ia juga bisa berubah menjadi "AI Interaction Designer" untuk dengan mudah menciptakan studio bertema yang sangat imersif.


3.5 Flash-Lite, mengalahkan sang kakak besar
Gemini 3.5 Flash-Lite versi kedua, menempuh jalur berbeda: menonjolkan kecepatan dan harga yang terjangkau.
3.5 Flash-Lite mencapai kecepatan output 350 token per detik, yang merupakan yang tercepat di seluruh seri 3.5.
Harganya juga sangat murah, hanya $0,3 untuk setiap juta token masuk dan $2,5 untuk setiap juta token keluar.
Cepat dan murah, dirancang khusus untuk skenario frekuensi tinggi dan volume besar seperti "memproses dokumen dalam jumlah besar" dan "pencarian Agent".
Yang paling menakjubkan adalah, ia malah menginjak-injak "kakaknya" sendiri.
Dalam berbagai pengujian pemrograman dan Agent, model ringan ini ternyata mengalahkan Gemini 3 Flash yang lebih besar ukurannya—
- SWE-Bench Pro: 54,2% vs 49,6%
- OSWorld-Terverifikasi: 74,0% vs 65,1%

3.6 Flash bertindak sebagai "otak utama" untuk memecah tugas, Flash-Lite bertindak sebagai "duplikat" untuk mengerjakan secara massal.
Satu orang bertanggung jawab untuk berpikir, banyak orang bertanggung jawab untuk menjalankan, dengan mudah mengatasi tekanan kinerja tinggi.
Dalam demo resmi, Flash-Lite secara langsung menghasilkan 25 desain solusi web yang tersedia tinggi, kecepatannya begitu cepat hingga hampir seperti "berpikir sebentar lalu langsung menghasilkan sejumlah desain".
Flash-Lite kini telah diluncurkan di Aplikasi Gemini dan akan segera menyusul di Google Search.
Flash Cyber: Bisa memperbaiki kerentanan, tapi tidak semua orang bisa menggunakannya
Gemini 3.5 Flash Cyber, model hardcore yang dirancang khusus untuk keamanan siber.
Tugasnya hanya satu, mencari kerentanan dan memperbaikinya.
Saat ini, kenyataan yang memalukan adalah kecepatan AI dalam menemukan kerentanan sudah lebih cepat daripada kecepatan sistem yang ada dalam memperbaiki kerentanan tersebut.

Google memasukkan model ini ke dalam agen keamanan kode CodeMender, yang bekerja sama melalui beberapa agen Cyber, dan memecahkan rekor SOTA di benchmark keamanan CyberGym dengan biaya lebih rendah daripada model yang lebih besar—
Gunakan model yang lebih ringan untuk melakukan tugas yang paling membutuhkan presisi.
Namun, model ini belum dapat diakses oleh orang biasa saat ini.
Gemini 4 Diluncurkan, Pre-training Paling Agresif Sepanjang Masa
Meskipun Gemini 3.5 Pro belum didapatkan, pelatihan Gemini 4 sudah dimulai.
Tiga ledakan ini hanyalah pembuka, tetapi pengumuman terakhir adalah inti utamanya.
Google telah mengonfirmasi bahwa telah memulai pelatihan pra-pemrosesan paling agresif dalam sejarahnya, dengan tujuan langsung menuju Gemini 4.

Para ahli menyatakan, mengikuti ritme pelatihan rutin Google selama 6 bulan, mungkin akhir tahun ini kita akan melihat Gemini 4.

Bagi kami yang benar-benar mengeluarkan uang sungguhan untuk membeli Token dan membangun Agent, peluncuran hari ini sebenarnya hanya memiliki satu kata yang paling nyata—turun.
Harga turun, konsumsi token turun, biaya menjalankan satu kali Agent turun.
Sedangkan flagship yang belum datang dan Gemini 4 yang baru saja diluncurkan, keduanya masih merupakan "futures".
Yang bisa digunakan dan harganya murah, itulah yang bisa langsung masuk ke dompetmu hari ini. Sehebat apa pun flagshipnya, harus bisa dulu diwujudkan.
