Google baru saja meluncurkan dua model AI baru ke pasar yang sudah bergerak sangat cepat. Gemini 3.6 Flash dan 3.5 Flash-Lite resmi dirilis pada 21 Juli 2026 melalui Gemini API, Google AI Studio, dan platform terkait, memberi para pengembang alasan tambahan untuk mempertimbangkan ulang stack AI mereka.
Gemini 3.6 Flash menyediakan kecerdasan yang menurut Google sebanding dengan pendahulunya, tetapi dengan kecepatan yang jauh lebih cepat dan biaya lebih rendah. Angka utamanya adalah pengurangan 17% dalam token output dibandingkan model 3.5 Flash dalam beberapa benchmark. Dalam bahasa Inggris: model ini menyelesaikan tugas yang sama sambil menghabiskan lebih sedikit sumber daya komputasi, yang secara langsung berarti tagihan API yang lebih murah bagi pengembang.
Model Flash-Lite 3.5 mengambil pendekatan berbeda. Model ini dirancang untuk throughput maksimal, mampu menghasilkan hingga 350 token per detik. Ini menjadikannya model tercepat di seluruh keluarga 3.5. Komprominya adalah harga: Flash-Lite lebih mahal daripada model Flash dasar dalam beberapa konfigurasi, ditujukan untuk kasus penggunaan agen dan volume tinggi di mana kecepatan merupakan kendala, bukan biaya.
Sebagai konteks harga, model 3.5 Flash (per 19 Mei 2026) berjalan pada $1,50 per juta token masukan dan $9 per juta token keluaran. Varian Flash-Lite berada pada premi terhadap harga tersebut dalam beberapa skenario, menjadikannya sebagai alat spesialisasi daripada pengganti umum.
Pengurangan 17% dalam penggunaan token bukan sekadar angka bagus di slide benchmark. Untuk proyek kripto yang menjalankan jutaan panggilan API per hari untuk mendukung agen perdagangan otonom atau sistem pemantauan risiko real-time, itu adalah pengurangan signifikan terhadap biaya operasional.
Throughput 350 token-per-detik di Flash-Lite sangat relevan untuk kasus penggunaan AI agen. Ini adalah sistem otonom yang tidak hanya merespons permintaan, tetapi juga mengambil tindakan berurutan, seperti memantau kolam likuiditas, menganalisis kondisi pasar, dan mengeksekusi perdagangan. Kecepatan sangat penting di sini. Model yang bisa berpikir lebih cepat dapat bertindak lebih cepat, dan di pasar kripto, bertindak lebih cepat seringkali menjadi perbedaan antara keuntungan dan di-front-run.
Strategi Google dengan tier Flash tampaknya dirancang untuk menangkap segmen pasar yang memiliki volume tinggi dan sensitif terhadap biaya. Flash 3.6 ditujukan bagi pengembang yang menginginkan rasio harga-kinerja terbaik. Flash-Lite 3.5 ditujukan bagi mereka yang membutuhkan kecepatan mentah dan bersedia membayarnya. Bersama-sama, keduanya mencakup berbagai kebutuhan penggunaan tanpa saling mengalahkan penawaran model Google yang lebih kuat (dan lebih mahal).
