Google Meluncurkan Gemini 3.6 Flash dan 3.5 Flash-Lite, Meningkatkan Kinerja dan Kecepatan AI

iconCryptoBriefing
Bagikan
AI summary iconRingkasan
Google meluncurkan Gemini 3.6 Flash dan 3.5 Flash-Lite pada 21 Juli 2026, menawarkan peningkatan kinerja AI dan efisiensi biaya. Model 3.6 Flash mengurangi token output sebesar 17% dibandingkan pendahulunya, sementara 3.5 Flash-Lite meningkatkan kecepatan hingga 350 token per detik. Kedua model kini dapat diakses melalui Gemini API dan Google AI Studio. Pembaruan ini membawa berita AI + kripto terbaru dan menyoroti peluang berita on-chain baru bagi pengembang dan trader.

Google baru saja meluncurkan dua model AI baru ke pasar yang sudah bergerak sangat cepat. Gemini 3.6 Flash dan 3.5 Flash-Lite resmi dirilis pada 21 Juli 2026 melalui Gemini API, Google AI Studio, dan platform terkait, memberi para pengembang alasan tambahan untuk mempertimbangkan ulang stack AI mereka.

Gemini 3.6 Flash menyediakan kecerdasan yang menurut Google sebanding dengan pendahulunya, tetapi dengan kecepatan yang jauh lebih cepat dan biaya lebih rendah. Angka utamanya adalah pengurangan 17% dalam token output dibandingkan model 3.5 Flash dalam beberapa benchmark. Dalam bahasa Inggris: model ini menyelesaikan tugas yang sama sambil menghabiskan lebih sedikit sumber daya komputasi, yang secara langsung berarti tagihan API yang lebih murah bagi pengembang.

Iklan

Model Flash-Lite 3.5 mengambil pendekatan berbeda. Model ini dirancang untuk throughput maksimal, mampu menghasilkan hingga 350 token per detik. Ini menjadikannya model tercepat di seluruh keluarga 3.5. Komprominya adalah harga: Flash-Lite lebih mahal daripada model Flash dasar dalam beberapa konfigurasi, ditujukan untuk kasus penggunaan agen dan volume tinggi di mana kecepatan merupakan kendala, bukan biaya.

Sebagai konteks harga, model 3.5 Flash (per 19 Mei 2026) berjalan pada $1,50 per juta token masukan dan $9 per juta token keluaran. Varian Flash-Lite berada pada premi terhadap harga tersebut dalam beberapa skenario, menjadikannya sebagai alat spesialisasi daripada pengganti umum.

Pengurangan 17% dalam penggunaan token bukan sekadar angka bagus di slide benchmark. Untuk proyek kripto yang menjalankan jutaan panggilan API per hari untuk mendukung agen perdagangan otonom atau sistem pemantauan risiko real-time, itu adalah pengurangan signifikan terhadap biaya operasional.

Throughput 350 token-per-detik di Flash-Lite sangat relevan untuk kasus penggunaan AI agen. Ini adalah sistem otonom yang tidak hanya merespons permintaan, tetapi juga mengambil tindakan berurutan, seperti memantau kolam likuiditas, menganalisis kondisi pasar, dan mengeksekusi perdagangan. Kecepatan sangat penting di sini. Model yang bisa berpikir lebih cepat dapat bertindak lebih cepat, dan di pasar kripto, bertindak lebih cepat seringkali menjadi perbedaan antara keuntungan dan di-front-run.

Strategi Google dengan tier Flash tampaknya dirancang untuk menangkap segmen pasar yang memiliki volume tinggi dan sensitif terhadap biaya. Flash 3.6 ditujukan bagi pengembang yang menginginkan rasio harga-kinerja terbaik. Flash-Lite 3.5 ditujukan bagi mereka yang membutuhkan kecepatan mentah dan bersedia membayarnya. Bersama-sama, keduanya mencakup berbagai kebutuhan penggunaan tanpa saling mengalahkan penawaran model Google yang lebih kuat (dan lebih mahal).

Penafian: Informasi pada halaman ini mungkin telah diperoleh dari pihak ketiga dan tidak mencerminkan pandangan atau opini KuCoin. Konten ini disediakan hanya untuk tujuan informasi umum, tanpa representasi atau jaminan apa pun, dan tidak dapat ditafsirkan sebagai saran keuangan atau investasi. KuCoin tidak bertanggung jawab terhadap segala kesalahan atau kelalaian, atau hasil apa pun yang keluar dari penggunaan informasi ini. Berinvestasi di aset digital dapat berisiko. Harap mengevaluasi risiko produk dan toleransi risiko Anda secara cermat berdasarkan situasi keuangan Anda sendiri. Untuk informasi lebih lanjut, silakan lihat Ketentuan Penggunaan dan Pengungkapan Risiko.