Yazar: Google DeepMind
Derin Akış TechFlow
Derin Akış Öne Çıkar: Google'ın bu kez sunduğu üç modelin temel amacı, AI Agent'ların ticarileştirilmesindeki gerçek sorunlar olan maliyet ve hızı çözmektir. 3.6 Flash, önceki nesilden %17 daha az token tüketiyor, daha ucuz ama kalitesi daha iyi; 3.5 Flash-Lite, saniyede 350 token hızıyla şu ana kadar en hızlı 3.5 serisi modeli; özel ağ güvenliği modeli Flash Cyber ise kod açıkları onarımı gibi kritik bir pazarı hedefliyor. Bu, performans testi oyunu değil, AI Agent'ların büyük ölçekli dağıtımını hazırlamaktır.
Google DeepMind, büyük ölçekli AI Agent oluşturma için verimlilik, gecikme ve güvenilirlik amacıyla tasarlanan üç yeni Gemini modeli olan 3.6 Flash, 3.5 Flash-Lite ve 3.5 Flash Cyber'ı yayınladı.
Gemini 3.6 Flash: Daha verimli, daha kaliteli
3.6 Flash, geliştiricilerin 3.5 Flash ile ilgili geri bildirimlerine dayanarak geliştirilmiştir. Sadece kodlama ve bilgi işlerinde ilerleme sağlamayı değil, aynı zamanda token verimliliğini de önemli ölçüde artırmıştır. Artificial Analysis Index'e göre, 3.6 Flash, 3.5 Flash'e göre çıktı token tüketimini %17 azaltmaktadır. Datacurve'un DeepSWE gibi bazı benchmark testlerinde bu azalma %65'e ulaşmaktadır. Çok adımlı iş akışlarını tamamlamak için gereken çıkarım adımları ve araç çağrıları da daha azdır.
Bu verimlilik artışı, daha düşük fiyatlarla birlikte gelmektedir. Milyon girdi token başına 1,5 dolar ve milyon çıktı token başına 7,5 dolar olarak belirlenen fiyatlarla, 3.6 Flash, her bir Agent görevinin toplam maliyetini düşürerek Agent oluşturma ve çalıştırma işlemini daha ekonomik hale getiriyor.
Daha verimli olsa bile, 3.6 Flash, çeşitli kullanım senaryolarında 3.5 Flash'tan daha iyi performans gösteriyor:
Kod düzenlemesi daha hassas hale getirildi, gereksiz değişiklikler ve yürütme döngüleri azaltıldı; DeepSWE'de %49 (3.5 Flash: %37), makine öğrenimi araştırma benchmark'u MLE Bench'te ise %63,9'a (3.5 Flash: %49,7) önemli ölçüde yükseltildi.
Bilgisayar işleme becerileri geliştirildi, OSWorld-Verified puanı %83,0 (3.5 Flash için %78,4). Bilgisayar işleme artık Gemini API ve Gemini Enterprise aracılığıyla yerleşik bir istemci aracı olarak sunulmaktadır.
GDPval-AA v2 referans puanı 1421 (3.5 Flash için 1349) olmak üzere, bilgi işlerinde daha iyi performans gösteriyor. Hebbia ve Harvey gibi müşteriler, belge çözümleme, grafik ve veri analizi, rapor taslağı oluşturma gibi çok modlu görevlerde özellikle etkili olduğunu gözlemledi.
Müşteri geri bildirimi: 3.6 Flash, maliyet ve kalite açısından bir ilerleme sunuyor ve karmaşık iş akışlarında ve bilgi odaklı görevlerde token verimliliği, doğruluk ve hız arasında denge kuruyor.
Güvenlik tasarımı
3.6 Flash, kimyasal, biyolojik, radyolojik ve nükleer (CBRN) ile ağ saldırıları kötüye kullanım alanlarını kapsayan geliştirilmiş ileri düzey güvenlik önlemleriyle donatılmıştır. Bu korumalar, modelin kaçış saldırılarına karşı direncini büyük ölçüde artırır. Aynı zamanda model, faydalı kullanım için reddetme olasılığını en aza indirmek üzere eğitilmiştir.
Gemini 3.5 Flash-Lite: Agent iş akışlarını ölçeklendirmek için tasarlandı
3.5 Flash-Lite, Agent arama ve belge işleme gibi düşük gecikme süreli görevler ve yüksek verimlilik gerektiren geliştirme senaryoları için tasarlanmıştır.
3.5 Flash-Lite, 3.5 serisinin en hızlı modelidir. Artificial Analysis'a göre, saniyede 350 çıktı token üretmektedir. Girdi token başına milyon başına 0,3 dolar, çıktı token başına milyon başına 2,5 dolar fiyatla, 3.1 Flash-Lite'den çok daha yüksek kalitedir ve yüksek hacimli üretim görevlerini çalıştıran geliştiriciler ve müşteriler için harika bir maliyet-verim oranı sunar.
3.5 Flash-Lite, Agent sisteminin verimli ölçeklenmesini destekler. Tüm düşünme seviyelerinde, bu model 3.1 Flash-Lite'ı önemli ölçüde aşar. Geliştiriciler, iş yüküne göre modeli yapılandırabilir: düşük gecikme ve düşük maliyetli yürütme önceliğiyle büyük miktarlı görevler için minimum ve düşük düşünme seviyelerini kullanabilir; ya da çok adımlı alt Agent iş yüklerini işlemek için daha yüksek düşünme seviyelerini etkinleştirebilir. Bu model artık bilgisayar işlemlerini yerleşik bir araç olarak desteklemekte ve arayüzler arasında Agent görevlerini güvenilir bir şekilde desteklemektedir.
Terminal-Bench 2.1 puanı %54 (3.1 Flash-Lite: %31), uzun bağlamda GDM-MRCR v2 puanı %72,2 (3.1 Flash-Lite: %60,1) ve gerçek görev yürütmede GDPval-AA v2 puanı 1140 (3.1 Flash-Lite: 642) olarak kodlama ve Agent görevlerinde önemli bir iyileşme gösteriyor.
Aslında birçok Agent ve kodlama değerlendirme testinde 3.5 Flash-Lite, SWE-Bench Pro (54,2% karşı 49,6%) ve OSWorld-Verified (74,0% karşı 65,1%) dahil olmak üzere 3 Flash'ı bile geçerek 2.5 ve 3 Flash iş yükleri için daha hızlı ve güçlü bir seçim haline geldi.
Erken müşteriler, 3.5 Flash-Lite'in Agent iş akışlarını ve veri işleme görevlerini genişletmede hız, akıllılık ve maliyet verimliliği kombinasyonunu vurguladı.
Gemini 3.5 Flash Cyber, CodeMender'da verimli şekilde açıkları tespit ediyor ve düzeltiyor
AI modelleri, güvenlik açıklarını bulma hızı, mevcut sistemlerin bunları düzeltme hızını aştı. Bu giderek artan tehditle başa çıkmak, hem verimli hem de güçlü bir yazılım güvenliği yaklaşımı gerektiriyor.
Flash'ın performansı ve verimliliği, büyük ölçekli kod güvenlik sorunlarının tespiti, doğrulanması ve düzeltilmesi için ideal bir temel oluşturur. Gemini 3.5 Flash Cyber, 3.5 Flash üzerine inşa edilmiş, ağ güvenliği açıklarını bulmak ve onarmak için özel olarak ince ayarlanmış olup, her token fiyatı büyük modellerden daha düşüktür.
CodeMender'de, birden fazla 3.5 Flash Cyber Agent, popüler benchmark CyberGym'de öncü rekabet seviyesine ulaşmak için tek bir kapsamlı rapor oluşturmak için birlikte çalışır.
Bu teknolojinin çift amaçlı doğası nedeniyle dikkatli bir dağıtım yaklaşımı izliyoruz. Model, CodeMender aracılığıyla kısa sürede hükümetler ve güvenilir ortaklara sınırlı erişimli bir pilot proje olarak sunulacaktır. Bu, kritik açıklar kötüye kullanılmadan önce önceden tespit edilip düzeltilmesini sağlayacak ve daha geniş çaplı kötüye kullanım riskini hafifletecektir.
Hemen başlayın
3.6 Flash ve 3.5 Flash-Lite bugün itibarıyla mevcut:
Geliştiriciler, Google AI Studio ve Android Studio aracılığıyla Gemini API'sini kullanabilir. 3.6 Flash, Google Antigravity'de de kullanılabilir.
Kurumlar, Gemini Enterprise Agent platformunda kullanabilir. 3.6 Flash, Gemini Enterprise uygulamasında da kullanılabilir.
Herkes Gemini uygulaması aracılığıyla erişebilir. 3.5 Flash-Lite aynı zamanda Google Arama'da başlatılıyor.
Gelecek Gemini modellerini geliştirmek için geri bildirim sağladığınız için teşekkür ederiz, 3.5 Pro'nun yakında yayınlanmasını bekliyoruz.
