Claude 5.1 hemen hemen piyasaya sürüldü, diğer taraftan OpenAI Astra hemen geliyor.
Şimdi Google bile yeni bir adım atıyor. En son söylentilere göre, Gemini 3.8 Flash yarın ortaya çıkacak.


Görünüşe göre AI dünyasında yine bir "Bayram" olacak.
Gemini 3.5 Pro kaldırıldı, bir sonraki büyük sürüm 4.0
Gemini 3.8 Flash'in açıklanmasından daha çok, birçok kişi Gemini 3.5 Pro'nun tam olarak ne zaman geleceğini merak ediyor!
Üzgünüz, beklemeyin, Google vazgeçti...

Mayıs'taki I/O konferansı duyurusundan bu yana yaklaşık 4 ay geçti ve Gemini 3.5 Pro, Flash'a bile kıyasla çok az gelişti.
Google de zorunlu olarak doğrudan "terk edilen taş".
İyi ki, Gemini 4.0 ön eğitimde mükemmel bir değerlendirme aldı, sonrası eğitim ise sorunsuz şekilde devam ediyor.


WSJ'den bu独家 ifşa, Gemini 3.8 Flash (kod adı «Skimaki»)’in güçlü programlama yeteneklerini büyük bir şekilde duyuruyor.
Google içi kodlama aracısı Jetski'nin karşılaştırmalı testlerinde, 3.8 Flash doğrudan Opus modelini ezdi.
Ayrıca, bu model, Google yönetiminin "depreminden" çok önce geliştirilmeye başlanmıştı.
Hassabis görevinden ayrıldı, Baş Bilim İnsanı Jeff Dean istifa etti ve bu, Gemini'nin geleceği hakkında birçok kişinin endişesine neden oldu.

Ancak şu anda her şey dahilde düzenli bir şekilde ilerliyor.
Şu anda Google, Gemini 3.8 Flash'ı önce piyasaya sürmektedir, çünkü bu modelin parametre sayısı azdır, daha az hesaplama gücü gerektirir ve daha hızlı sonuçlar elde etmek mümkündür.
İç kaynaklara göre, bu yılın başından beri Google, Gemini'nin kod yazma yeteneğini geliştirmek için daha fazla insan gücü ve hesaplama gücü ayırdı.
Özellikle, yapay zekânın sürekli deneme-yanılma yoluyla yeni becerileri gerçekten öğrenmesini sağlamak için "güçlendirilmiş öğrenme"ye yapılan yatırımlar artırıldı.
Ayrıca Google DeepMind ve diğer laboratuvarlar, aynı anda birden fazla projeyi ilerletiyor, böylece bu projeyi başarısız olursa, diğer biri devreye giriyor.
Gemini 3.5 Pro beklentileri karşılamadı, ancak Gemini 4.0 henüz çıkmadı.
Şu anda, Silicon Valley'nin "iki büyük şirketi" OpenAI ve Anthropic, öncü modellerde ve programlama Agent'lerinde oldukça etkili.
Bilgiye göre, OpenAI'nin bir sonraki Astra versiyonu, düşünme token'larını azaltırken aynı zamanda performansı büyük ölçüde artıran yeni bir "döngüsel derinlik" (recurrent depth) yöntemi kullanıyor.
Bu as, bu hafta açıklanacaktır.

Şu anda Google'nın bir şeyler ortaya koyması gerekiyor.
Aslında,劈柴 söz verdikten sonraki aylarda 3.7 Flash’ı yayınladıktan sonra AI dünyasını heyecanlandıracak başka bir model çıkarmadı.
Belki de bu akşam Gemini 3.8 Flash ortaya çıkıyor.

Gemini ilk kez, kendi kendine video izliyor
Bu yayımdan önce, Google bugün Gemini'ye yeni bir özellik eklemek için bir ön hazırlık yaptı—
Akıllı Ajan Video Anlama
Bu özellik, gerçekten büyük puan kazandırıyor.
I/O konferansının bir videosunu yükleyin, aynı model olan Gemini 3.7 Flash ile Token tüketimi doğrudan %88 düştü.

Google, resmi blogunda Gemini 3.7 Flash, 3.6 Flash ve 3.5 Flash-Lite modellerinin agentic video anlama yeteneğine sahip olduğunu ve erişimin Google AI Studio ile Gemini Enterprise Agent Platform'unda olduğunu belirtti.
Standart video analiz benchmark'larında bu anahtarı açın, token tüketimi en fazla %88 azalır, analiz maliyeti en fazla %66 düşer ve doğruluk oranı en fazla %7 artar.

Ayrıca ekstra bir kuruş alınmaz, standart API token fiyatı uygulanır. Tasarruf etmek ve doğru olmak genellikle çatışır. Bu sefer çatışmadı.

Çünkü Gemini, "ilerlemeyi sürüklemeyi" öğrendi.
Geçmişte uygulanan yöntem, "statik" işlem olarak adlandırılır; model, API parametreleriyle sabitlenmiş bir çerçeve hızıyla pasif olarak sabit çerçeve akışını alır ve modelin hiçbir söz hakkı yoktur.
Şimdi model kendi kararını veriyor: hangi bölümü, ne hızda, görseli mi izleyecek, sesi mi dinleyecek, yoksa doğrudan metni mi okuyacak, bunları kendi belirliyor.

Bu, Google'ın bunu ilk kez yapması değil.
Önceki agentic vision, kod yürütümünü Gemini'nin yerel görüntü anlama yeteneğiyle birleştiriyordu; model bir resme bakarak kendiliğinden büyütme, kırpma ve karşılaştırma kodları yazabiliyordu.
Bu sefer sırayla video, fikir aynı kalıyor, sadece araçlar yerel video araçlarına değiştiriliyor.
Dört önce çok zor olan iş
Resmi blogda birkaç zorlu kullanım senaryosu da listelenmiştir.
Alt saniye düzeyinde fragment arama. Önceki modeller, videoyu izlerken saniyede yalnızca bir kare çekiyordu. Sorun, birçok şey bir saniyeden kısa sürede geçip gidiyor olması.
Şimdi bu anları bir saniyenin altında tam olarak konumlandırabiliyoruz.
Bu, "otomatik kesim" işleminin ilk kez gerçekçi hale geldiğini anlamına geliyor: daha önce kesimciler, nerede kesim yapacaklarını belirlemek için zaman çizelgesi üzerinde kendi başlarına bir kare bir kare tarıyorlardı; şimdi model önce tarama yaparak aday kesim noktalarını işaretleyebilir, ardından insan seçimi yapar.

Uzun videoda iğne aramak. Saatlerce süren malzemelerde karmaşık bir soru sormak, milyonlarca tokeni harcamadan yapabilirsiniz.
Anomali tespiti. Model belirli bir zaman penceresini hedef aldıktan sonra, bu aralığın çerçevesini artırarak yeniden örnekleme yapabilir ve hızlı hareketleri ile ince ekran hatalarını net bir şekilde görebilir. Üretim hattı kalite kontrolü ve güvenlik izleme için en çok faydalı olan budur, çünkü anomali aslında sadece birkaç saniye içinde meydana gelir.
Sayın. Bir eylemin kaç kez tekrarlandığı, sahnede kaç farklı nesne olduğu gibi sorulara model geçmişte sabit bir şekilde yanlış cevap veriyordu; nedeni de oldukça basitti: atlanan birkaç karede tam olarak nesneler vardı.

Agent sonunda videolara bakmaya başladı
Video, her modalite içinde her zaman en pahalısı olmuştur.
Metin ucuz, resimler iyi, video ise büyük ve uzun, bir dakikalık video bir kitabın token'ını tüketebilir.
Bu iki yıl boyunca herkes, Agent'in okuyabileceğini, yazabileceğini ve araçlar kullanabileceğini konuşuyor.
Sorun şu ki, dünyayı sadece metinle anlayan bir Ajan, aslında birinin «aktarılmış» bir dünyayı görüyor.
Kamerada yakalanan, toplantıda kaydedilen, üretim hattından geçen, kimse zaman ayırmak istemeyen şeyleri bilmez.
Şimdi bu maliyet eğrisi büyük bir şekilde kesildi.
Bir agent, saatlerce süren izlemeleri, onlarca saatlik dersleri, yüzlerce malzeme parçasını kendi başına tamamlayabilir ve bütçeyi tükettiği hâlde dünyayla ilişkisi değişir.
Artık ekranı metne dönüştürerek ona vermek için insanları beklemek zorunda değil, "görebilmek" ve "doğru görebilmek" arasında seçim yapmak zorunda da değil.
Google, bu kırıcı oldu.
AI Savaşı, Bir Sonraki Tur
Bu günlerde dört tarafın yayınlama ritmi neredeyse çakıştı.
Claude 5.1 geldi, OpenAI Astra kapıda bekliyor, Google birkaç aydır bekledikten sonra nihayet Gemini 3.8 Flash ile karşılık verdi.
Bu güncellemeyle birlikte, Claude artık iki ana alanda odaklanıyor: programlama ve bilimsel araştırma.
Sonraki nesil Astra, bir "sürekli varlık" haline gelecek; Ultraman'ın sözleriyle, bilgisayar kullanım becerisi insan seviyesine ulaşmıştır.

Gemini 3.8 Flash, programlama alanında da daha büyük bir atlama yapacak.
Şu anda OpenAI, Anthropic, Google ve SpaceXAI aynı anda tam güçle çalışıyor.

Musk, Grok 4.7'in on gün içinde yayınlanacağını duyurdu
Bu karışıklık, henüz en çetin kısmına girdi.
Kaynaklar:
https://x.com/Google/status/2094840983913402704
https://deepmind.google/blog/introducing-agentic-video-in-gemini/
Bu yazı, WeChat hesabı "Yeni Akıl" tarafından yazılmıştır, yazar: ASI Vahiyleri
