Google, Yarın Gemini 3.8 Flash'ı Başlatacak, Kodlama ve Video Anlama Üzerine Odaklanacak

icon MarsBit
Paylaş
AI summary iconÖzet
Google, yarın Gemini 3.8 Flash'ı yayınlamaya hazırlanıyor; bu, AI alanında büyük bir token lanzmanı haberidir. 'Skimaki' kod adı verilen bu model, kodlama ve video anlama yeteneklerini geliştirirken token kullanımını %88'e kadar azaltıyor. Gemini 3.5 Pro iptal edildi ve geliştirme Gemini 4.0'a aktarıldı. Zincir üstü haberlere göre Google, dinamik içerik analizi için agentic video anlama da tanıtmaya hazırlanıyor.

Claude 5.1 hemen hemen piyasaya sürüldü, diğer taraftan OpenAI Astra hemen geliyor.

Şimdi Google bile yeni bir adım atıyor. En son söylentilere göre, Gemini 3.8 Flash yarın ortaya çıkacak.

Google

Google

Görünüşe göre AI dünyasında yine bir "Bayram" olacak.

Gemini 3.5 Pro kaldırıldı, bir sonraki büyük sürüm 4.0

Gemini 3.8 Flash'in açıklanmasından daha çok, birçok kişi Gemini 3.5 Pro'nun tam olarak ne zaman geleceğini merak ediyor!

Üzgünüz, beklemeyin, Google vazgeçti...

Google

Mayıs'taki I/O konferansı duyurusundan bu yana yaklaşık 4 ay geçti ve Gemini 3.5 Pro, Flash'a bile kıyasla çok az gelişti.

Google de zorunlu olarak doğrudan "terk edilen taş".

İyi ki, Gemini 4.0 ön eğitimde mükemmel bir değerlendirme aldı, sonrası eğitim ise sorunsuz şekilde devam ediyor.

Google

Google

WSJ'den bu独家 ifşa, Gemini 3.8 Flash (kod adı «Skimaki»)’in güçlü programlama yeteneklerini büyük bir şekilde duyuruyor.

Google içi kodlama aracısı Jetski'nin karşılaştırmalı testlerinde, 3.8 Flash doğrudan Opus modelini ezdi.

Ayrıca, bu model, Google yönetiminin "depreminden" çok önce geliştirilmeye başlanmıştı.

Hassabis görevinden ayrıldı, Baş Bilim İnsanı Jeff Dean istifa etti ve bu, Gemini'nin geleceği hakkında birçok kişinin endişesine neden oldu.

Google

Ancak şu anda her şey dahilde düzenli bir şekilde ilerliyor.

Şu anda Google, Gemini 3.8 Flash'ı önce piyasaya sürmektedir, çünkü bu modelin parametre sayısı azdır, daha az hesaplama gücü gerektirir ve daha hızlı sonuçlar elde etmek mümkündür.

İç kaynaklara göre, bu yılın başından beri Google, Gemini'nin kod yazma yeteneğini geliştirmek için daha fazla insan gücü ve hesaplama gücü ayırdı.

Özellikle, yapay zekânın sürekli deneme-yanılma yoluyla yeni becerileri gerçekten öğrenmesini sağlamak için "güçlendirilmiş öğrenme"ye yapılan yatırımlar artırıldı.

Ayrıca Google DeepMind ve diğer laboratuvarlar, aynı anda birden fazla projeyi ilerletiyor, böylece bu projeyi başarısız olursa, diğer biri devreye giriyor.

Gemini 3.5 Pro beklentileri karşılamadı, ancak Gemini 4.0 henüz çıkmadı.

Şu anda, Silicon Valley'nin "iki büyük şirketi" OpenAI ve Anthropic, öncü modellerde ve programlama Agent'lerinde oldukça etkili.

Bilgiye göre, OpenAI'nin bir sonraki Astra versiyonu, düşünme token'larını azaltırken aynı zamanda performansı büyük ölçüde artıran yeni bir "döngüsel derinlik" (recurrent depth) yöntemi kullanıyor.

Bu as, bu hafta açıklanacaktır.

Google

Şu anda Google'nın bir şeyler ortaya koyması gerekiyor.

Aslında,劈柴 söz verdikten sonraki aylarda 3.7 Flash’ı yayınladıktan sonra AI dünyasını heyecanlandıracak başka bir model çıkarmadı.

Belki de bu akşam Gemini 3.8 Flash ortaya çıkıyor.

Google

Gemini ilk kez, kendi kendine video izliyor

Bu yayımdan önce, Google bugün Gemini'ye yeni bir özellik eklemek için bir ön hazırlık yaptı—

Akıllı Ajan Video Anlama

Bu özellik, gerçekten büyük puan kazandırıyor.

I/O konferansının bir videosunu yükleyin, aynı model olan Gemini 3.7 Flash ile Token tüketimi doğrudan %88 düştü.

Google

Google, resmi blogunda Gemini 3.7 Flash, 3.6 Flash ve 3.5 Flash-Lite modellerinin agentic video anlama yeteneğine sahip olduğunu ve erişimin Google AI Studio ile Gemini Enterprise Agent Platform'unda olduğunu belirtti.

Standart video analiz benchmark'larında bu anahtarı açın, token tüketimi en fazla %88 azalır, analiz maliyeti en fazla %66 düşer ve doğruluk oranı en fazla %7 artar.

Google

Ayrıca ekstra bir kuruş alınmaz, standart API token fiyatı uygulanır. Tasarruf etmek ve doğru olmak genellikle çatışır. Bu sefer çatışmadı.

Google

Çünkü Gemini, "ilerlemeyi sürüklemeyi" öğrendi.

Geçmişte uygulanan yöntem, "statik" işlem olarak adlandırılır; model, API parametreleriyle sabitlenmiş bir çerçeve hızıyla pasif olarak sabit çerçeve akışını alır ve modelin hiçbir söz hakkı yoktur.

Şimdi model kendi kararını veriyor: hangi bölümü, ne hızda, görseli mi izleyecek, sesi mi dinleyecek, yoksa doğrudan metni mi okuyacak, bunları kendi belirliyor.

Google

Bu, Google'ın bunu ilk kez yapması değil.

Önceki agentic vision, kod yürütümünü Gemini'nin yerel görüntü anlama yeteneğiyle birleştiriyordu; model bir resme bakarak kendiliğinden büyütme, kırpma ve karşılaştırma kodları yazabiliyordu.

Bu sefer sırayla video, fikir aynı kalıyor, sadece araçlar yerel video araçlarına değiştiriliyor.

Dört önce çok zor olan iş

Resmi blogda birkaç zorlu kullanım senaryosu da listelenmiştir.

Alt saniye düzeyinde fragment arama. Önceki modeller, videoyu izlerken saniyede yalnızca bir kare çekiyordu. Sorun, birçok şey bir saniyeden kısa sürede geçip gidiyor olması.

Şimdi bu anları bir saniyenin altında tam olarak konumlandırabiliyoruz.

Bu, "otomatik kesim" işleminin ilk kez gerçekçi hale geldiğini anlamına geliyor: daha önce kesimciler, nerede kesim yapacaklarını belirlemek için zaman çizelgesi üzerinde kendi başlarına bir kare bir kare tarıyorlardı; şimdi model önce tarama yaparak aday kesim noktalarını işaretleyebilir, ardından insan seçimi yapar.

Google

Uzun videoda iğne aramak. Saatlerce süren malzemelerde karmaşık bir soru sormak, milyonlarca tokeni harcamadan yapabilirsiniz.

Anomali tespiti. Model belirli bir zaman penceresini hedef aldıktan sonra, bu aralığın çerçevesini artırarak yeniden örnekleme yapabilir ve hızlı hareketleri ile ince ekran hatalarını net bir şekilde görebilir. Üretim hattı kalite kontrolü ve güvenlik izleme için en çok faydalı olan budur, çünkü anomali aslında sadece birkaç saniye içinde meydana gelir.

Sayın. Bir eylemin kaç kez tekrarlandığı, sahnede kaç farklı nesne olduğu gibi sorulara model geçmişte sabit bir şekilde yanlış cevap veriyordu; nedeni de oldukça basitti: atlanan birkaç karede tam olarak nesneler vardı.

Google

Agent sonunda videolara bakmaya başladı

Video, her modalite içinde her zaman en pahalısı olmuştur.

Metin ucuz, resimler iyi, video ise büyük ve uzun, bir dakikalık video bir kitabın token'ını tüketebilir.

Bu iki yıl boyunca herkes, Agent'in okuyabileceğini, yazabileceğini ve araçlar kullanabileceğini konuşuyor.

Sorun şu ki, dünyayı sadece metinle anlayan bir Ajan, aslında birinin «aktarılmış» bir dünyayı görüyor.

Kamerada yakalanan, toplantıda kaydedilen, üretim hattından geçen, kimse zaman ayırmak istemeyen şeyleri bilmez.

Şimdi bu maliyet eğrisi büyük bir şekilde kesildi.

Bir agent, saatlerce süren izlemeleri, onlarca saatlik dersleri, yüzlerce malzeme parçasını kendi başına tamamlayabilir ve bütçeyi tükettiği hâlde dünyayla ilişkisi değişir.

Artık ekranı metne dönüştürerek ona vermek için insanları beklemek zorunda değil, "görebilmek" ve "doğru görebilmek" arasında seçim yapmak zorunda da değil.

Google, bu kırıcı oldu.

AI Savaşı, Bir Sonraki Tur

Bu günlerde dört tarafın yayınlama ritmi neredeyse çakıştı.

Claude 5.1 geldi, OpenAI Astra kapıda bekliyor, Google birkaç aydır bekledikten sonra nihayet Gemini 3.8 Flash ile karşılık verdi.

Bu güncellemeyle birlikte, Claude artık iki ana alanda odaklanıyor: programlama ve bilimsel araştırma.

Sonraki nesil Astra, bir "sürekli varlık" haline gelecek; Ultraman'ın sözleriyle, bilgisayar kullanım becerisi insan seviyesine ulaşmıştır.

Google

Gemini 3.8 Flash, programlama alanında da daha büyük bir atlama yapacak.

Şu anda OpenAI, Anthropic, Google ve SpaceXAI aynı anda tam güçle çalışıyor.

Google

Musk, Grok 4.7'in on gün içinde yayınlanacağını duyurdu

Bu karışıklık, henüz en çetin kısmına girdi.

Kaynaklar:

https://x.com/Google/status/2094840983913402704

https://deepmind.google/blog/introducing-agentic-video-in-gemini/

Bu yazı, WeChat hesabı "Yeni Akıl" tarafından yazılmıştır, yazar: ASI Vahiyleri

Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.