Yazar |桦林舞王
Düzenleyen | Jingyu
3 Eylül 2026'da, OpenAI Başkanı Greg Brockman, tanıtım sonrası AI endüstrisinde nadiren duyulan bir ifade kullandı: "Kişisel olarak, AGI'ye ulaşmış olabiliriz diye düşünüyorum, bu model tam olarak bunu temsil ediyor."
Dikkatli bir dil kullanmış, birinci kişiyle konuşmuş, "muhtemelen" ifadesini eklemiş ve "Eğer bunu ilk olarak nitelendirmek istiyorsanız, bunun mantıklı olduğunu düşünüyorum" diyerek arka kapıyı açık bırakmıştır.
Bu, OpenAI'nin resmi olarak AGI'nin geldiğini duyurması değil, bir şirket başkanının kameranın önünde kendi yargısını söylemesidir.
3 Eylül'de yerel saatle GPT-6 Astra resmi olarak yayınlandı. GeekPark, şu ana kadar elde edilebilen tüm teknik detayları ve gösterim materyallerini inceledi ve bu modelin aslında ne yapabildiğini, ne kadarını yapabildiğini, AGI'nin gelişini gerçekten temsil edip etmediğini yanıtlamaya çalıştı.
"Bilgisayarı kontrol etme" efsaneleşmeye başlıyor
Yayın materyalinde OpenAI, Astra için kısa bir slogan belirledi: “Bilgisayarınızda yapabileceğiniz her şeyi Astra sizin için yapabilir.”
Bu abartılı bir pazarlama ifadesi değil, bir yön bildirimi.
Geçtiğimiz yıllarda AI'nın bilgisayarı kontrol etmek için yaygın yol, API çağrısıydı. Yazılım geliştiriciler önce arayüzleri yazıyor, AI ardından bu arayüzler aracılığıyla işlemleri tamamlıyordu. Bu mantık, her yazılımın AI için özel olarak uyumlu hale getirilmesini gerektiriyordu; aksi takdirde AI hiçbir şey yapamazdı.
Astra, tamamen farklı bir yol izledi: Ekran üzerindeki pikselleri insan gibi doğrudan "gördü", sonra fareyi hareket ettirdi ve klavyeye bastı.
Bu farkın anlamı kapsama alanıdır. KiCad (basılı devre tasarımı yazılımı) AI için API yazmaz, FreeCAD yazmaz, on yıl boyunca şirket içi olarak kullanılan eski ERP sistemi de yazmaz. Ancak AI ekranı görebilir ve doğrudan işlem yapabilirse, bu tüm yazılımları kullanabilir—yeni işe başlayan bir çalışan gibi, yazılımın arka planındaki kodu anlamaya gerek yoktur, sadece arayüzü anlayabilmelidir.
OpenAI, materyalinde bilgisayarın nasıl kontrol edilebileceğine dair birkaç örnek gösterdi.

GPT-6 Astra, PCB levhası yerleşimini ve izlerini kendi kendine tamamladı | Kaynak: OpenAI
Astra'ya bir elektrik şeması verildi ve KiCad içindeki bileşen yerleşimi ve bakır hatları 2 dakika 54 saniyede tamamlandı. Başka bir gösterimde, Astra, Blender'da bir ev modeli oluşturdu ve bunu Unreal Engine 5'e aktararak gerçek zamanlı olarak gezilebilir bir bina sahnesi üretti. Daha günlük bir gösterimde, kullanıcı sadece Astra'ya konuştu ve Astra, bilgi girişiyle başlayıp yayınlama işlemini tamamlayarak bir eBay ürününü tamamen yükledi.

Astra'nın Blender'da oluşturduğu mimari model | Kaynak: OpenAI
Verimlilik artışı açısından, OpenAI'nin sunduğu karşılaştırma verileri de oldukça açıklayıcıdır. OSWorld 2.0 referans testinde, Astra bilgisayar kullanım görevlerini %72,6 puanla tamamlarken, önceki nesil lider GPT-5.6 Sol %65,7 puan almıştır; aynı görevleri tamamlamak için Astra ortalama yaklaşık 40 dakika, Sol ise yaklaşık 75 dakika gerektirmektedir, bu da Astra'nın hızının neredeyse yarıya indiğini göstermektedir.
| https://www.geekpark.net/news/369800https://www.geekpark.net/news/369800 |
Astra, daire arama görevini 9 dakikada tamamladı (sol), pediatrik klinik arama görevini 2 dakikada tamamladı | Kaynak: OpenAI
OpenAI, iki iç saatleme örneğini daha duyurdu. "Kediler için geçici bakıcı bulma" gibi yoğun web araması, bilgi karşılaştırması ve belgeye dönüştürme gerektiren görevlerde Astra, 5 dakika 27 saniyede tamamladı; OpenAI'nin insan referans bazı 30 dakikadır. "İş arama hazırlığı" gibi pozisyon arama, özgeçmiş uygunluğu ve başvuru sürecini düzenleme gerektiren karmaşık görevlerde Astra, 2 dakika 51 saniyede tamamladı; insan referans bazı 5 saattir.
Bu sayılar, üçüncü taraf bağımsız testler değil, OpenAI'nin kendi gösterim sonuçlarıdır ve mantıklı şüpheler korunmalıdır. Ancak bunlar, Astra'nın bir e-posta yazmanıza yardımcı olmak için tasarlanmadığını, bunun yerine "birden fazla yazılımı açıp birçok adımı tıklayarak" tamamlamanız gereken tam iş akışlarını sizin yerinize tamamlamak için tasarlandığını açıkça ortaya koymaktadır. Form doldurma, CRM kayıtlarını güncelleme, takvimi düzenleme, çevrimiçi araştırmadan rapor oluşturma gibi işlemler, OpenAI tarafından açıkça belirtilen kurumsal kullanım senaryolarıdır.
Yetenek «Next Level»
Her büyük model yayınlaması, bir dizi benchmark sayısı getirir. Çoğu zaman, 80 ile 85 arasında bir fark okuyucular için neredeyse aynı gibi görünür, ancak bu sefer gerçekten farklı.
ARC-AGI-3, şu anda en zor "çözülebilir" AI değerlendirmelerinden biridir. Tasarım amacı, modelin eğitim verilerini hatırlayarak sorulara cevap vermesini engellemek ve tamamen yeni sorular karşısında gerçek akıl yürütme yeteneğini ölçmektir; bu, AI için bir zeka testine benzer.

Astra, ARC-AGI-3'te neredeyse tanrısal bir puan aldı | Kaynak: OpenAI
Astra, ARC-AGI-3'te %98,6 puan aldı. GPT-5.6 Sol, %7,8 puan aldı. Anthropic'in Claude Opus 5, %30 puan aldı.
Bu, 80 puandan 90 puana yükselmek gibi bir ilerleme değil, bir ölçek atlamasıdır. ARC-AGI'nin kurucusu François Chollet, AI'nın her zaman çok hızlı bir şekilde "tam puan alması" nedeniyle test zorluğunu birkaç kez artırdı, ancak Astra, Tier 3 zorluk seviyesinde hâlâ neredeyse mükemmel puan aldı.

Astra, en üst düzey matematik araştırma yeteneği testinde de keskin bir şekilde önde | Kaynak: OpenAI
Diğer anahtar referanslar: FrontierMath Tier 4 (üst düzey matematik araştırmacı yeteneği) %97,6, GPQA Diamond (yüksek lisans düzeyi çok disiplinli soru-cevap) %96, DeepSWE (gerçek yazılım mühendisliği görevleri) %74,1, ExploitBench (siber güvenlik açıkları yararlı kullanımı) %100.
Astra, bir boyutta birinci olamadı. «Humanity's Last Exam» (araç çağrısı sürümü) üzerinde Astra %57,2 puan aldı, iki gün önce yayınlanan Anthropic Claude Fable 5.1 ise %65,0 puan aldı. Tamamen baskın bir durum değil, rekabet hâlâ devam ediyor.
Bir başka kritik detay belirtmek gerekir. ARC-AGI-3'in yüksek puanı, OpenAI'nin "durumlu test çerçevesini" kullanır; bu, modelin çoklu denemeler boyunca bağlam bilgilerini biriktirmesine izin verir; durumsuz normal API çağrıları altında, puan bu rakamdan önemli ölçüde daha düşük olacaktır. Modeller arasında karşılaştırma yaparken bu öncül koşula dikkat edilmelidir.
Genel olarak, Astra'nın bir önceki nesil modelden uzaklaştığı düzey, son iki yılda AI modellerinin gelişiminde nadiren görülen bir durumdur.

ExploitGym kapanmış kuyruklar testinde Astra'nın aldatılma olasılığı kapatıldı | Kaynak: OpenAI
En belirgin fark, zeka değil, uyumda. OpenAI, üretim ortamı güvenlik kısıtlamaları olmadan GPT-5.6 Sol'un %48,2'sinde yetkilerinin dışına çıktığını, Astra'nın ise %0 olduğunu gösteren bir iç test verisi açıkladı.
OpenAI'nin bu sefer gerçekten iletmek istediği sinyal, daha akıllıca ve aynı zamanda daha kurallara uygun olmaktır.
Henüz kullanamazsın
Astra şu anda aşamalı açılım stratejisi kullanmaktadır.
Öncelikle «Daybreak» projesine kurumsal kullanıcılar açılır, ardından ChatGPT Plus, Pro, Business ve Enterprise abonelik kullanıcılarına genişletilecek ve OpenAI API, AWS Bedrock ve Microsoft Azure üzerinden erişim sağlanacaktır.
Astra, OpenAI tarihinin ilk kez içsel "Kritik" ağ güvenliği eşiğini aşan modelidir ve insan müdahalesi neredeyse gerekmeden bilinmeyen sıfır gün açıklarını keşfedebilir ve tam bir exploit zinciri oluşturabilir. Bu nedenle, Astra'nın daha güçlü ağ güvenliği özelliklerine sahip sürümü yalnızca onaylanmış savunma güvenlik kurumlarına ve kritik altyapı alanlarındaki öncelikli kullanıcılara açıktır. Değerlendirme sürecinde, Astra daha önce açıklanmamış iki güvenlik açığı daha keşfetmiştir ve OpenAI bu açıkları ilgili yazılım bakım ekibine bildirmiştir.

API fiyatlandırmasında, Astra'nın milyon token başına girdi ve çıktı fiyatları sırasıyla 10 dolar ve 50 dolardır. ChatGPT aboneleri için Astra kullanımı mevcut abonelik limiti içinde yer alır.
Zamanlama seçimi kendisi de bir arka plan oluşturuyor. Daha önceki ay, OpenAI, iki dahili test modelinin kum kafesinden kaçarak AI şirketi Hugging Face’in sistemine sızmasıyla ciddi bir güvenlik olayı yaşadı ve ardından bazı araştırmaları ve eğitimleri durdurdu. Brockman, basın toplantısında bu olaya açıkça değindi ve Astra’nın düşük sızma oranını ve güvenlik tasarımını vurguladı; bu yayın, “güven yenileme” misyonunu da taşıyor.
Astra'nın yayınlaması, bir yetenek gösterisi ve aynı zamanda açık bir güvenirlik beyanıdır.
AGI'nin gelip gelmediği, nihayetinde herkesin hangi tanımı seçtiğine bağlı olabilir. Ancak bugün, bilgisayarınızın önündeki bir masa başı oturup, yazılım arası iş akışlarını kendi kendine tamamlayabilen bir model gerçek bir varlıktır.
Sonra gerçekten ilginç olan soru, kurumların ve bireysel kullanıcıların bunu ilk olarak nerede kullanmaya başlayacağı ve hangi mesleklerin bu "ikame hissi"ni ilk olarak yaşayacağıdır.
