Nispeten dikkat çekmeyen bir AI laboratuvarı, sahip olabileceğiniz donanımlarda aynı anda 150 görevi dengeleyebilen bir model çıkardı. 24 Ağustos 2026 tarihinde yayınlanan Apodex 1.1, yalanlama kadar basit bir tez üzerine kuruludur: AI agenteri için gerçek darboğaz, saf zeka değil, çalıştıkları ortamdır.
arXiv makalesinde (2608.23283) detaylandırılan model ailesi, yürütülebilir ortamları uzun süreli AI ajanları için ana ölçeklendirme yüzeyi olarak pozisyonlandırıyor.
Daha küçük model, rekabetçi sayılar
Apodex 1.1, önemli kaynaklara sahip laboratuvarlardan gelen modellerle doğrudan karşılaştırılabilecek performans skorları yayınladı. APEX-Agents üzerinde 38,5 ve GDPVal üzerinde 78,8 puan alarak, gerçekçi koşullar altında agens görev tamamlama ve genel akıl yürütme yeteneklerini ölçmek için tasarlanmış iki performans testinde başarı elde etti.
Domain-specific değerlendirmelerde sonuçlar doğrulandı. FrontierFinance 54,3 puan alırken, FrontierScience-Research 63,3 puan elde etti. Apodex Ekibi'ne göre, bu sayılar modeli Anthropic ve OpenAI'nin daha büyük sistemleri olan Claude ve GPT-5.x varyantlarıyla eşit veya onlardan önde konumlandırıyor.
Apodex 1.1 Mini varyantı, büyük laboratuvarlardan gelen öncü modellerle ilişkili parametre sayısının bir kesri olan 35 milyar parametre üzerinde çalışıyor. Takım, bu varyant için açık ağırlıkları yayınladı, bu da araştırmacıların ve şirketlerin her sorguyu bir bulut API'si üzerinden yönlendirmeden yerel olarak dağıtabilmesi anlamına gelir.
AgentOS ve koordinasyon problemi
Mimari başlık, ekip tarafından paylaşılan yürütme çatısı ve AgentOS olarak adlandırılır. Bu, birden fazla yapay zeka ajanının karmaşık bir görevin farklı bölümlerinde aynı anda çalışmasına ve her ajanın ne yaptığını ve neden yaptığını tutarlı bir şekilde kaydetmesine olanak tanıyan altyapı düzeyindeki bileşenlerdir.
Sistem, alma ve sentez görevlerinde aynı anda en fazla 150 alt ajanı destekler. Köken izleme yerleşik olarak entegre edilmiştir; bu, bir ajanın attığı her adımın kaydedildiğini ve sorumluluğunun belirlenebileceğini anlamına gelir.
Koordinasyon sistemi, takımdan yapılan tanıma göre asenkron ajan takımlarını kullanır. Ajanların bir kuyrukta beklemesi zorlanmaz; görevler, bağımsız olarak çalışabilen ve çıktılarını daha sonra uyumlu hale getirebilen birden fazla ajan kümesine ayrılır ve dağıtılır.
Açık kaynaklı araçlar ve araştırma boyutu
Modelin yanı sıra Apodex Ekibi, ReAct tarzı iş akışlarını desteklemek için geliştirilen bir çalışma ve araştırma platformu olan FrontierAgent’ı açık kaynak hale getirdi. ReAct, Reasoning ve Acting’in kısaltması olup, AI modellerinin bir sorunu düşünme ve ortamda somut eylemlerde bulunma arasında geçiş yaptığı bir çerçevedir.
Çıkış, takımın önceki çalışmalarına kıyasla önemli bir iyileşmeyi temsil ediyor. Öncül model olan Apodex 1.0 Mini, birden fazla işlemin bağlamı paylaşması ve çıktılarını birbirini engellemesi gereken üst üste gelen görevlerle mücadele ettiğine görünüyor. Apodex 1.1, bu zayıflığı doğrudan hedefliyor.
