OpenScience, Terminal-Bench Bilim'de %75,7 başarı elde ederek Codex'i geride bıraktı

iconKuCoinFlash
Paylaş
AI summary iconÖzet
OpenScience, Y Combinator 2026 Kış Batchesi startupı Synthetic Sciences'ten bir araştırma aracı, Terminal-Bench Science'de %75,7 puan alarak Codex'i geride bıraktı. Araç, deneyleri otomatikleştirir, kod yazar ve bilimsel veritabanlarını kullanır. Autoresearch özelliği yinelemeli testlere olanak tanır. Zincir üzerindeki haberler, yapay zeka tabanlı araştırma araçlarına olan ilginin arttığını gösteriyor. Enflasyon verileri, makro trendleri izleyen yatırımcılar için hâlâ ana göstergedir.
ME AI Haberi: Y Combinator 2026 Kış Bölümü (YC W26) şirketi Synthetic Sciences, açık kaynaklı bilimsel Agent OpenScience’i resmen duyurdu. OpenScience, makale araştırabilir, verileri işleyebilir, kod yazabilir ve bilimsel veritabanlarını çağırabilir; yeni eklenen Autoresearch özelliğiyle AI, kendisi ardışık deneyler gerçekleştirebilir. Örneğin bir model eğitirken, araştırmacı sadece “doğrulama seti kaybını düşür” diyebilir. OpenScience, önce bir baz çalıştırır, ardından kendi kendine改良 önerileri üretir ve deneyleri sırayla uygular. Sonuç iyiyse korunur, kötüyse geri alınır ve önceki sonuçlara göre bir sonraki deney planlanır. Kullanıcılar, çalıştırma sayısı, toplam süre ve durma koşullarını önceden sınırlayabilir veya “sonraki adımda yalnızca iyileştiriciyi değiştir” gibi kurallar belirleyebilir. OpenScience, araştırmacıların sürekli gözlemlemesi gereken deney yinelemelerini otomatikleştirir: öneri üretme, deney yürütme, metrikleri karşılaştırma, başarısız önerileri dışlama ve bir sonraki döngüye geçme. Deneyler yerel cihazda çalıştırılabilir veya uzaktaki GPU’lara, SSH sunucularına ve Slurm/PBS kümelerine gönderilebilir. Her deney döngüsünün kodu, sonucu ve kararları kaydedilir; bu da sonradan kontrol için kolaylık sağlar. OpenScience, doğrudan ChatGPT/Codex aboneliğine bağlanmayı da destekler; ayrıca kendi API anahtarınızı, yerel modellerinizi veya resmi ücretli Ace hizmetini kullanabilirsiniz. Resmi testlerde, OpenScience 70 Terminal-Bench Science görevinden 53’ünü tamamladı ve %75,7 puan aldı. Karşılaştırma olarak, Codex + GPT-6 Astra’nın açık verileri %68,1’dir. (Kaynak: BlockBeats)
Yasal Uyarı: Bu sayfadaki bilgiler üçüncü şahıslardan alınmış olabilir ve KuCoin'in görüşlerini veya fikirlerini yansıtmayabilir. Bu içerik, herhangi bir beyan veya garanti olmaksızın yalnızca genel bilgilendirme amacıyla sağlanmıştır ve finansal veya yatırım tavsiyesi olarak yorumlanamaz. KuCoin, herhangi bir hata veya eksiklikten veya bu bilgilerin kullanımından kaynaklanan sonuçtan sorumlu değildir. Dijital varlıklara yapılan yatırımlar riskli olabilir. Lütfen bir ürünün risklerini ve risk toleransınızı kendi finansal koşullarınıza göre dikkatlice değerlendirin. Daha fazla bilgi için lütfen Kullanım Koşullarımıza ve Risk Açıklamamıza bakınız.