Meta'nın otonom araştırma sistemi AIRA3, NVIDIA'nın Kaggle yarışmasında yaklaşık 4.000 takım arasında 8. oldu

Meta'ya göre otonom yapay zeka araştırma sistemi AIRA3, Haziran'da NVIDIA'nın Kaggle'da düzenlediği Nemotron akıl yürütme yarışmasına girdi ve yaklaşık 4.000 takım arasında 8. sırayla altın madalya seviyesinde bitirdi. Sistem insan yarışmacılarla aynı araçlara ve bilgiye sahipti, aynı gizli test küm

Paylaş
Meta'nın otonom araştırma sistemi AIRA3, NVIDIA'nın Kaggle yarışmasında yaklaşık 4.000 takım arasında 8. oldu

Meta, 5 Eylül'de resmi X hesabından yaptığı dört gönderilik duyuruda, otonom yapay zeka araştırma sistemi AIRA3'ün Haziran'da NVIDIA'nın düzenlediği canlı bir Kaggle yarışmasına girdiğini açıkladı; konu, 30 milyar parametreli bir Nemotron modeline daha iyi akıl yürütme öğretmekti. Meta'ya göre AIRA3 yaklaşık 4.000 takım arasında 8. olup altın madalya seviyesinde bitirdi; yarışmacılar aynı araçlara ve bilgiye sahipti, gizli bir test kümesinde dışarıdan puanlandı.

Meta bunu, AIRA3'ün “bir yapay zeka modelinin hedeflenen bir yeteneğini insan uzmanlara benzer düzeyde iyileştirebildiğinin güvenilir bir işareti” olarak yorumluyor. Dizide takımın Kaggle sıralamasındaki adı verilmiyor; sonuçlar Meta'nın beyanı, bağımsız doğrulama yok.

Yarışma ve modeller

Kaggle sayfasına göre NVIDIA Nemotron Model Reasoning Challenge Mart ortasından Haziran ortasına kadar sürdü. Herkes aynı temel modelden, Nemotron-3-Nano-30B'den başladı ve rank değeri en fazla 32 olan bir LoRA adaptörü teslim etti; puan, NVIDIA Research'ün geliştirdiği yeni bir akıl yürütme ölçütündeki doğruluktu. 4.182 takım katıldı; birincilik ödülü 25.000 dolar ve 5 DGX Spark'tı.

Meta'ya göre 8. sıradaki canlı gönderi GPT 5.5 (OpenCode ile) ve Claude 4.8 (ClaudeCode ile) topluluğuydu. Aynı gizli test kümesinde sonradan puanlanan denemelerde Meta'nın kendi modeli Muse Spark 1.2 (MuseCode ile) de altın seviyesine ulaştı; Muse Spark 1.1 ve GLM 5.2 (ikisi de OpenCode ile) gümüş seviyesine ulaştı.

Sistem nasıl çalışıyor

Meta'nın anlatımıyla AIRA3'te merkezi denetleyici yok: kodlama kabuğuyla eşlenmiş çok sayıda uzun süreli ajan, yalıtılmış ortamlarda çalışıyor ve hipotezlerle bulgular için ortak bir forum ile çözüm dosyaları için paylaşılan bir dosya sistemi üzerinden eşzamansız koordine oluyor. Ajanlar birbirinin keşiflerinin üstüne kuruyor; arama stratejileri kendiliğinden oluşuyor.

Genelleme iddiaları

Meta, alanlar arasında yalnız görev tanımının değiştiğini söylüyor: iç bir ölçütte üretim GPU çekirdeklerinde yüzde 27 gecikme azalması, 4.000 yıllık Akkadca kil tabletleri İngilizceye çeviren başka bir Kaggle yarışmasında altın seviyesi. Şirket “erken aşamada” olduğunu, hedefin “özyinelemeli kendini geliştirme” olduğunu ekliyor. Önceki sürüm AIRA2 Mart'ta arXiv'de yayımlanmıştı.

Kurumsal okur için

Bu sonuç, model ince ayarı işinin bir kısmının otonom sistemlere devredilebileceğine dair bir veri noktası; ama tek yarışma, şirketin kendi beyanı ve üretim ortamı değil.

Kaynaklar