Nvidia’nın yaptığı son araştırmalar, yapay zeka modellerinin tek başına ne kadar güçlü olduğundan ziyade, onları çevreleyen ve yöneten yazılım katmanlarının başarıyı belirlemede çok daha kritik olduğunu gösterdi.
Nvidia, yapay zeka dünyasında ezber bozacak yeni araştırma sonuçlarını kamuoyuyla paylaştı. Yapılan çalışmalara göre, karmaşık ve uzun soluklu görevlerin üstesinden gelmede asıl belirleyici unsur, yapay zeka modelinin kendisinden ziyade etrafındaki yazılım sarmalı olan harness katmanı.
Araştırmada, Claude Opus 5 modeli özel olarak geliştirilen AVO (Agentic Variation Operators) isimli bir harness ile test edildi. Bellek yönetimi ve kararları denetleyen bir supervisor (yönetici) bileşeni içeren bu özel sarmal sayesinde model, talimat verilmeyen 2D oyunları içeren ARC-AGI-3 benchmark testinde %100 başarı oranına ulaştı. Harness kullanılmadığında ise aynı modelin skoru %30’da kaldı.
Bu sonuçlar, yapay zekanın sadece bir ‘beyin’ olmadığını, onu yönlendiren araçların, bellek yönetiminin ve çalışma zamanı kütüphanelerinin başarıyı doğrudan etkilediğini kanıtlıyor. Rakiplerin de benzer şekilde basit ayar değişiklikleriyle skorlarını üçe katladığı, ancak Nvidia’nın yönetici ajan mekanizması sayesinde zirveye ulaştığı belirtiliyor.
İlgili yazılar: Yapay Zeka Ajanlarının Hafızası Nasıl Optimize Edilmeli? IBM Araştırmacılarından Çarpıcı Bulgular
Görsel ve haber kaynağı: TechCrunch AI
