Skild AI, NVIDIA ile yürüttüğü çalışmada S1 adlı robotik yapay zekâ sisteminin tek bir videodan daha önce görmediği, on dakikaya varan görevleri öğrenebildiğini duyurdu. NVIDIA’nın 10 Eylül tarihli açıklamasına göre yaklaşım, model ağırlıklarını yeniden eğitmeden videodaki eylemleri robotun kullanabileceği komutlara dönüştürüyor. Saksıya bitki yerleştirme gibi uzun ve çok adımlı örnekler üzerinde denemeler yapıldı.

Skild’in şirket içi karşılaştırmasında S1, görülmemiş uzun görevlerde adım başına yüzde 66 başarı bildirdi; belirtilen karşılaştırma yöntemi yüzde 9’da kaldı. Ekip, tek videonun yaklaşık 380 gösterime denk öğrenme sinyali verdiğini ve bir örnekte videodan uygulamaya geçişin 11 dakika sürdüğünü söylüyor.

Bu rakamlar bağımsız veya hakemli bir saha doğrulaması değil. Adım başına başarı, bütün görevin hatasız tamamlandığı anlamına gelmiyor. Farklı robot donanımları, ışık, nesne konumu ve güvenlik koşulları sonuçları değiştirebilir. Fabrika ya da ev kullanımı için insan denetimi, sınır testleri ve arıza senaryoları ayrıca değerlendirilmek zorunda.