MIT Geliştirdiği VLA Çerçevesi ile Robotların Yanıt Süresini 11 Kat Kısaltıyor
MIT, VLA çerçevesi ile robotların yanıt süresini 11 kat kısaltmayı başardı. Yeni yöntem, asenkron çıkarımın avantajlarını koruyor.
MIT tarafından geliştirilen yeni bir çerçeve, robotların yanıt sürelerini önemli ölçüde kısaltmayı hedefliyor. Araştırmacılar, mevcut çıkarım aşamasının, robotun mevcut eylemi gerçekleştirmesi sırasında çevre durumunun değişmesine rağmen, önceki bir duruma dayandığını belirtiyor. Bu durum, “zamansal uyumsuzluk” olarak tanımlanan bir soruna yol açabiliyor. Yani, çıkarım aşamasında kullanılan çevre durumu, mevcut durumu yansıtmayabiliyor.
Bu sorunu çözmek için geliştirilen VLASH, asenkron çıkarımın performans avantajlarını korurken, aynı zamanda bu dezavantajları ortadan kaldırmayı amaçlıyor. Araştırmacılar, bu yöntemin, bir hokey koçunun deyimiyle, “puck’ın gelecekte nerede olacağını tahmin ederek” çalıştığını ifade ediyor. VLASH, mevcut eylem için hesaplanan yörüngeyi kullanarak robotun yakın gelecekteki durumunu tahmin ediyor ve ardından çıkarım sürecini bu tahmin üzerine inşa ediyor.
MIT araştırmacıları, bu yaklaşımın “mimari değişiklikler veya ek çalışma süresi gerektirmeden, akıcı, doğru ve hızlı tepki kontrolü sağlayan genel bir asenkron çıkarım çerçevesi” sunduğunu belirtiyor.
Bu araştırmanın baş yazarı olan Song Han, MIT Elektrik Mühendisliği ve Bilgisayar Bilimleri Bölümü’nde doçent olarak görev yapıyor. Araştırmaya katkıda bulunan diğer isimler arasında MIT EECS yüksek lisans öğrencisi Jiaming Tang ve Tsinghua Üniversitesi’nden Yufei Sun ile birlikte NVIDIA, Kaliforniya Üniversitesi, Berkeley, Kaliforniya Üniversitesi, San Diego ve Caltech’ten araştırmacılar yer alıyor.
VLASH ve VLA çıkarım modelleri hakkında daha fazla bilgi için araştırma makalesini çevrimiçi olarak inceleyebilirsiniz ve VLASH kod deposuna github üzerinden ulaşabilirsiniz.




