ReflexVLA: 동적 조작을 위한 고속·예측형 비전-언어-액션 모델 분석
📌 핵심 요약 (Key Takeaways) 핵심 성과 1: 대규모 사전 학습 없이도 동적 조작(Reaction-critical manipulation) 환경에서 실시간 반응성을 확보한 ReflexVLA 아키텍처 제안 독창적 차별점 2: 시뮬레이터 구동과 제어 루프를 분리하고 잠재 미래 예측(Latent future prediction)과 CUDA Graph 리플레이를 통한 추론 지연 최소화 실무 파급력 3: 비동기 및 동기식 추론 환경 모두에서 설정 가능한 지연 시간을 … 더 읽기