FibVLA는 시각-언어-행동 모델의 시간적 효율성을 높이는 새로운 프레임워크입니다. 피보나치 샘플링을 활용해 장기적인 시간 의존성을 효율적으로 포착합니다. 행동 예측 전문가에서는 플로우 매칭을 도입하고, 실시간 피드백 기반의 장거리 계획을 생성합니다. 기존 방식 대비 FibVLA는 행동의 부드러움과 성공률을 향상시키면서도 대규모 시각 인코더 재학습 없이 작동합니다. 실제 평가에서 기존 방식보다 빠른 실시간 반응성을 보여줍니다.