Skip to content
Maximizing Alignment with Minimal Feedback: Efficiently Learning Rewards for Visuomotor Robot Policy Alignment — Ran Tian (2024) | RDL Network