Embodied Robotics Research
Search
Search
Dark mode
Light mode
Explorer
Tag: preference-optimization
3 items with this tag.
Aug 20, 2026
Logic-VLA: A Temporal Logic Conditioned Vision-Language-Action Model
temporal-logic
preference-optimization
flow-matching
formal-specification
vla-posttraining
Aug 02, 2026
SP3O: Reinforcement Learning from Segment Preferences without Reward Modeling
rl-robotics
preference-optimization
reward-free-rl
vla-posttraining
Jun 03, 2026
FlowPRO: Reward-Free Reinforced Fine-Tuning of Flow-Matching VLAs via Proximalized Preference Optimization
vla
reinforcement-fine-tuning
flow-matching
preference-optimization
reward-free
tencent-robotics