AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: advantage-conditioning
此标签下有1条笔记。
2026年7月16日
π*0.6: a VLA That Learns From Experience (RECAP)
vla
reinforcement-learning
offline-rl
advantage-conditioning
flow-matching
robot-learning
dagger
value-function