AI Research 技术调研

标签: advantage-conditioning

此标签下有1条笔记。

  • 2026年7月16日

    π*0.6: a VLA That Learns From Experience (RECAP)

    • vla
    • reinforcement-learning
    • offline-rl
    • advantage-conditioning
    • flow-matching
    • robot-learning
    • dagger
    • value-function

  • GitHub