AI Research 技术调研

标签: td-mpc2

此标签下有1条笔记。

  • 2026年7月16日

    PWM: Policy Learning with Multi-Task World Models

    • world-model
    • model-based-rl
    • first-order-gradient
    • differentiable-simulation
    • multitask
    • td-mpc2
    • continuous-control
    • policy-extraction

  • GitHub