AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: offline-rl
此标签下有8条笔记。
2026年7月16日
BridgeData V2: A Dataset for Robot Learning at Scale
dataset
robot-learning
teleoperation-data
widowx250
multi-task
language-conditioned
goal-conditioned
imitation-learning
offline-rl
cross-institution-generalization
2026年7月16日
Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions
offline-rl
q-learning
autoregressive-q-function
conservative-q-learning
action-discretization
transformer
rt-1-backbone
saycan
real-robot
corl-2023
2026年7月16日
Hume: Introducing System-2 Thinking in Visual-Language-Action Model
vla
dual-system
value-guided-thinking
flow-matching
offline-rl
cal-ql
cascaded-denoising
best-of-n
pi0
dexterous-manipulation
2026年7月16日
π*0.6: a VLA That Learns From Experience (RECAP)
vla
reinforcement-learning
offline-rl
advantage-conditioning
flow-matching
robot-learning
dagger
value-function
2026年7月16日
Online and Offline Reinforcement Learning by Planning with a Learned Model (MuZero Unplugged)
world-model
model-based-rl
mcts
offline-rl
reanalyse
muzero
atari
dm-control
planning
2026年7月16日
Vector Quantized Models for Planning
world-model
model-based-rl
mcts
vqvae
discrete-latent
offline-rl
muzero
chess
deepmind-lab
planning
2026年7月16日
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
world-model
diffusion-model
offline-rl
d4rl
model-based-rl
value-expansion
classifier-free-guidance
td3-bc
iql
rl-wm
2026年7月16日
Learning from Reward-Free Offline Data: A Case for Planning with Latent Dynamics Models
jepa
world-model
offline-rl
planning
mpc
latent-dynamics
goal-conditioned
trajectory-stitching
lecun
vicreg