AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: atari-100k
此标签下有11条笔记。
2026年7月16日
Mastering Atari Games with Limited Data (EfficientZero)
world-model
model-based-rl
muzero
mcts
sample-efficiency
self-supervised
atari-100k
simsiam
value-prefix
off-policy-correction
2026年7月16日
Transformers are Sample-Efficient World Models (IRIS)
world-model
model-based-rl
transformer
discrete-autoencoder
vqvae
autoregressive
image-tokens
atari-100k
sample-efficiency
latent-imagination
Superhuman
2026年7月16日
HarmonyDream: Task Harmonization Inside World Models
world-model
model-based-rl
multi-task-learning
loss-balancing
dreamer
atari-100k
meta-world
rlbench
sample-efficiency
2026年7月16日
STORM: Efficient Stochastic Transformer based World Models for Reinforcement Learning
world-model
model-based-rl
transformer
categorical-vae
atari-100k
imagination
actor-critic
sample-efficiency
2026年7月16日
Transformer-based World Models Are Happy With 100k Interactions (TWM)
world-model
model-based-rl
transformer-xl
atari-100k
sample-efficiency
latent-imagination
autoregressive
actor-critic
kl-balancing
2026年7月16日
Efficient World Models with Context-Aware Tokenization (Δ-IRIS)
world-model
model-based-rl
transformer
discrete-autoencoder
vqvae
autoregressive
delta-tokens
crafter
atari-100k
imagination
Superhuman
2026年7月16日
Diffusion for World Modeling: Visual Details Matter in Atari (DIAMOND)
world-model
diffusion
EDM
atari-100k
model-based-rl
neural-game-engine
csgo
action-conditioning
imagination
rl-wm
超人游戏
2026年7月16日
EfficientZero V2: Mastering Discrete and Continuous Control with Limited Data
world-model
model-based-rl
mcts
gumbel-search
sample-efficiency
continuous-control
atari-100k
dmcontrol
off-policy-correction
2026年7月16日
Improving Token-Based World Models with Parallel Observation Prediction
world-model
model-based-rl
retnet
retention-network
token-based-world-model
parallel-decoding
atari-100k
imagination
vqvae
icml2024
Superhuman
2026年7月16日
UniZero: Generalized and Efficient Planning with Scalable Latent World Models
world-model
transformer
mcts
muzero
model-based-rl
atari-100k
dmcontrol
multitask-learning
lightzero
latent-world-model
2026年7月16日
Learning Transformer-based World Models with Contrastive Predictive Coding (TWISTER)
world-model
transformer-state-space-model
contrastive-predictive-coding
action-conditioning
atari-100k
deepmind-control-suite
model-based-rl
iclr-2025