AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
Home
❯
world model
❯
2023
文件夹: world-model/2023
此文件夹下有32条笔记。
2026年7月16日
A-JEPA: Joint-Embedding Predictive Architecture Can Listen
jepa
audio
self-supervised
representation-learning
spectrogram
masking
curriculum-learning
vision-transformer
2026年7月16日
ADriver-I: A General World Model for Autonomous Driving
world-model
autonomous-driving
mllm
video-diffusion
action-conditioning
vicuna
nuscenes
closed-loop
control-signal-prediction
2026年7月16日
Learning to Act from Actionless Videos through Dense Correspondences
world-model
video-diffusion
dense-correspondence
optical-flow
action-free-learning
inverse-kinematics
robot-manipulation
navigation
cross-embodiment
replanning
2026年7月16日
Cam4DOcc: Benchmark for Camera-Only 4D Occupancy Forecasting in Autonomous Driving Applications
world-model
autonomous-driving
occupancy-forecasting
benchmark
camera-only
4d-occupancy
nuscenes
lyft-level5
cvpr2024
2026年7月16日
Copilot4D: Learning Unsupervised World Models for Autonomous Driving via Discrete Diffusion
world-model
autonomous-driving
discrete-diffusion
lidar
point-cloud-forecasting
vqvae
maskgit
tokenizer
iclr2024
2026年7月16日
Understanding Physical Dynamics with Counterfactual World Modeling
world-model
self-supervised
masked-prediction
video-transformer
counterfactual-reasoning
physical-dynamics
vit
physion-benchmark
non-generative
2026年7月16日
Mastering Diverse Domains through World Models (DreamerV3)
world-model
model-based-rl
rssm
actor-critic
imagination
latent-dynamics
minecraft
2026年7月16日
Driving into the Future: Multiview Visual Forecasting and Planning with World Model for Autonomous Driving (Drive-WM)
world-model
autonomous-driving
multiview-video
latent-diffusion
video-generation
end-to-end-planning
nuscenes
tree-rollout
2026年7月16日
DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving
world-model
autonomous-driving
diffusion
video-generation
action-conditioning
nuscenes
hdmap
3d-box
planning
2026年7月16日
DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model
world-model
autonomous-driving
diffusion
multi-view-generation
video-generation
layout-conditioning
nuscenes
consistency-attention
data-augmentation
2026年7月16日
Learning to Model the World With Language (Dynalang)
world-model
language-grounding
rssm
dreamerv3
multimodal
model-based-rl
imitation-free
text-pretraining
vision-language-navigation
2026年7月16日
GAIA-1: A Generative World Model for Autonomous Driving
world-model
autonomous-driving
autoregressive-transformer
video-generation
diffusion-decoder
vq-tokenizer
action-conditioning
scaling-laws
neural-simulator
2026年7月16日
HarmonyDream: Task Harmonization Inside World Models
world-model
model-based-rl
multi-task-learning
loss-balancing
dreamer
atari-100k
meta-world
rlbench
sample-efficiency
2026年7月16日
Self-Supervised Learning from Images with a Joint-Embedding Predictive Architecture (I-JEPA)
jepa
self-supervised
world-model
vision-transformer
latent-prediction
non-generative
masking
representation-learning
2026年7月16日
LightZero: A Unified Benchmark for Monte Carlo Tree Search in General Sequential Decision Scenarios
world-model
mcts
muzero
alphazero
model-based-rl
benchmark
open-source-toolkit
tree-search
reinforcement-learning
2026年7月16日
MagicDrive: Street View Generation with Diverse 3D Geometry Control
world-model
autonomous-driving
diffusion
multi-view-generation
controlnet
bev
3d-bounding-box
nuscenes
data-augmentation
cross-view-attention
2026年7月16日
MC-JEPA: A Joint-Embedding Predictive Architecture for Self-Supervised Learning of Motion and Content Features
jepa
self-supervised
world-model
optical-flow
multi-task-learning
vicreg
convnext
video
motion-features
2026年7月16日
OccWorld: Learning a 3D Occupancy World Model for Autonomous Driving
world-model
autonomous-driving
3d-occupancy
vqvae
gpt
autoregressive
4d-forecasting
planning
nuscenes
occ3d
2026年7月16日
Panacea: Panoramic and Controllable Video Generation for Autonomous Driving
world-model
autonomous-driving
diffusion
multi-view-generation
video-generation
bev
controlnet
nuscenes
data-augmentation
4d-attention
2026年7月16日
Physion++: Evaluating Physical Scene Understanding that Requires Online Inference of Different Physical Properties
world-model
intuitive-physics
benchmark
physical-property-inference
latent-properties
threedworld
neurips2023
human-comparison
object-centric
dpi-net
2026年7月16日
General World Models: The Next Frontier in AI Research
world-model
general-world-models
video-generation
research-agenda
runway
gen-series
simulation
robotics
2026年7月16日
Facing Off World Model Backbones: RNNs, Transformers, and S4
world-model
model-based-rl
structured-state-space
s4
s5
transformer-xl
rnn
long-term-memory
memory-maze
neurips-2023
2026年7月16日
STORM: Efficient Stochastic Transformer based World Models for Reinforcement Learning
world-model
model-based-rl
transformer
categorical-vae
atari-100k
imagination
actor-critic
sample-efficiency
2026年7月16日
TD-MPC2: Scalable, Robust World Models for Continuous Control
world-model
model-based-rl
mpc
latent-planning
td-learning
continuous-control
multitask
simnorm
mppi
enc-layers
Q
enc层
2026年7月16日
Transformer-based World Models Are Happy With 100k Interactions (TWM)
world-model
model-based-rl
transformer-xl
atari-100k
sample-efficiency
latent-imagination
autoregressive
actor-critic
kl-balancing
2026年7月16日
Learning Universal Policies via Text-Guided Video Generation
world-model
video-generation
video-diffusion
text-conditioned
inverse-dynamics
planning-as-generation
robot-manipulation
generalist-policy
UPDP
2026年7月16日
Learning Interactive Real-World Simulators (UniSim)
world-model
video-diffusion
action-conditioned
real-world-simulator
embodied-ai
sim-to-real
model-based-rl
robot-learning
2026年7月16日
VBench: Comprehensive Benchmark Suite for Video Generative Models
world-model
video-generation
benchmark
evaluation
human-alignment
t2v
vbench
cvpr2024
2026年7月16日
Visual Point Cloud Forecasting enables Scalable Autonomous Driving (ViDAR)
world-model
autonomous-driving
self-supervised-pretraining
point-cloud-forecasting
bev
latent-rendering
nuscenes
cvpr2024
2026年7月16日
Video Language Planning
world-model
video-generation
video-diffusion
vision-language-model
tree-search
PaLM-E
robot-manipulation
long-horizon-planning
goal-conditioned-policy
2026年7月16日
WonderJourney: Going from Anywhere to Everywhere
world-model
perpetual-view-generation
3d-scene-generation
point-cloud
llm-planning
vlm-verification
text-guided-outpainting
monocular-depth
training-free
2026年7月16日
WoVoGen: World Volume-aware Diffusion for Controllable Multi-camera Driving Scene Generation
world-model
autonomous-driving
diffusion
controlnet
multi-camera
video-generation
nuscenes
occupancy
hdmap
action-conditioning