AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: autonomous-driving
此标签下有50条笔记。
2026年7月16日
VQ-BeT: Behavior Generation with Latent Actions
vq-vae
residual-vector-quantization
action-tokenization
behavior-cloning
imitation-learning
multimodal-behavior-generation
transformer-policy
goal-conditioning
autonomous-driving
2026年7月16日
A Survey: Learning Embodied Intelligence from Physical Simulators and World Models
survey
world-models
physical-simulators
embodied-intelligence
humanoid-robot
autonomous-driving
sim2real
robot-taxonomy
benchmark
model-based-rl
2026年7月16日
A Comprehensive Survey on World Models for Embodied AI
survey
world-models
embodied-ai
taxonomy
autonomous-driving
manipulation
navigation
occupancy-forecasting
evaluation-metrics
dataset
2026年7月16日
Iso-Dream: Isolating and Leveraging Noncontrollable Visual Dynamics in World Models
world-model
model-based-rl
dreamer
rssm
disentanglement
inverse-dynamics
autonomous-driving
video-prediction
actor-critic
carla
2026年7月16日
ADriver-I: A General World Model for Autonomous Driving
world-model
autonomous-driving
mllm
video-diffusion
action-conditioning
vicuna
nuscenes
closed-loop
control-signal-prediction
2026年7月16日
Cam4DOcc: Benchmark for Camera-Only 4D Occupancy Forecasting in Autonomous Driving Applications
world-model
autonomous-driving
occupancy-forecasting
benchmark
camera-only
4d-occupancy
nuscenes
lyft-level5
cvpr2024
2026年7月16日
Copilot4D: Learning Unsupervised World Models for Autonomous Driving via Discrete Diffusion
world-model
autonomous-driving
discrete-diffusion
lidar
point-cloud-forecasting
vqvae
maskgit
tokenizer
iclr2024
2026年7月16日
Driving into the Future: Multiview Visual Forecasting and Planning with World Model for Autonomous Driving (Drive-WM)
world-model
autonomous-driving
multiview-video
latent-diffusion
video-generation
end-to-end-planning
nuscenes
tree-rollout
2026年7月16日
DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving
world-model
autonomous-driving
diffusion
video-generation
action-conditioning
nuscenes
hdmap
3d-box
planning
2026年7月16日
DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model
world-model
autonomous-driving
diffusion
multi-view-generation
video-generation
layout-conditioning
nuscenes
consistency-attention
data-augmentation
2026年7月16日
GAIA-1: A Generative World Model for Autonomous Driving
world-model
autonomous-driving
autoregressive-transformer
video-generation
diffusion-decoder
vq-tokenizer
action-conditioning
scaling-laws
neural-simulator
2026年7月16日
MagicDrive: Street View Generation with Diverse 3D Geometry Control
world-model
autonomous-driving
diffusion
multi-view-generation
controlnet
bev
3d-bounding-box
nuscenes
data-augmentation
cross-view-attention
2026年7月16日
OccWorld: Learning a 3D Occupancy World Model for Autonomous Driving
world-model
autonomous-driving
3d-occupancy
vqvae
gpt
autoregressive
4d-forecasting
planning
nuscenes
occ3d
2026年7月16日
Panacea: Panoramic and Controllable Video Generation for Autonomous Driving
world-model
autonomous-driving
diffusion
multi-view-generation
video-generation
bev
controlnet
nuscenes
data-augmentation
4d-attention
2026年7月16日
Visual Point Cloud Forecasting enables Scalable Autonomous Driving (ViDAR)
world-model
autonomous-driving
self-supervised-pretraining
point-cloud-forecasting
bev
latent-rendering
nuscenes
cvpr2024
2026年7月16日
WoVoGen: World Volume-aware Diffusion for Controllable Multi-camera Driving Scene Generation
world-model
autonomous-driving
diffusion
controlnet
multi-camera
video-generation
nuscenes
occupancy
hdmap
action-conditioning
2026年7月16日
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation
world-model
autonomous-driving
diffusion
multi-view-generation
long-video-generation
bev
controlnet
nuscenes
failure-case-mining
uniad
data-augmentation
2026年7月16日
DOME: Taming Diffusion Model into High-Fidelity Controllable Occupancy World Model
world-model
autonomous-driving
occupancy-prediction
diffusion-transformer
vae
trajectory-conditioning
nuscenes
occ3d
4d-forecasting
2026年7月16日
Driving in the Occupancy World: Vision-Centric 4D Occupancy Forecasting and Planning via World Models for Autonomous Driving
world-model
autonomous-driving
occupancy-forecasting
4d-occupancy
action-conditioned
end-to-end-planning
nuscenes
lyft-level5
aaai2025
2026年7月16日
DriveWorld: 4D Pre-trained Scene Understanding via World Models for Autonomous Driving
world-model
autonomous-driving
4d-pretraining
occupancy
rssm
bev
cvpr2024
uniad
bevformer
2026年7月16日
DrivingWorld: Constructing World Model for Autonomous Driving via Video GPT
driving-world-model
autoregressive-video-generation
gpt-style
temporal-aware-vqvae
ego-trajectory-prediction
long-horizon-generation
next-state-prediction
autonomous-driving
2026年7月16日
GaussianWorld: Gaussian World Model for Streaming 3D Occupancy Prediction
world-model
autonomous-driving
occupancy-prediction
3d-gaussian-splatting
streaming-perception
4d-forecasting
nuscenes
surroundocc
2026年7月16日
GenAD: Generalized Predictive Model for Autonomous Driving
world-model
autonomous-driving
video-prediction
latent-diffusion
sdxl
opendv
planning
cvpr2024
2026年7月16日
InfinityDrive: Breaking Time Limits in Driving World Models
driving-world-model
video-diffusion
diffusion-transformer
long-video-generation
memory-mechanism
curriculum-learning
image-to-video
text-to-video
autonomous-driving
2026年7月16日
MagicDrive3D: Controllable 3D Generation for Any-View Rendering in Street Scenes
world-model
autonomous-driving
3d-gaussian-splatting
video-generation
nuscenes
bev
controllable-generation
scene-generation
data-engine
2026年7月16日
MagicDrive-V2: High-Resolution Long Video Generation for Autonomous Driving with Adaptive Control
world-model
autonomous-driving
diffusion-transformer
flow-matching
multi-view-generation
3d-vae
long-video-generation
controlnet
nuscenes
sequence-parallel
2026年7月16日
OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving
world-model
autonomous-driving
occupancy-generation
diffusion-transformer
4d-occupancy
trajectory-conditioning
nuscenes
vq-vae
dit
2026年7月16日
Understanding World or Predicting Future? A Comprehensive Survey of World Models
world-model
survey
taxonomy
video-generation
embodied-ai
autonomous-driving
robotics
social-simulacra
sora
jepa
2026年7月16日
Vista: A Generalizable Driving World Model with High Fidelity and Versatile Controllability
driving-world-model
video-diffusion
stable-video-diffusion
action-conditioning
long-horizon-rollout
reward-model
opendv
autonomous-driving
2026年7月16日
WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens
world-model
video-generation
masked-token-prediction
vqgan
transformer
multimodal-conditioning
action-conditioning
autonomous-driving
parallel-decoding
2026年7月16日
WorldSimBench: Towards Video Generation Models as World Simulators
world-model
video-generation
benchmark
world-simulator
human-preference-evaluator
embodied-evaluation
autonomous-driving
robot-manipulation
minecraft
closed-loop-evaluation
指令
视频
维度
动作类别
正例
负例
2026年7月16日
Cosmos-Drive-Dreams: Scalable Synthetic Driving Data Generation with World Foundation Models
world-model
autonomous-driving
synthetic-data
controlnet
multi-view
lidar-generation
diffusion
dit
cosmos
data-flywheel
2026年7月16日
World Simulation with Video Foundation Models for Physical AI (Cosmos-Predict2.5 & Cosmos-Transfer2.5)
world-model
physical-ai
video-foundation-model
flow-matching
controlnet
robotics
autonomous-driving
sim2real
cosmos
2026年7月16日
Cosmos-Predict2: A Suite of Diffusion-based World Foundation Models Available in 2B, and 14B
world-model
physical-ai
video-generation
text-to-image
diffusion-transformer
robotics
autonomous-driving
natten
action-conditioned
cosmos
2026年7月16日
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
world-model
autonomous-driving
video-generation
end-to-end-planning
co-evaluation
behavior-permutation-test
diffusion-transformer
vlm-planner
synthetic-data-augmentation
ood-generalization
2026年7月16日
GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving
world-model
autonomous-driving
latent-diffusion
flow-matching
multi-camera
video-tokenizer
controllable-generation
safety-critical
synthetic-data
2026年7月16日
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation
world-model
autonomous-driving
3d-gaussian-splatting
vision-language-model
visual-grounding
scene-understanding
video-generation
langsplat
dual-condition-diffusion
cvpr2026
2026年7月16日
I2-World: Intra-Inter Tokenization for Efficient Dynamic 4D Scene Forecasting
world-model
autonomous-driving
4d-occupancy
tokenization
residual-quantization
occupancy-forecasting
nuscenes
occ3d
iccv2025
2026年7月16日
Cosmos-Transfer1: Conditional World Generation with Adaptive Multimodal Control
world-model
diffusion
dit
controlnet
multimodal-control
sim2real
autonomous-driving
robotics
physical-ai
video-generation
2026年7月16日
Semi-Supervised Vision-Centric 3D Occupancy World Model for Autonomous Driving
world-model
autonomous-driving
3d-occupancy
semi-supervised-learning
volume-rendering
nerf
4d-forecasting
motion-planning
nuscenes
occ3d
2026年7月16日
SparseWorld: A Flexible, Adaptive, and Efficient 4D Occupancy World Model Powered by Sparse and Dynamic Queries
world-model
autonomous-driving
4d-occupancy
sparse-query
occupancy-forecasting
motion-planning
nuscenes
occ3d
aaai2026
2026年7月16日
SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model
world-model
autonomous-driving
4d-occupancy
sparse-query
trajectory-conditioning
transformer
feed-forward
nuscenes
occ3d
chamfer-distance
2026年7月16日
The Role of World Models in Shaping Autonomous Driving: A Comprehensive Survey
world-model
survey
autonomous-driving
taxonomy
driving-world-model
occupancy
point-cloud
video-generation
benchmark
2026年7月16日
World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model
world-model
autonomous-driving
end-to-end-planning
latent-world-model
self-supervised
vision-foundation-model
multi-modal-trajectory
nuscenes
navsim
iccv2025
2026年7月16日
WorldSplat: Gaussian-Centric Feed-Forward 4D Scene Generation for Autonomous Driving
world-model
autonomous-driving
gaussian-splatting
feed-forward-reconstruction
latent-diffusion
controlnet
novel-view-synthesis
4d-scene-generation
rectified-flow
iclr2026
2026年7月16日
NVIDIA OmniDreams: Real-Time Generative World Model for Closed-Loop Autonomous Vehicle Simulation
world-model
autonomous-driving
closed-loop-simulation
diffusion-transformer
autoregressive-generation
self-forcing
distillation
cosmos
multi-view-generation
world-action-model
2026年7月16日
Xiaomi Auto World Model: A Joint World Model Integrating Reconstruction and Generation for Autonomous Driving
driving-world-model
3d-gaussian-splatting
feedforward-reconstruction
diffusion-transformer
causal-video-generation
distillation
sparse-query
autonomous-driving
2026年7月16日
自动驾驶世界模型族(GAIA · DriveDreamer · Vista · OccWorld · 占据/点云预测)
world-model
autonomous-driving
deep-dive
driving-wm
video-generation
occupancy-forecasting
point-cloud-forecasting
multi-view-generation
closed-loop-simulation
2026年7月16日
世界模型评测(物理一致性 · 3D 一致性 · 动作保真 · 下游 RL/规划 · 驾驶指标)
world-model
benchmark
evaluation
physics
controllability
planning
autonomous-driving
超人
2026年6月25日
Cosmos World Foundation Model Platform for Physical AI (Cosmos-Predict1)
world-model
physical-ai
video-generation
diffusion
autoregressive
dit
tokenizer
robotics
autonomous-driving
open-weight