AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: dinov2
此标签下有9条笔记。
2026年7月16日
CityWalker: Learning Embodied Urban Navigation from Web-Scale Videos
urban-navigation
point-goal-navigation
imitation-learning
visual-odometry
web-scale-video
dinov2
transformer
quadruped
data-scaling
cross-embodiment
2026年7月16日
Data Scaling Laws in Imitation Learning for Robotic Manipulation
imitation-learning
data-scaling-laws
diffusion-policy
umi
manipulation
generalization
dinov2
embodied-ai
iclr-2025
2026年7月16日
ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation
manipulation
keypoint-constraints
vlm
gpt-4o
dinov2
constrained-optimization
training-free
closed-loop
bimanual
code-as-policy
2026年7月16日
Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy
vla
diffusion-transformer
in-context-conditioning
cross-embodiment
open-x-embodiment
action-chunking
dinov2
q-former
libero
calvin
maniskill2
simplerenv
2026年7月16日
UniVLA: Learning to Act Anywhere with Task-centric Latent Actions
vla
latent-action
vq-vae
cross-embodiment
dinov2
prismatic-vlm
navigation
manipulation
human-video
libero
calvin
r2r
rss-2025
2026年7月16日
DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning
world-model
jepa
dinov2
latent-dynamics
model-predictive-control
zero-shot-planning
offline
patch-features
non-reconstructive
lecun
2026年6月25日
REPA: Representation Alignment for Generation — Training Diffusion Transformers Is Easier Than You Think
diffusion-transformer
representation-alignment
dinov2
sit
dit
self-supervised
training-efficiency
flow-matching
imagenet
2026年6月25日
TRELLIS: Structured 3D Latents for Scalable and Versatile 3D Generation
3d-generation
slat
rectified-flow
dit
sparse-voxel
dinov2
image-to-3d
text-to-3d
gaussian-splatting
mesh
2026年6月25日
Diffusion Transformers with Representation Autoencoders (RAE)
diffusion-transformer
representation-encoder
dinov2
autoencoder
latent-diffusion
imagenet
flow-matching
dit