AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: robot-manipulation
此标签下有20条笔记。
2026年7月16日
R3M: A Universal Visual Representation for Robot Manipulation
visual-representation-learning
ego4d
time-contrastive-learning
video-language-alignment
self-supervised-pretraining
frozen-visual-encoder
imitation-learning
resnet
robot-manipulation
2026年7月16日
LIBERO: Benchmarking Knowledge Transfer for Lifelong Robot Learning
libero
benchmark
lifelong-learning
robot-manipulation
imitation-learning
behavioral-cloning
procedural-generation
pddl
declarative-vs-procedural
vla-eval
2026年7月16日
RH20T: A Comprehensive Robotic Dataset for Learning Diverse Skills in One-Shot
dataset
robot-manipulation
teleoperation-data
contact-rich
multi-modal
force-torque
tactile-sensing
one-shot-imitation
cross-embodiment
2026年7月16日
RoboAgent: Generalization and Efficiency in Robot Manipulation via Semantic Augmentations and Action Chunking (MT-ACT / RoboSet)
robot-manipulation
teleoperation-data
multi-task-imitation-learning
action-chunking
cvae
semantic-data-augmentation
roboset
franka-panda
data-efficiency
language-conditioned-policy
2026年7月16日
All Robots in One: A New Standard and Unified Dataset for Versatile, General-Purpose Embodied Agents
cross-embodiment
robot-manipulation
teleoperation-dataset
data-standard
multi-modal
tactile-sensing
audio-sensing
object-navigation
sim-to-real
china
2026年7月16日
CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation
vla
diffusion-transformer
componentized-vla
prismatic-vlm
llama-2
open-x-embodiment
action-ensemble
simpler-env
robot-manipulation
2026年7月16日
DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset
robot-manipulation
teleoperation-dataset
franka-panda
in-the-wild
diffusion-policy
co-training
cross-lab
rlds
generalization
2026年7月16日
RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation
robot-manipulation
teleoperation-dataset
multi-embodiment
humanoid-dexterous-hand
failure-data
digital-twin
isaac-sim
vla-benchmark
cross-embodiment
rss-2025
2026年7月16日
Magma: A Foundation Model for Multimodal AI Agents
vla
foundation-model
ui-navigation
robot-manipulation
set-of-mark
trace-of-mark
cross-embodiment
video-pretraining
cvpr2025
2026年7月16日
RynnVLA-001: Using Human Demonstrations to Improve Robot Manipulation
vla
video-generative-pretraining
action-vae
chameleon-backbone
autoregressive-transformer
ego-centric-video
robot-manipulation
alibaba
2026年7月16日
SeedPolicy: Horizon Scaling via Self-Evolving Diffusion Policy for Robot Manipulation
diffusion-policy
imitation-learning
gated-attention
recurrent-state
long-horizon
robotwin
robot-manipulation
cross-attention-gating
vla-compatibility
real-robot
2026年7月16日
Learning to Act from Actionless Videos through Dense Correspondences
world-model
video-diffusion
dense-correspondence
optical-flow
action-free-learning
inverse-kinematics
robot-manipulation
navigation
cross-embodiment
replanning
2026年7月16日
Learning Universal Policies via Text-Guided Video Generation
world-model
video-generation
video-diffusion
text-conditioned
inverse-dynamics
planning-as-generation
robot-manipulation
generalist-policy
UPDP
2026年7月16日
Video Language Planning
world-model
video-generation
video-diffusion
vision-language-model
tree-search
PaLM-E
robot-manipulation
long-horizon-planning
goal-conditioned-policy
2026年7月16日
IRASim: A Fine-Grained World Model for Robot Manipulation
world-model
diffusion-transformer
action-conditioned-video
trajectory-to-video
frame-level-conditioning
robot-manipulation
model-based-planning
policy-evaluation
iccv-2025
2026年7月16日
RoboDreamer: Learning Compositional World Models for Robot Imagination
world-model
video-diffusion
compositional-generation
text-conditioned
multimodal-conditioning
robot-manipulation
RLBench
RT-1
text-parsing
energy-based-composition
2026年7月16日
WorldSimBench: Towards Video Generation Models as World Simulators
world-model
video-generation
benchmark
world-simulator
human-preference-evaluator
embodied-evaluation
autonomous-driving
robot-manipulation
minecraft
closed-loop-evaluation
指令
视频
维度
动作类别
正例
负例
2026年7月16日
V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning
world-model
jepa
self-supervised
video
action-conditioned
zero-shot-planning
robot-manipulation
predictive-embedding
non-generative
2026年7月16日
Vidar: Embodied Video Diffusion Model for Generalist Manipulation
world-model
video-diffusion
robot-manipulation
bimanual-manipulation
inverse-dynamics
cross-embodiment
test-time-scaling
rectified-flow
aloha-robot
2026年7月16日
WoW: Towards a World omniscient World model Through Embodied Interaction
world-model
video-diffusion
embodied-ai
robot-manipulation
diffusion-transformer
inverse-dynamics-model
vlm-critic
physical-reasoning
benchmark
scaling-law