AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: calvin
此标签下有13条笔记。
2026年7月16日
Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation
gr-1
video-generative-pretraining
gpt-style-transformer
ego4d
calvin
future-frame-prediction
action-token
mae-vit
clip-text-encoder
perceiver-resampler
2026年7月16日
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
manipulation
diffusion-policy
3d-scene-representation
relative-attention
rope
keypose
rlbench
calvin
imitation-learning
embodied-ai
2026年7月16日
GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation
vla
video-generation
generative-pretraining
world-model
manipulation
cvae
action-chunking
calvin
bin-picking
bytedance
2026年7月16日
DeeR-VLA: Dynamic Inference of Multimodal Large Language Models for Efficient Robot Execution
vla
early-exit
dynamic-inference
efficient-inference
robotflamingo
calvin
edge-deployment
neurips-2024
2026年7月16日
Efficient Diffusion Transformer Policies with Mixture of Expert Denoisers for Multitask Learning
manipulation
diffusion-policy
mixture-of-experts
noise-conditioned-routing
expert-caching
calvin
libero
imitation-learning
iclr-2025
embodied-ai
2026年7月16日
Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos
latent-action
video-pretraining
vq-vae
autoregressive-transformer
action-chunking
cross-embodiment
human-video-pretraining
calvin
simpler
co-fine-tuning
2026年7月16日
Towards Generalist Robot Policies: What Matters in Building Vision-Language-Action Models
vla
empirical-study
backbone-ablation
policy-head
kosmos-2
paligemma
calvin
simplerenv
cross-embodiment
bytedance
2026年7月16日
Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation
manipulation
predictive-inverse-dynamics
visual-foresight
end-to-end
droid
calvin
libero
imitation-learning
scalability
embodied-ai
2026年7月16日
Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy
vla
diffusion-transformer
in-context-conditioning
cross-embodiment
open-x-embodiment
action-chunking
dinov2
q-former
libero
calvin
maniskill2
simplerenv
2026年7月16日
OpenHelix: A Short Survey, Empirical Analysis, and Open-Source Dual-System VLA Model for Robotic Manipulation
vla
dual-system
system1-system2
llava
prompt-tuning
calvin
open-source
empirical-study
survey
cross-attention
2026年7月16日
UniVLA: Learning to Act Anywhere with Task-centric Latent Actions
vla
latent-action
vq-vae
cross-embodiment
dinov2
prismatic-vlm
navigation
manipulation
human-video
libero
calvin
r2r
rss-2025
2026年7月16日
具身智能评测(LIBERO/SimplerEnv/CALVIN/Meta-World · 真机成功率 · 泛化)
embodied
benchmark
evaluation
manipulation
generalization
sim-to-real
real2sim
libero
calvin
simpler-env
metaworld
maniskill
reproducibility
2026年7月16日
VideoWorld: Exploring Knowledge Learning from Unlabeled Videos
video-wm
latent-dynamics-model
autoregressive-video
magvit-v2
fsq-quantizer
go-benchmark
robotic-manipulation
calvin
rlbench
cvpr-2025