AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: vision-language-model
此标签下有7条笔记。
2026年7月16日
VLFM: Vision-Language Frontier Maps for Zero-Shot Semantic Navigation
zero-shot
object-goal-navigation
frontier-exploration
vision-language-model
blip-2
value-map
habitat
spot-robot
semantic-navigation
2026年7月16日
Helpful DoggyBot: Open-World Object Fetching using Legged Robots and Vision-Language Models
legged-locomotion
quadruped-manipulation
unitree-go2
vision-language-model
zero-shot-generalization
sim-to-real
florence-2
sam2
whole-body-control
open-vocabulary
2026年7月16日
Being-0: A Humanoid Robotic Agent with Vision-Language Models and Modular Skills
humanoid
hierarchical-agent
vision-language-model
foundation-model
teleoperation
act-policy
whole-body-control
unitree-h1-2
embodied-agent
long-horizon-task
2026年7月16日
RoboBrain 2.0 Technical Report
vla
embodied-reasoning
spatial-reasoning
temporal-reasoning
multi-robot-planning
vision-language-model
qwen2.5-vl
grpo
flagscale
chain-of-thought
2026年7月16日
RoboReward: General-Purpose Vision-Language Reward Models for Robotics
benchmark
reward-model
vision-language-model
reinforcement-learning
robot-learning
open-x-embodiment
roboarena
qwen3-vl
data-augmentation
2026年7月16日
Video Language Planning
world-model
video-generation
video-diffusion
vision-language-model
tree-search
PaLM-E
robot-manipulation
long-horizon-planning
goal-conditioned-policy
2026年7月16日
GaussianDWM: 3D Gaussian Driving World Model for Unified Scene Understanding and Multi-Modal Generation
world-model
autonomous-driving
3d-gaussian-splatting
vision-language-model
visual-grounding
scene-understanding
video-generation
langsplat
dual-condition-diffusion
cvpr2026