AI Research 技术调研

标签: vision-language-navigation

此标签下有2条笔记。

  • 2026年7月16日

    NaVid: Video-based VLM Plans the Next Step for Vision-and-Language Navigation

    • vision-language-navigation
    • VLN-CE
    • video-VLM
    • sim2real
    • RGB-only
    • embodied-navigation
    • LLaMA-VID
    • Vicuna-7B
    • RSS2024
  • 2026年7月16日

    Learning to Model the World With Language (Dynalang)

    • world-model
    • language-grounding
    • rssm
    • dreamerv3
    • multimodal
    • model-based-rl
    • imitation-free
    • text-pretraining
    • vision-language-navigation

  • GitHub