AI Research 技术调研

标签: qwen2-vl

此标签下有4条笔记。

  • 2026年7月16日

    Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning

    • vla
    • diffusion-policy
    • autoregressive-reasoning
    • reasoning-injection
    • film
    • qwen2-vl
    • robot-foundation-model
    • model-scaling
    • icml2025
  • 2026年7月16日

    ChatVLA-2: Vision-Language-Action Model with Open-World Embodied Reasoning from Pretrained Knowledge

    • vla
    • mixture-of-experts
    • embodied-reasoning
    • reasoning-following
    • qwen2-vl
    • dexvla
    • open-world-generalization
    • bimanual-manipulation
  • 2026年7月16日

    ChatVLA: Unified Multimodal Understanding and Robot Control with Vision-Language-Action Model

    • vla
    • mixture-of-experts
    • catastrophic-forgetting
    • spurious-forgetting
    • task-interference
    • phased-training
    • qwen2-vl
    • diffusion-policy-head
    • multimodal-understanding
    • dual-arm-manipulation
    • Params
  • 2026年7月16日

    DexVLA: Vision-Language Model with Plug-In Diffusion Expert for General Robot Control

    • vla
    • diffusion-policy
    • cross-embodiment
    • curriculum-learning
    • qwen2-vl
    • action-expert
    • dexterous-manipulation
    • long-horizon
    • sub-step-reasoning
    • corl2025

  • GitHub