AI Research 技术调研

标签: llama-2

此标签下有3条笔记。

  • 2026年7月16日

    CogACT: A Foundational Vision-Language-Action Model for Synergizing Cognition and Action in Robotic Manipulation

    • vla
    • diffusion-transformer
    • componentized-vla
    • prismatic-vlm
    • llama-2
    • open-x-embodiment
    • action-ensemble
    • simpler-env
    • robot-manipulation
  • 2026年7月16日

    OpenVLA: An Open-Source Vision-Language-Action Model

    • vla
    • open-source
    • open-x-embodiment
    • prismatic-vlm
    • llama-2
    • action-tokenization
    • lora
    • quantization
    • generalist-manipulation
    • robot-learning
  • 2026年6月25日

    AnyMAL: An Efficient and Scalable Any-Modality Augmented Language Model

    • any-modality
    • multimodal-llm
    • llama-2
    • perceiver-resampler
    • frozen-llm
    • audio
    • video
    • imu
    • instruction-tuning
    • understanding

  • GitHub