AI Research 技术调研

标签: simplerenv

此标签下有4条笔记。

  • 2026年7月16日

    Towards Generalist Robot Policies: What Matters in Building Vision-Language-Action Models

    • vla
    • empirical-study
    • backbone-ablation
    • policy-head
    • kosmos-2
    • paligemma
    • calvin
    • simplerenv
    • cross-embodiment
    • bytedance
  • 2026年7月16日

    Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy

    • vla
    • diffusion-transformer
    • in-context-conditioning
    • cross-embodiment
    • open-x-embodiment
    • action-chunking
    • dinov2
    • q-former
    • libero
    • calvin
    • maniskill2
    • simplerenv
  • 2026年7月16日

    MolmoAct: Action Reasoning Models that can Reason in Space

    • vla
    • action-reasoning-model
    • depth-tokens
    • visual-trace
    • steerability
    • chain-of-thought
    • open-source
    • molmo
    • libero
    • simplerenv
  • 2026年7月16日

    SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model

    • vla
    • spatial-representation
    • egocentric-3d
    • action-tokenization
    • cross-embodiment
    • paligemma2
    • zoedepth
    • simplerenv
    • libero
    • rss2025

  • GitHub