AI Research 技术调研

标签: video-text

此标签下有1条笔记。

  • 2026年6月25日

    Emu: Generative Pretraining in Multimodality

    • unified
    • autoregressive
    • lmm
    • multimodal-generation
    • interleaved
    • video-text
    • eva-clip
    • llama
    • stable-diffusion
    • in-context-learning

  • GitHub