AI Research 技术调研

标签: alignment

此标签下有2条笔记。

  • 2026年6月25日

    Diffusion-DPO: Diffusion Model Alignment Using Direct Preference Optimization

    • diffusion
    • dpo
    • alignment
    • rlhf
    • preference-optimization
    • sdxl
    • text-to-image
  • 2026年6月25日

    ImageReward & ReFL: Learning and Evaluating Human Preferences for Text-to-Image Generation

    • t2i
    • reward-model
    • rlhf
    • refl
    • human-preference
    • alignment
    • diffusion

  • GitHub