AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: alignment
此标签下有2条笔记。
2026年6月25日
Diffusion-DPO: Diffusion Model Alignment Using Direct Preference Optimization
diffusion
dpo
alignment
rlhf
preference-optimization
sdxl
text-to-image
2026年6月25日
ImageReward & ReFL: Learning and Evaluating Human Preferences for Text-to-Image Generation
t2i
reward-model
rlhf
refl
human-preference
alignment
diffusion