AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: stable-diffusion
此标签下有32条笔记。
2026年7月16日
Generative Image as Action Models
manipulation
diffusion-model
controlnet
stable-diffusion
action-representation
act
behavior-cloning
rlbench
visuomotor
image-generation
2026年7月16日
Diffusion Models Are Real-Time Game Engines (GameNGen)
world-model
neural-game-engine
diffusion
stable-diffusion
DOOM
action-conditioning
autoregressive-drift
noise-augmentation
game-wm
2026年6月25日
High-Resolution Image Synthesis with Latent Diffusion Models (LDM)
latent-diffusion
ldm
vae
u-net
cross-attention
text-to-image
stable-diffusion
two-stage
2026年6月25日
DiffEdit: Diffusion-based Semantic Image Editing with Mask Guidance
diffusion
image-editing
training-free
mask-guidance
ddim-inversion
semantic-editing
stable-diffusion
2026年6月25日
DreamBooth: Fine Tuning Text-to-Image Diffusion Models for Subject-Driven Generation
personalization
subject-driven
finetuning
diffusion
imagen
stable-diffusion
prior-preservation
2026年6月25日
Imagic: Text-Based Real Image Editing with Diffusion Models
image-editing
diffusion
text-guided
non-rigid-edit
embedding-interpolation
fine-tuning
imagen
stable-diffusion
tedbench
2026年6月25日
InstructPix2Pix: Learning to Follow Image Editing Instructions
diffusion
image-editing
instruction-following
synthetic-data
gpt-3
stable-diffusion
prompt-to-prompt
classifier-free-guidance
2026年6月25日
Null-text Inversion for Editing Real Images using Guided Diffusion Models
diffusion
image-editing
inversion
classifier-free-guidance
ddim
prompt-to-prompt
stable-diffusion
training-free
2026年6月25日
Prompt-to-Prompt Image Editing with Cross Attention Control
diffusion
image-editing
cross-attention
training-free
text-to-image
attention-injection
imagen
stable-diffusion
2026年6月25日
Stable Diffusion Inpainting / img2img (SD v1.5 编辑权重)
stable-diffusion
inpainting
img2img
sdedit
latent-diffusion
editing
open-weights
runway
2026年6月25日
Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation
video
t2v
video-editing
one-shot
diffusion
fine-tuning
stable-diffusion
ddim-inversion
attention-inflation
2026年6月25日
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation
character-animation
image-to-video
pose-guided
referencenet
diffusion
stable-diffusion
animatediff
human-video
2026年6月25日
CommonCanvas: An Open Diffusion Model Trained with Creative-Commons Images
t2i
latent-diffusion
creative-commons
synthetic-caption
copyright
blip-2
stable-diffusion
data-efficient
2026年6月25日
ControlNet: Adding Conditional Control to Text-to-Image Diffusion Models
controllable-generation
diffusion
stable-diffusion
conditional-control
zero-convolution
peft
image-to-image
2026年6月25日
Emu: Generative Pretraining in Multimodality
unified
autoregressive
lmm
multimodal-generation
interleaved
video-text
eva-clip
llama
stable-diffusion
in-context-learning
2026年6月25日
FreeU: Free Lunch in Diffusion U-Net
freeu
training-free
unet
skip-connection
backbone
fourier
frequency
inference-time
diffusion
stable-diffusion
cvpr2024
2026年6月25日
GILL: Generating Images with Multimodal Language Models
unified
frozen-llm
interleaved
retrieval
image-generation
mapping-network
opt
stable-diffusion
neurips-2023
2026年6月25日
HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models
personalization
hypernetwork
lora
dreambooth
face
fine-tuning
stable-diffusion
2026年6月25日
InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation
t2i
rectified-flow
reflow
distillation
one-step
flow-matching
acceleration
stable-diffusion
2026年6月25日
IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models
image-prompt
adapter
cross-attention
clip
ip-adapter
faceid
controlnet
stable-diffusion
2026年6月25日
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
mllm
subject-driven
personalization
zero-shot
image-as-foreign-language
score-distillation
alignernet
kosmos
stable-diffusion
2026年6月25日
Latent Consistency Models (LCM / LCM-LoRA)
diffusion
distillation
consistency-model
few-step
lora
acceleration
text-to-image
stable-diffusion
2026年6月25日
LCM-LoRA: A Universal Stable-Diffusion Acceleration Module
distillation
lcm
lora
consistency-model
few-step
acceleration
stable-diffusion
sdxl
pf-ode
task-arithmetic
2026年6月25日
MasaCtrl: Tuning-Free Mutual Self-Attention Control for Consistent Image Synthesis and Editing
diffusion
image-editing
self-attention
training-free
non-rigid-editing
stable-diffusion
consistency
attention-control
2026年6月25日
Controlling Text-to-Image Diffusion by Orthogonal Finetuning (OFT / COFT)
finetuning
peft
subject-driven
controllable-generation
dreambooth
controlnet
orthogonal
hyperspherical-energy
stable-diffusion
2026年6月25日
Pix2Pix-Zero: Zero-shot Image-to-Image Translation
diffusion
image-editing
training-free
cross-attention
ddim-inversion
structure-preservation
stable-diffusion
2026年6月25日
T2I-Adapter: Learning Adapters to Dig out More Controllable Ability for Text-to-Image Diffusion Models
controllable-generation
adapter
plug-and-play
stable-diffusion
conditional-control
sketch
depth
segmentation
pose
color
sdxl
2026年6月25日
TokenFlow: Consistent Diffusion Features for Consistent Video Editing
video-editing
diffusion-features
zero-shot
training-free
temporal-consistency
stable-diffusion
plug-and-play
iclr2024
2026年6月25日
Uni-ControlNet: All-in-One Control to Text-to-Image Diffusion Models
controllable-generation
adapter
diffusion
stable-diffusion
multi-condition
composable
spade
clip
neurips2023
2026年6月25日
Wonder3D: Single Image to 3D using Cross-Domain Diffusion
image-to-3d
multi-view-diffusion
cross-domain
normal-maps
sdf
stable-diffusion
objaverse
2026年6月25日
Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model
3d
multi-view
novel-view-synthesis
diffusion
stable-diffusion
reference-attention
controlnet
objaverse
2026年6月25日
模型族横向对比:Stable Diffusion → SDXL → SD3 → FLUX 谱系
deep-dive
lineage
stable-diffusion
sdxl
sd3
flux
latent-diffusion
mmdit
rectified-flow
t2i
open-weights