AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: clip
此标签下有17条笔记。
2026年7月16日
JEPA-T: Joint-Embedding Predictive Architecture with Text Fusion for Image Generation
jepa
text-to-image
cross-attention
flow-matching
masked-prediction
imagenet
multimodal-fusion
clip
mar
non-generative-lineage
2026年6月25日
CLIP-Forge: Towards Zero-Shot Text-to-Shape Generation
text-to-3d
text-to-shape
clip
normalizing-flow
zero-shot
voxel
implicit-field
point-cloud
shapenet
2026年6月25日
Zero-Shot Text-Guided Object Generation with Dream Fields
text-to-3d
nerf
clip
zero-shot
volumetric-rendering
optimization
distillation-free
2026年6月25日
Paint by Word
text-guided-editing
clip
stylegan2
biggan
gan-latent-optimization
local-editing
cma-es
zero-shot
2026年6月25日
StyleCLIP: Text-Driven Manipulation of StyleGAN Imagery
stylegan
clip
text-driven-editing
latent-manipulation
gan-inversion
style-space
image-editing
2026年6月25日
VQGAN-CLIP: Open Domain Image Generation and Editing with Natural Language Guidance
vqgan
clip
text-to-image
clip-guidance
training-free
image-editing
ai-art
latent-optimization
eleutherai
2026年6月25日
DALL·E 2 / unCLIP(Hierarchical Text-Conditional Image Generation with CLIP Latents)
t2i
diffusion
unclip
clip
prior-decoder
guidance
openai
2026年6月25日
eDiff-I: Text-to-Image Diffusion Models with an Ensemble of Expert Denoisers
diffusion
text-to-image
ensemble-of-experts
cascaded-diffusion
t5
clip
paint-with-words
edm
nvidia
2026年6月25日
Point·E: A System for Generating 3D Point Clouds from Complex Prompts
text-to-3d
point-cloud
diffusion
transformer
glide
clip
image-to-3d
2026年6月25日
Stable Diffusion v1 (CompVis / Stability AI / Runway)
latent-diffusion
text-to-image
open-weights
ldm
unet
clip
laion
2026年6月25日
Versatile Diffusion: Text, Images and Variations All in One Diffusion Model
unified
multimodal
diffusion
multi-flow
t2i
image-to-text
image-variation
ldm
clip
2026年6月25日
Human Preference Score v2 (HPS v2): A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis
t2i
human-preference
reward-model
benchmark
clip
rlhf
evaluation
dataset
2026年6月25日
IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models
image-prompt
adapter
cross-attention
clip
ip-adapter
faceid
controlnet
stable-diffusion
2026年6月25日
Kandinsky 2.x (Image Prior + Latent Diffusion)
t2i
unclip
image-prior
latent-diffusion
movq
multilingual
open-source
clip
2026年6月25日
Gen-1: Structure and Content-Guided Video Synthesis with Diffusion Models
video-editing
video-to-video
latent-diffusion
depth-conditioning
temporal-layers
structure-content
clip
runway
2026年6月25日
StyleGAN-T: Unlocking the Power of GANs for Fast Large-Scale Text-to-Image Synthesis
gan
stylegan
text-to-image
fast-inference
clip
dino
single-step
2026年6月25日
Uni-ControlNet: All-in-One Control to Text-to-Image Diffusion Models
controllable-generation
adapter
diffusion
stable-diffusion
multi-condition
composable
spade
clip
neurips2023