AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: image-to-video
此标签下有15条笔记。
2026年7月16日
InfinityDrive: Breaking Time Limits in Driving World Models
driving-world-model
video-diffusion
diffusion-transformer
long-video-generation
memory-mechanism
curriculum-learning
image-to-video
text-to-video
autonomous-driving
2026年7月16日
Yume: An Interactive World Generation Model
world-model
video-diffusion
image-to-video
camera-control
keyboard-control
masked-diffusion-transformer
diffusion-acceleration
sekai
open-source
2026年6月25日
Animate Anyone: Consistent and Controllable Image-to-Video Synthesis for Character Animation
character-animation
image-to-video
pose-guided
referencenet
diffusion
stable-diffusion
animatediff
human-video
2026年6月25日
I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models
image-to-video
video-diffusion
cascaded-diffusion
vldm
ldm
sdedit
open-source
2026年6月25日
Pika 1.0
video
text-to-video
image-to-video
consumer-product
closed-source
generative-video
2026年6月25日
Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
video
image-to-video
text-to-video
latent-diffusion
data-curation
open-source
edm
multi-view
Clips
2026年6月25日
VideoPoet: A Large Language Model for Zero-Shot Video Generation
video
autoregressive
llm
discrete-token
multimodal
text-to-video
image-to-video
audio
magvit-v2
zero-shot
2026年6月25日
Runway Gen-3 Alpha
text-to-video
image-to-video
video-generation
closed-source
world-model
diffusion
c2pa
2026年6月25日
Lumiere: A Space-Time Diffusion Model for Video Generation
text-to-video
diffusion
space-time-unet
t2i-inflation
pixel-diffusion
image-to-video
video-inpainting
2026年6月25日
Veo 2
video-generation
text-to-video
image-to-video
closed-source
cinematography
latent-diffusion
synthid
4k
2026年6月25日
Goku: Flow Based Video Generative Foundation Models
video-generation
text-to-image
image-to-video
rectified-flow
dit
joint-image-video
3d-vae
bytedance
2026年6月25日
Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation
video-generation
text-to-video
image-to-video
text-to-image
image-editing
latent-diffusion
flow-matching
dit
crossdit
nabla
sparse-attention
open-source
russian
2026年6月25日
Veo 3 与 Veo 3.1
video-generation
text-to-video
image-to-video
native-audio
audiovisual
diffusion
closed-model
google-deepmind
flow
2026年6月25日
Luma Ray3.14
video-generation
text-to-video
image-to-video
video-editing
hdr
reasoning-video
closed-source
dream-machine
2026年6月25日
视频生成族横向对比(Sora · Veo · Wan · Movie Gen · HunyuanVideo · Kling · CogVideoX 及其谱系)
video-generation
text-to-video
image-to-video
diffusion-transformer
flow-matching
3d-vae
vbench
sora
veo
wan
movie-gen
hunyuanvideo
kling
cogvideox
deep-dive