AI Research 技术调研
Search
搜索
暗色模式
亮色模式
探索
标签: lora
此标签下有20条笔记。
2026年7月16日
OpenVLA: An Open-Source Vision-Language-Action Model
vla
open-source
open-x-embodiment
prismatic-vlm
llama-2
action-tokenization
lora
quantization
generalist-manipulation
robot-learning
2026年7月16日
SAM-E: Leveraging Visual Foundation Model with Sequence Imitation for Embodied Manipulation
manipulation
segment-anything
visual-foundation-model
lora
multi-view-transformer
action-chunking
rlbench
few-shot-adaptation
behavior-cloning
keypose-prediction
2026年7月16日
TinyVLA: Towards Fast, Data-Efficient Vision-Language-Action Models for Robotic Manipulation
vla
small-vlm
diffusion-policy
lora
data-efficient
low-latency
pythia
llava
real-robot
bimanual-manipulation
2026年7月16日
RoboBrain: A Unified Brain Model for Robotic Manipulation from Abstract to Concrete
vla
mllm
embodied-brain
task-planning
affordance-perception
trajectory-prediction
sharerobot
lora
open-x-embodiment
cvpr2025
2026年7月16日
GameFactory: Creating New Games with Generative Interactive Videos
world-model
game-generation
minecraft
video-diffusion
action-control
scene-generalization
lora
autoregressive-generation
diffusion-forcing
dataset
2026年7月16日
LLM-JEPA: Large Language Models Meet Joint Embedding Predictive Architectures
jepa
llm-finetuning
llm-pretraining
embedding-space-objective
next-token-prediction
contrastive-representation-learning
custom-attention-mask
loss-dropout
lora
yann-lecun
2026年7月16日
WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation
world-model
video-generation
physics-aware
text-to-video
mixture-of-experts
cogvideox
wan2.1
physical-commonsense
dataset
lora
2026年6月25日
AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning
video
t2v
motion-module
plug-and-play
diffusion
sd1.5
lora
motionlora
iclr2024
2026年6月25日
Concept Sliders: LoRA Adaptors for Precise Control in Diffusion Models
lora
diffusion
controllable-generation
image-editing
disentanglement
sdxl
concept-control
2026年6月25日
DragGAN / DragDiffusion: 基于点的交互式拖拽图像编辑
drag-editing
point-based
interactive-editing
stylegan
diffusion
lora
motion-supervision
point-tracking
dragbench
2026年6月25日
HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models
personalization
hypernetwork
lora
dreambooth
face
fine-tuning
stable-diffusion
2026年6月25日
Latent Consistency Models (LCM / LCM-LoRA)
diffusion
distillation
consistency-model
few-step
lora
acceleration
text-to-image
stable-diffusion
2026年6月25日
LCM-LoRA: A Universal Stable-Diffusion Acceleration Module
distillation
lcm
lora
consistency-model
few-step
acceleration
stable-diffusion
sdxl
pf-ode
task-arithmetic
2026年6月25日
X-Adapter: Adding Universal Compatibility of Plugins for Upgraded Diffusion Model
adapter
plugin-compatibility
controlnet
lora
sdxl
sd15
training-free-plugin
feature-remapping
diffusion
2026年6月25日
In-Context LoRA for Diffusion Transformers (IC-LoRA)
in-context
lora
dit
flux
image-set
task-agnostic
editing
customization
2026年6月25日
OminiControl: Minimal and Universal Control for Diffusion Transformer
dit
flux
controlnet
subject-driven
image-conditioning
lora
rope
dataset
2026年6月25日
ACE++: Instruction-Based Image Creation and Editing via Context-Aware Content Filling
instruction-edit
subject-reference
flux
inpainting
lora
diffusion
rectified-flow
dit
2026年6月25日
DreamO: A Unified Framework for Image Customization
image-customization
dit
flux
lora
subject-driven
identity
try-on
style
feature-routing
unified
2026年6月25日
ICEdit:用 In-Context 生成范式做指令图像编辑(Enabling Instructional Image Editing with In-Context Generation in Large-Scale DiT)
image-editing
instruction-editing
in-context
flux-fill
lora
moe
inference-time-scaling
dit
rectified-flow
neurips2025
2026年6月25日
UNO: Less-to-More Generalization — Unlocking More Controllability by In-Context Generation
subject-driven
customization
in-context-generation
dit
flux
lora
rope
multi-subject
data-synthesis