Long-WAM
Efficient-Large-Model
community
AI & ML interests
None defined yet.
Recent Activity
Original LTX-2.3 refiners and the LTX-2.5 extension for MiniMax-H3. https://nvlabs.github.io/Sana/Sol-Refiner/
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
-
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
Paper β’ 2605.15178 β’ Published β’ 92 -
Efficient-Large-Model/SANA-WM_bidirectional
Image-to-Video β’ Updated β’ 130 -
Efficient-Large-Model/SANA-WM_streaming
Updated β’ 1 -
Efficient-Large-Model/SANA-WM_chunk_causal
Text-to-Video β’ Updated β’ 43
Efficient Diffusion LLM
-
Efficient-Large-Model/Fast_dLLM_v2_1.5B
2B β’ Updated β’ 3.72k β’ 14 -
Efficient-Large-Model/Fast_dLLM_v2_7B
333k β’ Updated β’ 7.36k β’ 34 -
Fast-dLLM v2: Efficient Block-Diffusion LLM
Paper β’ 2509.26328 β’ Published β’ 60 -
Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding
Paper β’ 2505.22618 β’ Published β’ 47
HuggingFace Transformers can load us.
SANA-1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer
-
SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer
Paper β’ 2501.18427 β’ Published β’ 27 -
Efficient-Large-Model/SANA1.5_4.8B_1024px
Text-to-Image β’ Updated β’ 327 β’ β’ 26 -
Efficient-Large-Model/SANA1.5_4.8B_1024px_diffusers
Text-to-Image β’ Updated β’ β’ 20 -
Efficient-Large-Model/SANA1.5_1.6B_1024px
Text-to-Image β’ Updated β’ 114 β’ β’ 7
β‘οΈSana: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformer
-
Efficient-Large-Model/Sana_1600M_1024px
Text-to-Image β’ Updated β’ 1.19k β’ β’ 226 -
Efficient-Large-Model/Sana_1600M_1024px_BF16
Text-to-Image β’ Updated β’ 3.3k β’ 14 -
Efficient-Large-Model/Sana_1600M_1024px_BF16_ControlNet_HED
Text-to-Image β’ Updated β’ 38 β’ 1 -
Efficient-Large-Model/Sana_600M_1024px_ControlNet_HED
Text-to-Image β’ Updated β’ 36 β’ 3
Few-step and CFG-distillation LoRAs for MiniMax-H3, Wan2.1-T2V-14B, and Wan2.2-TI2V-5B.
-
Efficient-Large-Model/LongLive-Plug-MiniMax-H3-few-step
Text-to-Video β’ Updated β’ 184 β’ 1 -
Efficient-Large-Model/LongLive-Plug-MiniMax-H3-cfg
Text-to-Video β’ Updated β’ 55 β’ -
Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-few-step
Text-to-Video β’ Updated β’ β’ 1 -
Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-cfg
Text-to-Video β’ Updated β’ 54 β’
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
-
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
Paper β’ 2605.30409 β’ Published β’ 38 -
Efficient-Large-Model/SANA-Streaming
Updated β’ 2 -
Efficient-Large-Model/SANA-Streaming_bidirectional
Updated β’ 2 -
Efficient-Large-Model/SANA-Streaming-example-training-dataset
Updated β’ 128 β’ 1
π¬ SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
-
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
Paper β’ 2509.24695 β’ Published β’ 55 -
Efficient-Large-Model/SANA-Video_2B_720p
Text-to-Video β’ Updated β’ 26 β’ 30 -
Efficient-Large-Model/SANA-Video_2B_720p_diffusers
Text-to-Video β’ Updated β’ 6 -
Efficient-Large-Model/SANA-Video_2B_480p
Text-to-Video β’ Updated β’ 49 β’ 17
NVILA: Efficient Frontier Visual Language Models
-
NVILA: Efficient Frontier Visual Language Models
Paper β’ 2412.04468 β’ Published β’ 61 -
Efficient-Large-Model/NVILA-8B
Text Generation β’ Updated β’ 404 β’ 7 -
Efficient-Large-Model/NVILA-15B
Text Generation β’ Updated β’ 107 β’ 26 -
Efficient-Large-Model/NVILA-8B-Video
Text Generation β’ Updated β’ 220 β’ 10
Boost AI's Long ability, while keeping Efficient. Models in this collection includes LongVILA, LongVILA-R1, LongLive.
πSANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation
-
SanaSprint
π422Ultra fast high quality image generation
-
SANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation
Paper β’ 2503.09641 β’ Published β’ 42 -
Efficient-Large-Model/Sana_Sprint_1.6B_1024px
Text-to-Image β’ Updated β’ 78 β’ 21 -
Efficient-Large-Model/Sana_Sprint_0.6B_1024px
Text-to-Image β’ Updated β’ 107 β’ 9
-
Efficient-Large-Model/Llama-3-VILA1.5-8B
Text Generation β’ Updated β’ 672 β’ 37 -
Efficient-Large-Model/VILA1.5-40b
Text Generation β’ Updated β’ 229 β’ 17 -
Efficient-Large-Model/VILA1.5-3b
Text Generation β’ Updated β’ 19.3k β’ 36 -
Efficient-Large-Model/VILA1.5-3b-AWQ
Text Generation β’ Updated β’ 33 β’ 7
Long-WAM
Few-step and CFG-distillation LoRAs for MiniMax-H3, Wan2.1-T2V-14B, and Wan2.2-TI2V-5B.
-
Efficient-Large-Model/LongLive-Plug-MiniMax-H3-few-step
Text-to-Video β’ Updated β’ 184 β’ 1 -
Efficient-Large-Model/LongLive-Plug-MiniMax-H3-cfg
Text-to-Video β’ Updated β’ 55 β’ -
Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-few-step
Text-to-Video β’ Updated β’ β’ 1 -
Efficient-Large-Model/LongLive-Plug-Wan2.1-T2V-14B-cfg
Text-to-Video β’ Updated β’ 54 β’
Original LTX-2.3 refiners and the LTX-2.5 extension for MiniMax-H3. https://nvlabs.github.io/Sana/Sol-Refiner/
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
-
SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
Paper β’ 2605.30409 β’ Published β’ 38 -
Efficient-Large-Model/SANA-Streaming
Updated β’ 2 -
Efficient-Large-Model/SANA-Streaming_bidirectional
Updated β’ 2 -
Efficient-Large-Model/SANA-Streaming-example-training-dataset
Updated β’ 128 β’ 1
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
-
SANA-WM: Efficient Minute-Scale World Modeling with Hybrid Linear Diffusion Transformer
Paper β’ 2605.15178 β’ Published β’ 92 -
Efficient-Large-Model/SANA-WM_bidirectional
Image-to-Video β’ Updated β’ 130 -
Efficient-Large-Model/SANA-WM_streaming
Updated β’ 1 -
Efficient-Large-Model/SANA-WM_chunk_causal
Text-to-Video β’ Updated β’ 43
π¬ SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
-
SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer
Paper β’ 2509.24695 β’ Published β’ 55 -
Efficient-Large-Model/SANA-Video_2B_720p
Text-to-Video β’ Updated β’ 26 β’ 30 -
Efficient-Large-Model/SANA-Video_2B_720p_diffusers
Text-to-Video β’ Updated β’ 6 -
Efficient-Large-Model/SANA-Video_2B_480p
Text-to-Video β’ Updated β’ 49 β’ 17
Efficient Diffusion LLM
-
Efficient-Large-Model/Fast_dLLM_v2_1.5B
2B β’ Updated β’ 3.72k β’ 14 -
Efficient-Large-Model/Fast_dLLM_v2_7B
333k β’ Updated β’ 7.36k β’ 34 -
Fast-dLLM v2: Efficient Block-Diffusion LLM
Paper β’ 2509.26328 β’ Published β’ 60 -
Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding
Paper β’ 2505.22618 β’ Published β’ 47
NVILA: Efficient Frontier Visual Language Models
-
NVILA: Efficient Frontier Visual Language Models
Paper β’ 2412.04468 β’ Published β’ 61 -
Efficient-Large-Model/NVILA-8B
Text Generation β’ Updated β’ 404 β’ 7 -
Efficient-Large-Model/NVILA-15B
Text Generation β’ Updated β’ 107 β’ 26 -
Efficient-Large-Model/NVILA-8B-Video
Text Generation β’ Updated β’ 220 β’ 10
HuggingFace Transformers can load us.
Boost AI's Long ability, while keeping Efficient. Models in this collection includes LongVILA, LongVILA-R1, LongLive.
SANA-1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer
-
SANA 1.5: Efficient Scaling of Training-Time and Inference-Time Compute in Linear Diffusion Transformer
Paper β’ 2501.18427 β’ Published β’ 27 -
Efficient-Large-Model/SANA1.5_4.8B_1024px
Text-to-Image β’ Updated β’ 327 β’ β’ 26 -
Efficient-Large-Model/SANA1.5_4.8B_1024px_diffusers
Text-to-Image β’ Updated β’ β’ 20 -
Efficient-Large-Model/SANA1.5_1.6B_1024px
Text-to-Image β’ Updated β’ 114 β’ β’ 7
πSANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation
-
SanaSprint
π422Ultra fast high quality image generation
-
SANA-Sprint: One-Step Diffusion with Continuous-Time Consistency Distillation
Paper β’ 2503.09641 β’ Published β’ 42 -
Efficient-Large-Model/Sana_Sprint_1.6B_1024px
Text-to-Image β’ Updated β’ 78 β’ 21 -
Efficient-Large-Model/Sana_Sprint_0.6B_1024px
Text-to-Image β’ Updated β’ 107 β’ 9
β‘οΈSana: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformer
-
Efficient-Large-Model/Sana_1600M_1024px
Text-to-Image β’ Updated β’ 1.19k β’ β’ 226 -
Efficient-Large-Model/Sana_1600M_1024px_BF16
Text-to-Image β’ Updated β’ 3.3k β’ 14 -
Efficient-Large-Model/Sana_1600M_1024px_BF16_ControlNet_HED
Text-to-Image β’ Updated β’ 38 β’ 1 -
Efficient-Large-Model/Sana_600M_1024px_ControlNet_HED
Text-to-Image β’ Updated β’ 36 β’ 3
-
Efficient-Large-Model/Llama-3-VILA1.5-8B
Text Generation β’ Updated β’ 672 β’ 37 -
Efficient-Large-Model/VILA1.5-40b
Text Generation β’ Updated β’ 229 β’ 17 -
Efficient-Large-Model/VILA1.5-3b
Text Generation β’ Updated β’ 19.3k β’ 36 -
Efficient-Large-Model/VILA1.5-3b-AWQ
Text Generation β’ Updated β’ 33 β’ 7