Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model Paper • 2607.24904 • Published 3 days ago • 24
StarVLA-$α$: Reducing Complexity in Vision-Language-Action Systems Paper • 2604.11757 • Published Apr 13
Perflow-Shuai/Wan2.2-5B-TheDenk-Depth-ControlNet-NonAR-DMD-4Step-LoRA-r64-iter3000 Text-to-Video • Updated 15 days ago • 16
Perflow-Shuai/SCOPE-Wan2.2-5B-NonAR-DMD-4Step-LoRA-r32-iter2000 Image-to-Video • Updated 15 days ago • 15
Perflow-Shuai/Wan2.2-5B-TheDenk-Depth-ControlNet-NonAR-DMD-4Step-LoRA-r64-iter3000 Text-to-Video • Updated 15 days ago • 16
Perflow-Shuai/SCOPE-Wan2.2-5B-NonAR-DMD-4Step-LoRA-r32-iter2000 Image-to-Video • Updated 15 days ago • 15