Latent Space·2d agoRunway’s WorldPrompt and the Engineering of Real-Time Worlds#runway#world-models#worldprompt 2 sources 15 min
Hugging Face daily papers·3d agoAV-GRPO: Modality-Anchored Decoupling Diffusion Reinforcement Learning for Joint Audio-Video Generation#diffusion#reinforcement-learning#audio-video-generation
Hugging Face daily papers·3d agoViRDM: Taming Representation Distribution Matching for Few-Step Causal Video Generation#virdm#video-generation#diffusion
arXiv cs.AI / cs.LG / cs.CL·3d agoOn the Diffusibility of High-Dimensional Latents#diffusion#flow-matching#representation-autoencodersAI research 2 sources
MarkTechPost·3d agoAlibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing#qwen#qwen-image#alibaba 9 sources 4 min
Hugging Face daily papers·4d agoAll modalities are equal, but video is more equal: Closing the Cross-Attention Gap in Joint Video Generation#video-generation#diffusion#cross-attention1
Hugging Face daily papers·4d agoUranus: Building the Next-Generation Simulation Infrastructure for Embodied AI#embodied-ai#robotics#simulation
The Decoder·4d agoA tiny software layer from lab-grown neurons promises faster, cheaper AI video#tbc#generative-video#diffusion 5 min
arXiv cs.AI / cs.LG / cs.CL·5d agoWorldCrafter: Consistent Video World Model with Implicit 3D-aware Memory#world-model#video-generation#3d-awareAI research 2 sources
arXiv cs.AI / cs.LG / cs.CL·5d agoDexTacWAM: A Visuo-Tactile World-Action Model for Dexterous Manipulation#robotics#world-model#tactileAI research
Hugging Face daily papers·8d agoUltraTex: Unleashing 2K Multi-View Diffusion for 3D Texturing#3d-texturing#diffusion#multi-view
arXiv cs.AI / cs.LG / cs.CL·9d agoPaint-Anything: Unified Any-Color Control for Image Generation and Editing#benchmark#color-control#diffusionAI research
Hugging Face daily papers·10d agoPaint-Anything: Unified Any-Color Control for Image Generation and Editing#benchmark#color-control#diffusion
Hugging Face trending models·13d agoQwen/Qwen-Image-2.1 — new model trending #30 on Hugging Face#alibaba#diffusion#ditModel release 4 min
Hugging Face daily papers·21d agoMulti-Grid Post-Training for Long-Form Multi-Shot Video Generation#diffusion#long-video#multi-shot
Hugging Face daily papers·24d agoOne Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing#benchmark#diffusion#generative-ai
Hugging Face trending models·25d agoOpenVDN/vdn-minimax-h3 — new model trending #12 on Hugging Face#diffusion#hybrid-attention#linear-attentionModel release 5 min1