World-R1: Reinforcing 3D Constraints for Text-to-Video Generation
DGX agentarXiv:2604.24764v1 Announce Type: new Abstract: Recent video foundation models demonstrate impressive visual synthesis but frequently suffer from geometric inconsistencies. While existing methods atte