1 article
Baidu's VEGA-3D uses video diffusion models to boost 3D spatial reasoning in multimodal AI - no explicit geometric supervision needed.
We use cookies to improve your experience on our site and to show you relevant advertising. To find our more, read our privacy policy and cookie policy