英伟达推出VideoLDM，根据文本可生成4.7秒视频-中国风投网

更多

英伟达推出VideoLDM，根据文本可生成4.7秒视频

财经来源：IT之家阅读量：14882 2023-04-20 15:17

，英伟达和康奈尔大学的研究团队合作，近日推出了名为 VideoLDM 模型，可以根据文本描述，自动生成最高分辨率 2048*1280、24 帧、最长 4.7 秒的视频。

英伟达表示该模型配有 41 亿个参数，其中 27 亿个经过视频训练，这符合现代生成式 AI 的标准。IT之家从博文中获悉，英伟达表示通过高效的潜在扩散模型，能够创建多样化、高质量、高清晰度的视频。

该模型还能创建驾驶场景的视频，视频分辨率为 1024 × 512 像素，最长 5 分钟。英伟达表示目前该项目处于研究阶段，暂时不会向公众开放。

免责声明：市场有风险，选择需谨慎！此文仅供参考，不作买卖依据。

上一篇：消费潜力仍然巨大业界热议零售业发展趋势