【乐鱼体育】近日,阿里云推出全新视频生成大模型I2VGen-XL,并在魔搭社区开放体验。据悉,用户上传一张图片后2分钟左右即可生成一段1280*720的高分辨率视频。对此,该模型研发负责人表示,未来将进一步实现2K超清效果,可应用于短视频内容生产、电影制作等场景。
据乐鱼了解,和业界爆火的AI绘画创作大模型不同,视频生成大模型的技术门槛更高,其需要克服文本和视频内容匹配度、视频画面质量、画面连续性等诸多技术挑战。在此之前,阿里云和微软等科技公司相继推出一系列可控视频生成研究成果,例如用户可通过定义空间布局、运动模式等条件来生成视频,但其画面清晰度难以满足真实场景应用的需求。
制作页面
目前,I2VGen-XL的模型和代码均已开源,国内外社交媒体显示,该模型已吸引了国内外用户和开发者的广泛体验和二次开发,涌现了大量创意AI视频生成内容,例如在城堡上展翅的恐龙、宇航员在飞船中行走的科幻电影画面等等。
在视觉生成领域,阿里云此前已推出AI绘画创作大模型通义万相(基座模型Composer)和可控视频生成模型VideoComposer,团队在该领域发表60多篇CCF-A类论文,并在国际顶级视觉竞赛中获得10余项冠军。
版权所有,未经许可不得转载
-乐鱼体育app下载