阿里云推视频生成大模型未来可应用于电影制作

【环球网科技综合报道】9月6日消息，近日，阿里云推出全新视频生成大模型I2VGen-XL，并在魔搭社区开放体验，用户上传一张图片后2分钟左右即可生成一段1280*720的高分辨率视频，该模型研发负责人表示，未来将进一步实现2K超清效果，可应用于短视频内容生产、电影制作等场景。

I2VGen-XL在魔搭社区开放体验

和业界爆火的AI绘画创作大模型不同，视频生成大模型的技术门槛更高，其需要克服文本和视频内容匹配度、视频画面质量、画面连续性等诸多技术挑战。在此之前，阿里云和微软等科技公司相继推出一系列可控视频生成研究成果，例如用户可通过定义空间布局、运动模式等条件来生成视频，但其画面清晰度难以满足真实场景应用的需求。

针对该问题，阿里云进一步提出新思路，I2VGen-XL模型设计了两个阶段，首先在低分辨率条件下保证生成结果和给定图像语义的匹配度，随后通过视频扩散模型(VLDM)来提高视频分辨率，并同时提升时间和空间上的一致性，保证最终视频内容的清晰度和连贯性，最终实现1280*720高分辨率的突破，并且在画面细节的展现上大幅领先现有模型。据介绍，该模型的训练还使用了多种风格的视频数据，因此可生成科技感、电影色、卡通风格和素描等类型丰富的视频。

I2VGen-XL流程图

目前，I2VGen-XL的模型和代码均已开源，国内外社交媒体显示，该模型已吸引国内外用户和开发者的广泛体验和二次开发，涌现了大量创意AI视频生成内容，例如在城堡上展翅的恐龙、宇航员在飞船中行走的科幻电影画面等等……知名AI社交媒体分析师Ahsen Khaliq在社交媒体发布多条由该模型生成的视频效果，并表示模型在清晰度、纹理、语义和时间连续性方面有优势。

国内外网友和开发者广泛关注和体验

据了解，在视觉生成领域，阿里云此前已推出AI绘画创作大模型通义万相（基座模型Composer）和可控视频生成模型VideoComposer，团队在该领域发表60多篇CCF-A类论文，并在国际顶级视觉竞赛中获得10余项冠军。

来源：环球网

展开阅读全文

页面更新：2024-05-16

标签：阿里模型语义视频环球连续性清晰度社交画面未来内容电影

1 2 3 4 5

阿里云推视频生成大模型未来可应用于电影制作

科技日报：陕西：在大西北构建“热带雨林”式的科技生态

每秒计算30亿亿次！西安点燃数智发展引擎

微信查看自己名下绑定几个微信账户

王楚钦/孙颖莎夺得杭州亚运会乒乓球混合双打金牌

中超联赛第27轮比赛：北京国安2比0击败大连人

「图集」葛曼棋夺得杭州亚运会田径女子100米金牌

（杭州亚运会）围棋-女子团体预赛：中国队胜中国香港队(2)

中国女足挺进亚运四强

夺冠后，陈芋汐仍有点小失落：发挥得不是特别好

组图：女子百米飞人葛曼棋摘金颁奖仪式上与观众互动

上午11点！北京媒体做出争议报道：林高远王艺迪很意外！球迷吐槽

王楚钦：我和孙颖莎看待混双的角度发生变化，现在更多去承担任务

药厂3-0美因茨暂登顶，霍夫曼建功，格里马尔多任意球破门

中国队王琦摘得杭州亚运会田径男子链球金牌

7年后，再看谢杏芳婚姻，才明白她原谅林丹是最好的选择

北京推出城市夜游指南推荐榜评选，并征集巡游北京文旅短

“我想去中国”短视频创意大赛在泰国举办

2023“福游丰都”短视频大赛获奖作品出炉

聚焦智博会丨助力制药产业开发创新药物成为“医疗顾

（高质量发展调研行）陕西西安：建设“未来之城” 助力产业

微信朋友圈能发5分钟长视频！我也是刚知道，操作简单，一看

喜讯！津门虎下赛季引援首签锁定国字号金靴？未来入队可接

现代与传统的完美结合丨“这里是静安”系列视频特写④

果然视频｜六旬老人出门走失，民警登山搜寻

江山如画丨视频：在沙湖，塞北和江南的美已融为一体

阿里云推视频生成大模型 未来可应用于电影制作

阿里云推视频生成大模型未来可应用于电影制作