写点什么

阿里云开源视频生成大模型 I2VGen-XL,2 分钟生成高清电影级效果视频

  • 2023-09-06
    北京
  • 本文字数:749 字

    阅读完需:约 2 分钟

大小:434.29K时长:02:28
阿里云开源视频生成大模型I2VGen-XL,2分钟生成高清电影级效果视频

近日,阿里云推出全新视频生成大模型 I2VGen-XL,并在魔搭社区开放体验,用户上传一张图片后 2 分钟左右即可生成一段 1280*720 的高分辨率视频。据介绍,该模型的训练还使用了多种风格的视频数据,可生成科技感、电影色、卡通风格和素描等类型丰富的视频。目前,I2VGen-XL 的模型和代码均已开源。

 

在此之前,阿里云曾推出 AI 绘画创作大模型通义万相(基座模型 Composer)和可控视频生成模型 VideoComposer,团队在该领域发表 60 多篇 CCF-A 类论文,并在国际顶级视觉竞赛中获得 10 余项冠军。

 

和 AI 绘画创作大模型相比,视频生成大模型的技术门槛更高,其需要克服文本和视频内容匹配度、视频画面质量、画面连续性等诸多技术挑战。在此之前,阿里云和微软等科技公司相继推出一系列可控视频生成研究成果,例如用户可通过定义空间布局、运动模式等条件来生成视频,但其画面清晰度难以满足真实场景应用的需求。

 

针对该问题,阿里云进一步提出创新思路,I2VGen-XL 模型设计了两个阶段:首先在低分辨率条件下保证生成结果和给定图像语义的匹配度,随后通过视频扩散模型(VLDM)来提高视频分辨率,并同时提升时间和空间上的一致性,保证最终视频内容的清晰度和连贯性,最终实现 1280*720 高分辨率的突破,并且在画面细节的展现上大幅领先现有模型。

 

I2VGen-XL 模型研发负责人表示,未来将进一步实现 2K 超清效果,可应用于短视频内容生产、电影制作等场景。


I2VGen-XL流程图

 

目前,I2VGen-XL 模型已吸引国内外用户和开发者的广泛体验和二次开发,涌现了大量创意 AI 视频生成内容,例如在城堡上展翅的恐龙、宇航员在飞船中行走的科幻电影画面等等……知名 AI 社交媒体分析师 Ahsen Khaliq 在推特发布多条由该模型生成的视频效果,并表示模型在清晰度、纹理、语义和时间连续性方面有优势。



模型体验地址:

https://modelscope.cn/studios/damo/I2VGen-XL-Demo/summary

2023-09-06 11:279423

评论

发布
暂无评论
发现更多内容

ThingsBoard 前端项目轮播图部件开发

echeverra

thingsboard

OpenHarmony人才生态大会|润开鸿分享全国智能物联行业产教融合共同体建设实践

新消费日报

从0到1手动搭建k8s集群-初始化master节点

doramingo

云计算 Kubernetes 云原生

淘宝订单API接口在电商行业中的应用与实现

Noah

用友iuap智能中台“数智员工”在中核四川环保成功上岗

用友BIP

iuap

DBA解决慢查询问题的利器

NineData

sql 工具 dba NineData 慢查询分析

为什么说低代码的出现是时代的选择?

互联网工科生

软件开发 低代码 JNPF

2023最新Go面经:百度滴滴小米360小红书展盟优咔科技......

王中阳Go

golang 面试题 面经 八股文 求职技巧

8小时保姆级教程|鹅厂重磅图像生成训练营带你玩转AI绘画

牵着蜗牛去散步

腾讯云 腾讯 AIGC AI绘画 腾讯云AI绘画

软件测试/人工智能丨利用 ChatGPT 编写测试报告

测试人

人工智能 软件测试

发布jar包到maven中央仓库

不在线第一只蜗牛

Java 仓库 镜像仓库

1688一件采购实现指南:含代码实现采购流程

Noah

# 浅谈分布式操作系统KubeWharf 的第二批开源项目

苏沐

#k8s #云原生 分布式操作系统 #运维 KubeWharf

教你使用Prometheus-Operator进行K8s集群监控

华为云开发者联盟

云原生 k8s 后端 华为云 华为云开发者联盟

专家观点∣国产化价值替代之路—钢铁企业的特征管理

用友BIP

国产价值替代

2024上海智慧城市展会(世亚智博会)促进长三角地区智慧城市发展

AIOTE智博会

智博会 上海智博会 智慧城市展

让网页自己总结、解答、翻译、创作?你的超级助理已上线

新消费日报

外贸客户如何开发西班牙市场

九凌网络

【教程】浅谈ios混淆和加固加密

什么是数字化营销?如何进行数字化营销?数字化有多重要?

天津汇柏科技有限公司

数据驱动国资监管 用友BIP助力提高国有资本运营效能

用友BIP

数据驱动

企业数智化进阶模型,大型企业实现数智融合的成功之“道”

用友BIP

企业服务大模型

软件测试/人工智能丨利用ChatGPT自动生成测试用例思维导图

测试人

人工智能 软件测试

阿里云开源视频生成大模型I2VGen-XL,2分钟生成高清电影级效果视频_阿里巴巴_凌敏_InfoQ精选文章