写点什么

阿里云开源视频生成大模型 I2VGen-XL,2 分钟生成高清电影级效果视频

  • 2023-09-06
    北京
  • 本文字数:749 字

    阅读完需:约 2 分钟

大小:434.29K时长:02:28
阿里云开源视频生成大模型I2VGen-XL,2分钟生成高清电影级效果视频

近日,阿里云推出全新视频生成大模型 I2VGen-XL,并在魔搭社区开放体验,用户上传一张图片后 2 分钟左右即可生成一段 1280*720 的高分辨率视频。据介绍,该模型的训练还使用了多种风格的视频数据,可生成科技感、电影色、卡通风格和素描等类型丰富的视频。目前,I2VGen-XL 的模型和代码均已开源。

 

在此之前,阿里云曾推出 AI 绘画创作大模型通义万相(基座模型 Composer)和可控视频生成模型 VideoComposer,团队在该领域发表 60 多篇 CCF-A 类论文,并在国际顶级视觉竞赛中获得 10 余项冠军。

 

和 AI 绘画创作大模型相比,视频生成大模型的技术门槛更高,其需要克服文本和视频内容匹配度、视频画面质量、画面连续性等诸多技术挑战。在此之前,阿里云和微软等科技公司相继推出一系列可控视频生成研究成果,例如用户可通过定义空间布局、运动模式等条件来生成视频,但其画面清晰度难以满足真实场景应用的需求。

 

针对该问题,阿里云进一步提出创新思路,I2VGen-XL 模型设计了两个阶段:首先在低分辨率条件下保证生成结果和给定图像语义的匹配度,随后通过视频扩散模型(VLDM)来提高视频分辨率,并同时提升时间和空间上的一致性,保证最终视频内容的清晰度和连贯性,最终实现 1280*720 高分辨率的突破,并且在画面细节的展现上大幅领先现有模型。

 

I2VGen-XL 模型研发负责人表示,未来将进一步实现 2K 超清效果,可应用于短视频内容生产、电影制作等场景。


I2VGen-XL流程图

 

目前,I2VGen-XL 模型已吸引国内外用户和开发者的广泛体验和二次开发,涌现了大量创意 AI 视频生成内容,例如在城堡上展翅的恐龙、宇航员在飞船中行走的科幻电影画面等等……知名 AI 社交媒体分析师 Ahsen Khaliq 在推特发布多条由该模型生成的视频效果,并表示模型在清晰度、纹理、语义和时间连续性方面有优势。



模型体验地址:

https://modelscope.cn/studios/damo/I2VGen-XL-Demo/summary

2023-09-06 11:278043

评论

发布
暂无评论
发现更多内容

OneData之OneModel

KAMI

大数据 数据中台 数据治理 OneData

计算机中的递归对普通人有什么启示?

BitSea

算法

发布Maven包的正确姿势

廖雪峰

maven 开源

Docker 镜像制作教程:针对不同语言的精简策略

米开朗基杨

Docker Dockerfile

写作对我的意义

Neco.W

总结 思考 写作 感悟

OneData之OneID

KAMI

大数据 数据中台 数据治理 OneData

程序员的晚餐 | 5 月 17 日 当西红柿遇上鱼

清远

美食

Collaboration on SaaS

zhenglei

SaaS Collaboration Cisco Webex

少说废话,先干起来

大辉辉

学习 个人成长 自律

2020年比以往任何时候更想做成的使命感

乐少

游戏夜读 | Scikit-learn迎来0.21版本

game1night

浅谈Cloud Native技术对云上产品的影响

韩超

Docker Kubernetes 云原生 IaaS PaaS

码农理财(一)

北漂码农有话说

理财

回“疫”录(19):都什么时候了,还在搞“填表抗疫”

小天同学

疫情 回忆录 现实纪录 纪实 形式主义

从零到部署:用 Vue 和 Express 实现迷你全栈电商应用(一)

图雀社区

node.js vue.js Vue

DevOps生命周期,你想知道的全都在这里了!

禅道项目管理

DevOps 测试 持续集成

数据治理与OneData 体系

KAMI

大数据 数据中台 数据治理 OneData

一种练好英语口语的方法

董一凡

学习

Java如何处理异常情况

Rayjun

Java 异常

11 万字的字节码编程系列合集放送(ASM、Javassist、Byte-buddy、Javaagent)

小傅哥

Java asm bytebuddy 《字节码编程》

都前后端分离了,咱就别做页面跳转了!统统 JSON 交互

江南一点雨

spring Spring Boot spring security

机会,是不会让你准备好的

Winann

学习 生活 知识管理 机会

有问必答(2020-05-09):如何督促自己做好一件事情?

冯夷

生活

sync.Map源码分析

陈思敏捷

源码 源码分析 Go 语言

微服务涉及的技术生态有哪些?

攀岩飞鱼

分布式 微服务 方法论 软件架构

【高级进阶】写给大忙人看的JDK14新特性

知春秋

Java java 14 java 14 新特性

Kotlin协程实践之进程、线程、协程

陈吉米

Java kotlin 协程 Coroutine

从连续两届图灵奖(2018-2019)看GPU发展史

GPU

人工智能 gpu 计算机基础 计算机图形学 计算机体系结构

OneData之OneService

KAMI

大数据 数据中台 数据治理 OneData

微服务为什么要有服务发现与注册?

攀岩飞鱼

微服务

EasyExcel最权威教程

知春秋

Java Excel EasyExcel

阿里云开源视频生成大模型I2VGen-XL,2分钟生成高清电影级效果视频_阿里巴巴_凌敏_InfoQ精选文章