AICon 上海站|90%日程已就绪,解锁Al未来! 了解详情
写点什么

百度又放大招!视觉生成模型 Hallo2 或将落地数字人等场景

  • 2024-10-24
    北京
  • 本文字数:722 字

    阅读完需:约 2 分钟

大小:354.10K时长:02:00
百度又放大招!视觉生成模型Hallo2或将落地数字人等场景

近日,百度联合复旦大学等发布 Hallo2,一个可以生成长达数小时且分辨率为 4K 的人物动画的视觉模型。Hallo2 目前已经在 GitHub 平台开源,供全球开发者免费使用和研究,预计将促进视频生成技术的广泛应用和发展。(项目地址:https://fudan-generative-vision.github.io/hallo2/#/



Hallo2 发布后,在海外引发了不小的震动。有人惊叹视频生成的长度和分辨率,也有老用户从 Hallo 第一代模型就被圈粉,还有对 Hallo2 开源模型和代码的认可。

Hallo2 备受关注,很重要一个原因是百度和复旦的研究团队解决了人像视频生成一个很大的痛点:如何提升视频生成的时长和质量。



一直以来,生成高质量的人物动画需要耗费大量的时间和人力成本。而百度与复旦联合发布的 Hallo2 的出现,有望彻底改变这一现状,为数字人、电影制作、虚拟助手、游戏开发等领域带来革命性的变化。




Hallo2 是能够实现长达一小时、4K 分辨率的音频驱动人像动画生成模型。通过创新的图像块丢弃、噪声增强和时间对齐等技术,Hallo2 解决了长时视频生成中的外观漂移和视觉不一致问题,支持灵活的语音与文本控制,生成质量达到业内领先水平。

Hallo2 继承了前代 Hallo 模型的创新框架,继续采用基于扩散的生成模型和分层音频驱动视觉合成模块,提高了音频与视觉输出之间的同步精度,并经过改进使得各部分的协同作用更加高效,增强了生成动画的质量和真实感。此外,Hallo2 不仅在图像和视频的质量方面有了显著提升,而且大幅增加了动作的丰富性和多样性。

有行业专家表示,Hallo2 的出现,标志着音频驱动的肖像图像动画技术迈入了新的发展阶段。百度基于长期的视觉技术积累,正在瞄准行业痛点进行针对性研究和场景落地,不仅为开发者提供了强大的工具,也为未来各种应用场景下的动画形象创作带来了新的可能性。



2024-10-24 17:368840

评论

发布
暂无评论
发现更多内容

一文让你清楚的知道互联网时代数据的重要性-行云管家

行云管家

数据安全 数据智能化 数据的重要性

ClkLog埋点用户分析系统支持手机端查询统计数据

ClkLog

开源 数据分析 埋点 sdk 用户画像

Omnissa Secure Email Gateway 2.31 - 电子邮件网关

sysin

horizon

数据迁移丨借助 AI 从 PostgreSQL 到 GreatSQL

GreatSQL

Mac解压缩zip工具 Unzip Expert-Zip file tool for Mac v1.4.0激活版

Rose

苹果电脑装机必备精美日历软件:CalendarX for mac

Rose

Parallels Toolbox for mac(工具箱合集)v7.0.0商业版

Rose

分布式系统架构8:分布式缓存

卷福同学

Java redis 分布式 后端 分布式缓存

大数据平台Bug Bash大扫除最佳实践

京东科技开发者

Ascend+FastAPI+ Uvicorn 实现推理

zjun

推理 昇腾

VMware Data Services Manager 2.2 发布 - 数据库管理和数据服务管理

sysin

数据库

VMware Avi Load Balancer 31.1.1 发布 - 多云负载均衡平台

sysin

负载均衡

荣耀换帅,一艘AI巨轮的舵手更替会带来什么?

脑极体

AI

Mac ftp文件传输工具 SecureFX注册激活版

Rose

我国数字经济创稳中求进

芯盾时代

数字经济

Seata 源码

京东科技开发者

Cisco ACI Simulator 6.1(2g) - ACI 模拟器

sysin

ACI

中小型科技公司效率提升秘籍

伤感汤姆布利柏

内部信息流出!37天GeeLark云手机直接薅!!

kookeey代理严选

亚马逊运营 跨境电商运营 海外IP代理 Tiktok shop 指纹浏览器

Little Snitch 4 for Mac(小飞贼系统防火墙软件) v4.4.3稳定激活版

Rose

AI英语阅读理解APP的主要功能

北京木奇移动技术有限公司

软件外包公司 AI口语练习 AI英语练习

使用贪心算法解决最小生成树问题

威哥爱编程

Python 算法

分布式日志追踪ID实战

京东科技开发者

百度又放大招!视觉生成模型Hallo2或将落地数字人等场景_生成式 AI_华卫_InfoQ精选文章