阿里云ODPS普惠算力再升级,Data+AI全产品降价低至59元! 了解详情
写点什么

百度又放大招!视觉生成模型 Hallo2 或将落地数字人等场景

  • 2024-10-24
    北京
  • 本文字数:722 字

    阅读完需:约 2 分钟

大小:354.10K时长:02:00
百度又放大招!视觉生成模型Hallo2或将落地数字人等场景

近日,百度联合复旦大学等发布 Hallo2,一个可以生成长达数小时且分辨率为 4K 的人物动画的视觉模型。Hallo2 目前已经在 GitHub 平台开源,供全球开发者免费使用和研究,预计将促进视频生成技术的广泛应用和发展。(项目地址:https://fudan-generative-vision.github.io/hallo2/#/



Hallo2 发布后,在海外引发了不小的震动。有人惊叹视频生成的长度和分辨率,也有老用户从 Hallo 第一代模型就被圈粉,还有对 Hallo2 开源模型和代码的认可。

Hallo2 备受关注,很重要一个原因是百度和复旦的研究团队解决了人像视频生成一个很大的痛点:如何提升视频生成的时长和质量。



一直以来,生成高质量的人物动画需要耗费大量的时间和人力成本。而百度与复旦联合发布的 Hallo2 的出现,有望彻底改变这一现状,为数字人、电影制作、虚拟助手、游戏开发等领域带来革命性的变化。




Hallo2 是能够实现长达一小时、4K 分辨率的音频驱动人像动画生成模型。通过创新的图像块丢弃、噪声增强和时间对齐等技术,Hallo2 解决了长时视频生成中的外观漂移和视觉不一致问题,支持灵活的语音与文本控制,生成质量达到业内领先水平。

Hallo2 继承了前代 Hallo 模型的创新框架,继续采用基于扩散的生成模型和分层音频驱动视觉合成模块,提高了音频与视觉输出之间的同步精度,并经过改进使得各部分的协同作用更加高效,增强了生成动画的质量和真实感。此外,Hallo2 不仅在图像和视频的质量方面有了显著提升,而且大幅增加了动作的丰富性和多样性。

有行业专家表示,Hallo2 的出现,标志着音频驱动的肖像图像动画技术迈入了新的发展阶段。百度基于长期的视觉技术积累,正在瞄准行业痛点进行针对性研究和场景落地,不仅为开发者提供了强大的工具,也为未来各种应用场景下的动画形象创作带来了新的可能性。



2024-10-24 17:368955

评论

发布
暂无评论
发现更多内容

Chunked-Prefills 分块预填充机制详解

Se7en

数据不 Ready,一切 AI Ready 都是伪命题

袋鼠云数栈

数据库 大数据 数据治理 Data + AI 数据开发与治理

黑龙江等保测评流程的注意事项

等保测评

多模态AI,敏感数据识别的终结者

权说安全

AI 零信任 数据防泄漏

数据不 Ready,一切 AI Ready 都是伪命题

袋鼠云数栈

人工智能 数据治理 数据管理 数据开发与治理 数据基座

为什么你的 App 需要一个“超级大脑”?

Speedoooo

APP开发 小程序容器 小程序技术 小程序容器技术

深度RAG笔记01:核心概念与诞生背景

王翊仰

LLM rag

天猫商品详情API接口技术解析与Python实现

tbapi

天猫商品详情接口 天猫API 天猫商品数据采集

基于MaxCompute MaxFrame 汽车自动驾驶数据预处理最佳实践

阿里云大数据AI技术

自动驾驶 数据处理 人工智能’ MaxCompute 数据库 大数据

巨头竞争,用户得利!大众CEO直言:有比亚迪这样的对手,最终受益的是顾客

爱极客侠

基于强化学习的智能体自主决策

申公豹

智能体

MIAOYUN | 每周AI新鲜事儿(07.04-07.11)

MIAOYUN

人工智能 云计算 AI 云原生 AI 原生

AI时代需要什么样的园区网络?答案藏在四个新技术里

Alter

springboot项目集成dolphinscheduler调度器 实现datax数据同步任务

刘大猫

人工智能 算法 数据分析 DolphinScheduler 调度器

Mac读取不到移动硬盘的常见原因及有效解决方法

阿拉灯神丁

格式化 Mac 软件 NTFS磁盘管理器 Tuxera NTFS2024 磁盘格式读写软件

系统综述:全同态加密友好的对称密码与密文转换技术

qife

全同态加密 密文转换

一文说明白Context Engineering:AI智能体的动态语境构建术

蔡超

AI Agent Agentic AI Context Engineering

AI背单词App的技术方案

北京木奇移动技术有限公司

软件外包公司 AI英语学习 AI背单词

淘宝图片搜索接口技术解析与Python实现

tbapi

淘宝图片搜索接口 淘宝拍立淘接口 天猫图片搜索接口 天猫拍立淘接口

黑龙江密码测评的实施流程

等保测评

MyEMS:ISO 50006 标准下的开源能源管理利器

开源能源管理系统

开源 ISO 50006 能源管理系统

苹果电脑装机必备软件推荐,Mac圈超实用软件列表

阿拉灯神丁

实用工具 苹果软件 Tuxera NTFS教程 CleanMyMac X中文版 mac装机必备

MCP 极简开发 读书笔记 1

wasa

大数据-40 Redis 类型集合 string list set zsorted hash 详解

武子康

Java redis 大数据 分布式 后端

智能网联 + AI:EMQX 5.10.0 大模型集成功能介绍

EMQ映云科技

人工智能 mqtt

EMQX + Amazon S3 Tables:从实时物联网数据到数据湖仓

EMQ映云科技

mqtt Amazon S3

Web3支付App的技术框架

北京木奇移动技术有限公司

区块链开发 软件外包公司 web3开发

大龄青年失业,可以在哪里寻找新的工作机会

安全乐谷

求职 找工作 招聘 转行

第七在线成功入选中服协《2025中国服装行业创新推荐目录》

第七在线

中烟创新灯塔大模型应用开发平台入选“2024年度百大AI产品”

中烟创新

三级等保测评流程五步走

等保测评

百度又放大招!视觉生成模型Hallo2或将落地数字人等场景_生成式 AI_华卫_InfoQ精选文章