首页 - 财经 - 行业新闻 - 正文

放大招!百度复旦视觉生成模型Hallo2或将落地数字人等场景

财经报道网 2024-10-25 12:27:34
关注证券之星官方微博:

(原标题:放大招!百度复旦视觉生成模型Hallo2或将落地数字人等场景)

近日,百度联合复旦大学等发布Hallo2,一个可以生成长达数小时且分辨率为4K的人物动画的视觉模型。Hallo2目前已经在GitHub平台开源,供全球开发者免费使用和研究,预计将促进视频生成技术的广泛应用和发展。

Hallo2发布后在海外引发了不小的震动。有人惊叹视频生成的长度和分辨率,也有老用户从Hallo第一代模型就被圈粉。

还有对Hallo2开源模型和代码的认可。

Hallo2备受关注,很重要一个原因是百度和复旦的研究团队解决了人像视频生成一个很大的痛点:如何提升视频生成的时长和质量。

一直以来,生成高质量的人物动画需要耗费大量的时间和人力成本。而百度与复旦联合发布的Hallo2的出现,有望彻底改变这一现状,为数字人、电影制作、虚拟助手、游戏开发等领域带来革命性的变化。这不同于Sora等AI视频生成模型遭遇到的发展瓶颈,Hallo2模型解决的问题更垂直,可落地空间更大。

Hallo2是目前首个实现长达一小时、4K分辨率的音频驱动人像动画生成模型。通过创新的图像块丢弃、噪声增强和时间对齐等技术,Hallo2解决了长时视频生成中的外观漂移和视觉不一致问题,支持灵活的语音与文本控制,生成质量达到业内领先水平。

Hallo2继承了前代Hallo模型的创新框架,继续采用基于扩散的生成模型和分层音频驱动视觉合成模块,提高了音频与视觉输出之间的同步精度,并经过改进使得各部分的协同作用更加高效,增强了生成动画的质量和真实感。此外,Hallo2 不仅在图像和视频的质量方面有了显著提升,而且大幅增加了动作的丰富性和多样性,可以说为AI驱动的肖像图像动画领域树立了新的标杆。

有行业专家表示,Hallo2的出现,标志着音频驱动的肖像图像动画技术迈入了新的发展阶段。百度基于长期的视觉技术积累,正在瞄准行业痛点进行针对性研究和场景落地,不仅为开发者提供了强大的工具,也为未来各种应用场景下的动画形象创作带来了新的可能性。

目前Hallo2模型已在GitHub上开源,项目地址:https://fudan-generative-vision.github.io/hallo2/#/。

另据悉,除视觉模型外,作为中国最大的AI公司,百度将在11月12日召开百度世界大会2024,展现更多AI方面的应用和技术进展。大会将围绕大模型和AI应用带来五大亮点,除百度创始人李彦宏领衔的主题演讲外,还有100+AI原生应用发布、四场主题分论坛、30+公开课和5000平米AI展区,全方位展示AI应用的落地成果。大会目前已开放免费报名通道,可通过大会官网报名参会。


本文来源:财经报道网

微信
扫描二维码
关注
证券之星微信
APP下载
相关股票:
好投资评级:
好价格评级:
证券之星估值分析提示长和盈利能力一般,未来营收成长性一般。综合基本面各维度看,股价偏高。 更多>>
下载证券之星
郑重声明:以上内容与证券之星立场无关。证券之星发布此内容的目的在于传播更多信息,证券之星对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至jubao@stockstar.com,我们将安排核实处理。
网站导航 | 公司简介 | 法律声明 | 诚聘英才 | 征稿启事 | 联系我们 | 广告服务 | 举报专区
欢迎访问证券之星!请点此与我们联系 版权所有: Copyright © 1996-