近日,2024(首届)中国数字人大会于北京召开,本次大会以“数字人应用与未来”为主题,汇聚了政府相关主管部门领导、院士专家、国内外数字人产业领军企业代表等,共话数字人未来发展及技术创新。大会开幕式上,快手视觉生成与互动中心负责人万鹏飞受邀出席,并发表主旨演讲《多模态数字人的技术创新与产业应用》。

万鹏飞表示,经过多年的技术研发,快手已构建起了完备的多模态数字人解决方案。具体而言,多模态数字人按照不同的输入形式,可分为传感器、文本/音频、视频、多模态综合四大驱动形式。其中,具备完整多模态输入输出能力的多模态数字人,相较而言效果上限更高,技术难度更大。
在此背景下,快手基于自研数字人采集建模、绑定、动捕驱动、大模型生成互动、交互渲染等技术,全面打造多模态数字人解决方案。他介绍称,数字人可应用于商业化、本地生活、电商、招聘等多元场景,主要分为身份型和服务型两种类型。
以快手官方虚拟主播“关小芳”为例,作为身份型数字人的典型应用,其打通了ASR、VLM、LLM等多个自研大模型能力,具备多模态感知、决策、生成能力,互动延时低于2秒且支持用户打断。卓越的性能表现和极低的推理时延使其广泛应用于快手财报解读等多种场景,并在快手平台吸引了超200万粉丝的关注。

同时,针对服务型数字人,快手打造了“快手智播”生成式数字人平台,支持超1000种数字人形象,用户只需提供3分钟视频素材,即可完成个性化数字人的生成。
万鹏飞介绍,除形象生成外,该平台融合了语音、图像及大模型等多种人工智能技术,具备直播/离线视频制作、配套脚本生成、素材管理等能力,打造低门槛、智能化的内容生产体验。一方面,平台所生成的数字人可帮助商家在快手实现云端实时驱动快速开播,打造7×24小时日不落直播间,增强用户观看体验;另一方面,对比真人主播,快手生成式数字人每月投入成本不足真人的20%,且支持万路以上直播间并发。目前,“快手智播”平台服务商家数已破万,数字人直播及短视频日均消耗规模超2000万。

随着AI大模型时代的来临,AIGC正在推动整个行业迈向更加高效、有创意的新纪元。万鹏飞表示,接下来,快手也将大力推动技术创新与产业发展,让多模态数字人更精美、更有智商和情商,为更多数字人应用场景带来更大的业务收益,也为人们的生活带来更多的便利。
应对AI技术迅猛发展的趋势及业界对前沿技术的迫切需求,聚焦新一代大模型的关键技术研发,未来,快手也将进一步夯实基座模型硬实力,持续坚持技术创新,为推动我国数字人产业的技术进步和创新发展贡献更大的力量。
免责声明
本文转载自网络平台,发布此文仅为传递信息,本文观点不代表本站立场,版权归原作者所有;不代表赞同其观点,不对内容真实性负责,仅供用户参考之用,不构成任何投资、使用等行为的建议。请读者使用之前核实真实性,以及可能存在的风险,任何后果均由读者自行承担。
本网站提供的草稿箱预览链接仅用于内容创作者内部测试及协作沟通,不构成正式发布内容。预览链接包含的图文、数据等内容均为未定稿版本,可能存在错误、遗漏或临时性修改,用户不得将其作为决策依据或对外传播。
因预览链接内容不准确、失效或第三方不当使用导致的直接或间接损失(包括但不限于数据错误、商业风险、法律纠纷等),本网站不承担赔偿责任。用户通过预览链接访问第三方资源(如嵌入的图片、外链等),需自行承担相关风险,本网站不对其安全性、合法性负责。
禁止将预览链接用于商业推广、侵权传播或违反公序良俗的行为,违者需自行承担法律责任。如发现预览链接内容涉及侵权或违规,用户应立即停止使用并通过网站指定渠道提交删除请求。
本声明受中华人民共和国法律管辖,争议解决以本网站所在地法院为管辖法院。本网站保留修改免责声明的权利,修改后的声明将同步更新至预览链接页面,用户继续使用即视为接受新条款。