“你好,我是张雨霏,很高兴与你交流!”
在如火如荼的巴黎奥运会,AI“张雨霏”和AI“邹敬园”现身法国巴黎所罗门罗斯柴尔德公馆的“中国之家”。
这是两位1:1高拟真度还原的运动员虚拟数字人,它们既可以回答奥林匹克运动的起源问题,还可以切换中文、英文、法语,与来自世界各地的运动员和观众交流互动。
结合语音合成、识别、语义理解、唇形预测、图像处理等多语种智能语音和大模型技术,让它们实现了信息处理能力、知识理解能力、跨语言自由对话能力。
虚拟数字人的兴起,最早源于虚拟偶像。在元宇宙火爆之后,虚拟数字人又有了新的应用场景,到了现在又有了像虚拟主播、数字员工等用途。尤其是最近几年,在生成式AI技术的带动下,虚拟数字人的交互能力、内容生成能力及智能化水平得到了极大的提升。
中国传媒大学文化产业管理学院执行院长张洪生曾表示,数字人的发展经历了从真人驱动到程序驱动,再到如今AI驱动三种主要形式。
随着虚拟数字人的不断发展,市场体量也在逐渐增大,iiMedia Research(艾媒咨询)发布的《2023年中国AI数字人产业研究报告》显示,2022年中国AI数字人核心市场规模为120.8亿元,同比增长94.2%,预计2025年将达480.6亿元。
中国传媒大学发布的《中国虚拟数字人影响力指数报告》显示,2023年度“数字人、虚拟人”相关企业达99.3万余家,其中,2023年1月-12月新增相关企业41.7万余家,与2022年同比上涨超四成。
生成式AI一方面可以赋能虚拟数字人的制作和生成,一方面可以让虚拟数字人实现一些功能进行场景落地。
一位业内人士称,生成式AI确实提升了整体的生产效率,但是这种效率提升并不是线性的,而是点状在某些环节实现效率提升,另外模型还需进行训练,嫁接专有知识库才能让虚拟数字人提供更具个性化的情绪价值。
在生成式AI加持下的虚拟数字人,现已在传媒、文旅、教育、金融、医疗、体育等领域广泛应用。像虚拟主播可以实现全年无休,大幅降低直播成本,简化运营流程;虚拟数字人员工能够担任客服、导游、助手等角色,不仅提高了整体工作效率,更实现了智能化的服务体验。
生成式AI已经为虚拟数字人带来了一些变化,虽未达到颠覆行业的程度,但其广泛应用已展现出可见的潜力,未来虚拟数字人也将成为连接AI和现实世界的一座重要桥梁。
《数字化转型方略》2024年第7期:http://www.zhiding.cn/dxinsight/2407
好文章,需要你的鼓励
英特尔携手戴尔以及零克云,通过打造“工作站-AI PC-云端”的协同生态,大幅缩短AI部署流程,助力企业快速实现从想法验证到规模化落地。
意大利ISTI研究院推出Patch-ioner零样本图像描述框架,突破传统局限实现任意区域精确描述。系统将图像拆分为小块,通过智能组合生成从单块到整图的统一描述,无需区域标注数据。创新引入轨迹描述任务,用户可用鼠标画线获得对应区域描述。在四大评测任务中全面超越现有方法,为人机交互开辟新模式。
阿联酋阿布扎比人工智能大学发布全新PAN世界模型,超越传统大语言模型局限。该模型具备通用性、交互性和长期一致性,能深度理解几何和物理规律,通过"物理推理"学习真实世界材料行为。PAN采用生成潜在预测架构,可模拟数千个因果一致步骤,支持分支操作模拟多种可能未来。预计12月初公开发布,有望为机器人、自动驾驶等领域提供低成本合成数据生成。
MIT研究团队发现,AI系统无需严格配对的多模态数据也能显著提升性能。他们开发的UML框架通过参数共享让AI从图像、文本、音频等不同类型数据中学习,即使这些数据间没有直接对应关系。实验显示这种方法在图像分类、音频识别等任务上都超越了单模态系统,并能自发发展出跨模态理解能力,为未来AI应用开辟了新路径。