“你好,我是张雨霏,很高兴与你交流!”
在如火如荼的巴黎奥运会,AI“张雨霏”和AI“邹敬园”现身法国巴黎所罗门罗斯柴尔德公馆的“中国之家”。
这是两位1:1高拟真度还原的运动员虚拟数字人,它们既可以回答奥林匹克运动的起源问题,还可以切换中文、英文、法语,与来自世界各地的运动员和观众交流互动。
结合语音合成、识别、语义理解、唇形预测、图像处理等多语种智能语音和大模型技术,让它们实现了信息处理能力、知识理解能力、跨语言自由对话能力。
虚拟数字人的兴起,最早源于虚拟偶像。在元宇宙火爆之后,虚拟数字人又有了新的应用场景,到了现在又有了像虚拟主播、数字员工等用途。尤其是最近几年,在生成式AI技术的带动下,虚拟数字人的交互能力、内容生成能力及智能化水平得到了极大的提升。
中国传媒大学文化产业管理学院执行院长张洪生曾表示,数字人的发展经历了从真人驱动到程序驱动,再到如今AI驱动三种主要形式。
随着虚拟数字人的不断发展,市场体量也在逐渐增大,iiMedia Research(艾媒咨询)发布的《2023年中国AI数字人产业研究报告》显示,2022年中国AI数字人核心市场规模为120.8亿元,同比增长94.2%,预计2025年将达480.6亿元。
中国传媒大学发布的《中国虚拟数字人影响力指数报告》显示,2023年度“数字人、虚拟人”相关企业达99.3万余家,其中,2023年1月-12月新增相关企业41.7万余家,与2022年同比上涨超四成。
生成式AI一方面可以赋能虚拟数字人的制作和生成,一方面可以让虚拟数字人实现一些功能进行场景落地。
一位业内人士称,生成式AI确实提升了整体的生产效率,但是这种效率提升并不是线性的,而是点状在某些环节实现效率提升,另外模型还需进行训练,嫁接专有知识库才能让虚拟数字人提供更具个性化的情绪价值。
在生成式AI加持下的虚拟数字人,现已在传媒、文旅、教育、金融、医疗、体育等领域广泛应用。像虚拟主播可以实现全年无休,大幅降低直播成本,简化运营流程;虚拟数字人员工能够担任客服、导游、助手等角色,不仅提高了整体工作效率,更实现了智能化的服务体验。
生成式AI已经为虚拟数字人带来了一些变化,虽未达到颠覆行业的程度,但其广泛应用已展现出可见的潜力,未来虚拟数字人也将成为连接AI和现实世界的一座重要桥梁。
《数字化转型方略》2024年第7期:http://www.zhiding.cn/dxinsight/2407
好文章,需要你的鼓励
在Cloudera的“价值观”中,企业智能化的根基可以被概括为两个字:“源”与“治”——让数据有源,智能可治。
苏州大学研究团队提出"语境降噪训练"新方法,通过"综合梯度分数"识别长文本中的关键信息,在训练时强化重要内容、抑制干扰噪音。该技术让80亿参数的开源模型在长文本任务上达到GPT-4o水平,训练效率比传统方法高出40多倍。研究解决了AI处理长文档时容易被无关信息干扰的核心问题,为文档分析、法律研究等应用提供重要突破。
微软正式确认配置管理器将转为年度发布模式,并将Intune作为主要创新重点。该变化将于2026年秋季生效,在此之前还有几个版本发布。微软表示此举是为了与Windows客户端安全和稳定性节奏保持一致,优先确保安全可靠的用户体验。配置管理器将专注于安全性、稳定性和长期支持,而所有新功能创新都将在云端的Intune中进行。
清华大学团队首次揭示了困扰AI训练领域超过两年的"幽灵故障"根本原因:Flash Attention在BF16精度下训练时会因数字舍入偏差与低秩矩阵结构的交互作用导致训练崩溃。研究团队通过深入分析发现问题源于注意力权重为1时的系统性舍入误差累积,并提出了动态最大值调整的解决方案,成功稳定了训练过程。这项研究不仅解决了实际工程问题,更为分析类似数值稳定性挑战提供了重要方法论。