'); })();
您好,欢迎来南方娱乐网-有趣有料雅俗共赏!

《天赐的声音》打通多模态AI链路:虚拟画面、合成嗓音、实时交互三大模块协同,完成音综舞台工程化落地

2026-07-20 19:02:06 来源:南方娱乐网

文章摘要

在 AIGC 技术加速迭代、广电媒体深度融合向纵深推进的行业背景下,《天赐的声音》节目组率先布局 AI 技术在音乐综艺舞台的深度落地

  在 AIGC 技术加速迭代、广电媒体深度融合向纵深推进的行业背景下,《天赐的声音》节目组率先布局 AI 技术在音乐综艺舞台的深度落地,以 “虚实共生、实时交互” 为核心目标开展前沿技术探索。本次项目构建了覆盖视觉、听觉、交互全链路的多模态 AI 技术体系,突破了传统 AI 内容生产仅用于离线辅助制作的局限,将 AI 能力深度嵌入节目录制的重要环节。

  体系核心涵盖三大技术模块:一是高保真虚拟人物画面生成技术,针对综艺舞台的专业光影、机位视角与实景环境做专项适配,结合市面上主流全能参考视频模型以及模块化AI配置,实现 虚拟生成画面与真实录制场景的自然融合,解决虚实画面融合、场景光影统一的难题;二是专业级虚拟 声音与演唱合成技术,可实现相对高精度音色还原与演唱情感拟合,兼顾音乐综艺对音质、音准、气息控制与情感表达的专业级要求,支撑 虚拟角色完成完整的舞台音乐演唱呈现;三是低延迟真人实时对话交互技术,基于大语言模型打造舞台专属交互大脑,支持现场真人嘉宾与虚拟角色的流畅临场对话及音乐点评,实现语义精准响应、多轮上下文衔接与舞台场景化自然表达。项目以业界前沿的视频生成、音频合成与大语言模型为基础底座,通过深度工程化调优与多模态链路打通,完成了从模型能力到广电级节目制作场景的定制化落地,初步形成了可稳定运行的端到端技术方案。

  本次技术尝试由浙江卫视《天赐的声音》节目组牵头,依托台内自有技术团队实现全链路自主可控落地,各模块分工明确、协同联动:虚拟画面技术由浙江卫视 ATLab 工作室提供核心技术支撑,虚拟声音与演唱技术由浙江卫视爱音斯坦音乐工作室提供技术保障,虚拟交互大脑由浙江卫视技术中心智媒果团队打造。

  不同于已形成相对成熟生产链路的纯虚拟内容生成,本次探索聚焦现场级虚实融合交互这一前沿赛道 —— 该方向需同时攻克多模态技术同步、现场环境适配、低延迟稳定运行、多系统协同调度、以及协调节目不同部门为新技术做适配等多重技术门槛,目前国内音综领域虚拟技术落地案例几乎为零。通过本次专项技术攻关,节目组通过本次专项尝试,积累了跨团队、跨技术链路的实操经验,最终节目呈现效果达到预期,也为音综领域的虚实融合创作沉淀了可复用的实践基础。

(责任编辑:吴丰丰)
关键词:天赐的声音
分享到:
娱乐聚焦
  • 明星
  • 电影
  • 电视
  • 综艺
  • 音乐
明星八卦