【第十九届电子年会】生成式媒体通信专题论坛在武汉召开
第十九届中国电子信息年会于2026年4月17-19日在中国光谷科技会展中心召开。4月17日上午,生成式媒体通信专题论坛成功举办。本次论坛由上海交通大学、北京邮电大学、深圳大学、中兴通讯主办,与会的专家学者就生成式媒体表征与编码、沉浸式通信、机器视觉空间计算技术及应用等主题进行了广泛深入的交流。
论坛主席、移动网络和移动多媒体技术国家重点实验室谢大雄主任做开幕致词。谢大雄主任向出席活动的各位来宾表示热烈欢迎,向论坛主办单位、协办单位、支持单位及媒体单位的指导与帮助表示衷心的感谢。
专家报告环节,上半场的3个特邀报告由上海交通大学宋利研究员主持。
移动网络和移动多媒体技术国家重点实验室谢大雄主任作题为《从灵镜哲学到具身交互原型系统》的报告,以钱学森的“灵境”哲学为起点,系统阐述了6G沉浸式通信的愿景、理论根基、技术架构、关键指标、典型应用与评估体系,为打破物理边界、实现“知觉透明化”与“人机合一”的6G沉浸式通信新纪元,提供了从哲学思辨到工程落地的系统性框架与关键路径。
清华大学自动化系季向阳教授作题为《机器视觉空间计算技术及应用》的报告。季教授阐述了机器视觉空间计算技术的历史沿革与前沿发展,介绍了如何通过系列视觉位姿估计创新技术推进高精度、鲁棒与强泛化的视觉空间计算,探讨了面向场景空间交互的视觉重建与理解技术,并一步探讨视觉空间计算技术在工业、航空航天等领域的应用现状与趋势。
论坛主席、中国工程院院士、上海交通大学讲席教授张文军作题为《生成式媒体网络-面向AIGC时代的媒体网络演进与架构重构思考》的报告。张院士系统阐述了面向AIGC时代媒体与网络关系的第三次范式跃迁——从“媒体适配网络”和“网络适配媒体”演进到“媒体定义网络”。他指出,通信本质的转变从忠实传输发送端拥有的信息,变为引导接收端基于意图与约束自主生成期望内容。为此,张院士提出了“参考流+生成流”的双流并行架构,给出了全参考(增强模式)、部分参考(空间重构)、无参考(意图驱动)三类典型场景及对应应用。最终愿景是构建具备“可改变、可控制、可兼容”特性的新一代媒体网络,实现“生成驱动媒体,媒体定义网络”。
下半场的4个特邀报告由北京邮电大学乔秀全教授主持。
北京大学马思伟教授作题为《生成式视频编码理论与方法》的报告。马教授指出,近来多模态大模型技术发展迅速,大大提升了跨媒体理解和生成能力,因其能够学习到更富的语义和视觉表示,或将改变传统媒体的表示、编码与传输方式,未来融合信号、特征和语义的智能编码/生成编码是突破编码效率提升瓶颈的重要方向。他重点介绍了在图像视频生成编码方面的一些工作,以及AVS在生成式视频编码标准化方面的进展和未来面临的挑战。
合肥工业大学鲍秉坤教授作题为《特征解耦驱动的跨模态视觉生成》的报告。鲍教授介绍了针对跨模态生成过程构建的“模态对齐解耦-语义增补解耦-时空表征解耦”方法体系。首先,将跨模态输入中的耦合语义拆解至不同粒度的语义子空间,实现对象、属性、关系等多层次独立解耦生成;其次,在潜在表征空间中引入外部知识,增强表征解耦能力;最后,通过时-空表征解耦,实现运动过程与空间结构的独立控制与连贯生成。该体系为细节可控、高效灵活的跨模态视觉生成提供了系统化支撑。
中国移动集团首席专家、咪咕公司科技创新部总经理李琳作题为《生成式AI在下一代视频通信的探索与实践》的报告。李琳总经理分析了中国移动大视频能力在超高清、沉浸化、智能化等方面的创新案例,同时针对下一代视频在通信环节中的问题挑战,分享中国移动咪咕公司的解决方案与实践之路,共同推动生成式AI媒体通信在企业落地应用。
天津大学雷建军教授作题为《面向沉浸式场景的3D数据重构:从多视图深度估计到自由视角合成》的报告。雷教授指出,沉浸式媒体技术快速发展,对三维场景的几何精度、视觉真实感与交互自由度提出了更高要求。面向沉浸式场景的3D数据重构,旨在从多视角视频图像中恢复场景的几何结构与外观信息,并支持用户以任意视角观察与漫游,已成为虚拟现实、数字孪生、沉浸式会议等应用的重要技术支撑。此外,他还探讨了面向沉浸式场景的3D数据重构技术,介绍了多视图深度估计与自由视角视图合成等方面的创新工作。
本次专题论坛重点围绕生成式内容制作、视频表征与编码等重点问题展开讨论,聚焦沉浸式通信与视觉生成等应用,探索面向6G的媒体生成与通信体系创新路径。论坛的成功举办进一步凝聚了产业共识,推动生成式媒体通信关键技术的协同创新与深入发展,为未来通信网络注入新的动能与智慧支撑。
