2026年7月31日上午,计算机学院、大数据与人工智能学院及科研处联合主办的《大型音频-语言模型》学术报告会在计算机学院会议室成功举行。本次活动特邀英国萨里大学王文武教授担任主讲嘉宾。报告会由计算机学院彭诗力主持,伍春晖、万德焕、刘芳、黄承慧、齐菲菲等师生共同参与了此次讲座,并围绕报告内容及相关热门议题进行了深入交流与讨论。

报告介绍了当前大型音频-语言模型(LALMs)的最新进展,重点探讨了新算法及其在音频相关任务中的应用。核心议题包括音频生成、声源分离与音频编辑、音频与文本的融合与对齐、跨模态音频应用、音频字幕生成与推理、神经音频编码与音乐转舞蹈生成,以及音频-语言学习的新兴研究方向。此外,还讨论了用于训练和评估大型音频-语言模型的关键数据集,包括WavCaps、Sound-VECaps和AudioSetCaps等。本次报告为我校师生搭建了高水平国际学术交流平台,有助于拓宽师生在AI领域的学术视野,深化对前沿理论与应用的了解,对推动学科建设与研究创新具有积极意义。

【王文武教授简介】王文武博士(IEEE Fellow)现任英国萨里大学计算机科学与电子工程学院教授、对外合作副院长,萨里大学人工智能研究所AI研究员。王教授目前的研究兴趣包括信号处理、机器学习、人工智能以及机器听觉,已发表论文400余篇。其研究成果获得了15项荣誉与奖项,包括2026年Meta杰出教师奖、2025年音频工程学会(AES)最佳技术论文奖、2022年IEEE信号处理学会青年作者最佳论文奖、DCASE评委奖、DCASE可复现系统奖、LVA/ICA最佳论文奖等。因在音频分类、生成和声源分离领域的杰出贡献,王教授于2026年当选为IEEE会士(IEEE Fellow)。王教授现任《IEEE Transactions on Multimedia》高级领域编辑、《IEEE Transactions on Signal Processing》副编辑,以及《IEEE/ACM Transactions on Audio, Speech and Language Processing》副编辑。此外,王教授现任欧洲信号处理协会(EURASIP)声学、语音与音乐信号处理技术委员会主席,以及IEEE信号处理学会(SPS)会议理事会理事和机器学习技术委员会主席,曾受邀在30多个国际会议和研讨会上担任主旨演讲或大会报告嘉宾。