大会报告嘉宾

胡事民,清华大学计算机科学与技术系教授,北京市可视媒体智能处理与内容安全工程研究中心主任,清华大学-腾讯公司互联网创新技术联合实验室主任。主要研究方向为计算机图形学、虚拟现实、智能信息处理等。在ACM TOG/SIGGRAPH、IEEE TPAMI、IEEE TVCG、IEEE TIP、CAD、 IEEE CVPR等重要刊物和国际会议上发表论文100余篇,并带来团队开源了深度学习框架计图(Jittor)。现为中国计算机学会副理事长,亚洲图形学学会主席,并担任Computational Visual Media期刊的主编和CAD、Computer & Graphics和中国科学等多个期刊的编委。

报告内容

报告题目:计算可视媒体:骨干网络与深度学习框架

人类获取信息的80%以上来自视觉,我们将承载视觉信息的媒体类型称为可视媒体,包括图像、视频与三维几何。可视媒体计算作为图形学、视觉、图像视频处理和几何学的交叉融合,是人类认识和改造现实世界的重要手段,蕴涵着无数影响人们生活和工作方式的应用。本报告从可视媒体智能处理的视角,分析从数据驱动到深度学习的计算可视媒体发展脉络,重点介绍清华大学计算可视媒体研究团队在外部注意机制和大核分解等视觉骨干网络方面的研究成果,视觉大模型预训练算法的加速策略,以及计图深度学习框架的新进展,包括软硬件适配优化与对大模型的支持。