Computer Vision
计算机视觉
研究图像与视频的感知、解析和理解,涉及图像分类、目标检测、语义分割、视觉跟踪以及三维场景理解。关注复杂场景和开放环境下的模型泛化,并探索工业缺陷检测、自动驾驶、文化计算与智能交互等应用。
01 / ABOUT US
融合多元视角,探索智能前沿。
融合智能与学习研究室依托哈尔滨工业大学,围绕计算机视觉、机器学习与多模态智能开展科学研究与人才培养,关注图像和视频信息的感知、理解、复原与生成。
实验室坚持面向学术前沿和实际需求,重视基础研究、技术创新与开放合作,致力于培养具有扎实基础和创新能力的青年人才。
了解团队成员 ↗02 / RESEARCH
从视觉感知到多模态学习
从理解世界到生成新的可能
Computer Vision
研究图像与视频的感知、解析和理解,涉及图像分类、目标检测、语义分割、视觉跟踪以及三维场景理解。关注复杂场景和开放环境下的模型泛化,并探索工业缺陷检测、自动驾驶、文化计算与智能交互等应用。
Image Restoration
围绕图像与视频去噪、去模糊、超分辨率、低照度增强和人脸复原等任务开展研究。探索真实退化条件下的自监督学习、灵活模型适配与智能成像方法,连接物理成像过程和数据驱动模型。
Visual Generation
研究图像、视频与三维内容生成,关注个性化生成、可控生成、图像编辑和生成式复原。探索扩散模型等生成方法,并研究生成与理解的联系及面向动态世界的视觉建模。
Learning & Multimodality
研究视觉与语言等多模态信息的理解、对齐和推理,关注视觉语言大模型、持续学习、半监督与自监督学习,以及多模态模型适配。进一步探索智能体、具身智能和 AI 驱动科学发现等方向。
04 / NEWS & EVENTS
第三届模式识别前沿论坛于 2026 年 8 月 5—7 日在哈尔滨举行,围绕人工智能前沿研究开展学术交流。