6月23日 |【第36期交叉沙龙】智能喉声解码与可控医学图像生成、从医学影像分割到视觉语言模型

来源: 前沿交叉学科研究院    发稿时间:2026-06-18

图片
图片

沙龙信息

1


智能喉声解码技术研究:多模态信号采集与前期探索

 

研究方向:

  
图像检索、微视觉计算、医学影像智能分析 


报告人:



图片


张伯健

南开大学计算机学院博士后



时间

2026年6月23日

上午9:30-10:30


地点

南开大学津南校区

计算机学院620会议室




2


可控医学图像生成模型的探索



研究方向:

  

医学图像、图像生成



报告人:



图片


范津亮
南开大学计算机学院研究生

时间

2026年6月23日

上午9:30-10:30


地点

南开大学津南校区

计算机学院620会议室




3


面向精准清创的骨髓炎病灶智能分割与诊断研究



汇报内容:

  
  • 骨髓炎病灶数据集收集、标注规范与清洗流程

  • 冻结SAM/SAM2医学图像适配,超网络动态生成LoRA参数

  • 小波差分专家模块设计,以及分割实验与结果分析



报告人:



图片

孙国磊
南开大学计算机学院教授


个人简介:

南开大学教授、博导,国家级青年人才。博士毕业于瑞士苏黎世联邦理工学院,后任博士后研究员,师从计算机视觉国际顶尖学者Luc Van Gool教授(谷歌引用28万+)。研究方向为多模态大模型、视频理解和大模型轻量化;在CCF-A类等顶级期刊和会议发表论文50余篇,谷歌学术总引用11000余次。担任CCF-A类会议ICLR、NeurIPS领域主席。

时间

2026年6月23日

上午10:30-11:30


地点

南开大学津南校区

计算机学院620会议室




4


基于视觉语言模型的

图像视频分割



汇报内容:

  
  • 介绍团队近年在视觉语言模型与分割方向的研究进展

  • 图像分割:开放词汇分割、无训练分割等方向

  • 视频分割:开放词汇视频分割、运动指代分割等方向



报告人:



图片


曹家乐
天津大学英才副教授

个人简介:

天津大学英才副教授、博士生导师,主要研究视觉感知与理解。发表IEEE TPAMI、CVPR等高水平论文50余篇,主持国家自然科学基金青年、面上及科技部重大项目课题等。入选国家博新计划、斯坦福大学全球前2%顶尖科学家、天津市青科协优秀青年科技工作者,获天津市科技进步一等奖、MICCA12024最佳论文奖提名,并担任多个顶级会议领域主席及审稿人等学术服务工作。


时间

2026年6月23日

上午10:30-11:30


地点

南开大学津南校区

计算机学院620会议室