1.项目介绍
项目聚焦“认知科学安全伦理的对齐与保障”这一重大科学问题,针对《生成式人工智能服务管理办法》等国家立法对生成式人工智能安全性、公平性、价值观对齐等方面的重大需求,开展认知科学安全伦理的理论研究与应用实践。项目围绕大模型意识形态安全、伦理对齐与安全保障等核心问题,融合马克思主义理论、社会学、心理学、哲学、计算机科学、网络空间安全等多学科优势,建立认知科学安全伦理的基础理论和评测体系,提出面向内容生成的伦理对齐方法与安全保障技术体系,构建基于国产超算平台的安全伦理对齐大模型,并面向党建、思政等重要应用场景构建智慧党支部、智慧马院等示范应用。项目预期在认知科学安全伦理评测标准、大模型价值观对齐技术、大模型思政应用构建等方面取得突破,为解决国家重大战略需求、打破国外技术封锁提供技术支撑,赋能课程思政、数字辅导员等实际应用。
2.项目负责人及团队骨干
(1)刘哲理

职称:教授,博士生导师
职务:南开大学计算机学院院长、密码与网络空间安全学院副院长,教育部特聘教授,数据与智能系统安全教育部重点实验室主任,中国新一代人工智能发展战略研究院智能网络安全研究中心主任
研究方向:数据安全与隐私保护、密态数据库、安全多方计算、人工智能安全、大模型安全、大模型价值观对齐
主持科研项目:
1.国家自然科学基金重点项目
2.国家重点研发计划项目
3.国防科技创新项目重点
4.工信部工业互联网创新工程等纵向课题10余项
5.与华为数据库、腾讯广告建立紧密合作,建立数据安全联合实验室,主持横向课题20多项
代表性学术成果:
•近五年发表 Usenix Security、Eurocrypt、VLDB、ASE、ISSTA、IEEE TDSC、IEEE TKDE、IEEE TIFS、IEEE TC、IEEE TSC、IEEE INFOCOM 等顶级期刊和会议论文 40 余篇
•11篇ESI高被引论文、2篇热点论文
•申请专利7项,授权4项;获批软件著作权2项
•担任SocialSEC2020、SPNCE2019、ICA3PP2018等多个国际会议会议主席
•担任《电子与信息学报》《网络与信息安全学报》编委,Springer期刊《Cybersecurity》副主编,SCI一区期刊《InformationSciences》编委
•宝钢优秀教师,南开大学百名青年学科带头人、天津市中青年科技领军人才
(2)肖光文

职称:教授,博士生导师
职务:南开大学马克思主义学院党委副书记
研究方向:中共党史、党建;马克思主义中国化;中国文化现代化;意识形态安全、生成式人工智能伦理风险及对策
主持科研项目:
先后主持参与国家级、省部级课题6项
代表性学术成果:
•编著出版《马克思主义中国化基本问题》等著作3部
•在《中共党史研究》《南开学报》《光明日报》等核心期刊报纸上发表论文四十余篇
(3)汪定

职称:教授,博士生导师,国家优秀青年科学基金获得者
职务:南开大学密码与网络空间安全学院副院长、计算机学院副院长,全国密码专业学位教指委委员,教育部数据与智能系统安全重点实验室副主任
研究方向:密码学与信息安全,口令密钥安全、身份认证、加密与签名
主持科研项目:
1.国家重点研发计划课题
2.国家基金委优秀青年科学基金项目
3.天津市杰出青年科学基金项目
4.主持各级各类科研项目20余项
代表性学术成果:
•以第一作者(或通讯作者)在IEEES&P、ACMCCS等国内外刊物发表论文110余篇,被引用8200余次
•一作或通讯安全四大顶会论文17篇,CCFA类期刊24篇,ESI全球前1‰热点论文5篇
•代表性论文:USENIX Security 2025《Password Guessing Using Large Language Models》;NDSS 2026《Success Rates Doubled with Only One Character: Mask Password Guessing》
•研究工作引起美国身份认证标准NISTSP800-63的修改,被国家基金委官网头版、华尔街日报、福布斯等200余家媒体报道
•获2024年度中国密码学会密码创新奖一等奖(全国密码领域个人最高奖)、2025年度教育部自然科学二等奖(排名第1)、2018年度教育部自然科学一等奖(排名第2)
(4)周详

职称:教授,博士生导师
研究方向:分布式认知与创造力,人机交互;认知心理学、安全伦理基础理论和评测体系;生成式AI背景下的人类创造力与人智共创研究
学术兼职:教育部高等学校教指委委员
主持科研项目:
1.教育部高等学校教指委课题:基础学科拔尖学生合作创新能力的协同培养路径(项目编号:20221039),2020年完成
2.国家社会科学基金后期资助项目:人机协同智能下的合作创新促进机制(项目编号:19FSHB010),2019年完成
3.国家社会科学基金项目:集体智慧在协同创新中的生成与应用研究(项目编号:12BSH053),2012年完成
4.天津市科技发展战略研究计划重点项目:众创空间创新创业团队的创造力评价与创业心理辅导研究(项目编号:15ZLZLZF00770),2015年完成
5.全国教育科学规划教育部重点课题:高效率学习中情绪对注意的影响机制研究(项目编号:DBA090294),2009年完成
代表性学术成果:
•《和而不同:生成式人工智能凸显下人类的社会创造策略》,《心理学报》2025年第57卷第11期,人大复印资料全文转载
•《三心二意胜过一心一意:媒体多任务提升低工作记忆容量者创造力》,《心理学报》2024年第56卷第8期,人大复印资料全文转载
•《人工智能自恋提升人机合作创新意愿及其机制》,《心理与行为研究》2024年第22卷第1期
•《生成式AI背景下人类创意的扬长与补短》,《企业管理》2025年,《新华文摘》观点转载
•专著《创造力与人工智能》,2024年出版
(5)王芳

职称:教授,博士生导师
职务:南开大学图书馆副馆长;网络社会治理研究中心主任;南开大学校务委员
研究方向:知识发现,情感挖掘;政府信息资源管理与电子政务;政策信息分析;数据管护与治理;情报学理论与方法;生成式人工智能风险及其治理
主持科研项目(代表性):
1.国家社会科学基金重大项目(首席专家):基于数据共享与知识复用的数字政府智能化治理研究(20ZDA039),2020-2023
2.国家社会科学基金重大项目(首席专家):我国网络社会治理研究(14ZDA063),2014-2017
3.国家自然科学基金项目:流动农民工信息获取与跨区域公共信息服务保障体系研究(71173121),2012-2015
4.文化和旅游部部级社科研究项目:文化和旅游数据资源开发利用模式研究(25DY09),2025-2027
5.信创海河实验室重点决策咨询课题:深化人工智能伦理和安全问题研究(2024L04),2024-2025
代表性学术成果:
•Reconstructing Human Value in the Age of AI: From Replacement to Liberation? ASIS&T 2025 录用(信息管理领域顶级会议)
•Cognition, Horizon and Practice: Formation of the Nonsynchronism in Theoretical Research of Information Science. Journal of Documentation, Vol. 81 No.1(SSCI, JCR Q2)
•A HighEfficiency Government Chatbot: MultisourceAware Algorithm Oriented ConversationLevel Goal. IEEE Transactions on Computational Social Systems(SCI, JCR Q2)
•组织发布《数据赋能政府治理评价报告》(2025,南开大学网络社会治理研究中心)
3.项目拟推进的多学科交叉研究方向
(1)认知科学安全伦理的基础理论和评测体系。从认知模型底层运行和内部机理维度形成可解释可量化的理论体系,从社会学、心理学、哲学等角度面向社会主义核心价值观、国家意识形态安全等维度构建认知模型安全伦理的评测指标体系及评估模型。构建覆盖人民安全、国土安全等十个关键领域的社会主义核心价值观评测指标体系,针对生成式人工智能生成的内容制定具体的评测标准,梳理意识形态领域存在的问题,确定社会主义核心价值观的负面清单。
(2)认知科学伦理对齐和安全保障机制。基于专家团队构建的高质量安全伦理评分数据集,构建认知科学安全伦理评测模型,提供对大模型安全伦理的评测机制,并研究指令微调、专家反馈等融合技术,用以增强国产大模型的安全伦理对齐能力。在安全保障方面,通过研究红色生成内容幻觉缓解技术、基于对抗样本的增强训练、已知攻击的抵御策略等内容,增强认知模型的鲁棒性和安全性。
(3)基于国产超算平台的大模型构建及面向智慧党建思政的示范应用。针对模型内容生成无偏化、扩散模型3D编辑丰富化以及扩散模型推理机制并行化等关键科学问题,系统性研究面向图像内容细粒度可控生成的扩散模型的理论方法,建立一套完善的从2D生成到3D编辑再到推理加速的视觉内容感知与生成的理论方法体系。面向国产超算平台,研究超大规模分布式GPT大模型训练、微调技术、高质量数据构建等技术,解决人工智能芯片短缺的卡脖子问题,构建安全伦理对齐的国产大模型,并面向政工、党建、思政等重要应用场景,构建智慧党支部、智慧马院等形态的全国重大应用。
4.项目制研究生招生专业背景要求
本项目面向认知科学安全伦理与智慧思政应用的前沿交叉领域,欢迎具有计算机科学与技术、网络空间安全、软件工程、人工智能、社会学、心理学、情报学、马克思主义理论、哲学、数学等相关专业背景的研究生报考。不局限于上述学科专业目录,凡是具备以下知识基础与综合能力、有志于从事人工智能安全伦理交叉研究的学生均可申请。
专业基础要求:具备扎实的数理基础与编程能力;具有人工智能、机器学习或自然语言处理相关课程学习经历者优先;具有马克思主义理论、社会学、心理学、哲学等人文学科背景,对意识形态安全、伦理道德、社会治理等问题有研究兴趣者优先;具有网络安全、密码学、数据安全等信息安全学科基础者优先。
综合学习能力要求:具有较强的跨学科学习意愿与团队协作能力,能够快速融合计算机技术与人文社会科学知识;具备良好的批判性思维与独立科研能力,关注国家重大战略需求与科技前沿;具有较强的文字表达与沟通能力,能够承担多学科交叉的科研任务与学术交流。
5.项目组联系方式
联系人:聂力海
联系方式:NLH@nankai.edu.cn