Lü Shuai, 吕帅

在读硕士生


李贵祥,男,2003年04月生,山东省聊城市人。

【学术论文】在国内外期刊和会议上发表学术论文3篇,在审学术论文3篇。

  1. Li Guixiang, Fang Wensi, Tan Lei, Lü Shuai*. Mixed-probability guided instance contrastive learning for source-free domain adaptation. 2026. (Submitted)
  2. Tan Lei, Guo Dong, Li Guixiang, Lü Shuai*. Learn from the recent: Test-time adaptation of vision-language models via distribution-aware calibration and temporal retrieval. 2026. (Submitted)
  3. Yuan Jianhui, Lü Shuai, Zhang Xinyu, Li Guixiang, Tan Lei, Li Jingyao*, Zhou Wenbo*. GRACE: Enhancing source-free universal domain adaptation via gradient-aware contrastive learning and entropy-aware alignment. 2026. (Submitted)
  4. Tan Lei, Guo Dong, Fang Wensi, Li Guixiang, Yuan Jianhui, Zhang Xiaodan, Li Jingyao*, Lü Shuai*. Divide and correct: Alternating normalization and prototype alignment for continual test-time adaptation. In: Proceedings of the 34th ACM International Conference on Multimedia (MM 2026), Rio de Janeiro, Brazil, November 10–14, 2026. (CCF推荐A类会议)
  5. Li Zhuang, Li Guixiang, Song Xiangyang, Wang Xinhua*. An efficient and dynamic framework for multi-scale target detection of underwater organisms. Journal of Ocean University of China, 2026, 25(1): 150-160. (中科院2区期刊, SCI, 目前IF: 1.6)
  6. Li Zhuang, Yuan Jianhui, Li Guixiang, Wang Hao, Li Xingcan, Li Dan, Wang Xinhua*. RSI-YOLO: Object detection method for remote sensing images based on improved YOLO. Sensors, 2023, 23: 6414. (中科院2区期刊, SCI, IF: 3.4)

【荣誉奖励】

【联系方式】


吴昊,男,2002年02月生,内蒙古自治区额尔古纳市人。

【学术论文】在国内外期刊和会议上发表学术论文2篇,在审学术论文7篇。

  1. Wu Hao, Zhang Shunhao, Lü Shuai*. Optimistic Q-value adaptation for offline-to-online reinforcement learning. 2026. (Submitted)
  2. Zhang Tao, Zhu Yungang, Chen Huangyang, Wu Hao, Xiao Wei, Lü Shuai*, Zhou Wenbo*. Efficient and stable offline-to-online reinforcement learning via heterogeneous policy transfer. 2026. (Submitted)
  3. Liu Xuejie, Zhang Shunhao, Zhong Jinyun, Wu Hao, Lü Shuai*. Dual uncertainty regularization for offline reinforcement learning. 2026. (Submitted)
  4. Liu Xuejie, Zhang Shunhao, Wu Hao, Hou Zhibin, Lü Shuai*, Zhou Wenbo*. Non-parametric behavior policy density estimation for offline reinforcement learning. 2026. (Submitted)
  5. Wu Hao, Lü Shuai, Zhang Shunhao, Chen Huangyang, Zhang Tao, Zhou Wenbo*, Li Jingyao*. UDPBC: Uncertainty-guided dual-perspective behavior cloning for offline-to-online reinforcement learning. 2026. (Submitted)
  6. Li Songlin, Lü Shuai, Wu Hao, Chen Huangyang, Zhou Wenbo*, Li Jingyao*. Anchor-based perturbation-driven exploration for offline-to-online reinforcement learning. 2026. (Submitted)
  7. Xiao Wei, Li Songlin, An Daolong, Wu Hao, Zhang Xiaodan, Lü Shuai*. Corrected critic and adaptive constraint for offline-to-online reinforcement learning. 2026. (Submitted)
  8. Wu Hao, Li Songlin, Xiao Wei, Zhong Taihong, Lü Shuai*. Offline-to-online reinforcement learning with triple-intensity policy constraints. Information Processing and Management, 2027, 64(1): 105035. (中科院1区TOP期刊, CCF推荐B类期刊, SCI, 目前IF: 8.1)
  9. Li Songlin, Xiao Wei, Wu Hao, Zhang Xiaodan, An Daolong, Lü Shuai*. State proficiency-based adaptive fine-tuning for offline-to-online reinforcement learning. In: Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI 2026), Singapore, January 20-27, 2026, 23169-23176. (CCF推荐A类会议)

【荣誉奖励】

【联系方式】


孙耕浩,男,2001年07月生,山东省德州市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文4篇。

  1. Sun Genghao, Lü Shuai*, Zhou Wenbo*. Meta-balanced state correction: A bi-level optimization framework for adaptive offline reinforcement learning. 2026. (Submitted)
  2. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*, Zhou Wenbo*. Trust-domain-based policy regularization in offline reinforcement learning. 2026. (Submitted)
  3. Sun Genghao, Chen Huangyang, Lü Shuai*, Zhou Wenbo*. AQHA: Accurate Q-value estimation and high-quality action imitation in offline reinforcement learning. 2026. (Submitted)
  4. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*. Reward shaping based on trajectory quality for offline and hybrid reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


章晓丹,女,2002年01月生,山东省威海市人。

【学术论文】在国内外期刊和会议上发表学术论文5篇,在审学术论文3篇。

  1. Fang Wensi, Lian Xiaoyu, Zhang Xiaodan, Li Qiang, Lü Shuai*. TADA: Text-anchored domain alignment for unsupervised cross-domain image retrieval. 2026. (Submitted)
  2. Zhang Xiaodan, Chang Yu, Fang Wensi, Lü Shuai*. Dual use of active samples for stable test-time adaptation under dynamic shifts. 2026. (Submitted)
  3. Xiao Wei, Li Songlin, An Daolong, Wu Hao, Zhang Xiaodan, Lü Shuai*. Corrected critic and adaptive constraint for offline-to-online reinforcement learning. 2026. (Submitted)
  4. Zhang Xiaodan, Fang Wensi, Tan Lei, Lü Shuai*. AutoVote: Adaptive learning rate modulation for continual test-time adaptation via sensitivity voting. In: Proceedings of the 34th ACM International Conference on Multimedia (MM 2026), Rio de Janeiro, Brazil, November 10–14, 2026. (CCF推荐A类会议)
  5. Tan Lei, Guo Dong, Fang Wensi, Li Guixiang, Yuan Jianhui, Zhang Xiaodan, Li Jingyao*, Lü Shuai*. Divide and correct: Alternating normalization and prototype alignment for continual test-time adaptation. In: Proceedings of the 34th ACM International Conference on Multimedia (MM 2026), Rio de Janeiro, Brazil, November 10–14, 2026. (CCF推荐A类会议)
  6. Fang Wensi, Zhang Xiaodan, Lian Xiaoyu, Li Qiang, Lü Shuai*. Selective constraint learning for unsupervised cross-domain image retrieval. In: Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR 2026), Melbourne, Australia, July 20-24, 2026, 313-323. (CCF推荐A类会议)
  7. Li Songlin, Xiao Wei, Wu Hao, Zhang Xiaodan, An Daolong, Lü Shuai*. State proficiency-based adaptive fine-tuning for offline-to-online reinforcement learning. In: Proceedings of the 40th AAAI Conference on Artificial Intelligence (AAAI 2026), Singapore, January 20-27, 2026, 23169-23176. (CCF推荐A类会议)
  8. Xiong Xi, Shen Chun, Wu Junhong, Lü Shuai*, Zhang Xiaodan. Combined data augmentation framework for generalizing deep reinforcement learning from pixels. Expert Systems with Applications, 2025, 264: 125810. (中科院1区TOP期刊, CCF推荐C类期刊, SCI, IF: 9.4)

【荣誉奖励】

【联系方式】


陈黄洋,男,2002年08月生,福建省漳州市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文8篇。

  1. Zhang Tao, Zhu Yungang, Zhang Shunhao, Chen Huangyang, Zhou Wenbo, Lü Shuai*. SEBDC: Structured exploration with behavior density constraints for offline-to-online reinforcement learning. 2026. (Submitted)
  2. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*, Zhou Wenbo*. Trust-domain-based policy regularization in offline reinforcement learning. 2026. (Submitted)
  3. Sun Genghao, Chen Huangyang, Lü Shuai*, Zhou Wenbo*. AQHA: Accurate Q-value estimation and high-quality action imitation in offline reinforcement learning. 2026. (Submitted)
  4. Zhang Tao, Zhu Yungang, Chen Huangyang, Wu Hao, Xiao Wei, Lü Shuai*, Zhou Wenbo*. Efficient and stable offline-to-online reinforcement learning via heterogeneous policy transfer. 2026. (Submitted)
  5. Wu Hao, Lü Shuai, Zhang Shunhao, Chen Huangyang, Zhang Tao, Zhou Wenbo*, Li Jingyao*. UDPBC: Uncertainty-guided dual-perspective behavior cloning for offline-to-online reinforcement learning. 2026. (Submitted)
  6. Xiao Wei, Zhang Tao, Chen Huangyang, Li Jingyao*, Zhou Wenbo*. Q-bounded and adaptive Q-value constraints for offline-to-online reinforcement learning. 2026. (Submitted)
  7. Li Songlin, Lü Shuai, Wu Hao, Chen Huangyang, Zhou Wenbo*, Li Jingyao*. Anchor-based perturbation-driven exploration for offline-to-online reinforcement learning. 2026. (Submitted)
  8. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*. Reward shaping based on trajectory quality for offline and hybrid reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


张涛,男,2002年10月生,河南省濮阳市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文6篇。

  1. Zhang Tao, Zhu Yungang, Zhang Shunhao, Chen Huangyang, Zhou Wenbo, Lü Shuai*. SEBDC: Structured exploration with behavior density constraints for offline-to-online reinforcement learning. 2026. (Submitted)
  2. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*, Zhou Wenbo*. Trust-domain-based policy regularization in offline reinforcement learning. 2026. (Submitted)
  3. Zhang Tao, Zhu Yungang, Chen Huangyang, Wu Hao, Xiao Wei, Lü Shuai*, Zhou Wenbo*. Efficient and stable offline-to-online reinforcement learning via heterogeneous policy transfer. 2026. (Submitted)
  4. Wu Hao, Lü Shuai, Zhang Shunhao, Chen Huangyang, Zhang Tao, Zhou Wenbo*, Li Jingyao*. UDPBC: Uncertainty-guided dual-perspective behavior cloning for offline-to-online reinforcement learning. 2026. (Submitted)
  5. Xiao Wei, Zhang Tao, Chen Huangyang, Li Jingyao*, Zhou Wenbo*. Q-bounded and adaptive Q-value constraints for offline-to-online reinforcement learning. 2026. (Submitted)
  6. Chen Huangyang, Chen Juan, Zhang Tao, Sun Genghao, Lü Shuai*. Reward shaping based on trajectory quality for offline and hybrid reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


檀磊,男,2000年11月生,安徽省安庆市人。

【学术论文和发明专利】在国内外期刊和会议上发表学术论文3篇,在审学术论文3篇,申请发明专利(目前实质审查)1项。

  1. Li Guixiang, Fang Wensi, Tan Lei, Lü Shuai*. Mixed-probability guided instance contrastive learning for source-free domain adaptation. 2026. (Submitted)
  2. Tan Lei, Guo Dong, Li Guixiang, Lü Shuai*. Learn from the recent: Test-time adaptation of vision-language models via distribution-aware calibration and temporal retrieval. 2026. (Submitted)
  3. Yuan Jianhui, Lü Shuai, Zhang Xinyu, Li Guixiang, Tan Lei, Li Jingyao*, Zhou Wenbo*. GRACE: Enhancing source-free universal domain adaptation via gradient-aware contrastive learning and entropy-aware alignment. 2026. (Submitted)
  4. Zhang Xiaodan, Fang Wensi, Tan Lei, Lü Shuai*. AutoVote: Adaptive learning rate modulation for continual test-time adaptation via sensitivity voting. In: Proceedings of the 34th ACM International Conference on Multimedia (MM 2026), Rio de Janeiro, Brazil, November 10–14, 2026. (CCF推荐A类会议)
  5. Tan Lei, Guo Dong, Fang Wensi, Li Guixiang, Yuan Jianhui, Zhang Xiaodan, Li Jingyao*, Lü Shuai*. Divide and correct: Alternating normalization and prototype alignment for continual test-time adaptation. In: Proceedings of the 34th ACM International Conference on Multimedia (MM 2026), Rio de Janeiro, Brazil, November 10–14, 2026. (CCF推荐A类会议)
  6. 马慧敏*, 檀磊, 张京会, 张鹏飞, 宁孝梅, 刘海秋, 高彦伟. 基于深度学习的合成孔径成像系统共相误差检测研究综述. 量子电子学报, 2022, 39(6): 927-941. (第一作者为指导教师)
  7. 檀磊, 马慧敏, 王小申, 戴明宇, 代腾辉, 焦俊, 刘倩, 辜丽川. 基于多尺度生成对抗网络的大气湍流图像复原方法及系统. (申请号: CN2023 1 1725750.0, 申请日: 2023.12.14, 目前实质审查)

【荣誉奖励】

【联系方式】


侯志斌,男,1999年08月生,山东省菏泽市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文4篇。

  1. Gong Jincheng, Hou Zhibin, Jiang Wenkang, Lü Shuai*. Divergence beacons: Neighborhood-aware active selection and propagation for active source-free domain adaptation. 2026. (Submitted)
  2. Liu Xuejie, Hou Zhibin, Lü Shuai*. When Gaussian cache heads distort confidence: A mechanistic diagnosis of calibration collapse in vision-language test-time adaptation. 2026. (Submitted)
  3. Liu Xuejie, Hou Zhibin, Zhang Shunhao. Marginal calibration for vision-language model guided source-free domain adaptation. 2026. (Submitted)
  4. Liu Xuejie, Zhang Shunhao, Wu Hao, Hou Zhibin, Lü Shuai*, Zhou Wenbo*. Non-parametric behavior policy density estimation for offline reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


张顺浩,男,2002年03月生,山东省济南市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文7篇。

  1. Zhong Jinyun, Zhang Shunhao, Li Qianlong, Lü Shuai*. Selective out-of-distribution state correction via behavior density in offline reinforcement learning. 2026. (Submitted)
  2. Zhang Tao, Zhu Yungang, Zhang Shunhao, Chen Huangyang, Zhou Wenbo, Lü Shuai*. SEBDC: Structured exploration with behavior density constraints for offline-to-online reinforcement learning. 2026. (Submitted)
  3. Wu Hao, Zhang Shunhao, Lü Shuai*. Optimistic Q-value adaptation for offline-to-online reinforcement learning. 2026. (Submitted)
  4. Liu Xuejie, Hou Zhibin, Zhang Shunhao. Marginal calibration for vision-language model guided source-free domain adaptation. 2026. (Submitted)
  5. Liu Xuejie, Zhang Shunhao, Zhong Jinyun, Wu Hao, Lü Shuai*. Dual uncertainty regularization for offline reinforcement learning. 2026. (Submitted)
  6. Liu Xuejie, Zhang Shunhao, Wu Hao, Hou Zhibin, Lü Shuai*, Zhou Wenbo*. Non-parametric behavior policy density estimation for offline reinforcement learning. 2026. (Submitted)
  7. Wu Hao, Lü Shuai, Zhang Shunhao, Chen Huangyang, Zhang Tao, Zhou Wenbo*, Li Jingyao*. UDPBC: Uncertainty-guided dual-perspective behavior cloning for offline-to-online reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


巩锦程,男,2002年09月生,山东省淄博市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文1篇。

  1. Gong Jincheng, Hou Zhibin, Jiang Wenkang, Lü Shuai*. Divergence beacons: Neighborhood-aware active selection and propagation for active source-free domain adaptation. 2026. (Submitted)

【荣誉奖励】

【联系方式】


甄德杰,男,2003年05月生,河北省邢台市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文0篇。

【荣誉奖励】

【联系方式】


钟金运,男,2003年06月生,江西省瑞金市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文2篇。

  1. Zhong Jinyun, Zhang Shunhao, Li Qianlong, Lü Shuai*. Selective out-of-distribution state correction via behavior density in offline reinforcement learning. 2026. (Submitted)
  2. Liu Xuejie, Zhang Shunhao, Zhong Jinyun, Wu Hao, Lü Shuai*. Dual uncertainty regularization for offline reinforcement learning. 2026. (Submitted)

【荣誉奖励】

【联系方式】


常钰,女,2003年01月生,辽宁省大连市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文1篇。

  1. Zhang Xiaodan, Chang Yu, Fang Wensi, Lü Shuai*. Dual use of active samples for stable test-time adaptation under dynamic shifts. 2026. (Submitted)

【荣誉奖励】

【联系方式】


姜文康,男,2003年07月生,山东省德州市人。

【学术论文】在国内外期刊和会议上发表学术论文0篇,在审学术论文3篇。

  1. Gong Jincheng, Hou Zhibin, Jiang Wenkang, Lü Shuai*. Divergence beacons: Neighborhood-aware active selection and propagation for active source-free domain adaptation. 2026. (Submitted)
  2. Lian Xiaoyu, Jiang Wenkang, Fang Wensi, Lü Shuai*. ProFuse: Probing modality dominance for directed feature infusion in domain generalizable cross-modal 3D semantic segmentation. 2026. (Submitted)
  3. Lian Xiaoyu, Jiang Wenkang, Fang Wensi, Lü Shuai*. GReCon: Reconstructing geometric representations for generalizable 3D semantic segmentation. 2026. (Submitted)

【荣誉奖励】

【联系方式】


邱天,女,2004年07月生,黑龙江省齐齐哈尔市人。

【荣誉奖励】

【联系方式】


崔永权,男,2004年09月生,河南省平顶山市人。

【荣誉奖励】

【联系方式】


杨凯轩,男,2001年11月生,山西省晋中市人。

【联系方式】