环绕智能和多模态系统研究室

科研成果

代表项目

       国家重点研发计划(2025) 基于类脑智能的视听言语功能障碍康复关键技术研究

  国家自然科学基金重点项目(2024) 基于多模态生理和行为表征学习的主动心理健康评价研究

  国家自然科学基金面上项目(2023) 基于外周生理信号的自主神经平衡检测应用于抑郁症诊断的研究

  深圳市高层次人才团队项目(2021) 生物医学大数据人工智能分析及自闭症早期分级筛查应用

  国家重点研发计划(2020) 发声与言语功能障碍康复训练系统

  国家自然科学基金重点项目(2018) 复杂环境下语音数据的目标识别与内容转写

  国家自然科学基金重点项目(2012) 语音生成的计算建模及在言语障碍康复中的应用

代表论文

  2026

  Su R, Xu C, Yu H, Wu X, Xu F, Chen X, Wang L, Yan N*. Investigating Acoustic-Textual Emotional Inconsistency Information for Automatic Depression Detection. IEEE Trans Affect Comput. doi: 10.1109/TAFFC.2026.3651667.

  2025

  Liu X, Du X, Liu J, Su R, Ng M L, Zhang Y, Yang Y, Zhao S, Wang L, Yan N*. Automatic Assessment of Chinese Dysarthria Using Audio-visual Vowel Graph Attention Network. IEEE/ACM Trans Audio Speech Lang Process. doi: 10.1109/TASLPRO.2025.3546562.

  Yang Y, Su R, Zhao S, Ng M L, Yan N*, Wang L*. Towards unified diffusion model for speech to ultrasound tongue imaging synthesis. Inf Fusion. doi: 10.1016/j.inffus.2025.103896.

  Liu X, Yang Y, Xu G, Du X, Su R, Yan N*, Wang L*. KGMV-net: Knowledge-guided multi-view network for audio-visual dysarthria severity assessment. Knowl Based Syst. doi: 10.1016/j.knosys.2025.114609.

  2024

  Zhao S, Dai G, Li J, Zhu X, Huang X, Li Y, Tan M, Wang L, Fang P, Chen X, Yan N*, Liu H. An interpretable model based on graph learning for diagnosis of Parkinson"s disease with voice-related EEG. NPJ Digit Med. doi: 10.1038/s41746-023-00983-9.

  2021

  Xie X, Liu X, Lee T, Wang L. Bayesian Learning for Deep Neural Network Adaptation. IEEE/ACM Trans Audio Speech Lang Process. doi: 10.1109/TASLP.2021.3088642.

  2019

  Su R, Liu X, Wang L, Yang J. Cross-Domain Deep Visual Feature Generation for Speech Visualization. IEEE/ACM Trans Audio Speech Lang Process. doi: 10.1109/TASLP.2019.2946321.

  2017

  Chen F, Wang L, Chen H, Peng G. Investigations on Mandarin Aspiratory Animations Using an Airflow Model. IEEE/ACM Trans Audio Speech Lang Process. doi: 10.1109/TASLP.2017.2766043.

  2015

  Su R, Liu X, Wang L. Automatic Complexity Control of Generalized Variable Parameter HMMs for Noise Robust Speech Recognition. IEEE/ACM Trans Audio Speech Lang Process. doi: 10.1145/2736121.

  Ge J, Peng G, Lyu B. Cross-language differences in the brain network subserving intelligible speech. Proc Natl Acad Sci U S A. doi: 10.1073/pnas.1418644112.

电话:(0755)86392288邮箱:info@siat.ac.cn
地址:深圳市南山区西丽深圳大学城学苑大道1068号邮编:518055
版权所有中国科学院深圳先进技术研究院粤ICP备09184136号-3