← back to search

Hao Huang

Xinjiang University · CN
🔎 Find collaborators in Signal Processing · Artificial Intelligence →
Search 5.9M scientists by topic, h-index, country & funding — free.
Area of research
Signal Processing · Artificial Intelligence
Research interest
Research focused on Speech recognition and Artificial intelligence, with related work in Watermark, Polyphony, Natural language processing. Notable publications include 'CMUA-Watermark: A Cross-Model Universal Adversarial Watermark for Combating Deepfakes', 'An Improved Cascade R-CNN-Based Target Detection Algorithm for UAV Aerial Images', and 'A Multi-grained based Attention Network for Semi-supervised Sound Event Detection'.
h-index
citations
159
works
11
NIH funding
primary concept
email

Recent publications

CB-PSR: Adaptive Contextual Biasing for Prompt-Driven Speech Recognition
Communications in computer and information science 2025cited by 0position: lastdoi
GLFER-Net: a polyphonic sound source localization and detection network based on global-local feature extraction and recalibration
EURASIP Journal on Audio Speech and Music Processing 2024cited by 8position: lastdoi
Introducing Multilingual Phonetic Information to Speaker Embedding for Speaker Verification
2024cited by 5position: lastdoi
Speech-Text Based Multi-Modal Training with Bidirectional Attention for Improved Speech Recognition
2023cited by 7position: middledoi
Hierarchical Softmax for End-To-End Low-Resource Multilingual Speech Recognition
2023cited by 5position: middledoi
Investigation into Phone-Based Subword Units for Multilingual End-to-End Speech Recognition
2023cited by 4position: middledoi
CMUA-Watermark: A Cross-Model Universal Adversarial Watermark for Combating Deepfakes
Proceedings of the AAAI Conference on Artificial Intelligence 2022cited by 101position: firstdoi
An Improved Cascade R-CNN-Based Target Detection Algorithm for UAV Aerial Images
2022 7th International Conference on Image, Vision and Computing (ICIVC) 2022cited by 13position: firstdoi
A Multi-grained based Attention Network for Semi-supervised Sound Event Detection
Interspeech 2022 2022cited by 11position: middledoi
A generalized network based on multi-scale densely connection and residual attention for sound source localization and detection
The Journal of the Acoustical Society of America 2022cited by 5position: lastdoi
Mel-S3r: Combining Mel-Spectrogram and Self-Supervised Speech Representation for Voice Conversion
SSRN Electronic Journal 2022cited by 0position: lastdoi

Grants

No grants ingested yet.

Frequent collaborators

Liang He · Xinjiang University3 papers (2022–2024)Ying Hu · Nanjing University of Chinese Medicine3 papers (2022–2024)Yuhang Yang · Xinjiang University2 papers (2023–2023)Sheng Li · University of Georgia2 papers (2023–2023)Yongtao Wang · Xinjiang University1 papers (2022–2022) · 1 papers (2023–2023) · 1 papers (2023–2023) · 1 papers (2024–2024)Ziyuan Chen · Ningbo University1 papers (2025–2025)Zhaoyu Chen · Northwest Normal University1 papers (2022–2022) · 1 papers (2023–2023)Chenhui Chu · Nanjing Agricultural University1 papers (2023–2023)Hongli Yang · Xinjiang University1 papers (2025–2025)Zhi Tang · King University1 papers (2022–2022)Zhengdong Yang · Tsinghua University1 papers (2023–2023) · 1 papers (2022–2022)Jichen Yang · National University of Singapore1 papers (2022–2022) · 1 papers (2023–2023)Zhida Song · Princeton University1 papers (2024–2024) · 1 papers (2023–2023)
Looking for a research collaborator?
Search millions of scientists by field, institution, impact, and funding status — see their work, find their email, and reach out directly.
Find collaborators in Signal Processing · Artificial Intelligence →