← back to search

Yu–Gang Jiang

Fudan University · CN
🔎 Find collaborators in Computer Vision and Pattern Recognition · Artificial Intelligence →
Search 5.9M scientists by topic, h-index, country & funding — free.
Area of research
Computer Vision and Pattern Recognition · Artificial Intelligence
Research interest
Research interests include Computer science, Artificial intelligence, Convolutional neural network, Benchmark (surveying), Discriminative model, and Deep learning.
h-index
citations
14,101
works
119
NIH funding
primary concept
email

Recent publications

DiffusionAD: Norm-Guided One-Step Denoising Diffusion for Anomaly Detection
IEEE Transactions on Pattern Analysis and Machine Intelligence 2025cited by 39position: lastdoi
Context Perception Parallel Decoder for Scene Text Recognition
IEEE Transactions on Pattern Analysis and Machine Intelligence 2025cited by 19position: lastdoi
Instruction-Guided Scene Text Recognition
IEEE Transactions on Pattern Analysis and Machine Intelligence 2025cited by 15position: lastdoi
FoodLMM: A Versatile Food Assistant Using Large Multi-Modal Model
IEEE Transactions on Multimedia 2025cited by 14position: middledoi
OmniTracker: Unifying Visual Object Tracking by Tracking-With-Detection
IEEE Transactions on Pattern Analysis and Machine Intelligence 2025cited by 12position: lastdoi
Retrieval Augmented Recipe Generation
2025cited by 9position: lastdoi
MeViS: A Multi-Modal Dataset for Referring Motion Expression Video Segmentation
IEEE Transactions on Pattern Analysis and Machine Intelligence 2025cited by 6position: lastdoi
NuScenes-QA: A Multi-Modal Visual Question Answering Benchmark for Autonomous Driving Scenario
Proceedings of the AAAI Conference on Artificial Intelligence 2024cited by 118position: lastdoi
A Survey on Video Diffusion Models
ACM Computing Surveys 2024cited by 96position: lastdoi
SimDA: Simple Diffusion Adapter for Efficient Video Generation
2024cited by 35position: lastdoi
MotionEditor: Editing Video Motion via Content-Aware Diffusion
2024cited by 22position: lastdoi
OmniViD: A Generative Framework for Universal Video Understanding
2024cited by 18position: lastdoi
PromptFusion: Decoupling Stability and Plasticity for Continual Learning
Lecture notes in computer science 2024cited by 10position: lastdoi
Adversarial Prompt Tuning for Vision-Language Models
Lecture notes in computer science 2024cited by 10position: middledoi
PolarFormer: Multi-Camera 3D Object Detection with Polar Transformer
Proceedings of the AAAI Conference on Artificial Intelligence 2023cited by 173position: lastdoi
MSMDFusion: Fusing LiDAR and Camera at Multiple Scales with Multi-Depth Seeds for 3D Object Detection
2023cited by 127position: lastdoi
SVFormer: Semi-supervised Video Transformer for Action Recognition
2023cited by 107position: lastdoi
Prototypical Residual Networks for Anomaly Detection and Localization
2023cited by 91position: lastdoi
Masked Video Distillation: Rethinking Masked Feature Modeling for Self-supervised Video Representation Learning
2023cited by 79position: lastdoi
StyleAdv: Meta Style Adversarial Training for Cross-Domain Few-Shot Learning
2023cited by 75position: lastdoi
Look Before You Match: Instance Understanding Matters in Video Object Segmentation
2023cited by 45position: lastdoi
Enhancing the Self-Universality for Transferable Targeted Attacks
2023cited by 36position: lastdoi
ResFormer: Scaling ViTs with Multi-Resolution Training
2023cited by 30position: lastdoi
Implicit Temporal Modeling with Learnable Alignment for Video Recognition
2023cited by 30position: lastdoi
Locate Before Answering: Answer Guided Question Localization for Video Question Answering
IEEE Transactions on Multimedia 2023cited by 21position: lastdoi
On the Importance of Spatial Relations for Few-shot Action Recognition
2023cited by 19position: lastdoi
Towards Transferable Adversarial Attacks on Image and Video Transformers
IEEE Transactions on Image Processing 2023cited by 14position: middledoi
Unlearnable Clusters: Towards Label-Agnostic Unlearnable Examples
2023cited by 13position: middledoi
M2TR: Multi-modal Multi-scale Transformers for Deepfake Detection
2022cited by 318position: middledoi
SVTR: Scene Text Recognition with a Single Visual Model
Proceedings of the Thirty-First International Joint Conference on Artificial Intelligence 2022cited by 210position: lastdoi

Grants

No grants ingested yet.

Frequent collaborators

Zuxuan Wu · Fudan University36 papers (2014–2025)Xiangyang Xue · Fudan University28 papers (2012–2021)Jingjing Chen · Fudan University24 papers (2020–2025)Yanwei Fu · Fudan University19 papers (2016–2023)Shaoxiang Chen · Fudan University10 papers (2019–2023)Wei Liu · Leiden University9 papers (2012–2020)Qi Dai · Fudan University9 papers (2012–2024)Shih‐Fu Chang · National University of Singapore8 papers (2012–2018)Xingjun Ma · The University of Melbourne7 papers (2019–2024)Chong‐Wah Ngo · City University of Hong Kong7 papers (2012–2025)Junke Wang · Fudan University5 papers (2020–2023)Han Hu · Monash University5 papers (2023–2024)Tao Xiang · Southwest Jiaotong University5 papers (2017–2021)Xiyang Dai · University of Maryland, College Park4 papers (2022–2025)Tianwen Qian · Fudan University4 papers (2022–2024)Yuqian Fu · Fudan University4 papers (2020–2023)Zhipeng Wei · Changchun University of Science and Technology4 papers (2020–2023)Xuelin Qian · Fudan University4 papers (2017–2021)Yuan Lü · King's College London4 papers (2022–2024)Tat-Seng Chua · National University of Singapore4 papers (2018–2020)
Looking for a research collaborator?
Search millions of scientists by field, institution, impact, and funding status — see their work, find their email, and reach out directly.
Find collaborators in Computer Vision and Pattern Recognition · Artificial Intelligence →