← back to search

Yingwei Pan

Bansomdejchaopraya Rajabhat University · TH
Area of research
Computer Vision and Pattern Recognition · Artificial Intelligence
Research interest
Research interests include Multimodal Machine Learning Applications, Domain Adaptation and Few-Shot Learning, Human Pose and Action Recognition, and Advanced Image and Video Retrieval Techniques.
h-index
40
citations
9,510
works
184
NIH funding
primary concept
email

Recent publications

DreamJourney: Perpetual View Generation With Video Diffusion Models
IEEE Transactions on Multimedia 2026cited by 0position: contributordoi
HiFi3D: Improving Text-to-3D With High-Fidelity Multi-View Diffusion
IEEE Transactions on Multimedia 2026cited by 0position: contributordoi
HiDream-I1: An Open-Source High-Efficient Image Generative Foundation Model
Proceedings of the 33rd ACM International Conference on Multimedia 2025cited by 9position: contributordoi
Stream-ViT: Learning Streamlined Convolutions in Vision Transformer
IEEE Transactions on Multimedia 2025cited by 7position: contributordoi
Kernel Masked Image Modeling Through the Lens of Theoretical Understanding
IEEE Transactions on Neural Networks and Learning Systems 2025cited by 4position: contributordoi
Exploring Vision-Language Foundation Model for Novel Object Captioning
IEEE Transactions on Circuits and Systems for Video Technology 2025cited by 4position: contributordoi
Creatively Upscaling Images with Global-Regional Priors
International Journal of Computer Vision 2025cited by 2position: contributordoi
Identity-Preserving Video Generation Challenge
Proceedings of the 33rd ACM International Conference on Multimedia 2025cited by 1position: contributordoi
Talk, Imagine, Evolve: A Unified Multimodal Agent for Seamless Visual Generation and Editing
Proceedings of the 33rd ACM International Conference on Multimedia 2025cited by 0position: contributordoi
Edit-by-Example: Adaptive Exemplar-Based Image Editing
Proceedings of the 33rd ACM International Conference on Multimedia 2025cited by 0position: contributordoi
HIRI-ViT: Scaling Vision Transformer With High Resolution Inputs
IEEE Transactions on Pattern Analysis and Machine Intelligence 2024cited by 39position: contributordoi
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
Proceedings of the 32nd ACM International Conference on Multimedia 2024cited by 19position: contributordoi
End-to-End Video Scene Graph Generation With Temporal Propagation Transformer
IEEE Transactions on Multimedia 2024cited by 14position: contributordoi
Improving Virtual Try-On with Garment-Focused Diffusion Models
Lecture Notes in Computer Science 2024cited by 10position: contributordoi
Contextual Transformer Networks for Visual Recognition
IEEE Transactions on Pattern Analysis and Machine Intelligence 2023cited by 600position: contributordoi
Dual Vision Transformer
IEEE Transactions on Pattern Analysis and Machine Intelligence 2023cited by 143position: contributordoi
Semantic-Conditional Diffusion Networks for Image Captioning*
2023cited by 110position: middledoi
Control3D: Towards Controllable Text-to-3D Generation
Proceedings of the 31st ACM International Conference on Multimedia 2023cited by 49position: contributordoi
Control3D: Towards Controllable Text-to-3D Generation
2023cited by 45position: middledoi
ControlStyle: Text-Driven Stylized Image Generation Using Diffusion Priors
Proceedings of the 31st ACM International Conference on Multimedia 2023cited by 42position: contributordoi
Retrieval Augmented Convolutional Encoder-decoder Networks for Video Captioning
ACM Transactions on Multimedia Computing, Communications, and Applications 2023cited by 38position: contributordoi
ControlStyle: Text-Driven Stylized Image Generation Using Diffusion Priors
2023cited by 36position: middledoi
3DStyle-Diffusion: Pursuing Fine-grained Text-driven 3D Stylization with 2D Diffusion Models
Proceedings of the 31st ACM International Conference on Multimedia 2023cited by 23position: contributordoi
A Low Rank Promoting Prior for Unsupervised Contrastive Learning
IEEE Transactions on Pattern Analysis and Machine Intelligence 2023cited by 15position: contributordoi
3D Creation at Your Fingertips: From Text or Image to 3D Assets
Proceedings of the 31st ACM International Conference on Multimedia 2023cited by 7position: contributordoi
Boosting Relationship Detection in Images with Multi-Granular Self-Supervised Learning
ACM Transactions on Multimedia Computing, Communications, and Applications 2023cited by 2position: contributordoi
Wave-ViT: Unifying Wavelet and Transformers for Visual Representation Learning
Lecture Notes in Computer Science 2022cited by 184position: contributordoi
Retrieval Augmented Convolutional Encoder-decoder Networks for Video Captioning
ACM Transactions on Multimedia Computing Communications and Applications 2022cited by 40position: middledoi
Unpaired Image Captioning With semantic-Constrained Self-Learning
IEEE Transactions on Multimedia 2022cited by 37position: contributordoi
Bottom-up and Top-down Object Inference Networks for Image Captioning
ACM Transactions on Multimedia Computing, Communications, and Applications 2022cited by 11position: contributordoi

Grants

No grants ingested yet.

Frequent collaborators

Ting Yao · Nanjing University of Posts and Telecommunications40 papers (2017–2026) · 31 papers (2020–2026) · 28 papers (2020–2026)Tao Mei · Chinese Academy of Sciences20 papers (2017–2026)Tao Mei · JD.COM15 papers (2022–2025) · 14 papers (2020–2026) · 13 papers (2020–2025)Yehao Li · Renmin University of China8 papers (2017–2023)Tao Mei · Wuchang University of Technology6 papers (2019–2023) · 5 papers (2022–2024)Yang Chen · University of Science and Technology of China5 papers (2023–2026)Hongyang Chao · Sun Yat-sen University5 papers (2018–2023) · 4 papers (2020–2025)Yiheng Zhang · Zhejiang Chinese Medical University3 papers (2022–2025)Zhaofan Qiu · Baidu (China)3 papers (2025–2025)Chong-Wah Ngo · Singapore Management University3 papers (2022–2025)Yu Wang · Nanjing Normal University3 papers (2023–2025)Jingwen Chen · China Pharmaceutical University2 papers (2019–2021)Jiajun Deng · University of Science and Technology of China2 papers (2021–2021)Zhineng Chen · Springer Nature2 papers (2023–2024)