I’m Xiaopeng Wang, a Ph.D. student at Beijing Institute of Technology (BIT), advised by Professors Ruibo Fu, Changsheng Li, and Jianhua Tao. Previously, I completed my M.S. at the School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS).

My research interests include audio deepfake detection, TTS, and VC.

🔥 Milestones

  • 2025.09:   📣 Posted preprint “Fake Speech Wild: Detecting Deepfake Speech on Social Media Platform” on arXiv.
  • 2025.06:   📣 Posted preprint “RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection” on arXiv.
  • 2025.04:   📣 Posted preprint “Detect All-Type Deepfake Audio: Wavelet Prompt Tuning for Enhanced Auditory Perception” on arXiv.
  • 2025.01:   📣 Posted preprint “Neural Codec Source Tracing: Toward Comprehensive Attribution in Open-set Condition” on arXiv.
  • 2025.01:   🎉 2 papers accepted by ICASSP 2025.
  • 2025.01:   🎉 Journal paper accepted by TASLP.
  • 2024.06:   🎉 5 papers accepted by INTERSPEECH 2024.
  • 2024.05:   📣 Submitted 1 journal paper to TASLP.
  • 2024.03:   📣 Submitted 5 papers to INTERSPEECH 2024.

📝 Publications

Preprint

  • The Codecfake Dataset and Countermeasures for the Universally Detection of Deepfake Audio

    Yuankun Xie, Yi Lu, Ruibo Fu, Zhengqi Wen, Zhiyong Wang, Jianhua Tao, Xin Qi, Xiaopeng Wang, Yukun Liu, Haonan Cheng, Long Ye, Yi Sun

  • Neural Codec Source Tracing: Toward Comprehensive Attribution in Open-set Condition

    Yuankun Xie, Xiaopeng Wang, Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Songjun Cao, Long Ma, Chenxing Li, Haonan Cheng, Long Ye

  • Detect All-Type Deepfake Audio: Wavelet Prompt Tuning for Enhanced Auditory Perception

    Yuankun Xie, Ruibo Fu, Zhiyong Wang, Xiaopeng Wang, Songjun Cao, Long Ma, Haonan Cheng, Long Ye

  • RPRA-ADD: Forgery Trace Enhancement-Driven Audio Deepfake Detection

    Ruibo Fu, Xiaopeng Wang, Zhengqi Wen, Jianhua Tao, Yuankun Xie, Zhiyong Wang, Xin Qi, Xuefei Liu, Cunhang Fan, Chenxing Li

  • ASRRL-TTS: Agile Speaker Representation Reinforcement Learning for Text-to-Speech Speaker Adaptation

    Ruibo Fu, Xin Qi, Zhengqi Wen, Jianhua Tao, Tao Wang, Chunyu Qiang, Zhiyong Wang, Yi Lu, Xiaopeng Wang, Shuchen Shi

  • MINT: a Multi-modal Image and Narrative Text Dubbing Dataset for Foley Audio Content Planning and Generation

    Ruibo Fu, Shuchen Shi, Hongming Guo, Tao Wang, Chunyu Qiang, Zhengqi Wen, Jianhua Tao, Xin Qi, Yi Lu, Xiaopeng Wang

  • A Multi-speaker Multi-lingual Voice Cloning System Based on VITS2 for LIMMITS 2024 Challenge

    Xiaopeng Wang, Yi Lu, Xin Qi, Zhiyong Wang, Yuankun Xie, Shuchen Shi, Ruibo Fu

Conference

  • C12-ICASSP 2025: Mixture of Experts Fusion for Fake Audio Detection using Frozen wav2vec 2.0

    Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Xiaopeng Wang, Yuankun Xie, Xin Qi, Shuchen Shi, Yi Lu, Yukun Liu

  • C11-ICASSP 2025: DPI-TTS: Directional Patch Interaction for Fast-Converging and Style Temporal Modeling in Text-to-Speech

    Xin Qi, Ruibo Fu, Zhengqi Wen, Tao Wang, Chunyu Qiang, Jianhua Tao, Chenxing Li, Yi Lu, Shuchen Shi, Zhiyong Wang, Xiaopeng Wang

  • C10-ISCSLP 2024: Does Current Deepfake Audio Detection Model Effectively Detect ALM-based Deepfake Audio?

    Yuankun Xie, Chenxu Xiong, Xiaopeng Wang, Zhiyong Wang, Yi Lu, Xin Qi, Ruibo Fu, Yukun Liu, Zhengqi Wen, Jianhua Tao

  • C9-ISCSLP 2024: EELE: Exploring Efficient and Extensible LoRA Integration in Emotional Text-to-Speech

    Xin Qi, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Shuchen Shi, Yi Lu, Zhiyong Wang, Xiaopeng Wang, Yuankun Xie, Yukun Liu

  • C8-ISCSLP 2024: A Noval Feature via Color Quantisation for Fake Audio Detection

    Zhiyong Wang, Xiaopeng Wang, Yuankun Xie, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Yukun Liu, Guanjun Li, Xin Qi, Yi Lu

  • C7-ASVspoof 2024: Temporal Variability and Multi-viewed Self-supervised Representations to Tackle the ASVspoof5 Deepfake Challenge

    Yuankun Xie, Xiaopeng Wang, Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Haonan Cheng, Long Ye

  • C6-INTERSPEECH 2024: PPPR: Portable Plug-in Prompt Refiner for Text to Audio Generation

    Shuchen Shi, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Tao Wang, Chunyu Qiang, Yi Lu, Xin Qi, Xuefei Liu, Yukun Liu, Yongwei Li, Zhiyong Wang, Xiaopeng Wang

  • C5-INTERSPEECH 2024: Generalized Source Tracing: Detecting Novel Audio Deepfake Algorithm with Real Emphasis and Fake Dispersion Strategy

    Yuankun Xie, Ruibo Fu, Zhengqi Wen, Zhiyong Wang, Xiaopeng Wang, Haonan Cheng, Long Ye, Jianhua Tao

  • C4-INTERSPEECH 2024: Codecfake: An Initial Dataset for Detecting LLM-based Deepfake Audio

    Yi Lu, Yuankun Xie, Ruibo Fu, Zhengqi Wen, Jianhua Tao, Zhiyong Wang, Xin Qi, Xuefei Liu, Yongwei Li, Yukun Liu, Xiaopeng Wang, Shuchen Shi

  • C3-INTERSPEECH 2024: Generalized Fake Audio Detection via Deep Stable Learning

    Zhiyong Wang, Ruibo Fu, Zhengqi Wen, Yuankun Xie, Yukun Liu, Xiaopeng Wang, Xuefei Liu, Yongwei Li, Jianhua Tao, Xin Qi, Yi Lu, Shuchen Shi

  • C2-INTERSPEECH 2024: Genuine-Focused Learning using Mask AutoEncoder for Generalized Fake Audio Detection

    Xiaopeng Wang, Ruibo Fu, Zhengqi Wen, Zhiyong Wang, Yuankun Xie, Yukun Liu, Jianhua Tao, Xuefei Liu, Yongwei Li, Xin Qi, Yi Lu, Shuchen Shi

  • C1-Blizzard 2023: The FruitShell French Synthesis System at the Blizzard 2023 Challenge

    Xin Qi, Xiaopeng Wang, Zhiyong Wang, Wang Liu, Mingming Ding, Shuchen Shi

💻 Competition

🌏 Visitor Map