I work on multimodal foundation models, audio representation learning, and interpretability.
My research focuses on bridging the gap between audio and large language models, from discrete audio representations to benchmarks and evaluation. I'm finishing my PhD at Mila and Concordia University with Mirco Ravanelli and Cem Subakan. I recently completed an internship at Epic Games, working on expressive generative models. I'm a core contributor to SpeechBrain and founded the Conversational AI Reading Group.
- 2026📢 Our workshop on Explainability, Robustness, and Controllability of Language Modeling for Speech and Audio was accepted at ICASSP! 🎉 Working on audio language models or conversational AI? Submit by November 11, 2026.
- Oct 2026🎙️ The Conversational AI Reading Group is back on October 8. Join us Thursdays at 11:00 ET.
- 2026Two papers accepted at Interspeech 2026: Investigating Faithfulness in Large Audio Language Models (oral) and Enhancing Audio Reasoning via Semantic Summary Prediction.
- 2026ALAS accepted at MLSP 2026.
- 2026DASB accepted at TMLR.
- 2026
Investigating Faithfulness in Large Audio Language Models
Pooneh Mousavi, Lovenya Jain, Mirco Ravanelli, Cem Subakan
- 2026
Enhancing Audio Reasoning via Semantic Summary Prediction
Francesco Bonzi, Pooneh Mousavi, Cem Subakan, Mirco Ravanelli
- 2026
DASB: Discrete Audio and Speech Benchmark
Pooneh Mousavi, Jarod Duret, Darius Petermann, … Mirco Ravanelli
- 2026
Listen First, Then Answer: Timestamp-Grounded Speech Reasoning
Jihoon Jeong, Pooneh Mousavi, Mirco Ravanelli, Cem Subakan
- 2026
ALAS: An Automatic Latent Alignment Score for Audio Language Models
Pooneh Mousavi, Yingzhi Wang, Mirco Ravanelli, Cem Subakan
- 2025
Discrete Audio Tokens: More Than a Survey!
Pooneh Mousavi†, Gallil Maimon*, Adel Moumen*, … Mirco Ravanelli
- 2025
LiSTEN: Learning Soft Token Embeddings for Neural Audio LLMs
Pooneh Mousavi*, Shubham Gupta*, Cem Subakan, Mirco Ravanelli
- 2025
What Are They Doing? Joint Audio-Speech Co-Reasoning
Yingzhi Wang, Pooneh Mousavi, Artem Ploujnikov, Mirco Ravanelli
- 2024
How Should We Extract Discrete Audio Tokens from Self-Supervised Models?
Pooneh Mousavi, Jarod Duret, Salah Zaiem, … Mirco Ravanelli
- 2024
CL-MASR: A Continual Learning Benchmark for Multilingual ASR
Luca Della Libera*, Pooneh Mousavi*, Salah Zaiem, Cem Subakan, Mirco Ravanelli
- 2024
Open-Source Conversational AI with SpeechBrain 1.0
Mirco Ravanelli, Titouan Parcollet, Adel Moumen, et al.
- 2023
WOODS: Benchmarks for Out-of-Distribution Generalization in Time Series
Jean-Christophe Gagnon-Audet, Kartik Ahuja, Mohammad Javad Darvishi Bayazi, Pooneh Mousavi, Guillaume Dumas, Irina Rish
- 2022
"Please Donate for the Affected": Supporting Emergency Managers in Finding Volunteers and Donations in Twitter Across Disasters
Pooneh Mousavi, Cody Buntain
- 2021
Detecting Hashtag Hijacking for Hashtag Activism
Pooneh Mousavi, Jessica Ouyang
* equal contribution · † lead author
- 🎮 Research Scientist Intern, Epic GamesGenerative & expressive TTS · Montréal · 2025–2026
- Scientist in Residence, MilaAudio representations & audio LLMs · 2022–present
- ML Scientist in Residence, Draft & GoalLLM fine-tuning with QLoRA · 2023
- Research Scientist, UKP Lab, TU DarmstadtAI for digital mental health, affective analysis · 2021–2022
- PhD Candidate, Computer ScienceMila / Concordia · 2022–present
- MS, Computer ScienceUT Dallas · 2018–2021
- BSc, Computer EngineeringK. N. Toosi University of Technology · 2009–2013
- Oral presentations, Interspeech2024, 2026
- Mila travel scholarship, WiML2025
- Concordia graduate travel grantInterspeech 2024, 2025, 2026
- TA, Conversational AIConcordia · 2023–2024
- Founder, Conversational AI Reading GroupFall 2024–present
- ReviewerAAAI 2026 · ICLR 2025 · NeurIPS 2024 D&B · ANNPR 2024 · ICASSP 2024 workshops