diff --git a/README.md b/README.md index 22f2246..ded3d77 100644 --- a/README.md +++ b/README.md @@ -72,6 +72,7 @@ A curated list of awesome large AI models in audio signal processing, inspired b **MusicLM: Generating Music From Text** [2023].
*Andrea Agostinelli, Timo I. Denk, Zalán Borsos, Jesse Engel, Mauro Verzetti, Antoine Caillon, Qingqing Huang, Aren Jansen, Adam Roberts, Marco Tagliasacchi, Matt Sharifi, Neil Zeghidour, Christian Frank*
[[PDF](https://arxiv.org/abs/2301.11325)]
**SeamlessM4T—Massively Multilingual & Multimodal Machine Translation** [2023].
*Seamless Communication, Loic Barrault, Andy Chung, David Dale, Ning Dong (AI), Paul-Ambroise Duquenne, Hady Elsahar et. al.*
[[PDF](https://ai.meta.com/research/publications/seamless-m4t/)]
**SALMONN: Towards Generic Hearing Abilities for Large Language Models** [2023].
*Changli Tang, Wenyi Yu, Guangzhi Sun, Xiaozhao Chen, Tian Tan, Wei Li, Lu Lu, Zejun Ma, Chao Zhang*
[[PDF](https://arxiv.org/abs/2310.13289)][[Github](https://github.com/bytedance/SALMONN)]
+**FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs** [2024].
*Keyu An et al.*
[[PDF](https://arxiv.org/abs/2407.04051)][[Github](https://github.com/FunAudioLLM/SenseVoice)]

## Automatic Speech Recognition (ASR)