UniAudio: An Audio Foundation Model Toward Universal Audio Generation
Dongchao Yang, Jinchuan Tian, Xu Tan +9 authors
UniAudio, a unified language model system, generates various audio types effectively using tokenization, sequence concatenation, and next-token prediction, with a multi-scale Transformer model handling extended sequences.