NoizAI/YuE2-Turbo
Fast, concurrent inference for YuE2. Same model and recipe: 1.68× faster per song, 3.31× more songs per GPU.
GitHub repository with 66 stars and 9 forks.
Language: Python
Topics: audio-generation, cuda, inference, model-serving, music-generation, pytorch, vllm