Model Detayları
### Musicgen Modeli Hakkında AudioCraft’ın MusicGen modeli, 4 codebook’lu bir EnCodec tokenizer kullanarak 32 kHz’de yüksek kaliteli müzik üreten tek aşamalı, auto-regressive bir Transformer’dır. 20 000 saatlik lisanslı parça üzerinde eğitildi; tüm codebook’ları paralel olarak, saniyede yalnızca 50 autoregressive adımla tahmin eder — ayrı semantic embedding’lere gerek yoktur.
### Modeller ve Demolar - **Boyutlar:** small, medium, large, melody, stereo - **Demolar:** Hugging Face Space, Colab notebook, yerel Gradio uygulaması, Jupyter örnekleri
### Öne Çıkan Avantajlar - **Verimlilik:** Daha hızlı inference için paralel codebook tahmini - **Esneklik:** Birden fazla model boyutunda yalnızca metinle ya da metin+melodiyle koşullandırma - **Erişilebilirlik:** Çok az dependency ile 🤗 Transformers (v4.31.0+) üzerinden kullanılabilir
