MusicGen
Free while signed in. Answers cite the passages they came from.

Meta's MusicGen is a single-stage transformer LLM for music generation that operates over compressed discrete audio tokens.
Single-stage transformer: Unlike multi-stage music generation pipelines, MusicGen generates music as a single autoregressive transformer over multi-codebook tokens.
Multi-stream tokens: Operates over several parallel streams of compressed discrete music tokens, producing high-fidelity audio without the cascaded VQ-VAE + LM setup.
Text and melody conditioning: Supports both text prompts and melody conditioning, letting users specify style with text and structure with reference audio.
High-quality generation: Delivers competitive subjective quality against multi-stage baselines while being simpler and faster to deploy.
Get next week’s papers.
The same picks and the same summaries, in your inbox. Free, and 176 issues deep.
Subscribe on Substack