sesame/csm-1b

Hugging Face
AUDIO GENERATIONConcurrent Unit Cost:1Architecture:Transformer2.4K Gated Warm

CSM (Conversational Speech Model) is a speech generation model from Sesame that generates RVQ audio codes from text and audio inputs

Preview unavailable