arXiv cs.AI / cs.LG / cs.CL·3d agoMizar: A 159M-Parameter Audio-Language Model for Audio Understanding#mizar#audio-language-model#smollm2AI research
Hugging Face daily papers·15d agoStepAudio 3 Realtime Technical Report#audio-language-model#full-duplex#realtime-speech