arxiv:2603.14145
Ramani Duraiswami
RamaniD
AI & ML interests
algorithms, audio, speech, spatial audio, vision, parallel computing
Recent Activity
liked a model 3 days ago
nvidia/audio-flamingo-next-hf authored a paper 6 months ago
MMOU: A Massive Multi-Task Omni Understanding and Reasoning Benchmark for Long and Complex Real-World Videos authored a paper about 1 year ago
CompA: Addressing the Gap in Compositional Reasoning in Audio-Language
Models