Popular repositories Loading
-
Audio-Mamba-AuM
Audio-Mamba-AuM PublicOfficial Implementation of the work "Audio Mamba: Bidirectional State Space Model for Audio Representation Learning"
-
SlowFastSign
SlowFastSign Public[ICASSP 2024] Official code for Slowfast Network for Continuous Sign Language Recognition
-
seed-pytorch
seed-pytorch Public[INTERSPEECH 2025] Official code for "SEED: Speaker Embedding Enhancement Diffusion Model"
-
Metric-UD-KWS
Metric-UD-KWS PublicOfficial code for Metric learning for user-defined keyword spotting
-
Repositories
- VoxMM Public
- Who-Says-What Public
[NeurIPS 2026] Who Says What: Symbolic Trimodal Binding Mechanisms in Audio-Visual LLMs
- Plug-and-Steer Public
[Interspeech 2026] Plug-and-Steer: Decoupling Separation and Selection in Audio-Visual Target Speaker Extraction
-
- SeeandSniff Public
[ECCV 2026 Oral] Official Pytorch implementation for See & Sniff: Learning Visuo-Olfactory Representations
- Dub-S2ST Public
[EMNLP 2025 Findings] Dub-S2ST: Textless Speech-to-Speech Translation for Seamless Dubbing
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…