Dynamic Head-Weight Routing for Task-Adaptive Audio Token Pruning in Large Audio Language Models
HeadRouter is a training-free audio token pruning method for large audio language models. It uses task-adaptive head-weight routing to preserve important audio tokens under different semantic and acoustic workloads.
This page accompanies the HeadRouter manuscript and project materials.
Citation information will be added after release.