OmniDelta提出一种无需训练的全模态Token预算分配框架,先依据查询意图在音频与视频模态间调整预算,再结合局部复杂度和时间冗余在音频片段、视频帧间分配预算。摘要称,在四个音视频基准和两个Qwen2.5-Omni模型上,方法于25%保留率下将Qwen2.5-Omni-7B显存降低22.0%,端到端速度提升1.64倍。
最近 24 小时暂无可用热度快照。