OmniPack 是一种无需训练的全模态 Token 压缩框架:在 LLM 前按模态重要性、全局覆盖与相似度合并去除结构冗余,并在模态充分交互后利用文本引导和音视频协作进行语义精炼。作者称其在五个基准、三个 Omni-LLM 骨干上取得最佳性能效率权衡;Qwen2.5-Omni-7B 在仅用原始 16.7% FLOPs 时保留 98.0% 性能。
最近 24 小时暂无可用热度快照。