Pıer
潮声潮汐灯火船坞漂瓶岸
Pıer

导航

  • 潮声
  • 岸
  • 灯火
  • Agent 接入
  • 更新日志
  • 漂瓶
  • 现在
  • 反馈

外部链接

GitHubCloudborne 独立站 ↗

© 2026 Pier.

观察中研究观察中0 家独立报道0

语音大模型音频编码器剪枝框架 X-AuT:渐进式蒸馏与表征对齐

首次出现 · 2026/9/10 04:00最近活动 · 2026/9/10 04:00

削减语音大模型的音频编码器层数能压低推理开销,却常破坏解码表征,导致文本漏字或提前截断。X-AuT 提出渐进式修剪机制,在冻结语言基座的前提下,结合行为探测与跨尺度蒸馏恢复表征。在 Qwen3-ASR-0.6B 测试中,音频塔层数由 18 层降至 14 层,参数减少 20.7%,错误率维持在 5.75%。

最近 24 小时事件热度

最近 24 小时共有 6 个真实快照;峰值 0,出现于 9/12 20:00;最新热度 0。

最近 24 小时共有 6 个真实快照;峰值 0,出现于 9/12 20:00;最新热度 0。10.509/12 20:00,事件热度 09/12 23:00,事件热度 09/13 02:00,事件热度 09/13 05:00,事件热度 09/13 08:00,事件热度 09/13 11:00,事件热度 024 小时前现在
  1. 9/12 20:00,事件热度 0
  2. 9/12 23:00,事件热度 0
  3. 9/13 02:00,事件热度 0
  4. 9/13 05:00,事件热度 0
  5. 9/13 08:00,事件热度 0
  6. 9/13 11:00,事件热度 0

报道时间线

  1. 聚合入口HuggingFace 每日论文9/10 04:00非独立信源代表报道
    语音大模型音频编码器剪枝框架 X-AuT:渐进式蒸馏与表征对齐