论文提出音视模态声场(AV-MSF),从多视角图像和少量撞击声音重建物体级声学表示。方法结合3D Gaussian Splatting与稠密视觉特征建立几何先验,并以紧凑、具物理意义的模态参数表示撞击声场,在两个真实世界数据集上据称超越物理仿真和纯数据驱动基线,还支持接触定位与物体声音编辑。
最近 24 小时暂无可用热度快照。