论文提出基于CLIP视觉编码器的SFT+RL两阶段稳健无监督域适应框架:先在有标签源域上用PGD进行对抗微调,再以衰减置信度阈值筛选目标域伪标签,并混合干净与对抗样本训练。作者在OfficeHome、PACS和VisDA上报告平均干净准确率提升10.2%、对抗鲁棒性提升15.8%,但目前信息仅来自摘要。
最近 24 小时暂无可用热度快照。