论文系统比较了18个图像编码器和7个文本编码器,覆盖7M至27B参数、五种影像模态及65万余张胸片。结果显示,表征趋同主要由自监督目标驱动,而非模型规模或临床监督;匹配的自监督模型在胸片上的对齐度为40.4%,标签监督为21.1%,图文训练仅3.3%。
最近 24 小时暂无可用热度快照。