arXiv发布FIDAL:面向真实分布偏移的联邦主动学习框架
文 / Mr.Xu
发布时间:
摘要:arXiv 平台发布了一种名为 FIDAL 的新型联邦主动学习框架,旨在解决现有方法在处理真实世界数据分布偏移时的局限性。FIDAL 结合了校准的全局-局部证据不确定性、支持集多样性加权以及自适应异常值拒绝机制,在多中心医学成像基准测试中表现出色,显著提升了模型在开放集场景下的平衡准确率,并减少了标注成本。实验结果表明,FIDAL 在处理无关异常值时效率更高,为医学领域的联邦学习提供了新的技术路径。
核心突破
- 开放集联邦主动学习框架:FIDAL 是一种新型的开放集联邦主动学习框架,结合了校准的全局-局部证据不确定性、支持集多样性加权以及自适应异常值拒绝机制。
- 自适应异常值拒绝:通过 Otsu 准则对每个客户端和每轮的基础模型高斯覆盖信号进行阈值化处理,FIDAL 能够高效地查询高度信息量的分布内样本,同时排除无关异常值,无需手动调整阈值。
- 多中心医学成像基准测试:在皮肤病理学、组织病理学和乳腺 X 线摄影三个多中心医学成像基准测试中,FIDAL 在开放集场景下的平衡准确率相较于基于检测器的开放集方法高出约 12 个百分点。
- 标注效率提升:在相同的查询预算下,FIDAL 在处理无关异常值时使用的标注数量至少比所有准确率匹配的基线方法少 1.3 倍,节省了 7-29 小时的专家阅读时间。
技术亮点
- 校准的全局-局部证据不确定性:通过结合全局和局部不确定性估计,FIDAL 能够更准确地识别信息量高的样本。
- 支持集多样性加权:通过支持集多样性加权,FIDAL 能够选择更具代表性的样本进行标注,从而提升模型泛化能力。
- 自适应异常值拒绝:利用 Otsu 准则自动调整阈值,FIDAL 能够有效排除无关异常值,减少标注成本。
行业影响
FIDAL 的发布为医学领域的联邦学习提供了新的技术路径,特别是在处理真实世界数据分布偏移时表现出色。其高效处理无关异常值的能力将有助于降低标注成本,提升模型性能,为医疗 AI 的应用带来更可靠的解决方案。
开发者建议
- 关注 FIDAL 的开源实现:开发者可以关注 FIDAL 的开源实现,并将其应用于医学图像分析等场景中,以提升模型在开放集场景下的性能。
- 结合领域知识进行优化:在应用 FIDAL 时,可以结合领域知识对模型进行进一步优化,以更好地适应特定的应用场景。
—— 完 ——消息来源:ArXiv Machine Learning (cs.LG) (2026-09-29)
社区整体评论区
正在加载实时智能评论与划词标注…