跳到正文
原文
AI × 生物医药(arXiv / AIHOT)· arXiv · cs.CV·· 3 小时前评分42

FOCUS:从基础视觉编码器到多模态大语言模型的视网膜模型泛化基准评测

FOCUS: Benchmarking Retinal Model Generalization from Foundation Vision Encoders to Multimodal LLMs

导读

FOCUS 跨数据集基准在 10 个公共数据集上对 532 个基础配置及 228 个 LoRA 微调 MLLM 配置评测 VM、VLM、MLLM 三类模型,覆盖糖网病与青光眼视神经病变任务。结果显示无模型族稳定领先:通用 VM 平均排序最强,医学 MLLM 具竞争力但波动大,双编码器 VLM 经轻量适配提升明显。微调改善域内表现但向外部数据集迁移呈异质性,尤其影响校准。

来源:AI × 生物医药(arXiv / AIHOT) · arxiv.org

CBACBA Frontier Insights (CFI)美国华人生物医药科技协会(CBA)www.cba-usa.org