跳到正文
原文
arXiv 人工智能· Wenxin Zhan, Yizheng Jiao, Haifeng Song, Shuai Xu, Chencheng Pan, Jiayi Feng, Anjie Xie·· 4 小时前AI 评分41

TrustMed-RL:面向证据驱动临床诊断的长程强化学习

TrustMed-RL: Long-Horizon Reinforcement Learning for Evidence-Grounded Clinical Diagnosis

AI 导读

研究人员推出 TrustMed-RL,结合 PubMed 罕见病病例与超 24,000 张人工标注图像,通过强化学习实现长程、有证据支持的临床诊断。其 8B 视觉语言策略在 2,500 个评估病例中取得 37.1% 的诊断准确率,在要求获取至少 50% 支撑检查证据的标准下达到 32.5%,超出 GPT-4o 6.8 个百分点。

来源:arXiv 人工智能 · arxiv.org