近日,第五届医学影像AI学术会议在上海举办,一场公开的“人机读片大赛”成为焦点。与行业常见的内部测评不同,主办方从三甲医院征集了10份罕见真实影像病例,设置7组“医生+AI协作”或AI智能体独立参赛,由专家现场打分。结果显示,高年资医生与多任务智能体组合得分最高(85.2分),低年资医生与智能体组合次之(83.8分),而独立工作的智能体得分虽低(66.2分),但用时仅20分32秒,远快于其他组别。

比赛暴露了AI落地的现实挑战:AI智能体输出可能混杂假阳性,医生需复核原始影像,部分病例反而延长了工作时间。同时,专家误判报告来源的现象凸显了AI生成内容与人类表达日益接近,人机边界模糊。行业正从垂直模型转向多模态医疗智能体,旨在整合碎片化工具,模拟医生完整阅片逻辑,实现一次输入生成完整报告。数坤科技等企业已发布相关产品,并计划推出医学世界模型,推动医生从重复性工作中解放,转向复核与综合研判。