用医院真实数据训练的AI读脑CT/MRI,诊断156种疾病超越GPT-5——Nature Medicine发表NeuroVFM

发布时间:2026/8/3 17:27:38

用医院真实数据训练的AI读脑CT/MRI,诊断156种疾病超越GPT-5——Nature Medicine发表NeuroVFM
一、研究背景过去两年医学AI的主流发展路径是互联网尺度学习——将海量网络图文喂给大模型训练出像GPT-5、Claude Sonnet 4.5这样的通用智能系统。但神经影像脑部CT和MRI几乎不会出现在互联网上它们是包含患者面部特征的私密三维体数据格式复杂且高度依赖专业解读。因此这些前沿通用模型在脑影像任务上往往力不从心。密歇根大学Todd Hollon团队提出了另一条根本不同的路径——“健康系统学习”Health System Learning。这个范式的核心思想很简单不做数据策展、不用人工标注、不依赖放射学报告直接从一家医院近20年积累的、原封不动的常规临床影像里学习。研究团队将这一理念实现为NeuroVFMNeuroimaging Vision Foundation Model并于2026年7月10日在Nature Medicine上发表了这一成果。二、研究创新点本研究的核心创新可以概括为三个层面1提出健康系统学习新范式。传统医学AI依赖大量人工标注或配对的放射学报告进行监督训练而NeuroVFM直接从未经整理的原始临床影像中自监督学习打破了数据标注的瓶颈。2开发Vol-JEPA体积联合嵌入预测架构。这是JEPAJoint Embedding Predictive Architecture在三维医学影像上的首次大规模应用。采用学生-教师双网络结构通过在隐空间中预测被掩码区域的表示来学习完全不需要体素级数据增强、负样本对、生成式解码器或配对报告。3单一冻结编码器覆盖156项诊断任务。NeuroVFM的视觉编码器在预训练后冻结不需要针对每个下游任务微调即可同时覆盖82种CT诊断和74种MRI诊断实现了真正的通才型医学AI。三、技术原理NeuroVFM基于Vol-JEPA架构其训练流程可分为以下关键步骤训练数据使用密歇根医学院2005–2025年积累的566,915例神经影像检查、共524万个临床CT/MRI体积约365万MRI 159万CT覆盖超过20年的真实临床数据。Vol-JEPA架构将三维体积分割为非重叠的4×16×16体素图块。每个体积分为两部分较小的可见上下文区域MRI采样25%、CT采样20%和较大的掩码目标区域。学生编码器处理上下文区域生成潜在表示预测器结合上下文表示和位置信息预测目标区域的潜在表示教师编码器通过学生编码器的指数移动平均EMA更新并提供预测目标。训练目标是最小化预测表示与教师生成表示之间的平滑L1距离。关键设计细节CT数据采用多窗口训练策略——脑窗权重0.7、硬膜下窗0.15、骨窗0.15——确保模型同时学习不同组织对比度下的特征。图块丢弃率设为20%以增加训练难度。四、实验结果NeuroVFM在多项评估中展现出全面的性能优势诊断性能在156项诊断任务中CT宏平均AUROC达92.6895% CI 92.27–93.08MRI宏平均AUROC达92.4995% CI 92.14–92.82全面超越HLIP、NeuroMAE、DINOv3、BiomedCLIP等对照模型AUROC提升1.55–3.87不等。标注效率NeuroVFM所需的阳性训练样本比传统方法少31.5%–55.9%意味着在临床稀有疾病上也能快速适配。报告生成超越GPT-5在300例专家验证的影像研究上NeuroVFM结合开源语言模型生成的放射学报告三级紧急程度准确率超越GPT-5 11.0%紧急发现检测超越10.5%关键发现错误率约为GPT-5的一半10% vs 20%。盲法专家以超过2:1的比例优先选择NeuroVFM生成的报告。前瞻性临床分诊在一项为期一周、覆盖1,155例真实急诊影像的前瞻性研究中NeuroVFM组平衡准确率达92.6%远超GPT-5的71.2%。关键发现漏检率方面NeuroVFM仅为GPT-5的约四分之一。五、应用前景NeuroVFM的健康系统学习范式为医疗AI的落地提供了全新的可能性急诊影像智能分诊。在放射科医生短缺的背景下NeuroVFM能自动识别脑出血、急性梗死等需要紧急处理的影像征象将真正需要优先处理的病例推到队列前面为抢救争取宝贵时间。基层医疗赋能。神经影像诊断高度依赖专家经验基层医院往往缺乏神经放射学专科医生。一个冻结的NeuroVFM编码器即可覆盖上百种诊断结合开源大语言模型生成结构化报告有望将三甲医院的诊断能力下沉至县级医院。作为AI医疗软件开发的基础模块。NeuroVFM的预训练编码器和Vol-JEPA架构可作为视觉感知前端与各类大语言模型如GPT-5、Claude等组合构建面向不同临床场景的AI辅助诊断系统。这正是思陌智能科研服务关注的方向——将前沿AI模型工程化为可落地的临床工具。六、结论NeuroVFM的研究证明了一个重要事实医学AI不需要依赖互联网规模的公共数据。一家医院20年积累的常规临床影像配合合适的自监督学习架构就能训练出在诊断、报告生成和临床分诊方面全面超越GPT-5等前沿模型的通才型系统。虽然该模型目前仍是研究工具、尚未获得监管批准用于临床诊断但其开放的代码和权重为全球医疗AI开发者提供了极有价值的参考框架。“健康系统学习不仅是技术路线的创新更提示了一种务实的落地路径让每家医院用自己的数据训练自己的AI。参考文献Kondepudi A, Rao A, Zhao C, et al. Health system learning enables generalist neuroimaging models.Nature Medicine, 2026. DOI: 10.1038/s41591-026-04497-1 | PMID: 42432292Assran M, et al. Self-supervised learning from images with a joint-embedding predictive architecture.Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2023: 15619–15629.Lyu Y, et al. Learning neuroimaging models from health system-scale data.Nature Biomedical Engineering, 2026. DOI: 10.1038/s41551-025-01608-0Moor M, et al. Foundation models for generalist medical artificial intelligence.Nature, 2023, 616: 259–265. DOI: 10.1038/s41586-023-05881-4 论文原文信息论文标题Health system learning enables generalist neuroimaging models作者Kondepudi A, Rao A, Zhao C, Lyu Y, Harake S, Banerjee S, Ogle J, Joshi R, Meissner AK, Hou X, Jiang C, Chowdury A, Srinivasan A, Athey B, Gulani V, Pandey A, Lee H, Hollon T期刊Nature Medicine发表时间2026-07-10DOI10.1038/s41591-026-04497-1PubMedPMID: 42432292

相关新闻

论文降重与降 AI 的“人机分工”教程:哪些段落建议用工具粗改,哪些必须手动重构?

论文降重与降 AI 的“人机分工”教程:哪些段落建议用工具粗改,哪些必须手动重构?

2026/8/3 17:27:38

临近毕业定稿提交,每一个毕业生都在跟相似度(查重率)和 AIGC 疑似度(AI率)这两个指标进行最后的赛跑。在庞大的工作量面前,很多同学陷入了两个极端的误区:要么为了省时省力,整篇大论…

SCI 论文 Results  Discussion 怎么写?三步讨论法、时态规范与对比表格包装教程

SCI 论文 Results Discussion 怎么写?三步讨论法、时态规范与对比表格包装教程

2026/8/3 17:27:38

在撰写大论文或 SCI 英文小论文时,许多研究生最害怕写的章节就是 Results & Discussion(实验结果与分析讨论)。前言部分可以大范围梳理和复述同行文献,有话可说;但到了结果分析,很多同学把 Origin 导出…

论文投稿中的“审稿人意见回复信”怎么写?教你用委婉外交辞令反驳学术偏见(附英文模板)

论文投稿中的“审稿人意见回复信”怎么写?教你用委婉外交辞令反驳学术偏见(附英文模板)

2026/8/3 17:27:38

在英文 SCI 或 SSCI 期刊投稿中,经历漫长痛苦的审稿等待后,很多同学会收到 Major Revision(大修)或者 Minor Revision(小修)的审稿意见。大修报告里,经常会包含几个让你血压飙升的问题。例如&am…

基于局部质心的无监督图像分割:原理、Matlab实现与应用

基于局部质心的无监督图像分割:原理、Matlab实现与应用

2026/8/3 18:37:42

如果你正在处理医学影像、遥感图像或任何缺乏标注数据的图像分割任务,那么“无监督”这三个字可能就是你的救星。传统的深度学习分割方法,如U-Net,虽然效果出色,但严重依赖大量、高质量的标注数据。获取这些数据不仅成本高昂&…

视频技术核心三要素:分辨率、帧率与码流的权衡艺术

视频技术核心三要素:分辨率、帧率与码流的权衡艺术

2026/8/3 18:37:42

1. 从一次“卡顿”的直播说起:为什么参数不是越高越好? 那天下午,我正调试一个基于RK3588的智能车多路摄像头推流系统。硬件配置看起来相当豪华:四颗高清摄像头,通过RK3588强大的NPU进行YOLO实时目标检测,然…

UE4 PSO缓存实战:从构建到热更的完整优化指南

UE4 PSO缓存实战:从构建到热更的完整优化指南

2026/8/3 18:37:42

1. 项目概述:为什么PSO缓存是UE4性能优化的“胜负手” 如果你是一名UE4开发者,尤其是在移动端或者PC上追求极致稳定帧率的项目里,一定对“着色器编译卡顿”(Shader Compilation Stutter)这个顽疾深恶痛绝。游戏运行中&…

数据流程图四要素详解与绘制实战:从理论到实践

数据流程图四要素详解与绘制实战:从理论到实践

2026/8/3 18:37:42

1. 从“一团乱麻”到“一目了然”:为什么我们需要数据流程图 刚入行做数据分析或者系统设计的时候,我最怕的就是开会。产品经理、业务方、开发、测试,大家围坐一圈,讨论一个需求。产品经理说:“用户点击这个按钮&#…

Appium+Python Android自动化测试实战:从环境搭建到脚本优化

Appium+Python Android自动化测试实战:从环境搭建到脚本优化

2026/8/3 18:37:42

1. 项目概述:为什么选择AppiumPython做Android自动化?如果你是一名移动端测试工程师、或者是一名想提升效率的Android开发者,那么“自动化测试”这个词对你来说一定不陌生。手动一遍遍点击、滑动、输入,不仅枯燥耗时,更…

Unity渲染线程分离:多线程渲染与DOTS架构的性能优化实践

Unity渲染线程分离:多线程渲染与DOTS架构的性能优化实践

2026/8/3 18:27:41

1. 项目概述:为什么我们要关心渲染线程分离?如果你在Unity项目里做过性能优化,尤其是针对中大型项目或者移动平台,大概率听过“主线程瓶颈”这个词。当你的游戏卡顿,Profiler里那个叫“Main Thread”的柱子顶天立地时&…

ncmdumpGUI:一键解锁网易云音乐ncm文件的终极解决方案

ncmdumpGUI:一键解锁网易云音乐ncm文件的终极解决方案

2026/8/3 4:49:52

ncmdumpGUI:一键解锁网易云音乐ncm文件的终极解决方案 【免费下载链接】ncmdumpGUI C#版本网易云音乐ncm文件格式转换,Windows图形界面版本 项目地址: https://gitcode.com/gh_mirrors/nc/ncmdumpGUI 你是否曾经从网易云音乐下载了心爱的歌曲&am…

分布式配置中心选型实战:Nacos与Consul在创业场景下的对比

分布式配置中心选型实战:Nacos与Consul在创业场景下的对比

2026/8/2 0:04:43

分布式配置中心选型实战:Nacos与Consul在创业场景下的对比工程导读:本文深入讨论 分布式配置中心选型实战:Nacos与Consul在创业场景下的对比 在生产工程实践中的核心落地方案。基于 分布式架构与微服务设计 视角,剖析实际痛点、架…

MoneyPrinterPlus实战指南:AI视频批量生成与自动化发布完整解决方案

MoneyPrinterPlus实战指南:AI视频批量生成与自动化发布完整解决方案

2026/8/2 0:04:43

MoneyPrinterPlus实战指南:AI视频批量生成与自动化发布完整解决方案 【免费下载链接】MoneyPrinterPlus AI一键批量生成各类短视频,自动批量混剪短视频,自动把视频发布到抖音,快手,小红书,视频号上,赚钱从来没有这么容易过! 支持本地语音模型chatTTS,fasterwhisper,…

从提示词小白到AI内容架构师(20年技术老兵的6阶能力跃迁图谱,仅剩最后87个免费解读名额)

从提示词小白到AI内容架构师(20年技术老兵的6阶能力跃迁图谱,仅剩最后87个免费解读名额)

2026/8/3 0:06:20

更多请点击: https://codechina.net 第一章:AI写作能力跃迁的认知革命 过去五年,AI写作已从“模板填充”迈入“语义共建”阶段——模型不再仅复述训练数据中的句式,而是基于跨文档推理、意图锚定与风格自适应,动态构建…

AU-48八米拾音的信噪比衰减与降噪门限耦合分析

AU-48八米拾音的信噪比衰减与降噪门限耦合分析

2026/8/3 0:06:20

一、"拾音 8 米"这个指标该怎么读AU-48 的规格里,麦克风拾取范围写的是 10cm-800cm,配合 T1/T2 参数切换可选四档:中距离 0.5-2m、近距离 0.1-0.2m、远距离 0.5-5m、超远距离 0.5-8m。"能拾音 8 米"这句话本身没错&#…

LangChain 从 Demo 到团队落地,真正卡壳的是哪一步?

LangChain 从 Demo 到团队落地,真正卡壳的是哪一步?

2026/8/3 0:06:20

聊《LangChain并不难,难的是知道什么时候不该用》之前,先说一句实在的:别急着背概念,先看它在真实项目里到底解决什么问题。 摘要 摘要:很多人学 LangChain 都是从调个 API 开始,跑通一个 Demo 觉得挺简单…

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

2026/8/2 17:06:42

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…

导师推荐!2026最新AI论文工具测评与实用推荐

导师推荐!2026最新AI论文工具测评与实用推荐

2026/8/3 7:25:44

2026年真正好用的AI论文工具,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

告别游戏崩溃:XCOM 2模组管理器的智能革命

告别游戏崩溃:XCOM 2模组管理器的智能革命

2026/8/3 2:41:27

告别游戏崩溃:XCOM 2模组管理器的智能革命 【免费下载链接】xcom2-launcher The Alternative Mod Launcher (AML) is a replacement for the default game launchers from XCOM 2 and XCOM Chimera Squad. 项目地址: https://gitcode.com/gh_mirrors/xc/xcom2-lau…