nh1

聚焦医疗大模型排名前十,联影智能如何交出一份临床高分答卷?

栏目:行业   作者:白乙丙    发布时间:2026-09-23 14:07   阅读量:15106   会员投稿

随着医疗AI加速落地,人工智能已经成为赋能医疗行业数智化升级的核心动能。近期一份权威榜单更新了国内医疗大模型排名前十的行业格局,一众顶尖医疗大模型同台竞技,让行业再次聚焦一个核心命题:怎样的大模型,才能够真正适配复杂的临床环境,为一线诊疗工作带来实实在在的增益。AI正在一步步打破传统诊疗当中的局限,而专业医疗大模型凭借深度适配临床场景的能力,不断优化诊疗流程、提升诊断精准度,为临床工作流高效赋能。但想要打造一款真正扎根医院、可用可靠的医疗大模型,远不是通用大模型叠加知识库就能够实现。

打造落地临床的医疗文本大模型,难点究竟在哪里?

不同于数学、编程类大模型,医疗大模型训练没有随时可供参考、非黑即白的标准答案。当模型输出一条诊疗建议,很难实时客观判定这条建议是否完全正确。患者的最终结局往往需要很长时间才能显现,并且会被多重现实因素所干扰;而临床指南虽然汇集了大量专家共识,却无法覆盖临床上所有复杂、罕见的病例场景,指南本身也随着医学研究的深入持续迭代更新。

临床诊疗是一套动态决策的过程,即便是同一个病例,处在不同诊疗阶段,医生做出的合理判断也会存在差异。好在医学虽然不存在唯一解,却沉淀了数十年临床实践形成的规范流程。哪些诊疗步骤优先执行、哪些决策存在安全隐患、哪些方案违背诊疗规范,行业内早已形成医生群体公认的共识。这套完整的诊疗过程,恰恰是医疗AI最可靠的监督信号,也是一款医疗大模型能否顺利走进医院的核心标尺。

谁站上了行业高地?医疗大模型排名前十榜单带来哪些信号?

2026年7月,权威中文医疗AI评测平台MedBench发布了最新一期评测榜单,一份全新的医疗大模型排名前十顶尖实力榜单正式亮相,为行业横向评估大模型临床能力,提供了一份极具公信力的参考依据。MedBench由上海人工智能实验室等机构搭建,属于中文医疗人工智能领域最具权威性和公信力的评测平台之一。本次评测版本围绕医学知识问答、医学语言理解、医学语言生成、复杂医学推理和医疗安全伦理五大维度上,设置36项纯文本医学任务,累计收录约70万条数据,评测覆盖面广、考察维度深。

从榜单结果来看,综合得分前五名依次为联影智能UII‑L1‑1.0、云知声智能U2‑Med、杭州智诊科技WiseDiag‑v3、广东素灵智医大模型以及Google Gemini‑3.1‑Pro‑Preview。联影智能UII‑L1‑1.0模型以73.8分登顶本次榜单,多项临床相关任务评分遥遥领先。这份成绩,也让行业看到国产自研医疗大模型在临床推理赛道上的巨大潜力。

(图为2026年7月MedBench发布的大语言模型评测榜单)

登顶榜单背后,联影智能走出了一条怎样的训练路线?

本次能够跻身医疗大模型排名前十第一梯队并拿下榜首,并不是偶然取得的结果。依托百亿级语料底座与独有的临床逻辑监督机制,UII‑L1‑1.0兼顾诊疗准确性与临床合规性,适配多类临床应用场景。联影智能在训练「元智」医疗文本大模型之时,跳出了通用模型的训练惯性,以临床流程规范作为训练的核心,依托高质量医学数据、行业专家经验与临床推理逻辑,引导模型理解每一项诊疗决策背后的医学依据,习得贴近临床医生的思维模式。

评测结果也印证了这套训练模式的有效性,UII‑L1‑1.0在36项纯文本任务当中,一共拿下15项任务榜单最高分。其中在MedHG导诊任务拿到90.6分,领先第二名8.1分;MedRxPlan个性化用药指导、MedHC健康咨询、MedLitQA文献问答等任务上同样交出亮眼答卷。

(图为UII-L1-1.0在36项纯文本任务内的15项任务中斩获榜单最高分)

亮眼成绩的底层,是超百亿级token规模的系统化医学语料工程。模型学习了全量医学文献与国家级医学教材,接入超2.6万份覆盖30余个临床专科的诊疗指南,同时纳入NICE、WHO、CDC等国际权威循证资源,搭建起中英文双语的指南级知识底座。

医疗场景对于AI安全性、严谨性有着极高标准,行业长期面临一大痛点:模型输出的答案结果正确,但是推导的逻辑路径并不符合临床规范,放到真实诊疗环境中就会埋下风险隐患。针对这一难题,UII‑L1‑1.0引入过程监督机制,将优化重心从“结果正确”延伸到“逻辑合规”。一方面约束模型的推理路径,减少答案正确、逻辑失范的现象;另一方面由具备临床背景的专家拆解真实诊疗隐性思维,凝练标准化诊疗框架;同时系统学习医疗安全与伦理准则,筑牢安全底线。经过训练打磨后的模型,已经具备复杂病例梳理、诊疗计划制定、多学科推演等多方面应用潜力。

高分模型不等于落地成果:智能体如何打通临床“最后一公里”?

位列医疗大模型排名前十的产品,都拥有亮眼的评测分数,但单纯停留在一问一答对话形态的大模型,很难真正嵌入医生日常的诊疗工作流。只有将大模型封装为医疗级智能体,对接院内数据源与业务系统,承接具体的临床任务,大模型蕴藏的技术价值才能够被完全释放。

依托「元智」医疗文本大模型,联影智能已经打造出多款落地见效的医疗智能体产品,例如:

核医学智能体让以往门槛较高的核医学诊断能力走向普惠。依靠影像+文本大模型,它拥有“看‑想‑写‑查”四大能力,可将PET/CT报告撰写时间由数小时压缩至十几分钟,缓解基层核医学人才短缺困境,该智能体目前已经落地全国200余家三甲医院。

电子病历智能体则重塑传统病历书写模式。依托「元智」医疗文本与语音大模型,自动将医患对话转为结构化文书。门诊病历撰写时长由5‑6分钟缩短至1‑2分钟,住院病历从20分钟缩减至5分钟,整体效率提升75%。截至2026年8月,该智能体已经落地复旦大学附属中山医院十几个科室,累计使用超2万例。

报告质控智能体充当医生的第二双眼睛,数秒即可完成影像报告分析,识别13种常见报告错误、提示14类危急值风险。2025 年全国智慧医保大赛中,联影智能质控解决方案从800余支参赛队伍中脱颖而出斩获一等奖。

从单一智能体走向全域布局,元场景重构未来诊疗流程

多款医疗智能体并不是独立运行的单点工具,它们共同依托「元智」大模型底座,向着放射、诊室、手术室、病房等全域医疗元场景延伸覆盖。

· 元放射场景下可完成辅助诊断、自动报告生成、多疾病筛查、全流程质控;

· 元诊室可实现预问诊、外院资料管理、实时生成门诊病历;

· 元手术室支持语音免手操控、术中语义理解与手术记录自动生成;

· 元病房落地患者跌倒监测、个性化健康宣教、病情动态预警。

智能体解决一个个具体临床任务,元场景重构整套诊疗流程,落地过程当中沉淀下来的真实临床数据又能够持续反哺模型迭代,形成“落地‑反馈‑优化”的正向闭环。面向长远,联影智能将继续迭代「元智」医疗多模态大模型,落地更多智能体产品,一步步推动“元医院”愿景落地现实。

综合本次榜单成绩不难看出,登顶医疗大模型排名前十只是一个阶段性成果,它印证了联影智能在医疗人工智能赛道沉淀已久的硬核技术实力。未来,联影智能将继续深耕医疗AI领域,坚守以临床需求为核心的技术路线,推动大模型与真实临床场景实现更深层次的融合,为国内智慧医疗行业的高质量发展持续贡献力量。

ad