首页 / 知识百科列表 / 登顶MedBench!联影智能刷新医疗文本大模型成绩
登顶MedBench!联影智能刷新医疗文本大模型成绩
2026-08-06

 近日,联影智能自主研发的通用医疗文本大模型UII-L1-1.0在MedBench最新评测中以73.8分的综合高分取得榜单第一。

 

 MedBench由上海人工智能实验室等机构搭建,是中文医疗人工智能领域最具权威性和公信力的评测平台之一。本次版本评测围绕医学知识问答、医学语言理解、医学语言生成、复杂医学推理和医疗安全伦理五大维度,设置36项纯文本医学任务,累计收录约70万条数据。

 本次评测结果显示,UII-L1-1.0在36项纯文本任务内的15项任务中斩获榜单最高分。在医学知识理解、诊疗逻辑判断维度,模型优势显著,代表性任务为MedHG导诊(90.6分,领先次席8.1分)、MedRxPlan个性化用药指导(80.8分)、MedHC健康咨询(74.3分)与MedLitQA文献问答(73.8分)。

 

 UII-L1-1.0在36项纯文本任务内的15项任务中斩获榜单最高分

 这份亮眼成绩的背后,是一套超百亿级token(词元)规模的系统化医学语料工程。模型不仅通读了全量医学文献与国家级医学教材,还接入了超2.6万份覆盖30余个临床专科的诊疗指南,以及NICE、WHO、CDC等国际权威循证资源,构建起中英文双语的「指南级」知识底座,为其扎实的专业能力打下坚实基础。

 

 医疗场景对人工智能的安全性和严谨性提出了更高要求。不仅需要输出准确结果,更需要确保分析过程符合医学规范。

 这也是医疗大模型面临的重要挑战:针对同一道医学问题,模型可能给出正确答案,但支撑答案的分析路径未必符合规范的临床逻辑。在真实诊疗场景中,「结果正确但过程不规范」仍可能带来潜在风险。

 针对这一行业难题,联影智能L1级医学通用大语言模型UII-L1-1.0引入过程监督机制,将模型优化重点从「结果正确」进一步延伸至「逻辑合规」。

 

 目前,UII-L1-1.0已展现出在复杂病例病史梳理、诊疗计划制定、多学科医学知识推演等场景中的应用潜力。

 凭借医疗人工智能领域的长期积累,联影智能持续拓宽医疗大模型能力边界。此次UII-L1-1.0登顶MedBench纯文本医学评测榜单,印证了联影智能在医疗文本理解与推理领域的成果与积淀。此前,联影智能「元智」医疗影像大模型入选国家人工智能应用中试基地五大代表性成果、「元智」医疗视频理解大模型面向全球开源,也充分彰显了其在多模态医学大模型赛道的综合技术实力。

 未来,联影智能将持续推进通用医学大模型与多元临床工作流的深度融合,为复杂临床决策提供可追溯、符合规范的智能化支撑,以硬核AI技术助力医疗行业的高质量数智化转型。

阅读 0
Copyright@2023 United Imaging Intelligence.ALL Rights Reserved.
沪ICP备2021013738号