第十二届中国健康信息处理大会(China Health Information Processing Conference, CHIP 2026)将于2026年10月30日-11月1日在辽宁大连举行。CHIP是中国中文信息学会医疗健康与生物信息处理专业委员会主办的“以信息处理技术助力探索生命之奥秘、提高健康之质量、提升医疗之水平”为主旨的年度会议。CHIP 2026官网地址:http://cips-chip.org.cn
中国健康信息处理大会自2018年以来每年都组织技术评测,本次CHIP 2026“评测二:医学NLP代码自动生成测评——识别符合临床试验纳排条件的患者”现已开启。本次技术评测共发布2项任务,其中“评测一:面向生物医学全文的特定患者表型概念识别任务”仍在火热评测中。获奖队伍需注册参加CHIP会议,进行口头汇报并撰写技术论文,欢迎广大研究者参与评测竞赛。
评测二:医学NLP代码自动生成测评 ——识别符合临床试验纳排条件的患者任务背景
识别符合临床试验纳入与排除条件的患者,是临床科研与决策支持的重要环节。相关条件涉及诊断、治疗、实验室检查等多类医学信息,需要从临床文本中提取信息并进行判断。将自然语言描述的临床需求转化为可运行的算法,是连接临床知识与软件系统的关键步骤,也对医学语义理解和代码生成能力提出了要求。
本次评测是CHIP 2025相关任务的升级,聚焦医学NLP代码自动生成。参赛团队根据临床纳排条件及对应的FHIR FSH定义生成算法,解析患者临床文本,并按HL7 FHIR标准组织和提交结果。任务探索大语言模型引导小语言模型的应用,通过代码运行、标准化数据查询和真实临床场景验证,考察自动生成算法在患者筛选中的应用能力。
任务亮点
面向临床纳排条件的代码生成:围绕17类、共48条临床纳排条件及51位患者数据开展评测,覆盖多种医学信息和不同难度的问题,考察从临床需求到患者筛选算法的转化能力。
符合FHIR标准的运行与查询:将算法按FHIR消息Bundle标准打包提交,结合代码运行、FHIR服务查询和患者匹配结果,考察生成算法的可执行性及筛选准确性。
真实医院场景的C榜探索:在A榜开发、B榜最终评测之外,新增由临床机构独立开展的C榜评测,将B榜最优算法以Docker容器形式部署至临床机构,探索真实病历上的应用效果。C榜本期不参与最终排名。
日程安排
报名时间 | 即日起—10月7日 |
训练数据发布 | 9月7日 |
A榜测试数据发布 | 9月7日 |
A榜结果提交截止 | 10月7日 |
B榜测试数据发布 | 10月8日 |
B榜结果提交截止 | 10月12日 |
C榜结果公布 | 会议期间 |
评测论文提交截止 | 10月20日 |
会议日期 | 10月30日-11月1日 |
评测入口
本次评测依托阿里云天池平台开展,评测网址:
https://tianchi.aliyun.com/competition/entrance/532480
任务详情及具体规则:
http://cips-chip.org.cn/2026/eval2
评测任务组织者
米岚 — 北京大学肿瘤医院
陶亮 — 上海商学院
宗辉 — 陆军军医大学第一附属医院
文栋 — 上海皓元医药股份有限公司
黄祥 — 锦欣生殖
汤步洲 — 哈尔滨工业大学(深圳)/鹏城实验室
李作峰 — 慧聚智真(上海)信息技术咨询有限公司
张晓艳 — 同济大学
钉钉群
欢迎加入任务交流钉钉群,讨论评测相关事宜。

钉钉群号:154880001500

评测一:面向生物医学全文的特定患者表型概念识别任务
任务背景
人类表型(Phenotype)是由基因型与环境共同作用形成、可在患者身上观察或测量到的临床特征,是罕见病诊断、疾病机制研究、基因发现和精准医疗的重要依据。随着生物医学文献的快速增长,如何从海量非结构化文本中自动抽取、标准化和组织患者表型知识,已成为生物医学自然语言处理领域的重要研究方向。
表型概念识别(Phenotype Concept Recognition)目标从生物医学文本中,自动识别出表型实体并将其链接至本体库(如人类表型本体HPO)中的标准概念,仍面临着诸多挑战。现有表型识别研究多聚焦于短文本中的所有表型概念识别,较少关注生物医学全文中特定患者的表型信息。实际文献往往同时描述多名患者或家系成员,不同个体的临床表现存在差异,且表型表达存在缩写、否定、复合等复杂现象。仅抽取通用表型实体难以满足患者画像构建、家系遗传分析及个体化医学研究的需求。因此,本评测聚焦“面向生物医学全文的特定患者表型概念识别”,旨在建立患者与表型之间的准确对应关系,为患者级知识库构建、基因型-表型关联等下游研究以及精准医疗应用提供技术支撑。
任务亮点
全文级表型概念识别:任务基于PMC公开生物医学文献全文开展评测,更贴近真实科研文本中的长篇幅、多患者和复杂表型表达场景。
复杂表型概念标准化场景:覆盖表型缩写、否定表型、复合表型等复杂情况,识别结果需标准化至人类表型本体HPO,综合考察复杂场景下模型的实体识别、语义理解和概念标准化能力。
特定患者表型抽取:任务不仅要求识别文献中的全部表型概念,还需进一步抽取特定患者的表型信息,可支撑患者个体化医疗分析。
日程安排
报名时间 | 8月20日-9月27日 |
A榜评测开始 | 8月20日 |
A榜评测截止 | 9月27日 |
B榜评测开始 | 9月28日 |
B榜评测截止 | 10月1日 |
评测论文提交截止 | 10月15日 |
会议日期 | 10月30日-11月1日 |
评测入口
天池大赛评测网址:
https://tianchi.aliyun.com/competition/entrance/532512
GitHub网址:
https://github.com/DUTIR-BioNLP/PatientPheX
评测任务组织者
组织单位大连理工大学 罗凌、王健、孙媛媛、林鸿飞
联系人
朱旋律(xlzhu@mail.dlut.edu.cn)
钉钉群
大赛官方钉钉群请扫码加入,最新通知将会第一时间在群内同步:
CHIP 评测主席
汤步洲,哈尔滨工业大学(深圳) 鹏城实验室
宗 辉,陆军军医大学第一附属医院
李作峰,慧聚智真(上海)信息技术咨询有限公司
点击“阅读原文”直达会议评测网址