学校在CCL 2026中文信息处理系列评测中获佳绩
近日,第二十五届中国计算语言学大会(CCL 2026)系列评测结果公布,人工智能教育研究院“所以然团队”获三项大奖:非字面义翻译和理解评测一等奖、中文电子病历疾病与手术ICD自动编码评测一等奖、第二届古诗词赏析评测二等奖。两篇技术报告被评测论文集录用。
该会议由中国中文信息学会主办,是中国计算语言学领域规模最大的学术会议,将于2026年10月15日至18日在湖北宜昌举行,届时对获奖项目和团队等进行颁奖。CCL26-Eval共设14个评测任务,涵盖语义分析、医疗与教育应用和大模型核心能力等方向,吸引国内外数百支队伍参赛。
非字面义翻译和理解评测聚焦成语、谚语、典故等表达,要求模型把中文非字面表达翻译为英语,并选出目标语言中约定俗成的文化等值表达。所以然团队以开源大模型为基座,把参数高效微调与偏好优化结合,使输出与官方评测指标对齐,A榜、B榜成绩分别为0.8589和0.8510,荣获一等奖。

所以然团队非字面义翻译和理解评测技术方案

CCL26-Eval 非字面义翻译和理解评测获奖名单
中文电子病历疾病与手术ICD自动编码评测要求模型从10个临床科室的3000条脱敏病历中,预测主要诊断、主要手术及辅助诊断、辅助手术编码。团队提出中文标签空间微调与共现后处理方案,把ICD编码映射为中文名称,压缩长病历的关键字段,并以多模型分工预测和规则校正降低误判,在官方测试集上取得0.9484的总成绩,荣获一等奖。

所以然团队中文电子病历疾病与手术ICD自动编码评测技术方案

CCL26-Eval 中文电子病历疾病与手术ICD自动编码评测获奖名单
第二届古诗词赏析评测在模型参数不超过10B、每项任务仅有20至164条训练样本且禁止检索增强生成的约束下,考察字词注释、诗句今译、情感判断、典故识别、类比填空与赏析辨析六项能力。团队按任务训练LoRA专家模型并做体裁感知路由,同时扩充训练数据,取得约0.808的成绩,荣获二等奖。

所以然团队第二届古诗词赏析评测技术方案

CCL26-Eval 第二届古诗词赏析评测获奖名单
上述成果依托团队在大模型后训练技术上的持续积累。团队在偏好对齐、中文标签空间映射、小样本专家编排等方面的探索,与大模型后训练研究的前沿方向一致。评测技术报告将随评测论文集被ACL Anthology收录,展示学校在中文信息处理领域的科研实力。
学校将继续围绕“人工智能赋能教育”主线,以评测检验技术、以竞赛锤炼队伍,把沉淀的关键技术转化为教学与科研生产力,为国家教育数字化战略贡献更大力量。
供稿审核:刘斌
审稿、编辑:侯伟、张淑芬
终审:孙磊
