近日,第二十五届中国计算语言学大会技术评测(CCL26-Eval)顺利完成,实验室组织了“任务2:非字面义翻译和理解评测”,受到国内外学者的广泛关注和参与。
任务背景
成语、习语、谚语、俚语和典故等非字面表达,往往需要结合文化知识、语境信息和语用功能进行理解。大语言模型在处理这类表达时,仍可能出现逐词直译、文化对应不准确和语用色彩缺失等问题。为提升大语言模型对非字面语义的理解与生成能力,本评测任务设置非字面义翻译与理解评测,为参赛队伍提供统一的测试场景,鼓励参赛者通过策略微调、提示工程等技术路径,引导模型识别目标语言中的习语、谚语及其他约定俗成的等值表达,增强模型的跨语言文化映射和语境推理能力。
任务设置
本次评测设置以下两个子任务:
子任务1:非字面义翻译。要求模型将中文非字面表达转换为自然、地道的英文等值表达,并优先使用英语中的习语、谚语或固定表达;
子任务2:非字面义理解。要求模型从多个英文候选中识别与中文表达构成公认等值关系的全部选项,同时区分等值表达、解释性改写和干扰项。
评测数据覆盖谚语、成语、习语、俚语和典故等类型,共约5,335条样本。
组织情况
评测组织者:张冬瑜教授、林鸿飞教授、博士生杨森淇、硕士生李文成、硕士生李浩嘉、硕士生姜亦凡
任务联系人:博士生杨森淇(ysq1997@mail.dlut.edu.cn)
项目仓库:https://github.com/DUTIR-YSQ/CCL2026-Non-literal-Translation-Task
参与情况
本次评测吸引了来自清华大学、中国科学技术大学、西安交通大学等高校的99支队伍报名。获奖队伍如下:
奖项 | 获奖团队 |
一等奖 | 齐鲁师范学院人工智能教育研究院团队 |
二等奖 | 北京交通大学计算机科学与技术学院、 新译科技有限公司团队 |
三等奖 | 郑州大学计算机与人工智能学院团队 |
评测获奖队伍由中国中文信息学会颁发官方荣誉证书。评测的总结论文和优秀技术报告将被CCL Anthology和ACL Anthology收录。