
EvaHan2026古籍多模态OCR国际评测研讨会将于2026年5月11日在西班牙马略卡岛召开的语言资源大会LREC 2026的子会议——LT4HALA 2026上隆重举行。
古籍是中华文明的载体,也是人类文明的珍贵组成部分。将海量古籍图像转化为可检索可计算的文本是古籍数字化加工过程中的关键一环。然而,古籍文档的版式多样、文字形态复杂,使得基于现代文档数据开发的OCR工具在处理古籍图像时往往难以达到理想效果。
EvaHan自2022年起,已先后在法国马赛(分词词性标注)、中国澳门(机器翻译)、意大利都灵(断句标点)及美国新墨西哥州(命名实体识别)成功举办了四届。2026年,EvaHan将目光转向更具挑战性的古籍多模态OCR与版面分析任务,力求建立高质量的数据集和评测基准。本次评测共有来自中国、法国等海内外高校与科研机构的41支队伍报名,13支队伍完赛。
PART1

会议日程

(注:以下为西班牙当地时间,北京时间已标注。)
开幕式:
14:00 – 14:03(北京时间:20:00-20:05)
特邀嘉宾讲话:
14:03 – 14:07(北京时间:20:05-20:35)
-
The Significance and Direction of Chinese Ancient Book OCR(中文古籍OCR的意义与方向)
著名计算语言学家 冯志伟 教授
评测总览:
14:07 – 14:22(北京时间:20:35-20:45)
-
Overview of EvaHan2026: The First International Evaluation on Ancient Chinese OCR and Layout Analysis(EvaHan2026评测总体情况报告)
南京农业大学 王东波 教授
口头报告 : 每篇4分钟
14:22 – 15:10(北京时间:20:45-21:10)
-
A Multi-Stage System for Ancient Chinese OCR and Layout Understanding in the EvaHan2026 Shared Task(古籍OCR与版面理解的多阶段系统)
KeYan Liang, Meiling Liu
-
A Multi-Modal Recognition Framework for Ancient Books Integrating DoRA-DPO Text Recognition and YOLO Layout Analysis(融合DoRA-DPO文本识别与YOLO版面分析的多模态识别框架)
Chaokun Zhang, Xin Wen, Tongtong Zhou
-
Enhancing Ancient Chinese Character Recognition and Layout Analysis via VLM Fine-Tuning and Linguistic Post-Processing(基于视觉语言模型微调与语言学后处理的古籍增强识别)
Yihuan Yin, Qian Zhao
-
A Dual-Modality Framework for Ancient Document Layout Analysis and Text Recognition(古籍版面分析与文本识别的双模态框架)
Qi Fan, Jieming Hu, Chen Ye
-
EvaHan 2026 Ancient Books Multimodal OCR and Layout Analysis System Technical Report(古籍多模态OCR与版面分析系统技术报告)
Chenrui Zheng
-
A Parameter-Efficient and Data-Centric Framework for Ancient Chinese Text(面向古籍文本的参数高效与数据驱动框架)
Yuchun Meng
-
LVLM Optimization for Ancient Chinese Book Image Analysis with Task-specific Augmentation and Instruction Tuning(基于任务增强与指令微调的大视觉语言模型古籍图像分析优化)
Xia Tian, Liu Yulong, Wang Yilin, Yang Yumeng, Cai Dongheng, Tan Yuyang,Yang Menghui
-
Data-Centric Strategies for Ancient Chinese Text Recognition: Augmentation, Annotation Refinement, and Style Transfer in EvaHan 2026(数据驱动策略:数据增强、标注优化与风格迁移)
Chengfei Li, Yunjie Zhang, Xiaoyi Li, Changshun Quan, Taihe Cao, Bin Liu
-
AnandaSky: A Vision–Language Model for Line-Level Transcription of Historical Sinographic Documents(面向历史汉字文档行级转录的视觉-语言模型)
Colin Brisson, Ayoub Kahfy, Frédéric Constant, Marc Bui
-
Multimodal Ancient Document Parsing: Technical Report for EvaHan2026 Competition(多模态古籍解析技术报告)
Liqi He, Qiwei Li, Ziye Yang, Zuchao Li
-
Multi-Task Learning Trade-offs in Vision–Language Models for Ancient Chinese OCR: An Empirical Analysis of Parameter-Efficient Adaptation(古籍OCR视觉语言模型中的多任务学习权衡:参数高效适应的实证分析)
Huizi Zhou, Yuhan Shu
-
Building Character(s): Synthetic Data and In-Context Learning Strategies for Few-Shot Ancient Chinese Recognition(合成数据与上下文学习策略在少样本古籍识别中的应用)
Denise Atzori, Marie Bizais-Lillig, Mathias Garnier, Maxime Létoffé, Charles Planque, Tianjie Yin, Chahan Vidal-Gorène
-
闭幕式
15:10 – 15:15(北京时间:21:10-21:15)
PART2

特邀嘉宾

著名计算语言学家 冯志伟 教授
冯志伟教授是我国著名计算语言学家、中国计算机学会高级会员、中国中文信息学会会士。先后在北京大学和中国科学技术大学研究生院两次研究生毕业,获双硕士学位。曾在法国格勒诺布尔理科医科大学应用数学研究所(IMAG)自动翻译中心(CETA)留学,后在德国夫琅禾费研究院(FhG)新信息技术与通信系统研究所、德国特里尔大学、德国康斯坦茨高等技术学院、韩国科学技术院(KAIST)电子工程与计算机科学系(EECS)、英国伯明翰大学担任高级研究员或教授,现为新疆大学天山学者。主要著作有《Forma Analysis for Natural Language Processing: A Handbook》、《自然语言计算机形式分析的理论与方法》《自然语言处理简明教程》《计算语言学方法研究》《数理语言学》《数学与语言》《机器翻译研究》《现代术语学引论》《现代语言学流派》《汉字》(英汉对照)等40部,主要译著有《自然语言处理综论》《统计语言学习》等3部,用中文、英文、法文、德文发表论文500多篇,主持研制国际标准(ISO)1项、国家标准(GB)1项、国家规范3项,参与研制国家标准(GB)14项。2006年获奥地利维斯特奖,2018年获中国计算机学会NLPCC杰出贡献奖,2023年获香港圣弗兰西斯科技人文奖。
PART3

会议信息

会议语言
英语
主持人
李斌 教授
主办团队
协办单位(排名不分先后)
中国人工智能学会语言智能专委会
中国中文信息学会青年工作委员会
中国古籍保护协会古籍智能开发与利用专委会
中国民族语言学会语言资源与计算人文专委会
江苏省人工智能学会自然语言处理专委会
中华书局 古联(北京)数字传媒科技有限公司
联系方式
-
邮箱:evahan2026@gmail.com
-
GitHub:https://github.com/GoThereGit/EvaHan
PART4

直播地址

直播地址请关注比特人文公众号后续推文。

= END =
比特人文
投稿邮箱:dhbase@126.com
扫码关注 获取更多资讯
