金连文在第二届CCF人文智能大会上分享了团队古籍OCR研究成果:研发的通古OCR大模型覆盖3.4万余字符类别、600余万样本,支持七类书体,通过版面感知智能分块、小模型识别加大模型后纠错及异体字保护机制,识别准确率超过现有方法,并已上线古籍OCR实时演示系统。