学者要读懂残断的竹简文献,得先有人找出哪些残片原本相连。2026 年 3 月 6 日发表于 Nature Communications 的研究介绍了 WisePanda,将 AI 引入这项搜寻工作。它为候选缀合排序,交给专家一组范围更小的残片,逐一核验。[1]
这里的区分关系到研究的基础。句子在文意上是否衔接得通,与残片在实物上能否可靠缀合,回答的是两类问题。对于由散落残片拼缀的竹简文献,判断一片在何处结束、另一片从何处开始,本身就是学术研究的一部分。机器若要发挥作用,就应让学者更容易检验这些判断。
让模型学习竹材如何断裂
武汉大学 3 月 23 日的中文报道指出,模型训练面临一个长期难题:已确认能够缀合的残片对十分稀缺,因为找出这些配对本就要耗费大量专业人力,而模型的目标恰恰是节省这部分劳动。研究团队汇集了人工智能研究人员与该校简帛研究中心的学者。[2]
团队从材料本身着手。研究者先模拟裂纹在竹纤维中的扩展,再模拟埋藏环境如何侵蚀断缘。这些模拟生成了成对的训练样本,供神经网络学习区分有望缀合的残片与互不相关的残片。武汉大学的报道将系统输出描述为面向简牍研究者、按次序排列的缀合建议。[2]
可以把这类模拟理解为给模型编制练习题。即使模拟了断缘的劣化,研究者仍能确定哪两条人工生成的断缘原本相接。模型由此得到一类很难从考古发掘中大批量取得的样本:残片之间的关系已经明确。考古研究仍要追问,从人工断裂中学到的规律,遇上真实文物后是否依然适用。
跨学科合作也是方法的一部分。武汉大学的报道提到,简牍学者处理残片藏品的经验,以及对实物的细致观察,为断裂力学研究带来了依据。[2] 在这项应用中,早在模型接受评估之前,专业知识就已参与决定训练样本应当是什么样子。
实用的输出是一份候选短名单
公开代码仓库展示了具体的使用流程:系统将一块目标残片与候选残片逐一比较,再在界面中显示排序结果,通常列出 50 项建议,供专家核验。软件包含选择、比较、核验功能,也设有示例数据导入流程。[3]
这样的设计有实际用途。假设一块值得进一步核对的对应残片排在第五位,研究者可以将它与目标残片比较。即使前四项建议都被排除,工具仍有助于这次搜寻。它的价值来自搜寻顺序的安排,前提是排序能让足够多真正值得核验的候选进入学者视野。
这也改变了评价成效的方式。即使首项建议有误,一个能帮助学者在检查数次后找到对应残片的系统,仍可发挥作用。反过来,首项建议看起来很有说服力,本身能说明的也有限:正确的对应残片须包含在候选集中,学者也须能够核验这次缀合。代码仓库对比较功能的重视,给使用者留下了作出专业判断的空间。[3]
候选残片越多,检索结果越不同
论文中的 Bamboo236 测试集收录了睡虎地 77 号墓出土汉代材料中的 118 对经专家核验的残片。WisePanda 的 Top-50 准确率达到 91.81%。加入 1,114 块干扰残片后,测试集扩展为 Bamboo1350,论文报告的 Top-50 结果降至 52.54%。这些都是针对特定候选集的检索成绩:正确的对应残片出现在前 50 项建议中的任意位置,即计为命中。[1]
两个百分比衡量的都是检索命中情况,与自动复原率有别。候选残片增加后,原有缀合关系仍然成立,只是正确配对更难被检索出来。放到实际馆藏中,真正要衡量的是这份排序替学者省下了多少核验工作。
论文还指出,较为平直的断缘难以匹配,因为其几何形态缺少可供区分的特征。系统的主要组件处理的是横向断裂;文字的连续性以及其他线索,仍是扩展这一方法的重要方向。[1]
从缀合到释读
Yiran Rex Ma 在 2026 年 1 月的一篇立场论文中,将残片缀合放入更完整的研究流程,与图像修复、文字识别、断代和阐释相连。文章认为,即使各项独立的计算任务有所进展,AI 的能力与学者提出的综合性研究问题之间仍有距离。这篇文章提出了一套研究议程,并未独立验证 WisePanda。[4]
顺着这一区分,下一步可以检验得更具体:追踪系统提出的缀合建议,看哪些得到专家认可,哪些进入有据可查的简牍复原成果。接受与驳回的建议都应记录,并统计每次作出判断所花的时间。这样,检索分数才能与系统希望改善的实际工作联系起来。
在这样的工作尺度上,WisePanda 的贡献最为清楚。它为学者提供了一种办法:少花些精力遍寻整批藏品,把更多注意力留给那些有望相接的残片。历史释读从这些相邻残片开始,后续的解释仍须经过论证。
来源
- Jinchi Zhu 及同事,《以物理驱动的深度学习缀合古代竹简残片》,Nature Communications 17, 3550(2026 年 3 月 6 日)。已发表的评估结果、文物来源与局限。
- 武汉大学,《跨学科团队在文化遗产数字化保护方面取得进展》(2026 年 3 月 23 日,中文一手报道)。训练数据生成方法及与简牍学者的合作。
- Jinchi Zhu,WisePanda 公开代码仓库。README 与软件使用流程,查阅于 2026 年 9 月 27 日。
- Yiran Rex Ma,《迈向计算中国古文字学》,arXiv:2601.06753v2(2026 年 1 月 29 日)。探讨计算任务与学术研究关系的立场论文。
- Gary Todd,《秦简上的〈秦律十八种〉》,2010 年 12 月 3 日摄于湖北省博物馆。Wikimedia Commons 照片记录;CC0。