8月底,古籍圈连着出了几件大事。
8月初,我国首个综合性科技典籍数据库在北京大学"识典古籍"平台上线,《天工开物》等首批1982部中华传统科技典籍可以在云端阅读。微博·北京日报这个平台自2022年启用,至今已将超7万部古籍数字化、免费开放。微博·首都广电几乎同一时间,《儒藏》"精华编"数字化平台也正式上线,510种儒学文献、两亿多字整理本可以在线阅读。微博·长安街知事关注古籍校勘的人应该明白这些数字的分量:免费古籍数字资源在这个夏天到了史上最充裕的状态。而更关键的是,资源开放的同时,"普通人参与古籍校勘"的入口也跟着打开了。
但入口里混着不少信息差。今天把它捋清楚:真心想参与的话,现在有两条路,门槛、干的活、拿到的东西完全不一样。
第一条路:零门槛的"校书官"志愿者
说的是识典古籍的"我用AI校古籍"。这个项目由全国高等院校古籍整理研究工作委员会主办,北京大学数字人文研究中心与字节跳动公益联合承办。微博·工人日报
先看规模:今年2月的总结会披露,已有3.7万人通过AI平台完成15亿字古籍粗校。微博·工人日报8月底的最新口径是,已有6000余个团队依托该平台开展古籍整理工作。知乎·餐观局今年4月,APP移动端校对功能也上线了,手机上就能参与。小红书·识典古籍
干的活比想象中简单:AI先对古籍原图做OCR,生成一版初校文字,志愿者要做的,是把这版文字跟原图比对,找出识别错的字、点错的句读——本质是"找不同"。不需要专业出身,上手教程官方都拍成了保姆级视频。

那能拿到什么?看社区反馈,这套激励做得很"游戏化":
积分制:攒校对积分,能换文创、冰箱贴、徽章,徽章分级,有人集徽章集上了头
署名:这个不是虚的。有网友去年参与整理的《鹤鸣集》上架平台时,被列入整理者名单。小红书·金正東UP
参与感:深圳有位在机场工作的00后,下班靠线上古籍校对解压,一坐下就停不下来。小红书·大米video

也有提醒:一位大二学生写过,她没系统学过古汉语,校对时遇到不少障碍,但觉得收获很大。门槛低是真的,想校得准,照样会撞上知识墙。
第二条路:《儒藏》全本招校点者,有专业门槛
这是夏天的另一条大新闻:北大《儒藏》工程为全本发布了校点者征聘说明。
先交代背景。《儒藏》是教育部2003年批准立项的重大课题攻关项目,2023年4月28日全本工作正式启动。微博·儒家网此前收书510种、近2亿字的"精华编"中国部分已全部出版,全本规模将在此基础上继续扩大。微博·北京日报

网上贴出的征聘说明里,条件写得很直白:门槛是文史文献相关硕士起步,有儒学古籍整理实绩可以酌情放宽。小红书·琴台钓叟全程在识典古籍整理平台线上完成,平台自带底本比对、异体字检索、句读标注功能,不用翻纸质书;校点成果署名出版,高校教师还可以申报古委会专项。
社区对这次征聘的反应挺有意思。有文献学学生翻了待整理书目,原以为都是稀见经学著作,结果看到了李白集、杜甫集这类已有纸本出版物的集子。这恰好说明:重大工程的"待校勘",不是"没人校过",而是需要按工程标准重新做一套校点成果。
先泼个冷水:这条路不是给纯爱好者"体验生活"的。硕士门槛、署名出版——这是专业劳动,不是公益体验。
三条边界,先划清楚
不管走哪条路,有三个边界要先分清。这不是劝退,是社区共识加上真实发生过的事:
边界一:粗校不等于精校。 志愿者做的是字句层面的纠错,属于校勘流程里的"初筛"。判断讹误该取哪个字、要不要改、依据是什么,那是专家做版本对校和考证、最后写成校勘记的活。别把粗校结果当成可靠文本直接引用,会翻车。
边界二:AI初校文字,要对原图。 现在AI的OCR和标点正确率已经不低,但异体字、形近字、避讳字这几类还是容易翻。识典社区今年4月讨论过部分图书看不到原图的问题——看不到原图时,文本的可信度就要打折。有条件的话,养成核对原图的习惯。
边界三:免费资源解决"读得到",不解决"是哪个本子"。 平台上每部数字化古籍都有它具体的底本,给的是阅读和粗校用的本子。想认真校一部书,终究要找别的本子对勘,要用到国图"中华古籍资源库"这类免费资源和出版社的付费古籍库——古籍库需要付费,检索是免费的。知乎·屠龙少年周旭免费资源省下的是入门成本,省不掉校勘本身的判断工作。

不同的人,不同的玩法
最后按人群拆开说:
纯兴趣、想杀碎片时间的: 走第一条路就行。每天校10分钟,攒徽章换冰箱贴,没有心理负担。记住自己做的是公益粗校,不是"学术研究",别给自己上强度。
文史专业学生: 第一条路是练手,平台的底本比对、异体字检索功能本身就是不错的训练工具;如果你是文献学方向的研究生,可以直接冲《儒藏》这类工程校点或学校古委会的项目——署名成果是硬通货。
手里已经有想校的具体的书: 先别急着报项目。用免费资源(识典古籍加国图古籍资源库)把版本源流摸清:这部书有哪些版本、底本在哪、对校本在哪。这一步做扎实了,再决定参不参加项目、参加哪个。

值得继续关注的信号:《儒藏》全本约三千种书的校点推进节奏,以及识典古籍专题库的上新速度——科技典籍、饮食文化之后大概率还会有新专题,每个新库上线,都意味着一批新校对任务开放。
关于《儒藏》工程,有个流传很广的说法:按1秒读1个字算,读完这部书要31年。校勘从来是慢功夫,但这个夏天的一系列动作,至少把慢功夫的入口修宽了。要不要进去走一段,看你图什么。