今夏三个"免费古籍"数字:16万影像、7万部全文、1.3万种AI句读,用途不同别搞混

源自135位全网作者

08:37

今夏三个"免费古籍"数字:16万影像、7万部全文、1.3万种AI句读,用途不同别搞混

七到八月,"古籍免费读"的消息一条接一条:全国首个体育古籍专题数据库上线、1982部科技典籍搬上云端、196部饮食典籍聚成专题,每一波都自带热搜体质。抖音上"典籍里的美食"话题十天播放量超1800万,小红书里免费书库合集帖动辄上千收藏。知乎专栏小红书

热闹背后是一个很多轻度古籍爱好者都踩过的坑:这些"免费"根本不是同一种免费。有的给你看宋版书的原书影像,有的给你能复制检索的整理全文,有的给你AI自动加标点的加工文本——找错平台,轻则查不到东西,重则论文里引错字。

第一个数:16.1万部/件——看到的是"书的样子"

国家图书馆牵头的古籍数字资源联合发布已经做了十一次。2025年12月30日第十一次发布后,全国累计发布古籍及特藏文献影像资源超16.1万部/件,其中国家图书馆"中华古籍资源库"超10.7万部/件,49家收藏单位合计超5.4万部/件。新华网

注意关键词:影像。这些是经过普查、编目、扫描的古籍书影,好处是版本绝对可靠,你能看到原书版式、题跋、藏印,甚至这次新增的620种河南石刻拓片;澳门也首次发布了何东藏书楼等馆藏中外文古籍404种,含嘉业堂旧藏。新华网 但书影本质上是高清照片:不能复制文字,不能全文检索,查一个词只能一页页翻。适合校版、看刻本、练书法的人,不适合想快速查资料的读者。

第二个数:7万部——能搜、能复制的整理全文

字节跳动联合北京大学数字人文研究中心做的识典古籍,截至2026年7月已免费公开超7万部古籍,6000多个团队依托它做整理。知乎专栏 这一类平台的价值在"全文":文字已经过OCR识别和整理,支持检索、复制、加笔记,还配了文白对照。

最近两个月它连续开专题库,节奏很说明问题。7月14日,识典古籍联合北京体育大学上线"中国体育古籍数据库",《蹴鞠谱》《丸经》归入球类专题,这是全国首个聚焦古代体育古籍文献的专题数据库。光明网

8月初,识典古籍上线综合性科技典籍数据库,《天工开物》等首批1982部中华传统科技典籍可在云端阅读。知乎 8月31日,识典古籍又与华中师范大学历史学院姚伟钧团队共建"食典汇藏"饮食典籍库,收先秦至明清196部文献,并用大模型挖出2.7万余条美食知识点。知乎专栏

这类垂直库的思路对内容创作者特别友好:古籍里本来没有"体育""美食"这种门类,文献散在经史子集各部,专题库等于替你做了第一轮选目和分类。此前平台还上线过东亚汉文数据库、中华女子艺文数据库、巴蜀历代方志库。做饮食溯源、写节令考据的博主,从知识点回到原典,比自己在影印库里盲翻快一个数量级。

第三个数:1.3万余种——AI句读,是草稿不是定稿

同样是国图牵头的"中华古籍智慧化服务平台",联合全国180余家古籍收藏单位,已发布1.3万余种、14万余册数字资源,主打自动句读、文白对照翻译、AI助手问答、划词查询、版本比对。新华网

但必须泼一盆冷水:自动句读是机器初加工,不是校勘定本。B站上已经有文史用户做"双平台校对"实录,用看典古籍和识典古籍互相对校《南斋词》,评论区对OCR错字、误标点的吐槽从没停过。哔哩哔哩 知乎上有编辑专门写古籍表格里"三行小字跨三叶"的排版修复难题。AI给的文本拿来当检索入口、当通读草稿没问题,正式引用必须回核原书影像或中华书局这类整理本,否则你把AI的错字也"整理"进了自己的文章。

一张对照表:你的场景决定你进哪个门

  • 只是通读原典、查典故、做笔记:识典古籍这类全文平台,能搜能复制;

  • 查特定主题(美食、体育、科技、方志):先看对应垂直专题库,选目和分类已经做完;

  • 写论文、做研究、要引文:AI句读平台当线索,结论回到纸本点校本或书影;

  • 看版本、赏刻本、练书法:中华古籍资源库影像,以及哈佛燕京图书馆捐赠汉籍这次已以"影像+全文转换数据"形式数字回归,海外珍本第一次不用出国门就能看。新华网

  • 想参与整理本身:识典古籍支持团队入驻认领任务,6000多个团队已经这么玩了。

接下来盯什么

国图联合发布基本按年初节点滚动,第十二次发布量级值得等;识典的专题库从体育、科技一路铺到饮食,下一批大概率还是"生活史"方向;二十四史修订本已出到第15种《晋书》,纸质整理和数字平台互为表里的日子还长。

一句话收束:16万、7万、1.3万这三个数都真,但"免费"的成色完全不同——影像给你底本,全文给你效率,AI给你草稿。分清用途再收藏,否则收藏列表吃灰的又是你。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章