很多人第一次听说识典古籍,是因为它"永久免费、没有广告";真正让它跑起来的,却是藏在阅读界面背后的那一整套 AI 能力。识典古籍的定位是"古籍智能整理数字化平台"——"智能"二字不是装饰,而是这个平台得以成立的前提。本文只依据可核验的公开信息,从底层技术讲到阅读端体验:OCR 文字识别、自动标点、命名实体识别这三项基本功,AI 译文、AI 朗读与播客、AI 助手与"深度研究助手"这些读者能直接感知的功能,以及它们各自的边界。既不把 AI 说成万能,也不因为它是机器就轻视它。
核心要点
- 识典古籍由北京大学—字节跳动数字人文开放实验室研发,定位"古籍智能整理数字化平台",AI 是它的底座而非附属功能。
- 三项底层能力与公开口径准确率:文字识别(OCR)96%–97%(行业平均约 93%–94%)、自动标点 94%、命名实体识别接近 98%。
- 阅读端可感知的 AI 功能:AI 译文 / 文白翻译(覆盖超 1 万部古籍)、AI 朗读与听书(依托火山引擎智能语音,支持超 700 部古籍)、AI 播客讲解、AI 助手与实体百科。
- "深度研究助手"据公开信息于 2025 年 10 月基于豆包大模型上线,面向阅读与研究场景。
- AI 产出的是"整理稿"而非"定本":平台走 AI 整理 + 众包校对 + 专家参与的路线,个别书籍可能仍有疏漏,可对照原图核对。
- 读可以放心用,引用则建议核对权威点校本或影像底本;涉及学术结论,以专家与官方说明为准。
为什么说它本质是一个"AI 古籍平台"
要理解识典古籍的 AI,先要看它面对的问题有多"硬"。中国古籍数量庞大,且多以影印或扫描图像存在:竖排繁体,异体字、避讳字、古体俗字层层叠叠,还夹杂虫蛀、漫漶、断版与眉批夹注。传统做法是学者逐字辨认、手工录入、再断句加标点,一部中等规模的典籍就可能耗去数月。不是不想做,而是人力成本把速度卡死了。
识典古籍的解法,是把能交给机器的部分全部交给机器。据公开信息,2022 年 3 月,字节跳动与北京大学合作成立"北京大学—字节跳动数字人文开放实验室",由北京大学数字人文研究中心提供学术指导与古籍图文数据,字节跳动提供技术与资金支持。2022 年 10 月 11 日网页版测试版上线,首期整理上线《四部丛刊》等 390 部经典古籍、共 3000 余万字,免费开放。此后规模持续增长,据公开信息,2026 年初权威口径约为累计上线 4.7 万部古籍。该数字仍在增长,以官方页面实时显示为准。
这个平台的能力也远不止"做一个阅读器"。它把整条生产线放进同一套系统:图像切分与文字识别、自动标点、实体提取、自动结构整理、自动校勘、自动文言文—白话文翻译被串联起来,再接入公众众包校对与专家把关。所以说它本质上是"AI 古籍平台",意思并不是"它有很多 AI 功能",而是内容本身就是 AI 生产出来的:你读到的每一行标点齐整的正文,背后都经过了一轮机器处理。
三大底层技术:OCR 文字识别、自动标点、命名实体识别
把这条流水线拆开,最核心的是三项能力。它们构成古籍从"图像"走向"文本"的第一段路,也决定了后续所有功能的成色。
| 技术能力 | 它到底在做什么 | 公开口径的准确率 | 对读者意味着什么 |
|---|---|---|---|
| 文字识别(OCR) | 把古籍影印版图像切分后,逐字识别为可检索的数字化文本 | 96%–97%(行业平均约 93%–94%) | 你能"搜索"一部古书,而不只是"看图片" |
| 自动标点 | 通过序列标注,为原本没有标点的古籍自动断句、加上标点 | 94% | 读起来不再是密密一片,断句有了基本参照 |
| 命名实体识别 | 识别文本中的人名、地名、书名、时间、官职等专名 | 接近 98% | 人名地名可被标注,进而延伸查阅背景 |
先说文字识别。古籍 OCR 与识别印刷体文档完全是两件事:竖排无空格、异体俗字极多、破损页面可能大面积残缺。平台先对影印图像做切分,再逐字识别,据公开信息准确率为 96%–97%,行业平均大致在 93%–94% 一线。几个百分点看似微小,放到一部十万字的书里就是数千字的差别——这正是后面必须引入"校对"的原因。
再说自动标点。古籍原文大多无标点,而标点本身就是一种"理解":同一个字串断在不同位置,意思可能完全不同。平台以序列标注实现自动断句加标点,公开口径准确率为 94%。一个常被引用的例子是《论语》开篇,自动标点结果为"学而时习之,不亦说乎?"。看上去理所当然,机器却要识别虚词的句末功能、判断问句语气、认出"不亦……乎"这类固定句式。94% 的含义是:大部分断句是对的,仍有一小部分需要人复核。
第三项是命名实体识别,公开口径准确率接近 98%,三者中最高。它把文本里"谁、哪儿、哪本书、什么官、什么时候"这些专名挑出来,是后续一切"知识化"工作的入口:只有先抽出实体,才谈得上配百科条目、画关系图、做跨文献关联。整理平台还整合了自动结构整理、自动实体提取、自动校勘,以及依托火山引擎方舟 MaaS 平台的自动文言文—白话文翻译。
- OCR(光学字符识别)
- 把图片中的字形转换成机器可处理的字符编码,是古籍数字化的第一步。
- 序列标注
- 为字序列的每个位置打上标签(如"句读点在此处"),自动标点正依此思路实现。
- 命名实体识别
- 从连续文本中定位并归类专有名词,如人名、地名、书名、时间、官职。
- 校勘
- 比对不同版本、判断文字异同与是非,是传统古籍整理的核心功课之一。
从"图像"到"知识":AI 如何把古籍变成可检索文本
把三项技术串起来,一条清晰的处理链条就出现了,大致可分四步:一是图像切分,按版面把整页影印图切成可处理单元;二是文字识别,把字转为文本;三是断句标点,让无标点原文变得可读;四是实体与结构提取,认出专名、划分篇章层级。走完这四步,一部古籍才真正从"一张张图"变成"可搜索、可统计、可关联的文本"。
这一步的意义比看上去更大。数字化之前,检索古籍只能靠"引得"——上一代人手编的索引,翻检一页要花许多时间。据公开信息,识典古籍的努力被视为延续 1930 年代洪业"引得编纂处"确立的传统:"可检索、可验证、可复用"。今天在检索框输入一个词就能定位到出现在哪部书、哪一卷,背后就是这条链条在支撑。平台支持按书名、作者、关键词、主题词检索,支持"搜全文、搜古籍",也支持分词检索。
再往前一步,是"知识图谱"。文本检索解决"这句话在哪本书里",知识图谱想解决"这个人和那个人是什么关系、这本书被谁引用过"。它把实体当作节点、把实体关联当作边,织成一张可浏览、可追问的网络。据公开信息,北大数字人文研究中心亦推进古籍知识图谱相关工作,例如《宋元学案》知识图谱可视化系统。其价值在于把"读书"从线性翻页变成可横向漫游的地图——你不必知道该翻哪一卷,沿着关系就能走过去。
需要保持清醒的是:知识图谱的成色取决于实体识别与关系抽取的准确率。它擅长提示"可能相关的线索",而不是宣布"确定的结论"。把它当导航,而不是当判词,才是它最合适的位置。
阅读端的 AI:文白翻译与 AI 译文
对普通读者来说,最容易直接感受到的 AI 功能是译文。文言文到白话文的距离,是多数人读古籍的第一道坎:实词意思变了、虚词功能复杂、省略成分多、典故密集,往往读三行就卡住。识典古籍的办法是"文白对照"——一句原文配一句白话译文,可一键开关。想先自己试读就关掉译文,卡住了再打开对照。据公开信息,文白翻译已覆盖超 1 万部古籍,自动文言文—白话文翻译依托火山引擎方舟 MaaS 平台实现。
这种设计的巧妙处,在于它没把译文做成"正文",而是做成"另一条轨道"。原文是权威的,译文只是辅助;两者并排呈现,读者随时能回到原文,不会产生"读的是别人转述"的错觉。配合阅读页已有的原图对照——点原图图标即可查看古籍影印底本——你甚至能形成"影印原貌 → 标点原文 → 白话译文"的三层对照。
也要理解它的局限。文言文里有许多"歧义句",学界的理解本身就不统一;有些虚词在特定语境中只有微妙的语气差别,译成白话难免丢失层次。因此平台的译文更适合理解为"AI 给出的一个读法"——它大幅降低了入门门槛,却不该替代注疏与专业研究。把阅读页提供的注疏展开 / 收起、生僻字词释义与译文配合起来,才是更稳的读法。
听得见的古籍:AI 朗读与古籍播客
如果说译文是把古籍"翻译"给现代人,语音功能就是把古籍"读"给现代人。据公开信息,识典古籍 App 的亮点功能包括 AI 朗读、AI 播客讲解与听书,其中听书依托火山引擎智能语音,已支持超 700 部古籍的原文与译文。原文与译文都能听,这点很关键:先听一遍白话译文听懂内容,再切回原文听一遍,让耳朵熟悉文言文的节奏与语感。
这类功能解决的是一个很现实的场景:眼睛被占住时怎么读书。通勤路上、跑步机上、做家务时,屏幕空不出来,耳朵却是自由的。古籍篇幅长、节奏慢,恰好适合"听"这种低强度、可持续的输入方式,对想培养文言文语感的人尤其友好。
至于 AI 播客讲解,它和"朗读"不是一回事:朗读是把文本念出来,讲解则偏向"带着你聊",围绕一部书或一个话题组织内容。据公开信息,AI 播客属 App 端的 AI 功能之一,平台在大模型方面的积累也体现在"深度研究助手"等产品上。需要提醒的是,语音类功能的支持书目、音色与表现形式属易变信息,会随版本更新变化,具体可用范围请以官方说明为准。
AI 助手与"深度研究助手":让提问变成检索
如果说前面几项功能是把书"呈现"给你,那么 AI 助手这一层,开始尝试回应你的具体问题。据公开信息,识典古籍 App 的亮点功能包含 AI 助手;更受关注的是"深度研究助手"——据公开信息,该功能于 2025 年 10 月基于豆包大模型上线,面向更"重"的使用场景:不是查一个词,而是围绕一个问题、一个主题,在平台已有古籍资源里寻找线索。
这类助手与普通问答最大的不同,在于它站在一个巨大语料之上。识典古籍已累计上线数万部古籍(据公开信息,2026 年初权威口径约 4.7 万部),并支持全文检索与分词检索。因此研究型助手的合理做法是先落到文献、再给出回答:指向具体书目与篇章,让回答可被追溯、可被核对。这种"回答带出处"的思路,与古籍研究"凡立论必有据"的传统一致——研究者最怕的不是不知道答案,而是得到一个查不到来源的答案。
使用时不妨养成几个习惯。第一,把回答当"线索清单"而非"结论":它指出"这些话可能出现在这些书里",接下来仍要打开那几部书读上下文。第二,留意它引用的具体篇章,回到原书确认字句与语境,尤其区分同一段话的不同版本。第三,涉及学术判断、版本取舍、真伪考辨,仍要以专家与官方说明为准。AI 擅长的是把"在哪儿找"变快,而不是替你完成"该怎么判断"。助手的交互方式与可用功能会随版本迭代,以官方实际提供的为准。
实体百科与实体关系图:把古文读成一张知识网络
阅读页里还有一个常被低估的 AI 功能:实体百科与实体关系图。平台会把人名、地名等实体标注出来,点开可延伸了解背景,也可查看它与其他人、地、书之间的关系图谱。前面提到命名实体识别公开口径准确率接近 98%,这项能力正是它落到读者眼前的样子。
它解决的是阅读中一种典型的困扰:不知道这个人是"谁"。古籍里的人物常以字、号、谥号、官职、籍贯相称,同一人在不同篇章可能有好几种叫法。以往读者只能停下来另查工具书,思路一断往往就读不下去;有了实体标注与百科条目,这一停顿缩短成一次轻点。
关系图则更进一步。当实体连成网络,一部书里的人物谱系、师承脉络、交游往来就有了可被"看见"的形状,散落在几十卷里的关系被压缩成一眼能扫过的一小片图。它不是替你读书,而是帮你不迷路。当然,关系图同样依赖抽取准确性,图中关联应理解为"文献中可查证的关联",而不是对历史事实的最终裁定。
AI 的边界与使用提醒
把功能讲完,也要把边界讲清。识典古籍的文本是"AI 整理 + 众包校对"的产物:AI 先完成初筛,志愿者对照底本逐字校对、处理疑难,整理平台支持多团队协同,专家再参与把关。这套组合极大提升了速度与规模,但也意味着一件事:它是整理稿,不是经过完整三审三校的定本,个别书籍在某些字句上可能仍有疏漏。
| 场景 | AI 的表现 | 建议怎么做 |
|---|---|---|
| 快速了解一部书讲什么 | 很擅长:译文与标点已足够把大意跑通 | 放心用,先读通再深究 |
| 查找某个词出现在哪些书里 | 很擅长:全文检索与分词检索 | 放心用,作为线索入口 |
| 认识人物、地名、官职 | 擅长:实体标注、百科与关系图可参考 | 可作导航,结论仍看文献本身 |
| 核对具体字句的写法 | 可能有疏漏,个别书籍存在识别或断句问题 | 打开原图对照,核对影印底本 |
| 学术引用与版本判断 | 不适用:不能替代权威点校本与专家考订 | 核对权威点校本或影像底本,以专家与官方说明为准 |
顺着这张表,可归纳出三种习惯。第一,善用原图对照:点开原图图标,把整理后的文本与影印底本并排查看,凡让你起疑的字句,看一眼原图往往就有答案。第二,把 AI 译文与标点当"参考读法":标点准确率 94%、OCR 为 96%–97%,都不低,但都不是 100%。第三,不把 AI 输出当专业意见:涉及版本、真伪、训释的判断须由专家做出,内容状态也请以官方最新说明为准。AI 的角色是把门槛降下来、把速度提上去,而不是把判断权接过去。
AI 功能常见问题(FAQ)
识典古籍有哪些 AI 功能?
分两层。底层是三项基本能力:文字识别(OCR)、自动标点、命名实体识别;阅读端可直接用到 AI 译文 / 文白翻译、AI 朗读与听书、AI 播客讲解、AI 助手、实体百科与实体关系图。据公开信息,"深度研究助手"于 2025 年 10 月基于豆包大模型上线。具体可用范围以官方版本为准。
OCR 文字识别准吗,准确率是多少?
据公开信息,识典古籍的文字识别准确率为 96%–97%,行业平均约在 93%–94% 一线。古籍是竖排繁体、异体字多、版式复杂,识别难度远高于普通印刷文档。准确率虽高仍会残留少量错字,因此平台以 AI 整理加众包校对的方式来复核。
自动标点会不会断错句?
有可能。自动标点公开口径准确率为 94%,即绝大多数断句合理,仍有一小部分需人工判断,尤其是歧义句与特殊句式。例如《论语》开篇,自动标点为"学而时习之,不亦说乎?"。遇到读起来别扭的断句,建议打开原图对照,参考底本与注疏。
AI 译文能替代权威译注吗?
不能。AI 译文适合帮你把难句读通、快速把握大意,据公开信息文白翻译已覆盖超 1 万部古籍。但文言文存在多解,译文只是其中一种读法。若要引用、写作或做研究,应回到原文,并核对权威点校本或影像底本,以专家与官方说明为准。
AI 朗读和听书是真人配音吗?
属于 AI 语音合成。据公开信息,听书功能依托火山引擎智能语音,已支持超 700 部古籍的原文与译文,优势是可持续、可覆盖大量书目,适合通读与语感培养;精读仍建议回到文本界面。支持书目与音色会随版本更新,以官方说明为准。
"深度研究助手"是什么,什么时候上线的?
据公开信息,它是识典古籍基于豆包大模型推出的 AI 助手功能,于 2025 年 10 月上线,面向阅读与研究场景。合适的使用方式,是把它的回答当"线索清单":顺着线索回到具体书目与篇章,自己确认字句与语境。其交互方式与功能范围以官方实际提供的为准。
发现 AI 识别或标点错了,怎么办?
首选打开原图对照:阅读页可点开原图图标,把整理后的数字化文本与古籍影印底本并排查看,一眼就能看出差异。平台整体采用 AI 整理加众包校对、专家参与的模式,个别书籍可能仍有疏漏,可对照原图核对,内容修正状态以官方说明为准。
这些 AI 功能要收费或注册吗?
识典古籍是公益免费项目,官方口径为永久免费、无广告,App 无内购,阅读与检索无需注册。AI 译文、实体百科、检索等功能在阅读端可直接使用;书架、笔记、古籍整理等需保存个人数据的功能才需注册登录。
手机 App 和网页版的 AI 功能一样吗?
阅读端的核心 AI 能力两端基本一致,差异主要集中在校勘整理端与部分语音功能上。据公开信息,AI 朗读、听书、AI 播客讲解等以 App 端为主;古籍整理相关的精细操作更适合电脑端网页版。两者配合使用,覆盖场景最完整。
小结
回头看,识典古籍的 AI 并不是若干零散功能的堆叠,而是一条从图像通向知识的完整链路。OCR(96%–97%)让文字可被读取,自动标点(94%)让文本可被理解,命名实体识别(接近 98%)让专名可被组织,三者合力,把一部部影印古籍变成可检索、可关联的数字文本。在这条链路的末端,才长出读者看得见的能力:一句原文配一句译文的文白对照、能让耳朵读书的 AI 朗读与听书、能回应提问的 AI 助手,以及把人物关系织成网络的实体百科与关系图。而"深度研究助手"据公开信息于 2025 年 10 月基于豆包大模型上线,正代表这条链路向"研究"再延伸一步的尝试。
同样要记住它的边界:文本来自 AI 整理与众包校对,个别书籍可能仍有疏漏,可以打开原图对照影印底本核对;译文与标点是参考读法,不是定论;学术引用仍应核对权威点校本或影像底本。AI 让读古籍的门槛低了很多,也让整理古籍的速度快了很多,但它没有、也不该取代人的判断。把机器擅长的事交给机器,把需要判断的事留给人,这大概就是这套平台最聪明的分工。
最后说明:本文涉及的功能范围、支持书目与版本情况均属易变信息,平台仍在持续更新,请以官方页面与 App 内实时说明为准。想动手体验,用浏览器访问官网 www.shidianguji.com 即可开始,或在应用商店免费下载识典古籍 App。