关于这本书
这本书里的每一处技术论断,都能回溯到源码的具体某一行。 下面这张表是成书时的实际数据,口径写在表头里。
| 章 | 标题 | 带行号引用 | 图 | 正文汉字 |
|---|---|---|---|---|
| 01 | 全景与编排 | 18 | 3 | 5893 |
| 02 | 多源摄取 | 19 | 3 | 5019 |
| 03 | 解析、归一化与切块 | 22 | 3 | 5017 |
| 04 | 实体关系抽取 | 20 | 3 | 4855 |
| 05 | 冲突检测与去重 | 23 | 3 | 6034 |
| 06 | 图谱构建与双时态事实 | 28 | 3 | 5991 |
| 07 | 本体生成与校验 | 36 | 3 | 5657 |
| 08 | 推理与溯源 | 21 | 3 | 4883 |
| 09 | 上下文与决策智能 | 22 | 3 | 5951 |
| 10 | 存储与出口 | 27 | 3 | 5263 |
| 合计 | 236 | 30 | 54563 | |
版本锚点
正文里的所有行号对应下面这个版本。上游仓库一直在改,隔一段时间再照着查,行号可能已经漂了。
- 仓库:https://github.com/semantica-agi/semantica
- commit:
1ee2ae88 - tag:
course-anchor-20260824 - 核对日期:2026-08-24
怎么读
- 代码块左侧是源文件里的真实行号,可以直接跳回原仓库对照
- 带 逐段 按钮的引用块中间有省略,点一下会按连续段落依次高亮,省略处不会被当成连续代码
- 每章末尾的思考题里至少有一道要动手改代码验证,那一道最值钱
这本书是怎么做出来的
用一套公开的方法论:先锁版本锚点,再写带源码锚点的大纲,然后按八段结构逐章精读, 最后编成这本书。全程由脚本把每一个代码块拿回源文件逐字节比对,行号错了自动校正, 静默删行会被判定为编造并退回重写。
方法论与模板已开源,可直接取用