实体词典
声明「标准名 ↔ 别名」校准规则,让检索、图谱与 MCP 用任意别名都能命中同一个实体。
实体词典是用户声明的校准规则层:告诉 NoteFast「晶圆 = wafer = 硅片」「流片 = tape-out」。它在 AI 理解之外补上一块确定性——涉及专业术语、中英混写、产品代号的领域,自动抽取容易分裂,声明式校准一步到位。
它解决什么问题
没有词典时,同一概念的不同写法会被当成不同实体:笔记里写「tape-out」,另一篇写「流片」,图谱里出现两个节点,搜「tape-out」找不到中文笔记。声明词典后:
- 抽取端:笔记中出现任何别名,都归并到标准名实体
- 查询端:用标准名或任一别名搜索,都会展开命中该实体
- 生效范围:实体页 / 全局搜索 / MCP 的实体检索
配置
设置 → 实体词典。每条规则:
{
"name": "流片",
"aliases": ["tape-out", "TapeOut", "送片"],
"kind": "concept",
"description": "芯片设计交付制造的关键节点"
}
| 字段 | 必填 | 说明 |
|---|---|---|
name | ✓ | 标准名(图谱节点显示名) |
aliases | 别名列表(最多 200 条/项) | |
kind | concept / person / tool / doc | |
description | 一句话说明 |
完整示例见仓库 docs/term-dict.sample.json。
生效时机
- 保存即生效:新写入的笔记按新词典抽取;查询端立即按新别名展开
- 存量归并:保存后自动对已有笔记做一次归并(幂等,可重复触发);「立即归并」按钮手动触发,返回合并 / 新建 / kind 更新的数量
- 空词典 = 零影响:不声明任何规则时,检索行为与无词典完全一致——它是纯增强层,不改变默认行为
与知识图谱的关系
词典校准的是实体身份;图谱展示的是实体共现(哪些概念在同批笔记中出现)。校准后的图谱:同名实体合并为一个节点,别名全部收拢。规模大后可在实体页发现「疑似重复」的合并建议(拼写变体自动合并 + 子串提示)。
先从最常见的 10–20 个术语开始(产品名、团队黑话、中英对照),观察图谱和检索的变化,再逐步补充。一次性声明几百条反而难维护。