实体词典

声明「标准名 ↔ 别名」校准规则,让检索、图谱与 MCP 用任意别名都能命中同一个实体。

实体词典是用户声明的校准规则层:告诉 NoteFast「晶圆 = wafer = 硅片」「流片 = tape-out」。它在 AI 理解之外补上一块确定性——涉及专业术语、中英混写、产品代号的领域,自动抽取容易分裂,声明式校准一步到位。

它解决什么问题

没有词典时,同一概念的不同写法会被当成不同实体:笔记里写「tape-out」,另一篇写「流片」,图谱里出现两个节点,搜「tape-out」找不到中文笔记。声明词典后:

  • 抽取端:笔记中出现任何别名,都归并到标准名实体
  • 查询端:用标准名或任一别名搜索,都会展开命中该实体
  • 生效范围:实体页 / 全局搜索 / MCP 的实体检索

配置

设置 → 实体词典。每条规则:

{
  "name": "流片",
  "aliases": ["tape-out", "TapeOut", "送片"],
  "kind": "concept",
  "description": "芯片设计交付制造的关键节点"
}
字段必填说明
name标准名(图谱节点显示名)
aliases别名列表(最多 200 条/项)
kindconcept / person / tool / doc
description一句话说明

完整示例见仓库 docs/term-dict.sample.json

生效时机

  • 保存即生效:新写入的笔记按新词典抽取;查询端立即按新别名展开
  • 存量归并:保存后自动对已有笔记做一次归并(幂等,可重复触发);「立即归并」按钮手动触发,返回合并 / 新建 / kind 更新的数量
  • 空词典 = 零影响:不声明任何规则时,检索行为与无词典完全一致——它是纯增强层,不改变默认行为

与知识图谱的关系

词典校准的是实体身份;图谱展示的是实体共现(哪些概念在同批笔记中出现)。校准后的图谱:同名实体合并为一个节点,别名全部收拢。规模大后可在实体页发现「疑似重复」的合并建议(拼写变体自动合并 + 子串提示)。

先从最常见的 10–20 个术语开始(产品名、团队黑话、中英对照),观察图谱和检索的变化,再逐步补充。一次性声明几百条反而难维护。