Skip to content
深脑

技术说明书

方法论、处理逻辑、算法与对象模型的完整版

一份把整套「第二大脑」从方法论到处理逻辑端到端讲清楚的总纲。面向需要专业理解本平台的人:客户、合作方、技术评审、投资人。


0. 摘要

深脑是一个把组织的对话变成「判断级、可溯源、会自省、越用越准」的第二大脑的平台。

市面上的工具帮你记录和总结会议;深脑帮你判断,并把每一次判断记住、串联、追到结果。它不是又一个录音/纪要应用——它是站在所有捕获工具下游、唯一会"思考"的那一层:吃任何来源的对话转写,沉淀成可跨对话复用的判断网络,越用越深、越深越难迁移。

核心技术命题:当 AI 让"分析"变得人人免费时,唯一买不到、带不走的,是一套被真实判断与真实结果校准过的、私有的判断资产。 深脑的全部架构,都围绕"攒出这套资产"来设计。


1. 方法论:为什么是"判断级第二大脑"

1.1 三条第一性原理

  1. 智能在变成水电:凡"拿模型跑一遍文本得到洞察"的事,前沿模型会原生做、更好、近乎免费。处理层会被抹平,护城河不在"能分析"。
  2. 生成免费了,判断稀缺:当产出零成本,值钱的是"知道哪个对、哪个该信"。押"判断级"正是价值迁移的方向。
  3. 会复利的只有私有的判断史:判断 × 结果的校准账本,只能靠深用 + 追结果一天天攒,买不到、抄不走。这是真正的壁垒。

1.2 四条产品原则(不动的底座)

  • 说真话:了解不够就老实说,绝不为了好听而编。
  • 可溯源:每一句判断都能点回原文出处,永远可核。
  • 越用越准:判断随佐证、矛盾、时效、真实结果持续校准,不是一次性输出。
  • 隐私优先:数据不训练、组织间隔离、支持数据主权(自托管)。

1.3 形态定位

不是"AI 会议助手",是组织判断力的第二大脑。入口是"单场判断级洞察"(立刻有用),深度是"跨对话的第二大脑"(逐步兑现),终局是"被你真实判断与结果校准过的判断分身"。


2. 端到端处理流程(总览)

一段来源对话(会议 / 客户访谈 / 谈判 / 讲课),经导入(粘贴转写 · 录音 ASR · MCP 反向摄取)后:

  1. 判断级分析 —— 读懂"真正发生了什么"(矛盾/沉默/立场,非摘要),每条结论带证据锚点。
  2. 原子化 —— 拆成带类型、带出处、可复用的最小判断单元,并向量化。
  3. 归位 + 沉淀 —— 自动归项目;同主题聚合;喂入下面所有能力。

随后这些原子同时喂养八路能力:

  • 问大脑:跨对话混合检索(语义 + 关键词 + 关系图),带出处回答。
  • 健康巡检:主动报矛盾 / 立场反转 / 悬而未决。
  • 合成层:概念 · 人物画像 · 决策台账。
  • 判断成色:内部自洽——佐证抬升、矛盾压制、时效衰减,三档。
  • 回响:新判断照见旧判断,印证或冲突。
  • 联想(微梦):会做梦的记忆——巩固完主动跨语境找 1–2 条真连接,不等你问(洞察 = 把两个原本不相干的东西接通)。
  • 现实校准:判断 × 结果,命中率回流,越用越准。
  • 生成:一键出简报 / 方案 / 对外内容,带溯源。

一句话:前三步是"听懂 + 记住",后八路是"会想 + 会自省"。绝大多数工具止于前三步的浅层;深脑的价值全在后面。


3. 处理逻辑逐层拆解

3.1 捕获 / 导入

三种来源:粘贴转写、录音 ASR(异步转写 + 说话人分离)、MCP 反向摄取(外部系统经协议把转写推进来)。战略上不抢捕获——做所有捕获工具下游的"脑",可吃任何来源。

3.2 说话人识别(把话钉到"人",而非"字符串")

标签优先,不猜身份:转写自带的真名(飞书妙记 @名字 是账号级事实)直接采用;只标了"说话人N"的保留标签、锚定它跑分析——AI 绝不把"被提到的名字"当成"在说话的人"(认错人整篇偏)。分析后的「说话人汇总」带每人原话给建议,你确认了才显真名、才进大脑。确认作用域是素材:一次指认广播到这份素材的所有镜头,并绑定通讯录里确定的人,下游抽画像直接并入,根治"同一个人裂成多条"。正文永远留"说话人N"锚点、渲染时投影真名——改名才可逆。

3.3 判断级分析(不是摘要)

多方法可组合 + 智能路由(按对话类型自动选方法),跑出判断级输出:矛盾、沉默与回避、真实立场、悬而未决。每条结论挂证据锚点,点开即见原文,可点可核。人格:冷静、基于证据、不拍马屁;空脑诚实兜底,绝不幻觉。

3.4 原子化(地基)

把分析拆成一颗颗原子:带类型、涉及谁、置信度、原文出处、向量指纹。七型:决策 · 人物判断 · 信号 · 矛盾 · 原则 · 待解 · 事实——类型决定下游用法。只提炼、不发明:落不回原文的判断不要。

佐证与取代(防熵增地基):别的录音又冒出同一判断 → 不当重复丢弃,而是加固计数(从"某场说过"长成"跨场景反复成立")。新判断更新/推翻旧判断 → 显式标"被取代",旧判断退出召回/图谱/打分但留档(拒绝遗忘曲线:认知资产只复利、不代谢遗忘,且留着解释新判断为何存在)。

3.5 记忆与召回(问大脑)

每颗原子向量化(pgvector,2048 维)。问大脑即 RAG,召回走混合检索:语义向量 + 关键词 BM25 + 关系图一跳遍历,三路独立信号用 RRF 融合排序(补上单一向量漏掉的人名/术语/编号等字面精确命中,也用上原子间已连好的关系边;任一路失败自动回退纯向量,永不挂)。召回时按每条原子的成色/战绩加权,排除被取代的原子。合成流式带溯源的回答;召回为 0 时诚实说"了解不够",不调模型、不幻觉。复杂问题走自研薄 ReAct 智能体,多步推理后作答。

3.6 主动巡检(健康检查 · 杀手锏)

定期/分析后自动扫原子,专找三类:矛盾、立场反转、悬而未决(被提 N 次、X 天无结论)。高置信发现写入「洞察 feed」并实时推到 IM。靠比对工作——需 ≥2 场、涉及同主题才比得出,语料稀时诚实留空。

3.7 合成层(沉淀 = 护城河)

概念(同主题原子合成的综述页)· 人物画像(同一个人的判断越攒越厚)· 决策台账(可追踪的决定/行动)。

3.8 判断成色(内部自洽)

给每条判断标三档成色——待证 → 成形中 → 已定:单次陈述只算待证;跨多场反复出现(佐证)才可信,边际递减;被矛盾指向要打折且封顶不得"已定";时效半衰减(有地板不清零);用户反馈微调。

3.9 回响(新判断照见旧判断)

每次分析后第一眼:把本次判断与大脑里过去同主题判断对照——印证(看法在收敛)或冲突(你可能在自打脸)。不只存,还把新旧判断连起来、点出张力。

3.10 联想(微梦 · 会做梦的记忆)

每次分析巩固结束,强制做一次轻量联想:从本次新判断出发,到全库跨语境(别的录音/主题)找 1–2 条真连接,冒到「洞察 feed」并连成带类型的关系边(先例 / 矛盾 / 通则…,不是"有连线")。两条铁律:只迁移结构 / 原理 / 模式,绝不迁移具体事实(防跨域污染);宁缺毋滥,没有真连接就不产出。这是深脑与一切检索工具的分水岭——主动发现连接、不等你问。

3.11 现实校准(判断 × 结果,真正的护城河)

任意判断/决策可回填"应验 / 落空 / 部分 / 言之尚早",形成校准账本,算出你这类判断的命中率——通用大模型给不了的维度。命中率回流成色:过去多应验更笃定;过去多落空封顶不得"已定";样本少时贝叶斯收缩、不敢下重手。这是未来"判断分身"的唯一原料,只能靠时间攒。

3.12 生成(从积累到产出)

基于项目全部原子+对话,一键合成季度简报 / 给客户的方案 / 对外内容 / 音频摘要,带溯源、可编辑导出。


4. 关键算法(可对外讲的版本)

算法解决什么机理(白话)
判断成色一条判断有多可信(内部自洽)(基础置信×0.4 + 佐证升力×0.6) × 时效 × (1−矛盾折扣) + 反馈 + 现实校准;佐证边际递减、矛盾封顶、180 天半衰期、有地板
现实校准你这类判断过去准不准命中率=(应验+0.5×部分)/已分晓;按样本量贝叶斯收缩映射成 [−1,1] 信号回流成色
回响新判断与旧判断的关系按规范化主题比对:同主题反复=印证;出现矛盾型/落空裁定=冲突;落空优先警示
混合检索跨对话找最相关判断语义向量(pgvector 2048维余弦) + 关键词 BM25 + 关系图一跳,三路 RRF 融合;组织/项目过滤,排除被取代的原子;任一路失败回退纯向量
微梦联想主动发现跨语境连接新判断向量召回跨语境近邻(排除同录音/同分析) → LLM 判真连接,只迁移结构不迁移事实,至多 2 条,落关系边 + 洞察 feed

设计取向:模型当水电(可换)、算法当地基(自建)。所有判断资产层与具体大模型解耦——谁家模型强用谁家。


5. 对象模型与数据架构

5.1 八个名词("脑"的结构 = 名词之间的连接)

对话(原料)→ 分析 → 原子(知识最小单元)→ 概念页 / 人物 / 决策(合成知识),全挂在项目(脊柱)下;问大脑 + 健康巡检跨上面所有对象工作(文件型工具做不到);洞察 = 巡检的主动产物。

对话是原料,原子是细胞,项目是器官,问大脑+巡检是神经系统。

5.2 存储与部署

数据库:PostgreSQL + pgvector(2048 维向量);多租户严格按组织隔离;append-only 审计与校准账本。数据主权:支持自托管整套栈落到自有服务器,数据不出私域。LLM 层:与具体大模型解耦,推理/嵌入/智能体可切换供应商。


6. 隐私 · 信任 · 安全

  • 不训练:用户对话不拿去训练模型;组织间数据严格隔离。
  • 可溯源即可信:每条判断可点回原文,AI 不是黑箱编的。
  • 数据主权:可整套自托管,敏感战略/谈判语料留在自有服务器。
  • 诚实兜底:数据不足时明说"了解不够",不幻觉。

7. 差异化(为什么别人难追)

个人记忆是 Meta/Limitless 的;会议纪要是钉钉/飞书/Granola 的;知识付费+录音整理是得到/GetSeed 的。「把组织的对话变成会判断、会自打脸提醒、且知道自己哪次对了的第二大脑」= 还没人占,是深脑的。 别人发的是整理/摘要;深脑发的是判断,而且是带命中率背书的判断——这层只能靠深用 + 追结果长出来,抄不走。


8. 术语表

术语含义
原子带类型/出处/向量的最小判断单元
成色判断可信度三档:待证/成形中/已定
回响新判断与历史同主题判断的印证/冲突
校准判断对照真实结果算出的命中率信号
概念同主题原子合成的综述
洞察健康巡检主动发现(矛盾/反转/待解)
问大脑跨对话语义召回+合成的带溯源问答

一句话收尾:别人给你一个聪明的答案;深脑给你一个记得你所有判断、知道你哪次对了、且越用越准的第二大脑。这件事,只有越用越深,才长得出来。

这一页有用吗?