公开方法论 · 给非技术读者

让重要的判断
不再失忆

一个判断力的工程化平台
写得下 · 找得回 · 能验证 · 能扩充
资深决策者的判断,从口到耳到执行,平均损失掉超过一半的信息量。 六个月后回看,只剩"那次他大概是这么说的"。 我们做的是把判断变成有迹可循的工程产物 — 像飞机黑匣子,像临床病历,像银行账本。
公开方法论展示 · 不含任何具体客户 / 真名 / 财务数字
第一章 · 决策为什么会"失忆"

4 个真实场景

这些对话, 是不是在你的会议室和邮件里听过?
"李总当年为什么这样决定?"
— 6 个月后, 团队回看, 没人能完整说清楚当时的关键变量反方排除
"我反对!"……然后呢?
— 反对意见被一句"那我们再讨论"吞掉, 执行就走偏了。反方没有结构就等于没有声音
"去年那个判断后来怎样了?"
— 没人盯, 也没人愿意盯。一年后翻不出"当时究竟预判了什么", 也就没法学。
"这事我们去年讨论过吧?"
— 信号散在5+ 个来源里: 访谈、笔记、报告、内部会议、客户对话。互相之间没有整合层。
第二章 · 我们做的事 — 一句话总结

判断也需要一份"黑匣子"

三个类比, 解释这个系统在做的事。
BLACK BOX

像飞机黑匣子

每次决策的关键变量、推理路径、反方排除都被自动记录。事后任何人打开都能原样回放当时的思考。

+ CLINICAL RECORD

像临床病历

同一份判断书, 不同角度的独立"诊断意见"并排打分, 互相不看。 哪里看法分歧大, 系统直接显示分歧度

30d 90d 365d

像时间胶囊

判断当天就写定 30 天 / 90 天 / 365 天分别要看哪些信号。 到期系统自动拉数据复核, 判断对还是错就有了客观答案。

第三章 · 系统全貌

一张图看懂这条流水线

从信号进来到判断书出去, 一共五站。每一站都自动留下"过站记录", 任何人事后都能查。
1 收集 五种来源 访谈 · 笔记 报告 · 文章 内部会议纪要 2 整理 自动归类 人物 · 公司 行业概念 · 摘要 建知识库 3 合议 圆桌合议 1 位本人 + N 位不同角度专家 独立打分 4 出书 版本化判断书 写定即冻结 永不可改 含 3 个验证点 5 回查 30/90/365 天 自动拉数据 证实 · 部分 · 证伪 证伪 → 反向修订 证伪 → 反向修订
5 站流水线 · 每站都留可审计记录 · 红色弧线 = "证伪了就反向修订" 的闭环
第三章 · 知识库

知识库 = 一个"自动归档的小图书馆"

五种来源进, 四类条目出。系统在背后自动维护"哪个判断引用过哪个条目", 翻一翻就能回到原文。
公开文章 网页 · 行业 blog 个人笔记 日常累积 · 增量 本人访谈纪要 最高权重 · 一手材料 行业研究报告 PDF · 手动触发 内部会议纪要 三道筛子过滤后 脱敏 + 校验 (真名 / 内部链接 / 精确数字 → 自动隔离) 如果命中敏感规则, 不进知识库, 隔离待审 自动编译器 认词 + 别名匹配 → 提取实体 + 维护反向链接 公司 / 机构 每家公司一份档案 人物 每位关键人物一份档案 行业概念 / 内部名词 解释 + 出处 原文摘要 长文的可搜索浓缩版
五类来源经"脱敏闸"过滤进入编译器, 自动产出四类知识条目 · 每个判断引用了哪些条目, 系统自动维护双向链接
第四章 · 合议机制

合议不是"投票", 是"独立诊断"

每一位评委独立打分, 互相不看。 系统把"本人主见"和"群议结果"并排放, 显示分歧度 — 不替你决定谁对, 但让你看清楚自己有没有跳步。
议题 (同一份材料) 本人 (心证基线) 行业趋势 战略愿景 客户战略 产品战略 组织战略 经营战略 每位独立打分 · 不看别人写的
圆桌座次: 中央是本人主见, 周围 6 位不同角度的专家评委
5 把尺子 · 每位评委都用这一套打分 推理顺不顺 (思路是否自洽) 证据合理吗 (说法有依据) 能验证吗 (未来能判对错) 实际扛得住吗 (落地不脆弱) 反方考虑了吗 (反对意见处理) 群议加权 本人主见 差距大 = 自己反思
五把尺子 = 推理 · 证据 · 反方 · 验证 · 韧性。本人和群议的差距,就是反方机制的最强信号
第四章 · 评分透明度 (1/4) · 老板最想问的

1 分到 10 分, 究竟意味着什么?

每位评委对5 把尺子各打一个 1-10 分。 不是"凭感觉给个分", 而是每一档都有可对照的具体标准 — 看一遍就能知道"为什么是 8 不是 5"。
分档锚定 · 4 档锚点 10 教科书级 推理 / 证据 / 反方 / 验证 / 韧性 全无瑕疵 — 罕见 在真实判断里一年也未必出现一次 7-9 优秀 主体扎实, 个别角落可挑剔 — 这是合格判断的目标区间 挑剔点会写进评委的"关键缺口"段, 给具体行动建议 4-6 合格但有明确缺陷 某一环明显薄弱 (常见: 反方处理 / 可证伪) 不退回, 但触发"行动建议"必须给修复路径 1-3 重大问题 · 此镜头基本失败 单镜头 1-3 分可一票否决全局 — 不按均分排序 触发 Lead 强制重写该维度的反方处理 5 把尺子各打 1 个分 → 5 个分的均分作总分
4 档不是"我觉得", 而是有可对照的锚点 — 评委独立打分时按这把尺子, 而非按"印象"
实例 · "可证伪" 这把尺子怎么对照 9 分 写法可证伪 · 数字 + 阈值 + 数据源 "90 天内 NPS ≥ +12, 留存 ≥ 40%, 否则视为证伪 (数据源: 客户调研 + CRM 留存表)" → 三个月后任何人可独立拉数据复核, 判对错不靠主观 5 分 方向有但数字软 "三个月内客户口碑改善, 留存稳住" → "改善" 到什么程度? "稳住" 是百分之多少? 缺锚点 2 分 无法被证伪 · 不是判断, 是祝福 "未来会越来越好" · "团队士气会上升" → 没有数字, 没有时点, 没有数据源 → 此镜头 2 分 = 一票否决, 整份判断退回重写 同一种说法, 不同写法 → 不同分
"可证伪" 是最常掉分的尺子 — 因为多数人没习惯写到能被证伪的具体程度
5 把尺子在前一页已经介绍 — 推理 / 证据 / 反方 / 可证伪 / 韧性。 每位评委对每把尺子都按这套 4 档打分, 给一个 1-10 之间的具体数字, 不是 A/B/C 评级。
第四章 · 评分透明度 (2/4) · 打开一份打分单

解剖一份评委 review

每位评委独立交出的"打分单"结构完全一致 — 五部分, 一部分缺都不能提交。 这是制度, 不是建议。结构本身就是反方机制最坚硬的部分
reviews/strategic-vision.md · 评委独立打分单 ① 5 镜头分数 (各 1-10) reasoning: 8 / evidence: 8 / counter: 6 / falsifiability: 8 / resilience: 6 confidence: 0.76 · doctrine_anchors_used: [黄金圈 Why · BHAG · Rumelt · 机会成本] 这五个数字不是分别给的, 是同一份证据下 5 个角度的同步评估 ② 一句话定调 (signature line) "路径上看每一步都对, 但'为什么这样走'这条链没接上来 — 4 件事会按节奏完成, 战略意义却悬空" ③ 关键缺口 (key gap) 明确指出 "三件必需品同时缺位" · 不是抱怨, 是给 Lead 的修复指针 ④ 行动建议 (具体到下一周 / 下一月) "下周做的 1 件事: ... 这是 30d checkpoint 的最低门槛交付物" ⑤ adversarial_view · 反方机制 (★ 缺这段 系统层面阻断提交) a. if_thesis_wrong — 如果本维度判错了, 哪一环最脆弱? b. contrary_signal_observed — 近期有什么反向信号支撑反命题? c. base_rate_warning — 同类决策的历史失败率参考? 为什么是这 5 段? 五段对应判断的 5 个 "可错点" — 任何一段 缺了, 评委的工作 就是不完整的。 分数 (①) "打多少" · 4 档锚定 不是 A/B/C, 是数字 金句 (②) "为什么这么打" 把分数翻成人话 缺口 + 建议 (③④) "问题在哪 · 下一步做什么" 让 Lead 能落地修订 反方 (⑤) · 最关键 三段填空, 缺一不可 把"反对意见被吞掉" 变成数据契约
每位评委独立交一份, 互相不看 · 五段必填 · 反方段缺字段 → 系统直接阻断提交
第四章 · 评分透明度 (3/4) · 老板最在意的"依据"

证据 → 分数: 一条可追溯的链路

分数不是凭空给的。每位评委的每一条推理, 都必须 anchor 到一份可追溯的具体文件 + 行号。 没有出处的陈述, 系统自动把置信度压到 ≤ 0.4 — 这就是"反幻觉"硬纪律
① 一手原料 本人访谈 · 个人笔记 · 文章 · 报告 行级别保留 · 谁说的 / 何时说的 raw/... ② 编译为知识条目 公司 · 人物 · 概念 · 摘要 自动维护 "出自哪条原料" _wiki/... ③ 维度调研 5-7 路 sub-agent 并行 每条证据 anchor 到 ①② raw_evidence/dim_*.md ④ Lead 合成 杠杆地图 · 脆弱边缘 跨维度矛盾点 synthesis.md ⑤ 评委打分 读 ④ + 自己 doctrine 写出 5 个分 + 五段 reviews/<judge>.md 评委 doctrine 这位评委的世界观 skills/<p>-perspective/ ★ 反幻觉硬纪律 (Anti-fabrication) — 评委每一句推理都必须挂出处 ✓ 合格示例 (实际见 reviews/strategic-vision.md 末尾): "同类机构 18-36 个月演化出关键能力的比例 < 30%" ← anchor 到 raw_evidence/dim_strategic_vision.md 证据 5 "黄金圈 Why-How-What 拆解" ← anchor 到 skills/strategic-vision-perspective/references/doctrine/01-golden-circle.md "本人在 N 期访谈中的反方排除模式" ← anchor 到 _wiki/people/<anchor>.md L142-156 ✗ 不合格示例 (实际会被 skill_lint 拦截): "业界普遍认为 ..." · "类似公司大多数 ..." · "据估计 ..." (无 source link, confidence 自动 ≤ 0.4)
从原料到分数, 5 个节点全程留链接 · 任何审计者拿到 review 都能反向走一遍, 看每一句推理出自哪里
第四章 · 评分透明度 (4/4) · 多人打分如何汇总

群议合成: anchor_delta 是镜子, 不是裁判

老板最常问的下一个问题: "几个评委分数不同, 系统按谁的算?" 答案是 — 系统不替你决定。它把"专家组的群议结果"和"本人的心证基线"并排放, 算出差距, 让本人自己判断。
合议公式 · 三个数字 ① 维度评委加权均分 3-6 位维度评委 · 5 镜头均分 · 加权汇总 dimension_weighted_mean 7.4 ② 本人心证均分 独立基线 · 不参与上面加权 · 用本人心智模型 anchor_mean 6.6 ③ anchor_delta · 镜子 = 维度加权 − 本人心证 = 7.4 − 6.6 anchor_delta +0.8 |Δ| > 2.0 → 系统自动高亮 飞书卡片置顶提示 "维度与本人判断分歧显著" 不告诉你谁对 — 让本人反思: 是评委过悲观 / 过乐观? 还是本人跳步未自知? 还是本人有未公开的信号?
合议公式只有 3 个数字 · 都在判断书的 panel_summary 段, 一眼可查
三种 delta · 三种解读 |Δ| ≤ 0.5 · 心证与系统化分析高度对齐 议题信号强, 反方机制有效 — 这是最理想的状态 不意味"肯定对", 但意味"两个独立来源都看到了同样的现实" 本人 维度 Δ > +2.0 · 维度评委比本人更乐观 可能 1: 评委 doctrine 过度依赖 base rate, 忽略本地特殊性 可能 2: 本人持有 inhibition 信号 (例如对方临时反馈), 未写进 synthesis 触发动作: 本人补写 inhibition 信号, 或调整心证 Δ < −2.0 · 本人比维度评委更乐观 可能 1: 本人看到 "escape hatch" — 非正式权威 / 关键人事 可能 2: 本人跳步, 把"理论上可行"读成"已经发生" 触发动作: 本人显式列出 escape hatch 路径, 写入 synthesis 三种情况, 系统都不替你决定 — 它只把镜子举给你
delta 的方向告诉你"分歧朝哪边", delta 的大小告诉你"分歧多大" · 怎么解读, 永远是本人的事
为什么不直接平均成一个分? 因为那样会把"专家组共识"与"本人心证"的差距藏起来, 最终只剩一个看上去客观的数字。 系统的核心价值不是给出"标准答案", 而是把判断过程拆开来给你看 — 谁打了几分 · 为什么 · 哪里分歧。 老板看一份判断书, 30 秒内就能定位"我和专家组哪里看法不同, 为什么不同"。
第五章 · 时间是最严苛的考官

30 天 · 90 天 · 一年 — 自动回查

写判断书的当天,就要写定三个具体可观测的信号。 到期系统自动拉数据,看实际发生的对不对得上。对不上的部分,自动产出复盘卡片。
今天 判断写定 永不可改 写好 3 个验证点 30 天 早期信号 客户反馈 试点反应 90 天 中期指标 业务数据 财务表现 一年 长期归因 市场份额 客户心智 写定预期 自动拉数据 对比 · 修订 最终归因 三种结果 证实 — 实际信号与预测一致, 判断没问题 部分 — 方向对, 但程度或时点偏了 证伪 — 实际反方向, 自动生成复盘卡片 证伪 → 自动归类 6 种复盘卡片 → 下一版判断书修订
第六章 · 这套系统现在到了哪一步

当前规模 (脱敏后的真实数字)

所有数字都是类别 / 量级, 不含具体业务内容。完整数据留在本地保密库, 永不外发。
5
种来源在持续监控
从外部到内部, 每天自动收集
50+
人物 / 公司 / 概念条目
系统自动从原料里抽出来
10+
不同角度的"评委"
本人主见 + 多位专家视角
多个
判断在 30/90/365 跟踪中
到期自动拉数据复核

自动化每日值班表

  • 凌晨 2:00 收集
  • 凌晨 2:30 过滤
  • 凌晨 3:00 整理入库
  • 凌晨 3:30 监控有无变更
  • 每日 9:00 验证点复核
  • 每月 15 号 全面体检

使用入口 · 一个命令

/boss 议题描述

触发完整 5 阶段流水线, 给出版本化判断书 + 30/90/365 验证点 + 评委独立评分。

/boss feishu-sync 手工触发监控扫描和入仓。

对外公开的部分

  • 方法论手册 (本站)
  • 9 篇架构决策记录
  • 命令 / 接口参考
  • 本份方法论 PPT
  • 真实案例 / 客户名永不公开
第七章 · 它带来的真实变化

用了它之后, 哪些事情变了?

"判断"这件事从"凭感觉 + 凭记忆"变成"凭记录 + 凭机制"。
之前 · "李总当时为什么这样决定?" 半年后无人能完整答出
之后 · 每个判断有完整的关键变量 + 推理 + 反方记录, 任何人事后都查得到
之前 · 反对意见被"再讨论"吞掉, 反方=讲话稿
之后 · 反方变成必填字段, 系统不允许跳过, 反方=数据契约
之前 · 30/90/365 天后, 没人愿意盯, 也没法盯
之后 · 系统自动到期, 自动拉数据复核, 自动出复盘卡片
之前 · "这事去年讨论过吧?" 信号散在 5+ 个来源里
之后 · 知识库自动整合 + 反向引用, 每次判断都站在历史所有判断之上
第八章 · 设计哲学

三条永远不改的原则

这三条不是"我们当前的实现选择", 而是"违反任一条系统就不再工作"。 任何修改这些原则的提议, 都需要双人评审。
原则 一

知识只能单向流动

原料 → 知识库 → 判断书。判断书永远不能反过来改写知识库

为什么 · 知识库是客观档案, 必须独立于任何具体判断。一旦"为了配合某个判断"修改知识库, 客观性就崩了。

原则 二

历史快照永不可改

判断书一旦写定, 系统层面锁死 — 任何人 (包括作者) 都改不了。新认识只能写成新版本, 老版本完整保留。

为什么 · 时间胶囊的意义就在"那一刻你究竟想了什么", 不在"现在你愿意承认你想了什么"。

原则 三

反方机制写进结构

每位评委必填三件事:
① 如果判错了, 哪一环最脆弱
② 近期有什么反向信号
③ 同类决策的失败率

为什么 · 反方机制如果靠"记得提醒", 一定会被吞掉。写进数据结构, 才进得了执行。

第九章 · 下一步

三个阶段, 一条曲线

从"一个人用"到"多个人共用"再到"方法论开放给外部"。每一步都对应一组明确的工程任务。
阶段一 · 现在 单人单库 阶段二 · 中期 多人共用 阶段三 · 长期 方法论开放 这一阶段要做的 · 本地工具链跑通 · 一位本人 + 6 位专家评委 · 公开手册站 (本站) 上线 · 自动监控 + 自动入仓 · 多个判断在跟踪验证 这一阶段要做的 · 支持多位本人共用一套基础设施 · 每位本人独立的"主见档案" · 云端调度 (替代本地定时任务) · 评委"漂移监控" (评分趋势) · 跨本人 panel 共享 这一阶段要做的 · 脱敏后的复盘卡片可公开 · 跨多本人的判断演化对比 · 方法论本身作为开放产品 · 外部判断者也能接入自己 panel · 多模型评委 (不止一家 AI) 已完成 规划中 愿景
阶段一到阶段二: 主要是系统形态变化 (从一个用户到多个用户, 从本地到云端). 阶段二到阶段三: 主要是边界打开 — 把可脱敏的方法论 publish 出去, 让外部判断者也能上挂自己的视角。
结尾

下一个判断,
90 天后能怎样被检验?

这个问题, 我们让系统帮你必答。

公开层

方法论手册 (本站) · 9 篇架构决策 · 命令 / 接口参考 · 本份方法论 PPT — 全部脱敏后可访问

开源

GitHub · zhanglunet/boss-vault · 含工具脚本 + 评委定义 + 模板 · 不含真实案例与原料

贡献

欢迎 issue / PR · 公开层的任何改动都走双重脱敏闸 + 双人评审, 真名永不上公网

本 PPT 由系统自动维护 · 任何具体数字 / 真名 / 内部链接已经过双重脱敏闸过滤 · 完整数据仅在本地保密库内
boss · 让重要的判断不再失忆
1 / 12