公开方法论 · 给非技术读者
让重要的判断
不再失忆
一个判断力的工程化平台
写得下 · 找得回 · 能验证 · 能扩充
资深决策者的判断,从口到耳到执行,平均损失掉超过一半的信息量。
六个月后回看,只剩"那次他大概是这么说的"。
我们做的是把判断变成有迹可循的工程产物 —
像飞机黑匣子,像临床病历,像银行账本。
第一章 · 决策为什么会"失忆"
4 个真实场景
这些对话, 是不是在你的会议室和邮件里听过?
"李总当年为什么这样决定?"
— 6 个月后, 团队回看, 没人能完整说清楚当时的关键变量和反方排除。
"我反对!"……然后呢?
— 反对意见被一句"那我们再讨论"吞掉, 执行就走偏了。反方没有结构就等于没有声音。
"去年那个判断后来怎样了?"
— 没人盯, 也没人愿意盯。一年后翻不出"当时究竟预判了什么", 也就没法学。
"这事我们去年讨论过吧?"
— 信号散在5+ 个来源里: 访谈、笔记、报告、内部会议、客户对话。互相之间没有整合层。
第二章 · 我们做的事 — 一句话总结
判断也需要一份"黑匣子"
三个类比, 解释这个系统在做的事。
像飞机黑匣子
每次决策的关键变量、推理路径、反方排除都被自动记录。事后任何人打开都能原样回放当时的思考。
像临床病历
同一份判断书, 不同角度的独立"诊断意见"并排打分, 互相不看。
哪里看法分歧大, 系统直接显示分歧度。
像时间胶囊
判断当天就写定 30 天 / 90 天 / 365 天分别要看哪些信号。
到期系统自动拉数据复核, 判断对还是错就有了客观答案。
第三章 · 系统全貌
一张图看懂这条流水线
从信号进来到判断书出去, 一共五站。每一站都自动留下"过站记录", 任何人事后都能查。
5 站流水线 · 每站都留可审计记录 · 红色弧线 = "证伪了就反向修订" 的闭环
第三章 · 知识库
知识库 = 一个"自动归档的小图书馆"
五种来源进, 四类条目出。系统在背后自动维护"哪个判断引用过哪个条目", 翻一翻就能回到原文。
五类来源经"脱敏闸"过滤进入编译器, 自动产出四类知识条目 · 每个判断引用了哪些条目, 系统自动维护双向链接
第四章 · 合议机制
合议不是"投票", 是"独立诊断"
每一位评委独立打分, 互相不看。
系统把"本人主见"和"群议结果"并排放, 显示分歧度 — 不替你决定谁对, 但让你看清楚自己有没有跳步。
圆桌座次: 中央是本人主见, 周围 6 位不同角度的专家评委
五把尺子 = 推理 · 证据 · 反方 · 验证 · 韧性。本人和群议的差距,就是反方机制的最强信号
第四章 · 评分透明度 (1/4) · 老板最想问的
1 分到 10 分, 究竟意味着什么?
每位评委对5 把尺子各打一个 1-10 分。
不是"凭感觉给个分", 而是每一档都有可对照的具体标准 — 看一遍就能知道"为什么是 8 不是 5"。
4 档不是"我觉得", 而是有可对照的锚点 — 评委独立打分时按这把尺子, 而非按"印象"
"可证伪" 是最常掉分的尺子 — 因为多数人没习惯写到能被证伪的具体程度
5 把尺子在前一页已经介绍 — 推理 / 证据 / 反方 / 可证伪 / 韧性。
每位评委对每把尺子都按这套 4 档打分, 给一个 1-10 之间的具体数字, 不是 A/B/C 评级。
第四章 · 评分透明度 (2/4) · 打开一份打分单
解剖一份评委 review
每位评委独立交出的"打分单"结构完全一致 — 五部分, 一部分缺都不能提交。
这是制度, 不是建议。结构本身就是反方机制最坚硬的部分。
每位评委独立交一份, 互相不看 · 五段必填 · 反方段缺字段 → 系统直接阻断提交
第四章 · 评分透明度 (3/4) · 老板最在意的"依据"
证据 → 分数: 一条可追溯的链路
分数不是凭空给的。每位评委的每一条推理, 都必须 anchor 到一份可追溯的具体文件 + 行号。
没有出处的陈述, 系统自动把置信度压到 ≤ 0.4 — 这就是"反幻觉"硬纪律。
从原料到分数, 5 个节点全程留链接 · 任何审计者拿到 review 都能反向走一遍, 看每一句推理出自哪里
第四章 · 评分透明度 (4/4) · 多人打分如何汇总
群议合成: anchor_delta 是镜子, 不是裁判
老板最常问的下一个问题: "几个评委分数不同, 系统按谁的算?"
答案是 — 系统不替你决定。它把"专家组的群议结果"和"本人的心证基线"并排放, 算出差距, 让本人自己判断。
合议公式只有 3 个数字 · 都在判断书的 panel_summary 段, 一眼可查
delta 的方向告诉你"分歧朝哪边", delta 的大小告诉你"分歧多大" · 怎么解读, 永远是本人的事
为什么不直接平均成一个分?
因为那样会把"专家组共识"与"本人心证"的差距藏起来, 最终只剩一个看上去客观的数字。
系统的核心价值不是给出"标准答案", 而是把判断过程拆开来给你看 — 谁打了几分 · 为什么 · 哪里分歧。
老板看一份判断书, 30 秒内就能定位"我和专家组哪里看法不同, 为什么不同"。
第五章 · 时间是最严苛的考官
30 天 · 90 天 · 一年 — 自动回查
写判断书的当天,就要写定三个具体可观测的信号。
到期系统自动拉数据,看实际发生的对不对得上。对不上的部分,自动产出复盘卡片。
第六章 · 这套系统现在到了哪一步
当前规模 (脱敏后的真实数字)
所有数字都是类别 / 量级, 不含具体业务内容。完整数据留在本地保密库, 永不外发。
50+
人物 / 公司 / 概念条目
系统自动从原料里抽出来
10+
不同角度的"评委"
本人主见 + 多位专家视角
多个
判断在 30/90/365 跟踪中
到期自动拉数据复核
自动化每日值班表
- 凌晨 2:00 收集
- 凌晨 2:30 过滤
- 凌晨 3:00 整理入库
- 凌晨 3:30 监控有无变更
- 每日 9:00 验证点复核
- 每月 15 号 全面体检
使用入口 · 一个命令
/boss 议题描述
触发完整 5 阶段流水线, 给出版本化判断书 + 30/90/365 验证点 + 评委独立评分。
/boss feishu-sync 手工触发监控扫描和入仓。
对外公开的部分
- 方法论手册 (本站)
- 9 篇架构决策记录
- 命令 / 接口参考
- 本份方法论 PPT
- 真实案例 / 客户名永不公开
第七章 · 它带来的真实变化
用了它之后, 哪些事情变了?
把"判断"这件事从"凭感觉 + 凭记忆"变成"凭记录 + 凭机制"。
之前 · "李总当时为什么这样决定?" 半年后无人能完整答出
→
之后 · 每个判断有完整的关键变量 + 推理 + 反方记录, 任何人事后都查得到
之前 · 反对意见被"再讨论"吞掉, 反方=讲话稿
→
之后 · 反方变成必填字段, 系统不允许跳过, 反方=数据契约
之前 · 30/90/365 天后, 没人愿意盯, 也没法盯
→
之后 · 系统自动到期, 自动拉数据复核, 自动出复盘卡片
之前 · "这事去年讨论过吧?" 信号散在 5+ 个来源里
→
之后 · 知识库自动整合 + 反向引用, 每次判断都站在历史所有判断之上
第八章 · 设计哲学
三条永远不改的原则
这三条不是"我们当前的实现选择", 而是"违反任一条系统就不再工作"。
任何修改这些原则的提议, 都需要双人评审。
原则 一
知识只能单向流动
原料 → 知识库 → 判断书。判断书永远不能反过来改写知识库。
为什么 · 知识库是客观档案, 必须独立于任何具体判断。一旦"为了配合某个判断"修改知识库, 客观性就崩了。
原则 二
历史快照永不可改
判断书一旦写定, 系统层面锁死 — 任何人 (包括作者) 都改不了。新认识只能写成新版本, 老版本完整保留。
为什么 · 时间胶囊的意义就在"那一刻你究竟想了什么", 不在"现在你愿意承认你想了什么"。
原则 三
反方机制写进结构
每位评委必填三件事:
① 如果判错了, 哪一环最脆弱
② 近期有什么反向信号
③ 同类决策的失败率
为什么 · 反方机制如果靠"记得提醒", 一定会被吞掉。写进数据结构, 才进得了执行。
第九章 · 下一步
三个阶段, 一条曲线
从"一个人用"到"多个人共用"再到"方法论开放给外部"。每一步都对应一组明确的工程任务。
阶段一到阶段二: 主要是系统形态变化 (从一个用户到多个用户, 从本地到云端). 阶段二到阶段三: 主要是边界打开 — 把可脱敏的方法论 publish 出去, 让外部判断者也能上挂自己的视角。
结尾
下一个判断,
90 天后能怎样被检验?
这个问题, 我们让系统帮你必答。
公开层
方法论手册 (本站) · 9 篇架构决策 · 命令 / 接口参考 · 本份方法论 PPT — 全部脱敏后可访问
开源
GitHub · zhanglunet/boss-vault · 含工具脚本 + 评委定义 + 模板 · 不含真实案例与原料
贡献
欢迎 issue / PR · 公开层的任何改动都走双重脱敏闸 + 双人评审, 真名永不上公网