boss 的每份报告,都来自一场多评委独立合议。这一页把评委阵容的方法论一次讲清:固定的打分尺、各持 doctrine 的维度评委、锚点基线,以及"真人蒸馏视角"的构造法 —— 评委的独立与视角差异,本身就是发现真问题的来源。
无论什么议题、哪位评委,都在这 5 个固定镜头上各打 1–10 分。镜头回答的是"评估按什么尺子",与评委的切入角度正交。
Reasoning Soundness —— 从事实到结论的 trace 是否自洽,有没有跳步、循环论证或偷换前提。
Evidence–Thesis Coupling —— 主张与它援引的证据是否真的匹配,还是"结论先行、证据装饰"。
Counter-position Treatment —— 是否严肃对待了反命题,还是只立不驳、回避最强反例。
Falsifiability —— 30 / 90 / 365 天的检查点是否可被独立观测,而不是永远无法被证明错。
Real-world Resilience —— 落地路径是否承受得住外部噪声、资源约束与执行摩擦。
六位维度评委各持一套战略 doctrine,从不同角度切同一份材料。5 镜头是尺子,6 维度是切入角度 —— 评委独立打分、互不可见,让视角差异成为有意义的数据。
把议题放进宏观与竞争格局里看:趋势是真拐点还是炒作周期,时机对不对。
方向与取舍:目标是否清晰有野心,战略是否有真正的核心,机会成本算清了吗。
从客户视角看价值:要完成的任务是什么,目标客户是谁,单位经济能不能跑通。
产品与商业模式:最小可行如何验证,完整产品是否成立,会不会被颠覆。
组织能不能扛住这个战略:结构与人是否匹配,变革怎么落地,先人后事了吗。
经营与财务底盘:护城河在哪,单位经济与现金流健康吗,估值有没有幻觉。
议题类型自动匹配上场维度(战略 / 产品 / 组织 / 客户 / 经营 / 跨域),通常 3–4 位维度评委参与合议,而非六维全上 —— 既省算力,也让每场评审聚焦。
除维度评委外,还有一位"锚点评委"——用一号位自己的心智模型(触发-阈值-行动 / 跳步识别 / 反方排除)独立打分,不参与维度加权,只作独立基线。
每场评审都算一个 delta:维度评委的加权均分 减去 锚点的心证均分。差值大时(正数=维度更乐观,负数=锚点更乐观),报告会高亮提示。
它不替人下判断,而是把"评委过度乐观/悲观"与"决策者跳步而不自知"这两种可能,摆到决策者面前 —— 是一面镜子,不是一个裁判。
评委不在多,而在能提出尖锐问题。除通用维度评委外,可按业务领域动态"蒸馏"出更具体的视角评委。一个有效阵容通常由三类视角交叉构成:
愿景、目标、组织,以及经营逻辑与经营风险 —— 站在决策者的位置上,问"这真的是我们要的吗"。
用第一性原理、资源聚焦与"删除、简化",挤掉水分、逼出硬指标 —— 问"如果从零开始,还会这么做吗"。
按业务领域,从对应领域标杆企业/人物的公开战略视角切入 —— 问"这个领域跑在最前面的人会怎么看"。
"行业标杆"视角可蒸馏自公认的公开思想领袖的公开言论与战略主张。例如评审 AI / 科技战略议题时,可能上场这样的视角评委(点开看每个视角的说明):
上述仅为方法示例 —— 均取自公开人物的公开观点,用作"视角镜子";具体上场视角随议题领域动态适配。
此外还有一批"角色原型"视角(不指向具体个人):经营结果 / 资本市场投资人 / 政府关系 / 中性观察 等,按场景需要组合。
同一套"镜头 × 评委"体系,按高频 × 高价值 × 可闭环的原则,适配到不同评审场景。小切口、大纵深 —— 从一个场景跑通,再复制到更大规模。
公司级、事业群级、专项级的经营规划与战略方案 —— 多维度评委 + 锚点基线,给出结构化判断。
从主题、问题、共识、行动多视角总结一场会议,汇成一份可传播的复盘。
发言、汇报、方案、周报的过程化预审 —— 拿到高质量反馈后再修正,把返工成本降到最低。
行动台账 + T+7 / T+30 跟催 + 30/90/365 归因 —— 让判断有下落、可回看、能被验证。
方案横向比拼场景:统一标尺给多份方案打分排序,不设个人锚点,重在公平可比。
把一号位的心智模型蒸馏成对话式分身,用一个视角快速给出即时评议。
每位评委只读材料合成、不读其他评委的评审,各自独立打分。这是合议设计的核心 —— 差异不是噪声,是信号。
每份维度评审必答三问:判断错了哪一环最脆弱、近期有无反向信号、同类决策的 base rate 是多少。不允许只立不驳。
AI 是参谋、外脑与镜子,判断权始终在人。证据分三档置信度,缺证据只出初评与待补材料,不硬下结论。