Skip to content

周报评审 · 把过程管理变成经营雷达

很多组织已经在做「周报打分」:按各岗位模板给管理者的周报打提交率与内容分。但打分打着打着,常会退化成一件行政事务 —— 只回答「谁交了、谁分高」,而周报里真正有价值的东西(客户经营、订单回款、AI 产品化、组织协同、风险信号)反而没被读进去。

这一页讲一种做法:在既有打分之上,叠加一层「虚拟外部评审」 —— 不动原有分数,只读周报原文,用多个外部视角把周报变成一台利润转正与组织进化的雷达。它是评审智能体方法论在「材料预审 / 复盘追踪」场景上的一次深挖。


传统周报打分的两个缺口

  1. 模板压分不公平。 高管模板抽象度高,还常把「带队伍、看竞对」这类月度事项当成周度必答来扣分 —— 管理者本周一切正常,也会被结构性地打低。
  2. 只评文书,不评经营。 打分停在格式与提交率,不追问「这条客户进展有没有转化、这个 AI 试点有没有产品化、这笔签约有没有回款」。周报的经营信号被浪费了。

叠加一层虚拟外部评审,针对的正是这两个缺口:换一批只认经营、不吃模板的眼睛,重新读一遍原文。


方法:叠加,而不是替换

  • 不动既有分。 既有打分继续跑;虚拟评审是加法,忽略旧分、只读周报原文文字,做内容质量与经营价值的独立诊断。
  • 命名纪律:「XX 式视角」。 每位评委是一种外部视角的方法论,不复刻某个真人的口吻、不宣称由真人评审 —— 它是一面镜子,不是一个代言人。
  • 产出可行动。 不只给分,给「最值得保留的能力 / 最影响利润的短板 / 下周必须补充的 1–3 条 / 组织进化建议」。

六个外部视角

一个能问出尖锐经营问题的评委阵容,通常由这几类互补的外部视角构成(括号内是可借鉴的公开思想原型):

视角盯什么 · 治什么病
利润转正 · CFO 视角(如 Ruth Porat / Amy Hood 式)追问完整利润链:商机 → 订单 → 收入 → 毛利 → 费用 → 交付 → 验收 → 回款。治「写订单不写毛利、写签约不写回款」。
客户增长 · GTM 视角(如 Benioff 式)痛点真伪、决策链穿透、漏斗质量。治「写客户不写转化、写拜访不写决策链」。
第一性原理 · 执行视角(如马斯克式)抓瓶颈、删复杂度、硬指标闭环。治「写计划不写硬闭环、堆事项不抓瓶颈」。
AI 产品化 · 增长视角(如黄仁勋式)AI 从学习/概念 → 产品化/客户验证/生态。治「写 AI 学习不写 AI 产品、写试用不写标杆验证」。
部署闭环 · CTO 视角(如 Palantir forward-deployed 式)POC → 试点 → 上线 → 业务结果闭环。治「写 POC 不写上线、写交付不写结果」。
组织进化 · CHRO 视角(如 Laszlo Bock 式)人才密度、管理节奏机制、知识沉淀、文化透明。治「写开会学习当组织成果」。

每位评委各持一套细则,并共读一份校准规则(证据优先 / 周月分离 / 角色适配 / 反模板压分 / 高分门槛 / 敏感度)—— 让六个视角标准一致、互不越位。


打分:一把经营尺子

不用格式与提交率打分,改用一把6 维经营尺子(合计 100):

维度权重
利润链与现金质量25
客户链与增长转化20
AI 产品化与方案验证15
执行闭环与第一性原理15
组织进化与知识沉淀15
风险治理与真实表达10

利润与现金质量权重最高 —— 尺子本身就在表达「什么最重要」。


输出:「七块」结构

每份周报的评审产出固定七块,让结论可读、可核对、可行动:

  1. 一句话判断,并归入 5 类管理状态之一(经营闭环型 / 事项推进型 / 认知输出型 / 风险暴露型 / 过程断档型)—— 由分数机械归类,不靠感觉。
  2. 总分 + 6 维分 + 最低两项
  3. ≥2 条原文证据(不能空口下结论)。
  4. 最值得保留的能力
  5. 最影响利润转正的短板
  6. 下周必须补充的 1–3 条
  7. 组织进化建议

硬校验:没有原文证据不得高分、只有口号不得高分、拿最高档必须"经营五链齐全"。


定级是刻度校准,不是放水

第一次跑,常会发现大多数周报都落在最低档 —— 不是人人不合格,而是既有模板从不引导写利润链,内容分被系统性压低。这时正确的动作是按真实分数分布重新定档(把"重写 / 修改 / 复核 / 优秀样例"的门槛对齐到实际直方图),而不是硬拔分。

刻度校准 ≠ 放水。 门槛跟着真实分布走,是为了让定级重新有区分度;分数本身的硬校验一条不松。


群体视图:分层抽样 + 聚合诊断

管理者要的往往不是某一份,而是一个群体这一季在往哪走。做法:

  • 数值聚合:各维均值 / 中位数 / 离散度 + 定级分布。
  • 分层抽样代表:按总分高 / 中 / 低各取少量代表(控制成本,不把成百上千份原文一次喂给模型)。
  • 聚合诊断:每个群体回答三问 —— 能力在进化什么?哪个能力风险最影响利润转正?下半年怎么用?
  • 不做重复排名:群体评价是为了看趋势与短板,不是再排一次名次。

AI × 人:两把尺子交叉验证

AI 的内容质量分,与既有的人工总分,是两把不同的尺子。把它们放一起看,比单看任一把都有用:

  • 相关性:两轴大体同向 → 互证;差异大 → 各自捕捉了不同信号。
  • 显著分歧才是金矿:「AI 高、人工低」= 内容很强但被过程/格式拉低;「人工高、AI 低」= 过程达标但内容单薄。这些分歧点最值得人去看。
  • 关键纪律:既有分只用于事后对照,绝不喂给 AI 评审 —— 否则 AI 会被旧分带跑,失去独立价值。

访问控制:用「登录 + 角色」取代「群成员脱敏」

把这套评审放到一个带登录的内部平台上时,一个常见的坑是靠"聊天群成员"来控权 —— 群成员随时可变,有人被拉进即泄漏,是脆弱的访问控制。更稳的模式:

  • 按登录用户的角色发内容:管理/HR 角色看全量(跨组对比、导出),个人只看自己那份与自己的历史。
  • 逐用户控权天然消除"群成员漂移"风险,也顺带满足了"看全局、可导出"的需求。
  • 认证要 fail-closed:只配了一半的强认证参数就拒绝启动,不静默降级成弱认证。
  • 内部授权面发原文、公网出口才脱敏:对已登录授权用户,真名/客户/数字是内容本身;只有真正对外(公开发布 / 外发)才过脱敏闸。详见人机共判与脱敏边界

人机共判红线

  • AI 是外脑与镜子,判断权在管理者。 评审给的是更聚焦的输入,不是结论。
  • 评审结果不作为个人绩效口径。 它用来让下一份周报写得更有经营含量,不用来考核人。
  • 反模板压分。 评委被明确要求不复刻旧模板的扣分逻辑,月度事项不当周度必答扣。
  • 证据优先,缺证据不下结论。 没有原文支撑的判断,宁可只给初评与待补清单。

落地建议

  1. 先选一个高频、高价值、可闭环的汇报场景(周报是天然入口)。
  2. 搭 4–6 个外部视角评委,给一把经营尺子,写清校准规则。
  3. 先跑一批样本校准刻度,按真实分布定档,再逐步扩到全量。
  4. 群体视图 + AI×人交叉验证 给管理者看趋势,个人视图给当事人看"下周必补"。
  5. 访问控制走登录 + 角色,内部发原文、出口才脱敏。

把周报从"谁交了、谁分高",变成"这个组织在经营上正往哪走、哪一环最脆弱" —— 评审的价值,从来不在打分,而在让被评的人下一次做得更好

判断力工程化 · Judgement, Engineered · 主站 · GitHub