不装任何东西、不写任何 prompt。把方案文档发给机器人, 几分钟后收到多评委独立评审: 评分与等级、关键缺口、反方视角、修订建议清单。@ 机器人提议题, 还能启动完整判断流水线。
直接把 docx / pdf / pptx / md 发给机器人 (支持一次多份攒批)。异步排队评审, 完成后自动回推评审卡片 + 报告文件 — 报告按你的文档标题命名, 多组提交也分得清。
用自然语言 @ 机器人提一个战略议题, 启动 6 阶段判断流水线: 并行调研 → 合成 → 多评委独立打分 → Lead 合议。GATE 确认卡让你在调研启动前把关方向, 产出完整判断书。
与带 doctrine 的分身机器人多轮对话。每个论点带三档标注: 【有据】有知识库出处 / 【推演】从原则推出 / 【存疑】不确定 — 分身不冒充全知, 编造被机制性抑制。
下面是一段虚构的典型交互 — 你发文档, 机器人先回执, 评审好了自动送上来, 不用催。
和网页版 / CLI 版同一套引擎与纪律 — 评委独立打分互不可见, 反方机制是必填项而不是姿态。
每位评委按 panel 定义的维度独立打分, 满分相加出总分; 按门槛映射等级建议 (如: 重写 / 修改 / 提交人工评审)。锚点评委另用独立心证尺子, 不与维度总分混算。
每位评委从自己的 doctrine 出发指出主叙事没覆盖到的角度 — 被选进 panel 就是因为视角不同, 泛泛的通用结论会被 prompt 纪律压掉。
维度评委必须回答三问: 如果结论错了, 哪一环最脆弱? 近期有什么反向信号? 同类决策的历史 base rate? 缺一不可, 系统强制。
评审模式独有交付: 各评委「如果是我会改的几点」聚合成可执行的修订清单, 配 30/90/365 天可观测的验证锚点。
@机器人 + 一句话议题, 按 GATE 卡确认即可.env (飞书应用凭证 + LLM provider key), 启动机器人与评审 worker 两个服务工程师想绕过飞书、用自己的模型直接调判断引擎? 走 boss-as-a-Service · MCP 接入。想完全掌控整条流水线? 走 自托管 CLI。