跳转到内容

第 3 周:核对证据并建立受限基线

直接答案: 第一次访谈或观察只能告诉你“这里可能有问题”,不能证明问题的频率、影响或根因。第 3 周要做的是选择三项会改变方向的假设,用更多角色、正常与异常任务、获准日志或可信模拟交叉核对,再写出一份明确说明样本、时间窗、来源、矛盾和未知的受限基线。

本周在证据链中的位置

标题“本周在证据链中的位置”
第 2 周:第一次跨层证据循环
→ 第 3 周:核对样本、口径、异常与竞争解释
→ 第 4 周:用有边界的证据作范围决定

如果你的原案例已经没有安全的访问条件,可以保留“本周无法继续取证”作为正确结论,改用本页的固定合成材料练习方法。没有授权,不是让你绕过权限的障碍;它本身就是范围证据。

先看完成品:一个受限而可信的结论

标题“先看完成品:一个受限而可信的结论”

下面所有公司、角色、工单、时间和结果都是北辰协作固定合成教学材料,不代表真实客户或生产结果。

第 2 周留下的初步解释是:

[H] 政策查找可能是客服处理计费任务的主要瓶颈。

第 3 周不能只找支持这句话的样本。先保留五个竞争解释:

  1. 真正耗时的是搜索不到材料;
  2. 材料能找到,但版本、生效日期或适用地区难判断;
  3. 普通任务很快,只有权限或政策冲突的异常任务慢;
  4. 主要等待来自主管审批,而不是查找;
  5. 工单复杂度、标签质量或并行工作造成了看似很长的处理时间。

任务包 northstar-week03-replays-v1 包含 8 条合成脱敏回放。时间窗是一个教学工作日;它不是随机抽取的真实业务样本。

任务 ID 类型 路径 可观察行为 从首次查询到选定依据 结果边界
N-01 套餐升级差价 正常 打开知识库 3 篇、群通知 1 条 5:52 只证明这一次跨来源核对
N-02 重复扣费说明 正常 打开知识库 1 篇 1:18 未观察到跨来源核对
N-03 发票下载 正常 使用固定操作页 0:46 不需要政策判断
N-04 套餐降级 正常 打开知识库 2 篇 2:41 比较生效日期
N-05 试用期结束 正常 打开知识库 1 篇 1:09 单一来源完成
X-01 高金额特殊退款 权限异常 看不到主管规则,转主管 未选定 等待另行记录,不能填成搜索耗时
X-02 两份政策冲突 内容异常 打开 3 篇并升级知识所有者 未选定 正确结果是升级,不是强选一篇
X-03 工单缺少地区 输入异常 停止查询并补字段 未开始 缺字段使政策判断无效

从这 8 条固定回放只能得到:

  • [O] 来源=northstar-week03-replays-v1,合成环境,样本 n=8;其中 3/8 打开了两个或更多知识来源(N-01、N-04、X-02)。
  • [O] 同一样本中,2/8 因权限或政策冲突没有选定依据(X-01、X-02),另有 1/8 因缺少地区没有开始查询(X-03)。
  • [I] 跨来源核对确实出现在这组计费任务里,但它与版本判断、权限、冲突和输入完整性纠缠在一起。
  • [U] 这 8 条是否代表真实任务分布、总体耗时或成本结构。
  • [H] 如果先改善版本和适用范围的可追溯性,某些任务可能更容易完成;什么方案最合适仍未知。

一个合格的受限结论是:

在固定合成计费任务包 northstar-week03-replays-v1 的 8 条回放中,观察到 3 条跨两个或更多知识来源,2 条因权限或政策冲突没有选定依据。现有材料支持继续调查“版本、权限和异常路径怎样影响政策确认”,但不能证明政策查找是全部客服成本的主要来源,也不能证明 AI 是最佳干预。

这段话的价值在于它改变了下一步问题,而不是把一句假设写得更自信。

最小心智模型:声明、证据和结论不是一回事

标题“最小心智模型:声明、证据和结论不是一回事”

每次补证都经过同一条小循环:

待核对声明
→ 竞争解释
→ 能改变方向的最小观察
→ 样本、来源与口径
→ 受限结论
→ 下一项决定问题

六种标记继续沿用

标题“六种标记继续沿用”
标记 本周使用规则 常见误用
[Q] 只证明某人作了这项陈述 把“经常”换算成频率
[O] 写明来源、日期、样本和真实或模拟情境 一次回放外推到所有任务
[I] 回链支持证据,同时保留其他解释 把解释写成根因
[H] 写出验证动作和会反驳它的结果 只寻找支持材料
[D] 写明有权角色、范围和日期 把管理目标当已经实现的结果
[U] 继续保留,不用估计填满 为了做表而编数字

不要用平均数消灭异常

标题“不要用平均数消灭异常”

正常、异常和权限路径承担的风险不同。把 X-01 的“等待主管”硬填成搜索时间,再与正常任务求平均,会让错误口径看起来很精确。先按任务类型和终态分层;样本不足时就报告逐例结果。

第 1 天:选择三项会改变方向的假设

标题“第 1 天:选择三项会改变方向的假设”

week-03-research-plan.md 中选择三项,而不是试图回答所有未知。优先核对“答案不同会导致继续、缩小、改用流程方案或停止”的问题。

完成的 assumption-test-plan.md 示例:

假设 支持它的现有材料 竞争解释 最小核验动作 什么结果会反驳或缩小它
政策查找是主要瓶颈 [O] N-01 跨知识库和群通知 版本判断、权限、审批或任务复杂度 分层回放 5 条正常、3 条异常任务 多数正常任务不需跨来源;异常主要等待主管
个人收藏造成旧政策风险 [Q] 一位客服使用个人笔记 收藏可能只是入口,最终仍核对正式来源 访谈知识所有者并复盘一次更新 收藏只存链接且有自动失效机制
缩短查找可释放容量 老板的价值假设 时间可能转移到审批、写作或返工 定义任务步骤和容量兑现所需数据 节省时间不能改变积压、排班或招聘动作

检查每一行:如果无论结果是什么,你都准备做同一个功能,这就不是一次有效核验。

第 2 天:先写访问和样本边界

标题“第 2 天:先写访问和样本边界”

完成 sample-and-access-note.md,先回答四个问题:

  1. 你获准接触什么,谁授权,期限到何时?
  2. 样本怎样选择,哪些任务没有进入?
  3. 每个字段代表什么业务事件,缺失时意味着什么?
  4. 哪些信息只能使用脱敏回放或合成材料?

北辰完成示例:

# 样本与访问说明 v1
- 情境:课程固定合成回放,不是真实客户数据
- 样本:8 条计费任务;5 条正常、3 条异常/权限任务
- 选择目的:比较路径,不估计真实分布
- 包含字段:任务类型、可见步骤、来源数量、任务终态、合成时间线
- 不包含:客户身份、真实金额、消息正文、员工绩效、生产日志
- 不能证明:总体频率、平均处理时间、真实错误率、成本或采用
- 如果使用自己的材料:必须记录数据所有者、授权范围、保留期限与撤回方式

第 3 天:走一条正常任务和一条异常任务

标题“第 3 天:走一条正常任务和一条异常任务”

观察时按时间记录,不要边看边宣布根因:

时间 触发或输入 可见动作 系统/材料 可见终态 证据标记 待确认

至少补一个数据、知识或风险所有者。让对方只验证自己有权回答的部分。例如知识所有者可以确认正式版本关系,不能替客服回答每天怎样绕路;主管可以解释队列规则,不能把个人员工的回忆变成总体数据。

无法接触真实角色时,使用第 2 周角色卡和本页固定任务包。产物标题必须写“课程模拟”,不能换成虚构客户名称。

第 4 天:完成证据登记并保留矛盾

标题“第 4 天:完成证据登记并保留矛盾”

evidence-register-v1.md 不只是材料清单。每一行都要说明它支持什么、不能支持什么:

ID 标记 内容 来源/样本/日期 支持的判断 不能证明 关联假设
E-01 [Q] 主管说查政策占客服大部分时间 合成主管角色卡;1 人;2026-08-25 主管持有这项解释 真实时间占比 H-01
E-02 [O] N-01 打开 3 篇知识库和 1 条通知 合成回放 v1;1/8;2026-08-25 该任务发生跨来源核对 所有工单都如此 H-01
E-03 [O] N-02、N-03、N-05 使用单一来源 合成回放 v1;3/8;2026-08-25 部分正常任务没有跨来源 真实总体占比 H-01
E-04 [I] 异常任务的版本与权限可能比搜索更重要 E-01 至 E-03 值得把异常单独研究 已找到根因 H-01

矛盾示例:访谈说慢,日志字段却很短

标题“矛盾示例:访谈说慢,日志字段却很短”

假设一个系统字段记录 search_duration=42s,客服回放却显示从首次搜索到选定依据用了 5:52。不要取平均,也不要立即判断谁错了。写进 contradiction-log-v1.md

- 解释 A:search_duration 只记录输入搜索词到结果页返回。
- 解释 B:回放时间包含打开文档、比较版本和查看通知。
- 解释 C:观察中有并行任务或停顿。
- 当前结论:两个口径衡量的可能不是同一事件。
- 下一步:让系统所有者说明字段起止点,并把时间映射到任务步骤。

矛盾不是需要清理掉的噪声;它经常暴露指标和真实任务不一致。

第 5 天:修订流程,并让相关角色回读

标题“第 5 天:修订流程,并让相关角色回读”

current-workflow-v0.md 复制为 v1,不要覆盖历史。每项改变写原因:

# current-workflow-v1 变更记录(合成示例)
- 保留:普通计费任务会先读取套餐、地区和购买时间。
- 缩小:不是所有任务都跨多个来源;当前只在 N-01、N-04、X-02 观察到。
- 新增:缺地区时在查询前停止;它不是“搜索失败”。
- 新增:政策冲突的正确结果是升级知识所有者,不是强行选一篇。
- 保留未知:主管等待的频率、时长和业务影响。

回读时不要要求所有人同意同一个“根因”。请业务负责人核对待支持的决定,请一线角色核对步骤与负担,请数据或知识所有者核对字段和版本关系。保留未解决的异议。

最后写 week-04-decision-questions.md

1. 第 4 周需要在继续补证、流程/内容治理、确定性薄片或停止之间作什么决定?
2. 哪一个角色、任务和异常已经有足够证据进入范围讨论?
3. 哪些指标只有口径,没有可信基线?
4. 哪些权限、隐私或额外负担会直接阻断方案?
5. 什么新证据会让当前解释缩小或失效?

五天安排与可见产物

标题“五天安排与可见产物”
学习日 建议时间 当天动作 离开前必须有的结果
第 1 天 1.5 小时 选择三项关键假设和竞争解释 assumption-test-plan.md
第 2 天 1.5 小时 检查授权、样本与字段口径 sample-and-access-note.md
第 3 天 2–3 小时 走查正常与异常任务,补一个证据所有者 时间线和原始记录
第 4 天 2 小时 建证据登记、受限基线和矛盾记录 evidence-register-v1.mdbounded-baseline-v1.md
第 5 天 1–2 小时 回读、修订流程并提出决定问题 current-workflow-v1.md、第 4 周问题

建议目录:

fde-course/
└─ week-03/
├─ assumption-test-plan.md
├─ sample-and-access-note.md
├─ evidence-register-v1.md
├─ bounded-baseline-v1.md
├─ contradiction-log-v1.md
├─ current-workflow-v1.md
└─ week-04-decision-questions.md

本周通过需要同时满足:

  • 每个总体数字都写明分母、时间窗、样本和来源;
  • [Q/O/I/H/D/U] 没有混写;
  • 正常、异常和权限路径都有证据或明确的 [U]
  • 至少一项原始解释被缩小、反驳或保留为未知;
  • 矛盾没有被取平均或静默删除;
  • 相关角色只回读自己能够验证的部分;
  • 无授权时停止读取真实数据,改用脱敏回放或合成材料;
  • 能说明当前基线不能证明 ROI、总体频率、根因或最佳方案。
常见失败 诊断信号 恢复动作
只抽方便或成功任务 样本全是同一正常路径 按任务类型、异常和权限重新分层
把日志字段当业务结果 报表有数字,却说不清对应哪一步 让字段所有者解释起止点并映射任务
访谈与日志冲突时选边 删除一方或直接求平均 保留两种解释,核对定义、时间窗和缺失字段
把“经常”写成频率 数字来自受访者修辞 降回 [Q],寻找可计数材料
开始讨论 AI 或 ROI 假设测试表出现模型和收益承诺 改问“什么证据会改变下一步决定”

独立迁移:核对“ERP 数据总是不准”

标题“独立迁移:核对“ERP 数据总是不准””

供应链负责人说:“ERP 数据总是不准,延误判断都靠人工。”使用第 2 周供应链时间线,独立完成:

  1. 写同步延迟、字段质量、人工确认、责任边界四个竞争解释;
  2. 设计一个正常订单和一个延误异常订单的最小核验;
  3. 指出 ERP、承运商门户、个人 Excel 和仓库消息各能证明什么;
  4. 写一段受限结论,不能使用“永远”“主要根因”或“实时集成一定有效”。

答案检查点:一条延误记录只能证明该案例存在来源时间差和人工核对;它不能证明 ERP 总体错误率,也不能直接批准预测模型或实时集成。

用同一证据向三类人解释

标题“用同一证据向三类人解释”
  • 老板版: 哪项假设被支持、缩小或反驳,哪个商业判断仍不能作出,为什么第 4 周值得评审。
  • 一线版: 哪条任务理解被修订,记录怎样使用,哪些内容不能外推到所有员工。
  • 工程版: 样本、字段口径、异常和权限怎样限制未来数据与系统设计;当前没有批准技术方案。

第 4 周只能使用这份有来源、有边界的证据包。重要未知必须原样进入 Brief,不能为了“完成 Discovery”填满。

核验日期:2026-08-25。 本页的北辰任务包、人物、数字、状态、五步核验过程和文件结构均为本教程的合成材料或原创教学设计,不是行业统一方法,也不代表真实客户、频率、成本、采用或业务效果。