Table of Contents
工程项目的价值
工程项目,无论是及时交付还是遇到意外挑战,都提供了丰富的学习来源。一个结构完善的死后经验有时被称为追溯性原始经验转化为可操作的知识。它使团队能够系统地审查所发生的事情、发生的原因以及如何改进今后的工作。正确的做法是,死后建立信任、促进心理安全并推动不断改进。 没有这种经验,团队有可能重复同样的错误,并失去完善其过程的机会。
有效的尸检并不是指责。 相反,它们侧重于发现系统性问题、沟通差距和导致结果的流程崩溃。 当团队采取无责方法时,它们鼓励诚实的反馈,并产生能带来有意义的变化的洞察力。 良好的尸检成为工程组织内部学习文化的基石。
是什么使死后有效?
并非所有的尸检都是平等的,最有效的尸检都具有几个关键特征,第一,在团队成员感到安全无责的环境下进行,第二,它们依靠数据驱动,依靠具体的证据,如时间,衡量标准,日志而不是记忆和主观意见,第三,它们产生一套明确的可采取行动的后续措施,最后,它们被融入团队的常规工作流程,而不仅仅是在重大失败后完成的.
工程团队经常使用结构化的格式来指导对话。 Atlassian recurvery play 提供了一个简单的框架:开始,停止,继续。其他人更喜欢更详细的方法来检查项目的具体阶段。无论选择何种格式,根本原则都保持不变——侧重于学习,而不是断层调查。
准备验尸
准备将一次富有成效的死后讨论与一次模拟讨论分开。在会议之前,收集所有相关数据,包括项目时间表、关键里程碑、可交付成果、会议说明和任何事件报告。通过简短调查或一对一对话收集小组成员的反馈。这一前期工作确保会议时间得到有效利用,并确保每个人都在对事实有共同理解的情况下抵达。
- 确定范围和目标。 这是整个项目的验尸结果还是只是一个特定阶段?你想回答的关键问题是什么?
- 确定利害关系方。 邀请参与项目的每一个人——开发者、设计者、产品管理者、质量保证和业务,外部伙伴也可以提供宝贵的观点。
- 准备一个时间表. 视觉时间表有助于追踪事件和决定的顺序. 包含计划日期与实际日期,以突出偏差.
- 确定议程和规范。明确声明会议是无责的,提前分享议程,以便与会者能够准备。
由一位准备好的调解人担任至关重要。 此人应该中立,熟练地指导对话,而不主宰对话。 他们的作用是保持讨论的轨道,鼓励更安静的声音,并确保小组从观察转向行动。
举行验尸会议
会议本身应该创造富有成效的对话,而不是演讲。首先要确定基调:重申目的和不指责政策。 然后通过一个结构化的议程。 一个共同的方法是将讨论分为三大类:什么进展顺利,什么发生错误,什么可以改进。
怎么样?
首先要从成功开始。 承认成就可以创造势头,提醒团队其优势。 庆祝胜利,如及时交付、有效合作或创新解决方案。 这一积极的框架使得以后更容易讨论挑战。
出什么事了? 发生什么了?
其次,找出问题。 避免“ 通信不良” 等模糊的言论。 询问具体事件和促成因素。 使用数据支持观测结果。 例如,“守则审查周转时间平均为48小时,而不是商定的24小时,导致整合阶段的延误 。 ” 这让讨论有根据和客观。
哪些措施可以改进?
最后,脑暴解决方案。 将影响最大的变化列为优先事项。 一些改进可能是速赢 — — 比如更新文件或添加Slack提醒。 另一些需要长期投资,比如采用新的工具或重组团队角色。 抓住所有想法,但行动计划侧重于一个可管理子集。
在整个会议期间,使用诸如的“五大原因”等技术深入挖掘根源。例如,如果部署失败,请询问为什么直到发现一个系统性问题,如自动化测试不足或部署脚本所有权不明。另一个有用的工具是时间线分析[,团队在白板上绘制事件图,以可视化因果关系。
pro Tip: Google SRE对尸检方法[强调无责写作——在写初级事件报告时没有点名个人,而是注重过程和技术故障。
]
会议后的调查结果分析
工作不会在会议休会时结束。 主持人或指定的记事员应该将结果汇编成一份清晰、简洁的报告。 将见解分为几类:流程问题、技术债务、沟通差距、资源制约和外部依赖。 对于每一类,请确定根源、影响和一个或多个建议的行动。
使用一个优先排序框架来决定首先要处理哪些行动。 简单的影响力与努力矩阵效果很好:应该立即处理影响大、效果低的项目。低影响、效果高的项目可以推迟或重新审视。 确保每项建议都与具体、可衡量的结果挂钩。
外部基准可以帮助验证你的发现。例如,将你的尸检结果与]埃齐无责的尸检文化[可以揭示出你的过程可以加强的领域。
制定并执行行动计划
死后行动的价值仅与其引发的变化相同,应制定正式行动计划,处理前三至前五项调查结果。每项行动应[S.M.A.R.T.[](具体、可计量、可实现、相关、有时限的),为每项行动项目指定一个单一所有人,并设定一个现实的最后期限。
- 实例行动:“通过确定轮换审查员时间表和整合Slack提醒,将平均代码审查周转时间从48小时缩短至24小时。
- 另一个例子:“为支付网关模块添加自动集成测试,以便在部署前抓住回归。所有者:Mike。到期日:30天。”
与大家广泛分享行动计划,不仅仅是与工程团队,而且也与需要知名度的利害关系方分享,以便不断改进。 考虑将这些行动项目添加到团队的项目管理工具中,并在日常立案或每周审查中跟踪这些项目。
学习的跟进和嵌入
最常见的死后失误之一是缺乏后续跟踪。 没有跟踪的行动很快失去了优先性。 定期检讨 — — 比如30天的检讨和90天的检讨 — — 以评估进展。 如果某项行动被搁置,那么就讨论哪些阻塞者的存在,并相应调整计划。
将学习内容融入团队的文件和流程中。更新运行本、部署清单、编码标准和登入材料。通过知识库或定期的“学习午餐”系列,团队之间分享经验教训。目的是从组织集体记忆中的每一段死后记忆中得出深刻见解。
避免的常见陷阱
即使是有经验的团队也可能陷入破坏尸检价值的陷阱。这里有一些陷阱需要注意:
- 点燃个人。 这禁绝了参与,助长了恐惧。专注于系统,而不是人。
- 移动太快。 讨论的进行导致肤浅的分析。允许有足够的时间来彻底探讨每个专题。
- 忽略小问题. 小问题可能复合,及早解决这些问题,防止下游出现较大的故障.
- 飞向文档. 没有书面记录,教训很容易被遗忘. 创建一个可搜索的死后档案.
- 动作超载。 试图同时修复一切会淡化焦点。优先处理一些高影响的变化,并妥善执行这些变化。
建设死后文化
最终,最有效的验尸是那些成为团队运作方式的常规部分的验尸。 当团队在每一个重要项目之后进行验尸 — — 而不是仅仅在失败之后 — — 它们使反思和改进的做法正常化。 这种文化转变需要领导支持、心理安全以及高级工程师和管理人员的一致模型。
随着时间的推移,尸检从偶尔召开的会议演变成不断改进的引擎。 它们帮助团队识别模式,测试新流程,并系统地提高质量和可靠性。 通过对有纪律的尸检进行投资,工程组织将每个项目转化为学习机会。
进一步阅读建立强有力的尸检做法时,请探讨[合作过程专家的先进尸检技术[]和 IBM关于有效进行尸检的指南]。