انطلق تنبيه في تمام الساعة 2:10 صباحًا. قام أحد المهندسين بتطبيق تغيير في الإعدادات، فبدأت خدمة التحقق من النظام بإرجاع أخطاء، فقام المسؤول المناوب بإلغاء التغيير بعد 40 دقيقة. في اجتماع المراجعة، كان السؤال الأول: "من قام بتطبيق التغيير؟". في غضون دقائق، تحول النقاش إلى تقدير شخص واحد في الساعة الثانية صباحًا، ولم يسأل أحد عن سبب وصول التغيير إلى بيئة الإنتاج دون إجراء اختبار تجريبي، أو سبب تأخر ظهور التنبيه، أو سبب تقادم دليل التشغيل.
هذا سيناريو توضيحي، وليس حالة عميل. وهو قابل للتمييز لأنه يحدث بالفعل: فمراجعة الحادث التي تركز على آخر شخص قام بالتصرف تُنتج قصة مُنمقة وقليلًا جدًا من الدروس المستفادة.
هذا الدليل مُخصّص لمديري الهندسة وقادة التمكين الذين يرغبون في تحسين مهارات الموظفين في تحليل أدلة الحوادث والاتفاق على التحسينات القابلة للاختبار. ويتناول كيفية فصل فجوات المهارات عن الظروف المحيطة بها، وكيفية تصميم الممارسات، وكيفية إجراء جلسات التقييم، وكيفية قياس مدى فعالية المراجعات.
ما يعنيه مصطلح "بلا لوم" وما لا يعنيه
يوضح كتاب جوجل "هندسة موثوقية المواقع" الأمر بوضوح: لكي يكون تحليل ما بعد الحادثة خالياً من اللوم، يجب أن يركز على تحديد الأسباب المساهمة في الحادثة دون توجيه الاتهام لأي فرد أو فريق بسلوك سيئ أو غير لائق. كما يصف الكتاب الافتراض الأساسي: أن جميع المعنيين تصرفوا بنوايا حسنة وقاموا بالشيء الصحيح بالمعلومات التي كانت لديهم.كتاب جوجل SRE بعنوان "ثقافة ما بعد الوفاة: التعلم من الفشل".)
لا يعني الإعفاء من اللوم عدم وجود عواقب. يتوقع الفصل نفسه أن تنتهي التحقيقات اللاحقة ببنود عمل ذات أولوية ومسؤول عنها. لا يزال التحقيق غير الموجه لللوم يتطلب المساءلة، ولكن المساءلة تنتقل من "من تسبب في ذلك؟" إلى "من سيجعل النظام أكثر أمانًا، ومتى؟". إذا أغفلت مراجعاتك النصف الثاني، فستجري محادثة ودية، لا عملية تعلم.
1. تحديد السلوك وسياقه
ابدأ بالسلوك المحدد الذي ترغب في تغييره. فعبارة "تركز مراجعات الحوادث لدينا على آخر شخص قام بالتصرف" قابلة للملاحظة، بينما عبارة "ثقافتنا تركز على إلقاء اللوم" ليست كذلك.
ثم اسأل نفسك ما إذا كانت هذه مشكلة تتعلق بالمهارة أصلاً. فالتدريب لا يُعالج إلا بعض أسباب ضعف الأداء. قبل أن تبدأ في بناء أي شيء، حدّد ثلاثة احتمالات:
- مهارة مفقودة. لا يعرف المراجعون كيفية بناء جدول زمني، أو التمييز بين المحفز والعامل المساهم، أو السؤال "ما الذي جعل هذا الإجراء يبدو معقولاً في ذلك الوقت؟"
- حوافز. تُساهم التقييمات في مناقشات الأداء، لذا يقوم الأشخاص بتعديل حساباتهم لحماية أنفسهم.
- تدرجات السلطة والاستجابات السابقة. لن يثير المهندس المبتدئ الذي أثار مخاوفه في الربع الماضي وطُلب منه التوقف عن السلبية، مخاوفه في هذا الاجتماع، مهما كان تدريبه جيداً.
المشكلة الأولى فقط تتعلق بالتدريب، أما المشكلتان الأخريان فهما ظروف. إذا درّبت على المهارة وتركت الظروف دون تغيير، فسيكرر الموظفون ما يُعاقب عليه في بيئة العمل. تعامل مع وجهة نظرك الحالية حول السبب كفرضية، واختبرها من خلال بعض المحادثات مع المهندسين والاطلاع على وثائق المراجعة الحديثة قبل الالتزام ببرنامج تدريبي.
2. تحديد الظروف التشغيلية للممارسة
لا تنتقل الممارسة إلا إذا استجاب لها مكان العمل. قبل أن يبدأ أي شخص بالتدرب، يجب الاتفاق على هذه النقاط مع الأشخاص الذين يُجرون التقييمات:
- المسؤوليات المعتمدة. من يُيسّر العملية، ومن يضع الجدول الزمني، ومن يتحمل مسؤولية إجراءات المتابعة؟ يجب توضيح الأدوار بشكل صريح حتى لا يرتجل الميسّر صلاحياته.
- كيف يستقبل القادة المخاوف. إذا قال أحد المهندسين "أداة النشر سمحت لي بتجاوز مرحلة الاختبار التجريبي"، فماذا يفعل المدير بعد ذلك؟ حدد الإجابة مسبقًا، على سبيل المثال: شكره، وتسجيل ذلك كعامل مساهم، وتعيين إجراء.
- رد المشرف. يحتاج تدريب الموظفين إلى استجابة مماثلة من المشرفين. إذا درّبت المهندسين على التعبير عن آرائهم في التقييمات، لكن مديريهم ما زالوا يسألون "من المخطئ؟"، فإن التدريب سيفشل.
يُعدّ تقديم شرح موجز للمديرين حول عملية التقييم بنفس أهمية تدريب المشاركين. يجب تضمين بيان واضح حول كيفية استخدام وثائق التقييم في إدارة الأداء، وما لا يُستخدم منها.
3. تصميم رحلة تعليمية قائمة على السلوك
تُشير إرشادات مركز إيبرلي التابع لجامعة كارنيجي ميلون بشأن أهداف التعلم إلى نقطة مفيدة، وهي أن الأهداف والتقييمات والاستراتيجيات التعليمية يجب أن تتوافق مع بعضها البعض (مركز إيبرلي، أهداف التعلم). هذا توجيه تصميمي، وليس دليلاً على أي أداة أو نتيجة معينة، ولكنه اختبار جيد لهذا البرنامج: إذا كان الهدف هو تحليل الأدلة والاتفاق على تحسينات قابلة للاختبار، فلا يمكن أن تكون أسئلة الاستذكار وحدها هي التقييم.
يُفيد تصنيف بلوم هنا في وصف المتطلبات المعرفية للمهمة: التحليل، والتقييم، والإبداع. فهو يصف ما تتطلبه المهمة من الشخص، لكنه لا يُفسر سبب قيامه بها أو عدم قيامه بها، لذا لا يُنصح باستخدامه لتشخيص الدافع.
تتكون الرحلة الناجحة من ثلاث مراحل.
| المرحلة | إجراء المتعلم | مدة التسليم |
|---|---|---|
| التحضير | اقرأ سياسة مراجعة الحوادث الخاصة بك وقاموس المصطلحات المختصر (المحفز، العامل المساهم، التخفيف، الإجراء المطلوب). تحقق من المتطلبات الأساسية بإجراء تشخيص موجز. | دراسة ذاتية الوتيرة. اختبار التذكر يؤكد المتطلبات الأساسية فقط، وليس مهارات المراجعة. |
| ممارسة | قم بتحليل حالة حادثة مُعدة مسبقاً، واتفق على تحسينات قابلة للاختبار. المطلوب هو رد منطقي، وليس مجرد اختيار من بين عدة خيارات. | ممارسة تفاعلية أو مُيسّرة لدراسة الحالة، مع تقديم ملاحظات حول جودة تحليل العوامل المساهمة والمتابعة. |
| مراجعة ونقل | ناقش خيارًا غامضًا واحدًا، ثم أكمل حالة جديدة أو مراجعة حقيقية تحت الإشراف. | التدريب المباشر أو المراجعة غير المتزامنة. تحقق من مدى تطبيق المهارة بعد أن يتاح للأفراد الوقت الكافي لاستخدامها في العمل. |
اجعل الحالة واقعية واطلب من مهندس خبير التحقق منها. فالحالة الخاطئة تقنياً تجعل المراجعين يشككون في العملية.
4. العمل على السيناريو وتقييمه
إليك كيفية إجراء جلسة تدريبية باستخدام سيناريو 02:10. تحتوي حزمة الأدلة على سجل النشر، والجدول الزمني للتنبيهات، وسياسة الترحيل، وطلب السحب، ودليل التشغيل، وكلها افتراضية.
توجيه للمشارك. اشرح لماذا أصرّ المهندس على إجراء التغيير في ذلك الوقت. اذكر الأدلة التي استخدمتها. أخبرنا ما هي المعلومات أو الدعم الإضافي الذي ستحتاجه قبل أن تتمكن من التأكد من صحة إجابتك.
الرد الضعيف يبدو كالتالي: "كان ينبغي على المهندس التحقق من بيئة الاختبار." إنه يذكر اسم شخص، ولا يستشهد بأي شيء، ولا يقترح أي تغيير.
ردٌّ أقوى يبدو كالتالي: "يُظهر سجل النشر أن التغيير طُبِّق مباشرةً لأن خطوة الاختبار التجريبي اختيارية في الأداة. كان لطلب السحب مُراجع واحد وافق عليه بعد مرور 20 دقيقة. تم تشغيل الصفحة بعد 18 دقيقة من بدء الأخطاء لأن عتبة التنبيه مُحدَّدة على متوسط خمس دقائق. أود معرفة عدد التغييرات الأخرى هذا الشهر التي تخطت خطوة الاختبار التجريبي، وما إذا كان قد تم إبلاغ المهندسين المناوبين بإمكانية تخطي هذه الخطوة. الإجراءات المقترحة: جعل خطوة الاختبار التجريبي إلزامية لهذه الطبقة الخدمية، المسؤول: فريق المنصة، التحقق: محاولة نشر نسخة متجاوزة لخطوة الاختبار التجريبي في بيئة الاختبار والتأكد من حظرها؛ تقليل فترة التنبيه، المسؤول: قائد فريق المناوبة، التحقق: إعادة تشغيل أخطاء الأسبوع الماضي مقابل العتبة الجديدة."
لاحظ ما يجعله أفضل. فهو يستخدم الأدلة، ويحدد القيود والشكوك، وينتهي بإجراءات يمكن اختبارها.
والآن، حان وقت التقييم. لا تكتفِ بتقييم الأداء. اسأل:
- ما الذي دعمته الأدلة، وما الذي افترضته؟
- أي من الإجراءات التي تقوم بها سيكون للفريق صلاحية القيام بها فعلياً؟
- ما الذي سيسهل تكرار هذا السلوك في تقييمك الحقيقي القادم؟ وما الذي سيجعله أصعب؟
السؤال الثالث هو الأهم. فهو يكشف عن الشروط الواردة في القسم 2. إذا قال ثلاثة مشاركين "سيسأل مديري من فعل ذلك"، فقد وجدت قيدًا لا يمكن للتدريب إزالته.
5. قياس السلوك والمتابعة
السؤال الأساسي هو: ما الدليل الذي يُثبت قدرة المتعلمين على تحليل أدلة الحوادث والاتفاق على تحسينات قابلة للاختبار؟ إليكم معيارًا مبدئيًا للبدء. إنه اقتراح يُمكن تعديله بالتعاون مع مهندس خبير، وليس معيارًا مُعتمدًا للجاهزية.
| معيار | أدلة قابلة للملاحظة | 0 | 1 | 2 |
|---|---|---|---|---|
| تنفيذ المهمة | يحلل الأدلة ويوافق على التحسينات؛ ويسجل الإجراء والأدلة التي تدعمه | غائب أو غير مدعوم | جزئي، مع حذف بعض الأجزاء ذات الصلة | كامل ومبرر وفقًا للمعايير المتفق عليها |
| منطق | يشرح القيود والبدائل وعدم اليقين؛ وتتجاوز العوامل المساهمة الإجراء الأخير | غائب أو غير مدعوم | جزئي، مع حذف بعض الأجزاء ذات الصلة | كامل ومبرر |
| الحدود | يلتزم بالإجراءات المعتمدة؛ ويطلب المساعدة عند غياب المعلومات أو الصلاحيات | غائب أو غير مدعوم | جزئي، مع حذف بعض الأجزاء ذات الصلة | كامل ومبرر |
حدد الأخطاء الحرجة بشكل منفصل، على سبيل المثال تسمية فرد ما كسبب لها أو اقتراح إجراء دون وجود مسؤول عنه. يجب ألا يخفي ارتفاع مجموع الدرجات أي خطأ حرج.
أما بالنسبة للقياس نفسه:
- جودة تحليل العوامل المساهمة. قارن بين التقييمات المكتوبة قبل البرنامج والتقييمات المكتوبة بعده، مع تقييمها وفقًا لمعايير موحدة من قِبل شخص لا يعرف أيهما قبل البرنامج وأيهما بعده. استخدم حالات متابعة غير مرئية بالإضافة إلى الحالات الحقيقية.
- متابعة. احسب نسبة بنود العمل التي لها مالك، واختبار، وتم إنجازها، من إجمالي بنود العمل المطروحة. حدد المقام والفترة الزمنية.
- قم بربط الملاحظة بتغييرات العملية. احضر جلسة مراجعة حقيقية. تحقق مما حدث لبنود العمل بعد ذلك.
توخَّ الحذر عند الإبلاغ عن حجم الحوادث. فإذا سُجِّلت المزيد من المخاوف والحوادث الوشيكة بعد البرنامج، فقد يعني ذلك تحسُّن السلامة، أو زيادة الثقة، أو أن أداة جديدة سهَّلت عملية التسجيل. أما السقوط فقد يعني انخفاض المشاكل أو تراجع الرغبة في الإفصاح. انظر إلى التغييرات التي طرأت خلال الفترة نفسها قبل أن تُعزي أي تحسُّن إلى التدريب، وتجنَّب الادعاء بحجم تأثير لم تقم بقياسه.
تُركز إرشادات إيبرلي المذكورة أعلاه على التوافق، لكنها لا تُثبت أن هذا النهج يُقلل من الحوادث. احتفظ ببياناتك الأساسية وبيانات المتابعة الخاصة بك، واعتبرها أدلة محلية.
ما هي القيود التي قد تبقى حتى بعد تحسن المهارات؟
كن صادقاً بشأن هذه الأمور مع الرعاة:
- قد تظل وثائق المراجعة تؤثر على قرارات الأداء.
- قد تتجاهل الفرق التي تعاني من ضغط التسليم إجراءات مكلفة ولكنها معقولة.
- قد تتعثر تحركات الفرق المشتركة لأن لا أحد يملك السيطرة على المنطقة الحدودية.
- قد يظل كبار المهندسين مهيمنين على النقاش.
لا يؤدي تحسين التحليل إلى إزالة هذه المشكلات. لذا، خطط لتغييرات منفصلة في العمليات لكل منها.
تطبيق ذلك عمليًا باستخدام AhaSlides
يدعم AhaSlides التعلم التكيفي والتفاعلي، والتنقل بين التعلم المباشر والتعلم الذاتي. في هذه الرحلة، قد يتضمن ذلك خطوة تحضيرية ذاتية، وجلسة دراسة حالة مباشرة أو مُيسّرة مع أسئلة مفتوحة تُحفّز الجميع على الالتزام بتحليل قبل مناقشة المجموعة، ومهمة متابعة بعد الجلسة. يجب التحقق من وظائف التأليف والتقييم وإعداد التقارير المحددة من خلال عرض توضيحي على حالتك الخاصة قبل الاعتماد عليها، وأي شيء يتعلق بالذكاء الاصطناعي أو المحاكيات أو التكامل مع أدوات إدارة الحوادث يجب التعامل معه كعنصر خارجي حتى يتم عرضه.
الخطوة التالية: استخدم المعايير المذكورة أعلاه وقم بتعديلها مع أحد كبار مهندسيكم، ثم أنشئوا الحالة التي ستستخدمونها. إذا كنتم ترغبون في رؤية كيف يمكن أن تعمل نسخة عملية ذاتية الوتيرة من هذه الرحلة، احجز عرضًا توضيحيًا لسير عمل AhaSlides بمجرد الانتهاء من صياغة القضية ومعايير التقييم.








