SRE المكثف عبر الإنترنت: سنقوم بتكسير كل شيء على الأرض ، ثم إصلاحه ، وكسره عدة مرات ، ثم إعادة بنائه

دعونا نكسر شيئا؟ وإلا فإننا نبني ونبني ونصلح ونصلح. الملل مميت.



دعنا نقسمها حتى لا يكون لدينا شيء لهذا - لن نثني فقط على هذا الغضب. ومن ثم سنعيد بناء كل شيء - لدرجة أنه سيكون ترتيبًا من حيث الحجم أفضل وأكثر تسامحًا مع الأخطاء وأسرع.



وسوف نكسرها مرة أخرى.



هل تعتقد أن هذه مسابقة لاستخدام الأداة الأكثر سرية بين جميع رواد الفضاء لدينا - مطرقة الفضاء الروسية الكبيرة؟



لا ، هذا هو SRE عبر الإنترنت مكثف. لقد حدث فقط أن كل دورة Slurm SREأبدًا ولأي شيء بخلاف السابق. ببساطة لأنك لن تخمن أبدًا أنه في نظام معقد ضخم ، والذي يتصل به الآلاف والآلاف من المستخدمين كل ثانية ، والجمهور نفسه يبلغ عدة ملايين ، يمكن أن يسقط ، ويتعطل ، ويضعف ، ويخيب ، وفي مئات الطرق الأخرى يفسد الحالة المزاجية لتغيير واجب مهندسي SRE.



في كانون الأول (ديسمبر) ، سنعقد SRE مكثفًا آخر .



صورة



دعونا نرتب استعادية صغيرة. ضع في اعتبارك كيف كانت الموارد البشرية ، قبل بضع سنوات فقط ، تجري سباقًا للعثور على المزيد من مهندسي DevOps في شركتهم. لقد تغيرت الجائزة. الآن ، مثل نظام التتبع "Pantsir-C1" ، يقومون بفحص المنطقة المحيطة بحثًا عن مهندسي SRE. لقد قلت في مقال " يوجين فاراففا ، مطور في Google. كيف تصف Google في 5 كلمات "، وكيف يعيش مهندس SRE في Google ، وكيف حتى هذه الشركة تعاني من نقص المتخصصين في SRE.



في دورة Slurm SRE المكثفة عبر الإنترنت في ديسمبر ، في غضون ثلاثة أيام ، من الساعة 10:00 إلى الساعة 19:00 ، ستتعلم كيفية ضمان السرعة والتسامح مع الأخطاء وتوافر المواقع في ظروف الموارد المحدودة ، والقضاء على حوادث تكنولوجيا المعلومات وإجراء استخلاص المعلومات حتى لا تتكرر المشكلات.



المتحدثون في الدورة:



إيفان كروغلوف . مهندس برمجيات الموظفين في Databricks. من ذوي الخبرة في شركات المؤسسات في التسليم الموزع ومعالجة الرسائل ، BigData و Web-stack ، والبحث ، وبناء السحابة الداخلية ، وشبكة الخدمات.



بافيل سيليفانوف . كبير مهندسي DevOps في Mail.ru Cloud Solutions. على حساب العشرات من البنى التحتية المبنية ومئات من خطوط أنابيب CI / CD المكتوبة. مسؤول Kubernetes المعتمد. مؤلف للعديد من الدورات التدريبية في Kubernetes و DevOps. متحدث منتظم في مؤتمرات تكنولوجيا المعلومات الروسية والدولية.



كل شيء سيكون صعبًا وغير متوقع وعمليًا. سوف تقوم بالبناء والكسر والإصلاح - وأحيانًا في مجموعة متنوعة من التسلسلات.



بناء:يجب عليك صياغة مؤشرات SLO و SLI و SLA لموقع يتكون من عدة خدمات مصغرة ؛ تطوير بنية وبنية تحتية تدعمهم ؛ بناء واختبار ونشر الموقع ؛ تكوين المراقبة والتنبيه.



كسر: ستأخذ في الاعتبار العوامل الداخلية والخارجية لتدهور SLO: أخطاء المطورين ، وإخفاقات البنية التحتية ، وتدفق الزوار ، وهجمات DoS. تعلم كيفية فهم المرونة وميزانية الخطأ وممارسة الاختبار وإدارة المقاطعة والحمل التشغيلي.



الإصلاح: سيتم تدريبك على تنظيم عمل فريق الاستجابة للطوارئ بسرعة وفعالية في أقصر وقت ممكن: التواصل مع الزملاء وإخطار أصحاب المصلحة وتحديد الأولويات.



دراسة:سوف تكون قادرًا على تحليل نهج الموقع من حيث SRE. تحليل الحوادث. تحديد كيفية تجنبها في المستقبل: تحسين المراقبة ، وتغيير البنية ، وأساليب التطوير والتشغيل ، واللوائح. أتمتة العمليات. تحاكي



SRE المكثفة عبر الإنترنت الظروف الحقيقية - سيكون الوقت لاستعادة أداء الخدمة محدودًا للغاية. كما هو الحال في الحياة الواقعية ، كما في حالة العمل الحقيقية.



يمكنك معرفة شروط دورة SRE ، وكذلك دراسة البرنامج الكامل ، هنا .



تمت جدولة الدورة المكثفة عبر الإنترنت في ديسمبر 2020. بالنسبة لأولئك الذين يدفعون مقابل المشاركة مقدمًا ، قمنا بإعداد خصم.



هل أنت مستعد للتدريب المكثف والتحديات الصعبة والحوادث المفاجئة؟



فقط لن تفعل. سيكون هناك نمو مهني.



All Articles