Vận hành
incident
còn gọi là sự cố
Sự việc đang làm hỏng trải nghiệm người dùng thật, cần xử lý ngay thay vì xếp hàng đợi.
Ranh giới giữa bug và incident không nằm ở mức độ khó, mà ở chỗ người dùng đang chịu thiệt ngay lúc này. Một lỗi hiếm gặp nhưng chặn hết đường thanh toán là incident; một lỗi hiển thị xấu gặp hàng ngày thì không.
Trong lúc xử lý, thứ tự đúng là: chặn máu trước, hiểu nguyên nhân sau. Tìm root cause khi người dùng còn đang hỏng là đặt tò mò lên trên thiệt hại.
Bài dùng thuật ngữ này
- Tư duy Shift LeftNền tảng
- Chưa đo được thì chưa kiểm soát đượcNền tảng
- Vai trò và trách nhiệmNền tảng
- Từ ý tưởng đến releaseTổ chức công việc
- Vòng đời một hạng mục công việcTổ chức công việc
- Ưu tiên công việcTổ chức công việc
- Chuẩn viết codeYêu cầu với lập trình viên
- Chuẩn pull requestYêu cầu với lập trình viên
- Chuẩn test của devYêu cầu với lập trình viên
- Chuẩn riêng cho Chat, Task và Bán hàngYêu cầu với lập trình viên
- Definition of DoneKiểm soát chất lượng
- Automation test cho mobile và APIKiểm soát chất lượng
- Chất lượng ở quy mô 500.000 người dùngQuy mô và hiệu năng
- Device matrix và OS support policyQuy mô và hiệu năng
- Vì sao cần kiểm kê thiết bị testQuy mô và hiệu năng
- Quy trình release và rollbackPhát hành
- Release từng phần và feature flagPhát hành
- Production monitoringVận hành
- Quy tắc cảnh báoVận hành
- Bug severity, on-call và root cause analysisVận hành
- Yêu cầu báo cáo và điều kiện kỹ thuật đi kèmVận hành
- Đo lường sản phẩmNgười dùng và số liệu
- Security baseline và privacyQuản trị rủi ro
- Bảo mật và quyền riêng tưQuản trị rủi ro
- Sức khoẻ đội ngũQuản trị rủi ro
- Mẫu họp cải tiếnBiểu mẫu
- Mẫu báo cáo tuầnBiểu mẫu

