Chủ đề bài viết
SRE
Tổng hợp các bài viết về SRE
Fact: Jira/Confluence outage 2 tuần nhưng không mất một dòng dữ liệu
Tháng 4 năm 2022, Atlassian gặp một trong những sự cố nghiêm trọng nhất trong lịch sử của họ. Một lỗi khi vận hành script đã vô tình xóa nhầm […]
Fact: AWS ngăn chặn tấn công DDoS 2,3 Tbps
Tháng 2 năm 2020, Amazon Web Services (AWS) công bố đã chặn thành công một trong những đợt tấn công DDoS lớn nhất từng được ghi nhận. Lưu lượng tấn […]
Fact: GitHub từng bị DDoS 1,35 Tbps và khôi phục chỉ trong 20 phút
Ngày 28 tháng 2 năm 2018, GitHub, nền tảng code lớn nhất thế giới, trở thành mục tiêu của cuộc tấn công DDoS lớn nhất từng được ghi nhận ở […]
Các câu hỏi trong buổi phỏng vấn DevOps vừa rồi của mình
Thứ 2 vừa rồi mình có đi phỏng vấn tìm chân trời mới, nay nhận mail pass mới tự tin viết bài chia sẻ sau những năm gắn bó với […]
Fact: Downtime dài nhất lịch sử GitHub bắt nguồn từ một sự cố bảo trì mạng
Ngày 21 tháng 10 năm 2018, GitHub, nền tảng code lớn nhất thế giới, rơi vào sự cố nghiêm trọng. Trong 24 giờ 11 phút, nhiều dịch vụ chính của […]
Atlassian: Thách thức di chuyển và tái cấu trúc 4 triệu database
Làm thế nào để migrate một hệ thống cơ sở dữ liệu khổng lồ mà không gây gián đoạn cho người dùng? Đây là câu hỏi mà đội ngũ kỹ […]
DevOps, Cloud và SRE: Góc nhìn cá nhân về sự khác biệt
Kỹ Sư Đám Mây, DevOps Với SRE Mấy Ông Này Khác Gì Nhau? Chắc các bác cũng từng thấy mấy cái chức danh như Cloud Engineer , DevOps Engineer, với […]
Site Reliability Engineering (SRE) là gì?
Site Reliability Engineering (SRE) là gì? Cách xây dựng hệ thống đáng tin cậy với SRE Giới Thiệu Site Reliability Engineering (SRE) là một phương pháp quản lý hệ thống […]
Tham gia DevOps VietNam Newsletter
Cập nhật kiến thức thực tế, sự kiện từ các chuyên gia, việc làm chất lượng, và các đặc quyền dành cho cộng đồng.