모든 시스템 정상
네트워크 상태
지난 12개월 동안 모든 위치에서의 가용성은 99.9% SLA 대비 99.987%입니다. 아래의 모든 사고는 근본 원인과 이후 변경 사항과 함께 공개되며, 전적으로 우리 잘못인 경우도 포함됩니다.
답변
Incognito VPS has recorded 99.987% uptime across all locations over the last twelve months against a 99.9% SLA. The full incident history is published with root causes and remediation, including the worst outage in the company's history.
90 days · one bar per day 운영 중 성능 저하 중단
§01 6 published
인시던트 기록
우리를 나쁘게 보이게 하는 사고까지 포함합니다. 사고 기록이 없는 가동 시간 수치는 마케팅 숫자에 불과합니다.
- SLA 크레딧이 자동 적용됨
업스트림 트랜짓 플랩
Bucharest 22m
- 영향
- OTP-1의 30%에 22분간 간헐적 패킷 손실.
- 원인
- 트랜짓 제공업체 유지보수 창이 길어지고 BGP 재수렴이 진동했습니다.
- 변경 사항
- OTP-1에 세 번째 트랜짓 제공업체를 추가하고 BGP 댐프닝 임계값을 낮췄습니다.
-
해저 케이블 절단
Panama City 1h 36m
- 영향
- PTY-1의 유럽 지연 시간이 96분 동안 280ms로 상승했으며 패킷 손실은 없었습니다.
- 원인
- 제3자 해저 케이블 장애로 트래픽이 마이애미를 경유하는 더 긴 경로로 우회되었습니다.
- 변경 사항
- 우리 쪽에는 문제가 없었습니다. 지연 시간 저하가 다운타임 없이도 사고이므로 여기에 기록합니다.
- SLA 크레딧이 자동 적용됨
하이퍼바이저 커널 패닉
Amsterdam 14m
- 영향
- 한 호스트의 38개 VPS 인스턴스가 예기치 않게 재부팅되었습니다.
- 원인
- 6.11 NVMe 드라이버의 커널 버그가 특정 IO 패턴에서 발생했습니다.
- 변경 사항
- 전체 시스템을 6.10 LTS로 롤백한 후, 4주간의 안정성 테스트를 거쳐 6.12로 단계적으로 업그레이드했습니다.
-
스토리지 어레이 성능 저하
Zürich no customer impact
- 영향
- 고객 영향 없음. 동일한 RAID-10 어레이에서 1시간 이내에 두 드라이브가 고장났습니다.
- 원인
- 불량 드라이브 배치. 서로 다른 미러 쌍에서 실패했기 때문에 어레이가 살아남았습니다 — 운이지 설계가 아닙니다.
- 변경 사항
- 전 지역에서 해당 배치를 선제적으로 교체했습니다. 이제 드라이브 조달 시 제조 로트를 의도적으로 섞습니다.
- SLA 크레딧이 자동 적용됨
전력 공급 실패 및 발전기 전환 실패
Sofia 47m
- 영향
- SOF-1 전체 다운타임 47분.
- 원인
- 전력 공급이 중단되고 자동 전환 스위치가 작동하지 않았습니다. UPS가 11분간 부하를 감당한 후 방전되었습니다.
- 변경 사항
- 전환 스위치를 분기별 무부하 테스트에서 월간 전체 부하 테스트로 변경했습니다. 두 번째 발전기를 추가 투입했습니다.
- SLA 크레딧이 자동 적용됨
코어 스위치 라인 카드 장애
Amsterdam 3h 12m
- 영향
- AMS-3의 40%가 3시간 12분 동안 접근 불가.
- 원인
- 라인 카드가 고장났고 예비 부품이 다른 시설에 보관되어 있었습니다.
- 변경 사항
- 모든 섀시의 예비 부품을 모든 위치에 상시 보관합니다. 이것은 우리 역사상 최악의 중단이며 해당 정책을 도입한 이유입니다.
크레딧은 자동입니다
한 달 내에 99.9% 미만이면 영업일 기준 5일 이내에 잔액으로 크레딧이 적용됩니다. 신청할 필요가 없습니다. 신청해야 받을 수 있는 크레딧은 대부분의 고객이 받지 못하는 크레딧이며, 이것이 보통 설계의 핵심입니다.
99.50–99.89%
10%
99.00–99.49%
25%
95.00–98.99%
50%
Below 95%
100%