Claude 전 서비스 1시간 장애, 로그인과 파일 업로드까지 막혀 14:59 UTC 복구
- 9월 29일 14:00 UTC부터 claude.ai, Claude API, Claude Code, Claude Cowork에서 오류가 급증했고 14:36 UTC에 1차 완화됨
- 단일 로그인(SSO, Sign in with Apple), 새 대화 시작, 음성 대화, 결제, 파일 업로드가 막히는 2차 문제가 겹쳤고 14:59 UTC에 복구됨
- 14:00~14:59 UTC 사이에 주고받은 일부 메시지는 저장되지 않았을 수 있음
- Anthropic은 14:21 UTC부터 15:30 UTC까지 상태 페이지에 6차례 업데이트를 올리며 '가능한 한 빨리 업데이트하겠다'는 문구를 반복함
- 영향 범위는 claude.ai, Claude Console(platform.claude.com), Claude API(api.anthropic.com), Claude Code, Claude Cowork로 명시됨
Hacker News opinions
OpenAI $200 요금제 쓰던 사람들이 Anthropic으로 너무 많이 넘어온 거 아님? 트래픽이 감당이 안 되는 듯
Opus 5.5 나오고 첫 장애가 이제야 났다는 게 신기함. 내 체감으로는 Fable 5.1보다 사용량이 10배는 많고 지능도 비슷하거나 더 높음
Fable 5.1은 그냥 Pareto 열위인 듯. 나한테 4.6 이후로 세대 변화가 온 건 Opus 5.5가 처음임
상태 페이지 업데이트가 1분 간격으로 '곧 업데이트하겠다'만 반복되더라. update-status-page.pl을 1분 크론에 넣은 사람 있나 봄
로그인이 죽은 거지 추론 자체가 죽은 건 아니더라. IPO 소식 듣고 가입자가 몰린 탓일 수도 있고
500 에러를 한 시간 넘게 겪는 사람들 많은데 상태 페이지는 계속 초록불이었음. E2E 테스트 좀 돌려보면 안 되나. 다운디텍터가 상태 페이지보다 믿을 만함
어제 50% 할인 갱신 메일 받고 오늘 결제했는데 바로 이 사태가 났음. 메일을 너무 많이 뿌린 거 아님?
코딩은 해결됐다는데 업타임은 여전히 미스터리임
업타임은 미스터리가 아니라 관리 문제임. 변경 통제, 롤백, 부하 테스트를 강제할 권한을 경영진이 걷어가면 100% 가용성도 무너짐. 대기업 장애는 다 이 패턴
Claude 에이전트가 8k diff PR 여러 개 만들어놓고 접속이 끊기면 사람이 그걸 다 받아야 함. 세션 세부 정보는 제공자가 공유 안 하니 OpenRouter로 갈아타기도 애매하고, 업타임이 시장 침투를 막을 듯
8k diff PR은 누가 만들었든 리뷰가 말이 안 됨. 에이전트에서 개발자로 넘어가는 그 구간에 이름이라도 붙여야 할 듯
Codex랑 Claude를 같이 쓰면 장애도 상쇄됨. OpenAI 모델이 Claude 코드를 리뷰해주고 반대도 됨. 한 벤더 모델만 쓰는 건 크롬에서만 웹사이트 테스트하는 거랑 같음
인증이 죽은 거라 추론은 멀쩡했는데, 시간 민감한 에이전트 작업 돌리던 사람들은 손 놓고 기다렸겠음