logpipelineanalytics
대용량 로그 수집·분석 시스템 설계 시 고려할 점은 무엇인가요?
- 예상 시간
- 9분
30초 답변
꼬리질문
조금 더 깊게 물어본다면
답변 뒤에 이어질 수 있는 질문들을 하나씩 열어볼 수 있어요.
로그 수집에 queue를 두는 이유는?
로그 유실을 줄이려면?
로그 수집 agent vs sidecar 방식의 차이는?
로그는 어떤 기준으로 저장소를 고르나요?
로그 schema가 중요한 이유는?
로그 레벨(debug/info/warn/error)은 어떻게 구분해서 쓰나요?
개인정보가 포함된 로그는 어떻게 처리하나요?
부가 설명
로그는 생각보다 빨리 커지므로 sampling, compression, retention policy가 중요합니다.
장애 상황에서는 로그가 폭증할 수 있어 backpressure와 rate limit 없이 모든 로그를 동기 전송하면 서비스 자체가 느려질 수 있습니다.
한 줄 정리
대용량 로그 시스템은 수집, buffering, 저장, indexing, query, retention, 장애 대응을 pipeline으로 설계해야 합니다.