로그 패턴 추출기
텍스트 로그를 줄마다 입력하면 숫자·IP·UUID·16진수·시간 표기를 변수 후보로 바꾸고, 고정 단어의 위치가 충분히 겹치는 줄을 같은 템플릿으로 묶습니다. 가운데서 달라지는 단어도 변수로 표시합니다. 비슷한 로그의 빈도와 원본 줄 번호·변수 값을 확인할 수 있습니다. 첫/마지막 일반 단어가 다른 이벤트는 합치지 않아 무관한 메시지가 쉽게 한 군집이 되지 않도록 합니다. 결과는 규칙 기반 후보이며 완전한 로그 파서가 아닙니다.
주요 기능
- 텍스트 로그 최대 1500줄·256KiB 분석
- 숫자·단위·IP·UUID·16진수의 형태 기반 변수 후보
- 공통 고정 단어와 가운데 가변 단어를 이용한 메시지 군집
- 빈도·원본 줄 번호·변수 위치와 값 표시
- 템플릿 CSV·변수 CSV·전체 JSON 다운로드
사용 방법
- 로그를 붙여 넣거나 로컬 .log/.txt 파일을 선택합니다.
- 패턴 추출을 눌러 비슷한 메시지와 단독 메시지를 구분합니다.
- 반복·단독 필터와 각 템플릿의 원본 줄 번호를 확인합니다.
- 변수 위치의 원본 값과 잘못 묶인 후보를 직접 검토합니다.
- 템플릿·변수 CSV 또는 전체 JSON을 내려받습니다.
활용 예시
- 반복되는 서버 오류 메시지의 빈도 보기
- 요청 ID·응답 시간 등 변하는 부분 찾기
- 알림 규칙을 만들기 전 로그 형태 후보 정리
자주 묻는 질문
어떤 줄을 같은 템플릿으로 묶나요?
공백으로 나눈 토큰 수와 첫 토큰이 같고, 고정 위치의 약 60% 이상이 일치하는 줄을 묶습니다. 첫/마지막 일반 단어가 달라지면 별도로 둡니다. 휴리스틱이므로 결과를 직접 검토하세요.
로그 형식을 자동으로 완전히 이해하나요?
아니요. 정해진 날짜·숫자·IP·UUID·16진수 형태와 같은 위치의 공통 단어를 이용합니다. 중첩 JSON, 다중 줄 스택 추적, 사용자 지정 구분자는 구조적으로 파싱하지 않습니다.
숫자에 붙은 ms나 MB도 변수로 잡나요?
예. ms, s, KB, MB, GB, % 접미사가 붙은 수를 숫자 변수로 취급합니다. 모든 임의의 단위 표기를 해석하지는 않습니다.
원본 로그가 외부로 전송되나요?
아니요. 입력과 선택 파일은 브라우저에서만 읽습니다. 내려받은 변수 CSV와 JSON에는 원본 토큰과 샘플 줄이 포함되므로 보안 정보를 확인하세요.
왜 같은 이벤트가 여러 템플릿으로 나뉘나요?
단어 수나 첫/마지막 일반 단어가 다르면 자동 병합을 제한합니다. 잘못된 병합을 줄이기 위한 보수적인 규칙이며 수동 규칙 학습은 제공하지 않습니다.
빈 줄과 처리 한도는 어떻게 되나요?
빈 줄은 건너뛰고 개수를 표시합니다. 비어 있지 않은 로그 최대1500줄, UTF-8 256KiB, 한 줄2000자·64토큰까지 받습니다.
개인정보 안내
로그는 브라우저 메모리에서만 분석하며 파일을 서버에 업로드하지 않습니다. 변수 CSV·JSON에는 IP·사용자명 등 원본 값이 포함될 수 있습니다. 공유 전 직접 확인하세요.
댓글과 질문