데이터 흐름 계보 작성기
데이터가 어디에서 왔고 어느 단계와 화면에서 쓰이는지 필드 단위로 기록합니다. 원천·변환·소비 노드를 만들고 한 필드에서 다른 필드로 명시적 연결을 추가하면, 선택한 열의 하위 영향 또는 상위 출처를 따라갈 수 있습니다. 데이터베이스에 접속하거나 SQL을 실행하지 않는 수동 설계 도구입니다.
주요 기능
- 원천·변환·소비 노드와 노드별 필드의 독립 편집
- 같은 필드로 합쳐지거나 여러 필드로 나뉘는 매핑과 설명 기록
- 명시적 연결만 따라가는 하위 영향·상위 출처와 최단 연결 거리
- 필드 단위 순환 그룹·연결 없는 필드 수와 빠짐없는 참조 표
- 엄격한 프로젝트 JSON 저장·불러오기, SVG 그림·영향 CSV 내보내기
사용 방법
- 예제를 열거나 노드 이름과 분류를 입력해 노드를 추가합니다.
- 선택한 노드에 필드를 추가하고 출발 필드·도착 필드·설명으로 매핑을 저장합니다.
- 기준 필드를 선택하고 하위 영향 또는 상위 출처 분석을 실행합니다.
- 영향 필드·노드 수·거리·순환 그룹을 표와 그림에서 확인합니다.
- 프로젝트 JSON을 저장하거나 현재 그림 SVG와 분석 CSV를 내려받습니다.
활용 예시
- 원천 주문금액 열을 변경하기 전에 매출 집계와 대시보드의 의존 관계 확인
- 보고서 지표가 어느 입력 열에서 유래했는지 상위 방향으로 검토
- ETL 전환 회의에서 여러 원천의 병합·분기 경로 설명
- 수동으로 기록한 계보를 JSON으로 전달하고 같은 프로젝트로 다시 편집
자주 묻는 질문
SQL 포맷터나 ER 다이어그램과 무엇이 다른가요?
SQL 문장을 정리하거나 테이블 키 관계를 정의하지 않습니다. 사용자가 작성한 필드 사이의 흐름을 따라 특정 열의 출처와 영향을 계산합니다. SQL 포맷터의 FROM/JOIN 테이블 요약과도 계산 대상이 다릅니다.
같은 변환 노드의 모든 필드가 영향을 받나요?
아닙니다. 명시적으로 연결된 필드만 따라갑니다. 예제의 주문금액은 정제금액·매출집계·대시보드의 세 필드에 닿지만, 같은 노드의 customer_id 필드로 자동 전파하지 않습니다. 필요한 의존 관계를 매핑으로 모두 입력해야 합니다.
순환이 있으면 분석할 수 없나요?
필드의 재방문을 막아 순환이 있어도 분석합니다. 전체 프로젝트의 실제 필드 순환 그룹과 자기 연결을 별도로 표시하며, 단순히 노드 A→B와 B→A가 있다는 이유만으로 서로 다른 필드를 순환으로 묶지 않습니다. 원천·변환·소비 분류는 표현용으로 연결 방향을 제한하지 않습니다.
JSON은 어떤 규칙으로 불러오나요?
local-data-lineage-v1 형식, 노드·필드·매핑 ID와 필수 속성이 정확히 맞아야 합니다. 중복 JSON 속성·알 수 없는 속성·중복 ID·존재하지 않는 필드 연결·같은 방향의 중복 매핑을 거부합니다. 256KiB와 노드40개·노드당 필드20개·전체 필드400개·매핑800개 상한을 적용합니다.
그림과 CSV에는 어떤 내용이 들어가나요?
SVG는 저장된 노드·필드·매핑을 그리며 분석 후에는 시작점과 도달 필드를 강조합니다. 긴 그림 이름은 줄여 보이지만 프로젝트와 참조 표에는 원문이 있습니다. CSV는 시작 필드를 제외한 영향 필드의 ID·이름·거리·최초 도달 매핑을 담고, 수식처럼 보이는 문자열에는 작은따옴표를 붙입니다.
실제 데이터 계보를 자동으로 발견하거나 변경하나요?
아닙니다. 데이터베이스 연결·SQL 해석·실행 로그 수집·실제 파이프라인 변경은 없습니다. 결과는 입력한 연결이 나타내는 잠재적 의존 관계이며 누락된 흐름이나 조건부 변환의 실제 실행 여부까지 검증하지 않습니다.
개인정보 안내
제목·노드·필드·매핑·설명과 파일은 현재 페이지 메모리에서만 처리합니다. 이 도구는 입력을 업로드하거나 URL·브라우저 저장소에 자동 기록하지 않습니다. 새로고침·페이지 종료 전에 필요한 프로젝트 JSON을 직접 저장하세요. 파일 내용 읽기는 운영체제 단계에서 중단할 수 없지만 취소나 입력 변경 후 늦게 도착한 결과를 반영하지 않습니다.
댓글과 질문