1분
인벤토리가 모델보다 먼저다
데이터 소스 조사와 프로파일링
인벤토리가 모델보다 먼저다
데이터 소스 조사와 프로파일링 > 데이터 소스 조사와 프로파일링
학습 목표
- 데이터를 보기 전에 CQ 와 스키마를 먼저 세운 이유를 이해한다
- 데이터 심사의 세 등급을 안다
원칙 — 인벤토리가 모델보다 먼저다
이 코스의 철칙입니다. 가진 데이터가 아니라 가질 수 있는 데이터 전체를 먼저 지도로 그립니다.
눈앞의 CSV 하나로 시작하면 그 파일의 구조가 온톨로지를 역으로 오염시킵니다. 꼬리가 개를 흔드는 설계입니다.
우리는 순서를 지켰습니다 — CQ(코스 2 모듈 1)와 스키마(코스 2 모듈 2~4)가 먼저 있고, 이제 데이터가 그 요구를 얼마나 채우는지 심사하는 것입니다. 순서가 반대였다면 지금쯤 "입항신고 CSV의 컬럼들"이 곧 우리 온톨로지가 되어 있었을 겁니다.
심사 결과는 세 등급
- 가능 — 확보된 데이터로 지금 답할 수 있다
- 조건부 — 시제 완화나 대체 지표가 필요하다
- 불가 — 공공 데이터에 없다. 협의 대상이다
세 등급을 나누는 일 자체가 이 모듈의 산출물이며, 마지막 과제에서 판정 매트릭스로 정리합니다.