무엇인가
공공데이터 렌즈는 공공데이터포털의 월간 목록(약 9.6만 건)을 정규화해, 어떤 데이터가 존재하고 어떤 후보가 검토할 가치가 있는지를 근거 수준과 함께 제시하는 탐색·판단 계층입니다. 검색·비교·구조 확인의 모든 판정은 버전이 관리되는 규칙으로 재현 가능하게 수행됩니다. 중앙대학교 HIKE 연구실이 운영하는 AIRD(AI-Ready Data) 표준안 실증 프로젝트입니다.
무엇을 할 수 있는가
- 검색 — 자연어·키워드에 필터(주제·기관·포맷·주기·지역)를 결합한 목록 탐색
- 컬럼 기준 검색 — 위도·경도처럼 실제 파일에서 관측된 컬럼 조건으로 데이터셋 찾기
- 구조 확인 — 실파일에서 관측한 원본 컬럼명·유형·예시값(근거 수준 FILE_OBSERVATION)
- 비교·변경 이력 — 후보 데이터셋의 구조화된 사실 비교, 월간 스냅샷 간 변경 조회
- 활용 계획 초안 — 목적 문장에서 후보·역할·미충족 요구를 결정론적으로 조립(항상 DRAFT)
한계
- 모든 판정은 목록 메타데이터 기반이며 실제 데이터의 내용·품질·결합 가능성을 보증하지 않습니다. 원문 접근은 모두 공공데이터포털로 연결됩니다.
- 카탈로그는 월간 스냅샷으로 갱신되며 지연이 있습니다 — 현재 스냅샷·지연 일수는 /api/status가 정본입니다.
- 실파일 구조 관측은 파일형 목록의 일부에 대해서만 존재합니다 — 커버리지 분모도 /api/status에서 확인할 수 있습니다.
- 검색 결과 없음은 데이터 부재가 아니고, 구조 미수집은 품질 문제가 아닙니다.
AI 어시스턴트에서 쓰기 (MCP)
검색·비교·구조 조회는 원격 MCP(Model Context Protocol) 서버로도 제공됩니다 —
인증 없이 무료이며 읽기 전용입니다. MCP를 지원하는 AI에 커넥터 URL
https://service.datahub.kr/projects/public-data-lens/mcp를 등록하면
웹과 동일한 판정 엔진을 대화로 사용할 수 있습니다. AI 에이전트용 안내 문서는
llms.txt에 있습니다.