사이트 소개

표준 소개

AI 레디 데이터란

유형 · 개요읽는 시간 · 약 5분모든 독자

AI 레디 데이터가 무엇이고 어떤 단계를 거쳐 준비되는지, 지금 할 수 있는 일은 무엇인지 설명합니다.

지금 할 수 있는 것

AI 레디 데이터는 에이전트가 판단에 쓰는 사실을 데이터와 함께 기계가 읽는 형식으로 기록하고, 품질이 확인된 데이터(Quality-Ready) 이상의 상태에 도달한 데이터입니다. 약칭은 AIRD이며 「에어드」로 읽습니다. 1단계만 마친 데이터는 찾을 수 있는 데이터(Discoverable)입니다. [제1부 3.1 · 5.1]

구분항목조건
지금 할 수 있음1단계 마니페스트 작성 · 결함 수정 · 한계 기록 · 조직의 운영 지침 구성진단 도구와 운영 지침 없이도 수행
운영 지침이 있어야 함측정 완성도(표준 용어: 진단 성숙도, DM) DM-1 · 품질 등급 · Quality-Ready 이상으로의 전이표준 제공 운영 지침은 표준 제정 시 공개(2026년 12월 예상). 조직은 자체 운영 지침을 구성해 적용할 수 있음
후속 부(제4 · 5부)후속 부확인 지점 판정 절차 세부 · 자동 활용 조건2026년 12월 제정 범위 밖

Quality-Ready로 전이하려면 운영 지침을 적용한 판정이 필요하므로, 그 전에는 데이터가 Discoverable(찾을 수 있는 데이터)까지만 도달할 수 있습니다. 운영 지침의 구성은 운영 지침 구성에 있습니다.

달라지는 점

에이전트는 데이터에 기록되지 않은 사실을 추정합니다. 그 이유와 관측 결과는 필요성과 배경에 있습니다.

지금데이터 파일 + 제목 · 설명뜻 · 품질 · 이용 조건을 추정오류 없이 틀린 결론
AI 레디 데이터데이터 파일 + 데이터 설명서(마니페스트) — 찾는 정보 · 품질 근거 · 목적별 준비 상태마니페스트를 읽고 판단근거 있는 답 · 근거가 없으면 보류

데이터 활용 전의 네 가지 판단

적합성질문에 맞는가수록 내용 · 범위와 기준 시점
신뢰성신뢰할 수 있는가갱신 시점 · 품질 확인 근거
결합성결합할 수 있는가식별자 · 분류 체계의 일치
사용 가능성이용해도 되는가라이선스 · 권리의 범위 · 접근 제한

네 가지 판단은 모든 데이터 유형에 같습니다. 판단에 필요한 정보는 데이터 유형마다 다릅니다. [제1부 5.6]

데이터 유형판단에 주로 필요한 정보 (예)
표 형태 · 시계열 STRUCT TSERIES컬럼의 의미 · 단위 · 코드 체계 · 기준 시점 · 레코드 키
문서 TEXT출처 · 작성 시점 · 문서를 나눈 단위 · 근거 위치 · 개인정보 포함 여부
이미지 IMAGE촬영 · 수집 조건 · 라벨 체계 · 라벨 파일과 이미지의 대응
지시문 · 응답 쌍 PT지시문과 응답의 대응 · 출처 · 검수 여부

현재 표준의 데이터 유형은 위의 다섯 가지입니다. 영상 · 음성 같은 유형은 향후 추가될 수 있습니다.

3 단계

1발견 가능담당자가 데이터가 무엇이고 어디에 있는지 마니페스트에 기록합니다. 데이터값은 바꾸지 않습니다.
2품질 확인품질을 측정하고 결함을 수정합니다. 측정한 지표와 측정하지 못한 지표를 근거와 함께 기록합니다.
3목적 적합활용 목적 6종(예: 검색증강생성 · 기계학습 · 통계 분석)마다 필요한 준비를 하고 운용 파일을 만듭니다.

표준의 상태 이름: Discoverable → Quality-Ready → Purpose-Ready

1단계만 마쳐도 에이전트가 추정해야 하는 항목이 줄어듭니다. 사례는 사례 영상에서 볼 수 있습니다.

함께 제공하는 파일

AI 레디 데이터는 데이터 파일과 함께 판단에 필요한 사실을 담은 문서를 제공합니다. 표준은 이 배포 단위를 팩(Pack)이라 부릅니다. [제1부 3.15 · 5.5] 팩의 구성 · 파일 형식 · 검증은 팩 구성과 배포에 있습니다.

데이터만데이터 파일뜻 · 품질 · 이용 조건은 추정
팩데이터 파일 — 팩에 넣지 않고 주소 · SHA-256 체크섬으로 가리킴마니페스트 — 찾는 정보 · 품질 근거 · 목적별 준비 상태. 나머지 파일의 주소 · 체크섬 기재결과서 — 측정한 지표와 측정하지 못한 지표팩 마니페스트목적별 운용 파일 — 활용 목적이 정해졌을 때근거를 읽고 판단 · 근거가 없으면 보류
상태 · 확인 지점 · 등급 상세
G1G2G3
하는 일
내용과 소재가 기록되어 검색과 접근이 가능한 상태입니다.
검증된 계층
발견
품질 등급
—
목적 등급
—
측정 완성도
측정했다면 DM-0 · DM-1 · DM-2
원시 데이터 관계
원시 데이터셋의 값을 유지 · 필요하면 형식만 변환
진입 경로
1단계 — 수집 · 개방 형식 변환 · 발견 계층 작성
G1 판정 대상
발견 계층의 완비
상태 증명 파일
manifest.json (발견 계층) · G1 판정 기록
상태를 선택하면 그 상태의 조건과 증명 파일을 표시합니다. 상태마다 공개하는 파일과 그 안의 항목은 팩 구성과 배포 — 준비 상태별 필요한 파일에서 파일 단위로 확인할 수 있습니다. 상태 · 확인 지점(G1 · G2 · G3)의 정의는 제1부가, 판정 절차 세부는 제4부가 다룹니다. [제1부 표 5-1 · 5-2]후속 부

자주 묻는 질문

의무입니까
아닙니다. 법령이나 규정에 따른 의무는 아닙니다. 기관 · 기업은 데이터 관리 지침, 사업 요구사항, 계약 조건에서 이 표준을 관련 표준으로 인용해 활용할 수 있습니다. 1단계만 수행해도 에이전트가 추정해야 하는 항목이 줄어듭니다.
무엇을 얻습니까
에이전트와 이용자는 담당자에게 문의하지 않고 데이터가 무엇인지, 신뢰할 수 있는지, 어떤 조건으로 이용할 수 있는지 판단합니다. 마니페스트에는 에이전트가 데이터를 검색 결과와 결합 후보로 고를 근거도 기재됩니다.
데이터를 고쳐야 합니까
1단계는 데이터값을 바꾸지 않고 설명을 기재하는 작업입니다. 값은 2단계의 결함 수정에서 고치며, 원본은 보존합니다.
얼마나 걸립니까
소요 시간은 기존 등록 정보와 컬럼 설명이 얼마나 갖춰져 있는지에 따라 달라집니다. 메타데이터의 생성과 입력은 도구로 자동 처리할 수 있고, 담당자는 등록 정보에 없는 항목만 직접 씁니다.
최종 수정 · 2026-10-07오류 신고