더러운 데이터
Dirty data악성 데이터라고도 알려진 더러운 데이터는 특히 컴퓨터 시스템이나 데이터베이스에서 부정확하거나 불완전하거나 일관성이 없는 데이터다.[1][2]
지저분한 데이터에는 철자법이나 구두점 오류, 필드와 관련된 잘못된 데이터, 불완전하거나 오래된 데이터 또는 데이터베이스에 중복된 데이터까지 포함될 수 있다.그것들은 데이터 클렌징이라고 알려진 과정을 통해 청소될 수 있다.[3]
더티 데이터(사회과학)
사회학에서, 더러운 데이터는 비밀스러운 데이터를 의미하는데, 그 발견은 그 데이터를 비밀로 유지한 사람들에게 불명예스러운 것이다.MIT의 명예교수 Gary T. Marx의 정의에 따르면, 더러운 데이터는 네 가지 유형의 데이터 중 하나이다.[4]
- 비암호화 및 비암호출 데이터:
- 일상적으로 이용할 수 있는 정보.
- 비밀 데이터 및 비보안 데이터:
- 전략적이고 친밀한 비밀, 프라이버시.
- 비암호적이고 신빙성 있는 데이터:
- 면책특권,
- 규범적 불일치,
- 선택적 불일치,
- 신용위협을 잘 살려서
- 발견된 더러운 데이터
- 비밀 데이터 및 신빙성 데이터:숨겨져 있고 더러운 데이터.
참고 항목
참조
- ^ 스팟 없는 버전 12 지금 출시
- ^ Margaret Chu (2004), "What Are Dirty Data?", Blissful Data, p. 71 et seq, ISBN 9780814407806
- ^ Wu, S. (2013), "A review on coarse warranty data and analysis" (PDF), Reliability Engineering and System, 114: 1–11, doi:10.1016/j.ress.2012.12.021
- ^ "Notes on the discovery, collection, and assessment of hidden and". web.mit.edu. Retrieved 2017-02-17.
