더러운 데이터

Dirty data

악성 데이터라고도 알려진 더러운 데이터는 특히 컴퓨터 시스템이나 데이터베이스에서 부정확하거나 불완전하거나 일관성이 없는 데이터다.[1][2]

지저분한 데이터에는 철자법이나 구두점 오류, 필드와 관련된 잘못된 데이터, 불완전하거나 오래된 데이터 또는 데이터베이스에 중복된 데이터까지 포함될 수 있다.그것들은 데이터 클렌징이라고 알려진 과정을 통해 청소될 수 있다.[3]

더티 데이터(사회과학)

사회학에서, 더러운 데이터는 비밀스러운 데이터를 의미하는데, 그 발견은 그 데이터를 비밀로 유지한 사람들에게 불명예스러운 것이다.MIT의 명예교수 Gary T. Marx의 정의에 따르면, 더러운 데이터는 네 가지 유형의 데이터 중 하나이다.[4]

  • 비암호화 및 비암호출 데이터:
    • 일상적으로 이용할 수 있는 정보.
  • 비밀 데이터 및 비보안 데이터:
    • 전략적이고 친밀한 비밀, 프라이버시.
  • 비암호적이고 신빙성 있는 데이터:
    • 면책특권,
    • 규범적 불일치,
    • 선택적 불일치,
    • 신용위협을 잘 살려서
    • 발견된 더러운 데이터
  • 비밀 데이터 및 신빙성 데이터:숨겨져 있고 더러운 데이터.

참고 항목

참조

  1. ^ 스팟 없는 버전 12 지금 출시
  2. ^ Margaret Chu (2004), "What Are Dirty Data?", Blissful Data, p. 71 et seq, ISBN 9780814407806
  3. ^ Wu, S. (2013), "A review on coarse warranty data and analysis" (PDF), Reliability Engineering and System, 114: 1–11, doi:10.1016/j.ress.2012.12.021
  4. ^ "Notes on the discovery, collection, and assessment of hidden and". web.mit.edu. Retrieved 2017-02-17.