Skip to main content
QUICK REVIEW

[논문 리뷰] Repair-Based Degrees of Database Inconsistency: Computation and Complexity

Leopoldo Bertossi|arXiv (Cornell University)|2018. 09. 27.
Logic, Reasoning, and Knowledge참고 문헌 40인용 수 3
한 줄 요약

이 논문은 카디널리티-수리(repair)를 사용하여 정합성 제약 조건에 대한 비정합성 정도를 수량화하는 수리 기반 비정합성 측정법을 제안한다. 이 측정법은 응답 집합 프로그래밍(ASP)을 통해 계산될 수 있으며, 데이터 복잡도에서 NP-완전이지만, 고정 매개변수 유형의 다항시간 결정론적 및 확률적 근사법을 제공하며, 소규모 업데이트 하에서 고정 매개변수 유형의 계산이 가능하다.

ABSTRACT

We propose a generic numerical measure of the inconsistency of a database with respect to a set of integrity constraints. It is based on an abstract repair semantics. In particular, an inconsistency measure associated to cardinality-repairs is investigated in detail. More specifically, it is shown that it can be computed via answer-set programs, but sometimes its computation can be intractable in data complexity. However, polynomial-time deterministic and randomized approximations are exhibited. The behavior of this measure under small updates is analyzed, obtaining fixed-parameter tractability results. Furthermore, alternative inconsistency measures are proposed and discussed.

연구 동기 및 목표

  • 정합성 복구의 복잡도를 반영하는 일반적이고 수리 기반의 관계형 데이터베이스 비정합성 수치 측정법을 개발하는 것.
  • 부정 제약 조건과 함수적 의존성에 초점을 맞춰 데이터 복잡도에서 비정합성 측정의 계산 복잡도를 조사하는 것.
  • 비정합성 측정법을 위한 실용적인 계산 기반 기법으로 응답 집합 프로그래밍(ASP)을 제공하는 것.
  • 소규모 데이터베이스 업데이트 하에서 비정합성 측정법의 행동을 분석하고, 업데이트 크기를 매개변수로 하는 고정 매개변수 유형의 계산 가능성을 확립하는 것.
  • 비정합성 측정법, 데이터베이스 원인 분석, 튜플 수준의 책임 사이의 관계를 탐색하는 것.

제안 방법

  • 비정합성 측정법은 카디널리티-수리 기반으로 정의되며, 정합성을 복구하기 위해 삭제해야 할 최소 튜플 수에 해당하는 비정합성 정도를 반영한다.
  • 비정합성 측정법의 인코딩 및 계산을 위한 계산 프레임워크로 응답 집합 프로그래밍(ASP)을 사용하며, 비단조화적 추론을 위한 표현력을 활용한다.
  • 측정법은 부분집합-수리의 최대 크기의 역수로 정의되어, 0은 완전한 정합성을 나타낸다.
  • 근사 비율 $ d $ 를 갖는 결정론적 및 확률적 기법을 사용하여 다항시간 근사 알고리즘을 개발한다.
  • 소규모 업데이트가 비정합성 정도에 미치는 영향을 분석함으로써, 업데이트 크기를 매개변수로 하는 고정 매개변수 유형의 결과를 도출한다.
  • 튜플이 제약 위반의 원인이 되는 책임을 통해 비정합성과 튜플 수준의 원인 분석 간의 연결 고리를 설정한다.

실험 결과

연구 질문

  • RQ1정합성 복구 비용을 반영하는 일반적이고 수리 기반의 비정합성 측정법을 관계형 데이터베이스에 어떻게 정의할 수 있는가?
  • RQ2부정 제약 조건과 함수적 의존성에 대해 카디널리티-수리 기반 비정합성 측정법을 계산할 때 데이터 복잡도는 어떻게 되는가?
  • RQ3응답 집합 프로그래밍(ASP)을 사용하여 비정합성 측정법을 효과적으로 계산할 수 있으며, 필요한 표현력과 계산 능력을 제공하는가?
  • RQ4소규모 데이터베이스 업데이트 하에서 비정합성 측정법은 어떻게 행동하는가? 그리고 업데이트 크기를 매개변수로 하여 계산이 고정 매개변수 유형인가?
  • RQ5전반적인 비정합성 측정법은 개별 튜플의 국소 기여로 분해될 수 있는가? 그리고 이는 데이터베이스의 원인 분석과 어떻게 관련되는가?

주요 결과

  • 부정 제약 조건과 특정 함수적 의존성에 대해 카디널리티-수리 기반 비정합성 측정법은 데이터 복잡도에서 NP-완전이다.
  • 측정법은 응답 집합 프로그래밍을 통해 계산될 수 있으며, 이는 측정법의 사양 및 평가에 필요한 정확한 표현력과 계산 능력을 제공한다.
  • 근사 비율 $ d $ 를 갖는 다항시간 결정론적 및 확률적 근사 알고리즘이 존재하여 비정합성 정도의 효율적 추정이 가능하다.
  • 소규모 업데이트 하에서 비정합성 측정법은 고정 매개변수 유형의 계산이 가능하며, 이는 변경 수가 제한될 경우 계산이 여전히 효율적임을 의미한다.
  • 전반적인 비정합성 측정법은 어떤 튜플이 제약 위반의 원인이 되는 책임의 최대값의 역수로 표현될 수 있으며, 이는 데이터베이스 원인 분석과 연결된다.
  • 측정법은 업데이트에 대해 잘 행동하며, 데이터베이스에 소규모 변경이 가해질 경우 비정합성 정도의 변화가 유계로 유지된다.

더 나은 연구,지금 바로 시작하세요

논문 읽기부터 검토까지, 연구 시간을 획기적으로 줄여보세요.

카드 등록 없음 · 무료 플랜 제공

이 리뷰는 AI가 만들고, 인간 에디터가 검토했습니다.