Data skew는 데이터베이스 파티션 또는 노드의 데이터 배포가 언데일 때 발생합니다. 이 imbalance는 느린 쿼리 응답 시간과 자원 소비를 증가시키는 성능 문제로 이어질 수 있습니다. 인식 및 관리 데이터 skew는 대규모 시스템에서 효율적인 데이터베이스 운영을 유지하기위한 필수적입니다.

데이터 Skew는 무엇입니까?

Data skew는 데이터베이스의 다른 부분에서 데이터의 균일 한 배포를 나타냅니다. 균형 잡힌 부하를 가지고 있지만 일부 파티션 또는 노드는 다른 것보다 훨씬 더 많은 데이터를 보유합니다. 이 불균형은 전체 성능에 영향을 미치는 병목이되는 시스템의 특정 부분을 일으킬 수 있습니다.

Data Skew의 실제 사례

전자 상거래 플랫폼에서 높은 인기를 가진 제품 카테고리는 데이터의 분산 금액을 생성 할 수 있습니다. 예를 들어, 트렌드 제품은 단일 파티션에 저장된 많은 트랜잭션으로 이어지고 관련 데이터에 대한 느린 쿼리 응답을 유발할 수 있습니다. 마찬가지로 소셜 미디어 애플리케이션에서 수백만 명의 추종자가 데이터 핫스팟을 만들 수 있으며 데이터베이스 효율성을 충격을줍니다.

Database 성능에 대한 영향

Data skew는 증가한 지연, 높은 CPU 사용법 및 더 긴 쿼리 실행 시간을 일으킬 수 있습니다. 특정 노드가 데이터로 압도 될 때, 시스템은 전반적인 처리량 및 확장성을 감소시키기 위해 추가 작업을 수행해야 할 수 있습니다.

  • Slower 쿼리 응답 시간
  • 증가된 자원 소비
  • 시스템 확장성 감소
  • 시스템의 정전에 대한 잠재적