Azure Data Lakes는 큰 데이터 분석에 대한 확장 가능한 스토리지 솔루션입니다. 올바른 스토리지 요구 사항을 결정하는 것은 효율적인 계획 및 비용 관리에 필수적입니다. 이 문서는 Azure Data Lakes에 저장 요구 사항을 계산하는 단계별 접근 방식을 제공합니다.

Data Volume에 대한 이해

첫 번째 단계는 저장 될 데이터의 총 볼륨을 추정하는 것입니다. 원료 데이터, 처리 된 데이터, 백업을 포함한 모든 데이터 소스를 고려하십시오. 미래 저장 요구 사항에 대한 역사적인 데이터 성장 패턴 분석.

Data Types 및 압축을 곱합니다.

다른 데이터 유형에는 저장 효율이 다양합니다. 텍스트, 이미지 및 비디오는 공간의 다른 양을 차지합니다. 압축 기술을 적용하면 저장 요구 사항을 줄일 수 있습니다. 데이터의 압축 크기를 계산하여 정유 견적을 계산합니다.

캘리포니아

압축 계수가 총 저장 요구 사항을 결정하기 위해 추정된 데이터 볼륨을 결합합니다. 메타 데이터, 인덱스 및 잠재적 인 데이터 성장을위한 추가 공간을 포함하십시오. 다음 공식을 사용하십시오.

총 저장 = (Raw Data Size × Compression ratio) + 메타데이터 + 성장 버퍼

확장성 계획

Azure Data Lakes는 확장 가능한 스토리지를 지원하므로 향후 확장 계획. 일반적으로 데이터 성장을 모니터링하고 따라 스토리지 추정을 조정합니다. 이 유능한 접근은 예상치 못한 비용이나 용량 문제를 피할 수 있습니다.