정처LAB 자체 제작내용 검수 완료정처LAB 정보처리기사 필기 자체 제작 2회 · 정보시스템 구축 관리 · 빅데이터 처리 · 90번
HDFS의 블록 크기가 128MB이고 복제 계수가 3인 클러스터에 300MB 파일 하나를 저장한다. 파일 블록과 메타데이터 관리에 대한 설명으로 옳은 것은?
1
파일은 3개 블록으로 나뉘며 복제본을 포함해 9개 블록이 DataNode에 저장되고 NameNode는 네임스페이스와 블록 위치 메타데이터를 관리한다.
정답 근거필요 블록 수는 `ceil(300/128)=3`이고 각 블록을 3개씩 복제하므로 DataNode에 9개 복제본이 저장된다. NameNode는 네임스페이스와 블록 위치 메타데이터를 관리한다.
2
파일은 2개 블록으로 나뉘며 복제본을 포함한 블록 저장 수는 6개다.
오답 이유300MB는 128MB 블록 두 개로 담을 수 없으므로 3개 블록이 필요하고, 복제 계수 3을 적용하면 저장되는 블록 복제본은 총 9개다.
3
파일은 3개 블록으로 나뉘고 MapReduce가 각 블록의 물리 저장 위치를 직접 관리한다.
오답 이유MapReduce는 분산 계산 모델이며 HDFS 블록의 배치와 위치 메타데이터 관리는 NameNode와 DataNode가 담당한다.
4
파일은 3개 블록으로 나뉘고 NameNode 한 곳에 블록 내용 3개가 저장된다.
오답 이유블록 수 계산은 맞지만 NameNode는 일반 파일 블록 내용을 저장하는 노드가 아니라 파일 네임스페이스와 블록 위치 같은 메타데이터를 관리한다.
정답·상세해설
정답 1번
300MB 파일은 128MB, 128MB, 44MB의 세 블록으로 나뉜다. 복제 계수 3은 각 블록을 세 곳에 저장한다는 뜻이므로 DataNode에 저장되는 블록 복제본은 `3×3=9`개다. NameNode는 파일 네임스페이스와 각 블록이 어느 DataNode에 있는지에 대한 메타데이터를 관리한다.