현재 선택한 정보처리 과정

정보처리기사 실기 이론 학습

이론 목록으로 돌아가기

데이터·신기술 핵심 용어

자료에 제시된 데이터·신기술 용어를 대표 특징에만 연결한다.

예상 읽기 3

실기 학습 목표

자료에 제시된 데이터·신기술 용어를 대표 특징에만 연결한다.

핵심 이론

데이터 마이닝은 데이터에서 유용한 패턴·관계를 발견하는 분석이다. 다크 데이터는 수집·보관했지만 분석·의사결정 등에 활용되지 않는 데이터라는 관점이다.

LOD는 개방성과 데이터 간 연결성을 결합한 Linked Open Data다. URI로 개체를 식별하고 RDF 등으로 관계를 표현해 다른 데이터와 연결한다.

Hadoop에서 HDFS는 분산파일시스템, MapReduce는 Map과 Reduce로 나누어 병렬 처리하는 모델, YARN은 자원 관리 계층이다.

블록체인의 이전 블록 해시 연결은 앞 블록 변경을 뒤 블록의 참조와 비교해 탐지하게 한다. 이 연결만으로 모든 공격 방지·합의·신뢰 문제가 해결되는 것은 아니다. 용어 정의와 작은 구조 추적을 넘는 내부 구현은 제외한다.

신기술은 처리 대상과 목적만 구별한다

데이터 마이닝은 데이터에서 의미 있는 패턴·관계를 찾는 활동이다. 다크 데이터는 수집·저장했지만 분석이나 활용에 충분히 쓰이지 않는 데이터라는 관점이며, 암호화되어 읽을 수 없다는 뜻과 다르다. LOD는 공개 데이터를 연결 가능한 방식으로 표현하고 연계하는 특징을 본다.

Hadoop에서 HDFS는 분산 저장, MapReduce는 데이터를 나누어 처리하고 중간 결과를 모으는 처리 모델이다. 대용량이라는 단서만으로 두 이름을 바꾸어 답하지 않는다. 저장 위치·복제와 관련된 설명인지, 분할 계산·집계와 관련된 설명인지 구분한다.

블록체인은 각 블록이 이전 블록의 해시를 참조해 연결된다. B1→B2→B3에서 B2의 내용이 바뀌어 현재 해시가 달라지고 B3의 이전 해시 참조는 그대로라면, 그 참조와 현재 B2 해시를 비교하는 B3의 연결 검증이 실패한다. 변경된 블록 번호와 다음 블록에서 발견하는 연결 불일치를 구별한다.

용어 문제는 핵심 정의와 한 가지 대표 사례를 연결해 외운다. 분산 시스템의 내부 구현, 머신러닝 수학, 모든 최신 기술 이름을 추가로 암기하기보다 제시된 지문에서 저장·처리·연결·활용 중 목적을 찾아 답한다.

풀이 예시

기업은 업무 과정에서 오래된 장비 로그, 녹취, 이미지 자료를 저장했지만 대부분 분석하거나 의사결정에 사용하지 않고 있다. 새로 생성할 데이터가 아니라 이미 수집·보관했으나 활용되지 않는 데이터라는 관점의 명칭을 쓰시오.

예시 정답

CODE코드 영역 안에서 좌우로 이동할 수 있습니다.
다크 데이터

풀이 과정

업무 중 수집·처리·저장되었지만 분석이나 가치 창출에 충분히 활용되지 않는 데이터를 다크 데이터라고 부른다. 데이터가 반드시 암호화되어 있거나 인터넷에서 접근 불가능하다는 의미는 아니다.

답안 점검

위 풀이 예시의 답을 가린 뒤, 핵심 이론의 규칙을 적용해 직접 풀어 보세요. 코드와 계산 문제는 중간값·단위·최종 출력의 순서를, 용어 문제는 지문의 핵심 단서와 답의 의미를 점검하세요. 해설과 다른 부분이 있으면 어느 조건을 놓쳤는지 확인하고 연결된 실기 문제로 다시 연습하세요.