데이터베이스 개요
목차 15
2과목이 완성된 소프트웨어를 묶어 출고하는 과정이었다면, 3과목은 그 소프트웨어가 다루는 데이터를 어디에 어떻게 쌓는가 — 데이터베이스다. 3과목(데이터베이스 구축)은 5과목 중 출제 비중이 가장 높은 핵심 과목이고, 20강은 그 출발선. 출제는 가벼운 편이지만 이후 모든 단원의 토대다. 시험 점수밭은 둘 — DB 정의 4키워드(공통운저) 와 DB 4대 특징(실계동내). 이 두 줄에서 함정 분별만 되면 20강은 통과다.
핵심 암기: DB 정의 4키워드 공통운저(공용·통합·운영·저장) · DB 4대 특징 실계동내(실시간·계속적변화·동시공용·내용참조) · DB 장점 6 독무중보공표(독립성·무결성·중복최소·보안·공유·표준화)
데이터·정보·데이터베이스
데이터 · 정보 · 지식의 위계 ·데이터 위계·
[정의] 데이터(Data) = 현실에서 관찰한 가공 전 사실(Fact) 그 자체. 정보(Information) = 데이터를 처리·가공해 의미를 부여한 결과. 지식(Knowledge) = 정보가 모여 의사결정의 근거가 된 단계.
[흐름] 가공 단계가 한 칸씩 올라간다. DBMS가 책임지는 건 맨 아래 데이터 계층뿐이다.
[데이터] 가공 전 사실 예: 23
│ 맥락·가공
▼
[정보] 의미를 부여한 결과 예: 오늘 서울 기온 23℃
│ 축적·판단
▼
[지식] 의사결정의 근거 예: 23℃면 외투는 필요 없다
↑ DBMS 관할 = [데이터] 계층만 / 정보·지식 = 응용·BI 도구 몫
🔑 암기 데이터=원재료(가공 전) / 정보=가공 결과(의미 부여) / 지식=판단 근거. DBMS는 데이터 계층만 관할. ⚠️ 함정 '의미 있는 결과·처리된 결과'는 데이터가 아니라 정보의 정의 — 자리 뒤바꿈 함정. 'DBMS가 정보·지식까지 직접 관리한다'도 함정(정보·지식은 응용·BI 몫). 🎯 빈출 데이터 vs 정보 정의 구분, 위계 설명 매칭. 간헐.
DB 정의 4키워드 — 공통운저 ·DB 정의·1순위·
[정의] 데이터베이스(Database) = 여러 사용자가 공유할 목적으로 통합·저장·관리되는 운영 자료의 집합. 이 정의에서 시험에 그대로 나오는 4키워드가 추출된다.
[표] 네 키워드를 모두 충족해야 비로소 DB. 하나라도 빠지면 DB가 아니다(All-of 조건).
| 글자 | 키워드 | 영문 | 한 줄 |
|---|---|---|---|
| 공 | 공용 데이터 | Shared | 여러 사용자·응용이 함께 사용 |
| 통 | 통합 데이터 | Integrated | 중복 최소화 (완전 제거 아님 — 통제된 중복은 허용) |
| 운 | 운영 데이터 | Operational | 조직 업무 수행에 필수 (임시 데이터 ❌) |
| 저 | 저장 데이터 | Stored | 컴퓨터 접근 가능 매체에 저장 (종이·머릿속 ❌) |
🔑 암기 공통운저 — "공통으로 운영하고 저장한다." 네 글자가 한 글자도 빠짐없이 다 있어야 DB. ⚠️ 함정 통신(Communication) 데이터가 최빈출 오답 — '통합'과 한 글자 차이로 헷갈리게 만든다. 4키워드에 '통신'은 없다. 색인·중복·임시·개인 데이터도 ❌. '중복을 완전히 제거'(절대 표현)도 함정 — 통합은 중복 최소화다. 🎯 빈출 'DB 정의에 해당하지 않는 것?' 소거형. 거의 매회. 📝 기출 공통운저 자리 함정 단골.
데이터베이스의 4대 특징
DB 4대 특징 — 실계동내 ·DB 특징·1순위·
[표] 정의 4키워드가 데이터의 정적 성질이라면, 4대 특징은 데이터가 어떻게 활용되는가(동적 성질)를 정의한다.
| 글자 | 특징 | 영문 | 핵심 한 줄 |
|---|---|---|---|
| 실 | 실시간 접근성 | Real-Time Accessibility | 요청 즉시 응답 (수초 내·수백 ms) |
| 계 | 계속적인 변화 | Continuous Evolution | Insert·Update·Delete로 항상 최신 상태 |
| 동 | 동시 공용 | Concurrent Sharing | 여러 사용자가 같은 시각에 접근 |
| 내 | 내용에 의한 참조 | Content Reference | 위치(주소)가 아닌 값으로 검색 |
[흐름] 네 특징은 시간·반복·다수·기준 네 축으로 자연스럽게 이어진다.
실시간(요청 즉시) → 계속적(시간 흘러도 변화 반영) → 동시(여러 사람 같은 시점) → 내용(값 기준 검색)
🔑 암기 실계동내 — "실제로 동네에서 DB가 필요하다." 동시 공용엔 잠금(Locking)·병행 제어가, 내용 참조엔 물리적 독립성이 따라붙는다. ⚠️ 함정 세 표현이 최빈출 함정 — '위치/주소에 의한 참조'(→파일 시스템 방식), '고정된 스냅샷·변하지 않는다'(→계속적 변화의 정반대), '단일 사용자만 이용'(→동시 공용의 정반대). 모두 4대 특징을 거꾸로 뒤집은 표현이다. 🎯 빈출 '4대 특징이 아닌 것?'·설명→용어. '위치/주소' 단어가 1순위 함정. 거의 매회. 📝 기출 위치 참조·고정 스냅샷 함정 단골.
파일 시스템에서 데이터베이스로
파일 시스템의 한계 → DB의 해결 ·등장 배경·
[정의] 1960년대 이전엔 응용마다 별도 파일을 만들어 자료를 보관했다. 같은 사원 정보가 인사·급여·복지 파일에 따로 저장돼, 두 가지 만성 문제가 생겼다 — 데이터 종속성(구조가 프로그램 코드에 박힘)과 데이터 중복성(같은 데이터가 여러 곳에). DB는 이 둘을 구조적으로 풀며 1970년대에 정착했다.
[표] 한계 두 개를 DB가 어떻게 뒤집었는가.
| 비교축 | 파일 시스템 | 데이터베이스 |
|---|---|---|
| 종속성 | 파일 구조 = 프로그램 코드에 박힘 | 구조 바뀌어도 프로그램 영향 ❌ (데이터 독립성) |
| 중복성 | 같은 데이터가 여러 파일에 | 한 곳 저장·여러 곳 참조 (중복 최소화) |
| 일관성 | 파일마다 다를 위험 | 한 번 수정으로 전체 반영 |
| 공유 | 부서별 독립·공유 어려움 | 여러 응용·여러 사용자 동시 공유 |
🔑 암기 파일 시스템의 두 병 = 종속성·중복성. DB의 두 약 = 독립성·중복 최소화. 종속성의 반대가 독립성이다. 💡 보충 데이터 독립성은 논리적·물리적 둘로 나뉘고, 이를 구현하는 장치가 3단계 스키마(외부·개념·내부)다 — 22강에서 본격. ⚠️ 함정 'DB는 중복을 완전히 0으로 만든다'는 함정 — 통제된 중복(인덱스 등)은 허용하는 최소화다. 🎯 빈출 파일 시스템 vs DB 비교, 종속성·중복성 해결. 간헐.
데이터베이스의 구성과 구조
구성 3요소 + 구조 2계층 ·구성·구조·
[표] DB가 표현하는 현실 세계는 세 요소로 모델링된다(구성 3요소). 그 요소가 저장·관리되는 관점은 두 계층으로 나뉜다(구조 2계층).
| 구성 3요소 | 영문 | 정의 | 예시 |
|---|---|---|---|
| 개체 | Entity | 현실에서 구별되는 객체·사물 | 학생, 과목 |
| 속성 | Attribute | 개체가 가지는 고유 성질 | 학번, 이름 |
| 관계 | Relationship | 개체들 사이의 연관 | 학생 — 수강 — 과목 |
| 구조 2계층 | 관점 | 예시 |
|---|---|---|
| 논리적 구조 | 사용자·응용이 인식하는 형태 | 테이블·뷰·필드 |
| 물리적 구조 | 컴퓨터가 매체에 저장하는 실제 형태 | 페이지·블록·인덱스 파일 |
🔑 암기 구성 3요소 = 개체·속성·관계. 구조 = 논리적(사용자 관점) ↔ 물리적(저장 매체 관점). 💡 보충 개체·속성·관계는 E-R 다이어그램(23강)·관계 데이터 모델(24강)의 토대. 논리·물리 분리는 3단계 스키마로 체계화(22강). ⚠️ 함정 '도메인'을 구성 3요소에 끼우면 함정 — 도메인은 속성값의 범위(제약)이지 구성 요소가 아니다. '데이터·정보·지식'(위계)·'테이블·행·열'(관계 모델 표현 단위)도 구성 3요소가 아니다. 🎯 빈출 '구성 3요소가 아닌 것?', 개체 정의 매칭. 간헐.
장단점과 DBMS
DB 장점 6 + 단점 4 — 독무중보공표 ·장단점·
[표] 파일 시스템이 못 푼 문제를 DB가 푼 결과가 장점 6가지. 한 곳에 모아둔 힘의 그림자가 단점 4가지.
| 장점 | 핵심 의미 |
|---|---|
| 독립성 | 논리적·물리적 구조 바뀌어도 응용 수정 불필요 (종속성 제거) |
| 무결성 | 잘못된 데이터 저장 차단 (음수 나이 ❌·없는 부서코드 ❌) |
| 중복 최소화 | 통합 단일 저장소 → 저장 공간 절약 + 일관성 향상 |
| 보안 | 사용자별 접근 권한 제어 (GRANT/REVOKE) |
| 공유 | 여러 응용·여러 팀이 같은 데이터 동시 공유 |
| 표준화 | 명칭·자료형·형식을 조직 차원에서 통일 |
| 단점 | 핵심 의미 |
|---|---|
| ① 고비용 | DBMS 라이선스·하드웨어·전문 인력(DBA) 비용 큼 |
| ② 복잡성 증가 | 시스템 구조 복잡 → 전문 인력 필요 |
| ③ 시스템 취약성 (SPOF) | 중앙 집중식이라 DB 다운 시 전체 서비스 동시 마비 |
| ④ 백업·회복 부담 | 대용량 데이터의 일관된 백업·복구가 파일보다 복잡 |
🔑 암기 장점 6 = 독무중보공표(독립성·무결성·중복최소·보안·공유·표준화). 단점의 핵심은 ③ 시스템 취약성(SPOF) — 한 곳이 죽으면 모두가 죽는다. ⚠️ 함정 '데이터 종속성 유지·강화'를 장점으로 끼우면 매년 단골 함정 — DB는 종속성을 제거하려고 등장했다('아닌 것 고르기'에서 그게 정답). '응답이 항상 파일보다 빠르다'·'백업이 파일보다 간단하다' 같은 절대 표현도 ❌. 🎯 빈출 '장점이 아닌 것?'(종속성 함정), '단점 고르기'. 간헐. 📝 기출 종속성 유지 함정 단골.
DBMS 한 줄 정의 ·DBMS·
[정의] DBMS(DataBase Management System) = 데이터베이스를 생성·관리·운용하는 소프트웨어. 사용자(또는 응용 프로그램)와 DB 사이의 중간 관리자 역할을 한다.
[흐름] 사용자는 값만 던지고, 위치·저장 방식은 DBMS가 가려준다.
[사용자·응용] "이름='홍길동'인 행을 찾아라"
│ 요청(SQL)
▼
[ DBMS ] 중간 관리자 — 위치·저장 방식 추상화
│ 접근
▼
[데이터베이스] 실제 저장 데이터
🔑 암기 DBMS = 사용자와 DB 사이 중간 관리자. DB는 '자료의 집합', DBMS는 그걸 '관리하는 소프트웨어' — 둘은 다르다. 💡 보충 DBMS의 필수 기능(정의·조작·제어 = 정조제)·SQL 명령어 분류는 21강, 3단계 스키마는 22강에서 본격적으로 다룬다. 🎯 빈출 DB vs DBMS 구분, DBMS 정의 매칭. 간헐.
함정 4쌍 종합 ·함정 종합·
[표] 20강 출제는 사실상 함정 분별 게임이다. 이 4쌍만 잡으면 통과 — 시험 5분 전 마지막 점검판.
| # | 함정 보기 ❌ | 정답 키워드 ⭕ | 출제 영역 |
|---|---|---|---|
| ① | 통신(Communication) 데이터 | 공통운저 (공용·통합·운영·저장) | DB 정의 4키워드 |
| ② | 위치/주소에 의한 참조 | 내용에 의한 참조 | DB 4대 특징 |
| ③ | 데이터 종속성 유지·강화 | 데이터 독립성 확보 | DB 장점 |
| ④ | 고정된 스냅샷 유지 | 계속적인 변화 | DB 4대 특징 |
🔑 암기 통신·위치/주소·종속성 유지·고정 스냅샷 — 이 네 표현이 보이면 곧 ❌ 신호. 정답 키워드가 그 옆에 있다. 🎯 빈출 20강 함정의 90%가 이 4쌍. 함정을 알면 정답이 보인다.
기출 다지기
[기출 1 출제] 다음 중 데이터베이스의 정의를 구성하는 4키워드에 해당하지 않는 것은? (아닌 것 고르기)
- ① 공용(Shared) 데이터
- ② 통합(Integrated) 데이터
- ③ 통신(Communication) 데이터
- ④ 운영(Operational) 데이터
정답 및 해설 보기
정답 ③
DB 정의 4키워드 = 공통운저 = 공용·통합·운영·저장. 통신(Communication) 데이터는 '통합'과 한 글자 차이로 헷갈리게 만든 최빈출 함정 — 4키워드에 '통신'은 없다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 키워드 | 공 — 여러 사용자 공동 이용 |
| ② | 키워드 | 통 — 중복 최소화 |
| ③ | 정답(아님) | '통신'은 4키워드에 없음 — 한 글자 함정 |
| ④ | 키워드 | 운 — 조직 업무 필수 |
🔑 '통합'과 '통신'이 같은 보기에 섞이면 무조건 '통합'이 정답. 공통운저에 '통신'은 없다.
[기출 2 출제] 다음 중 데이터베이스의 특징으로 볼 수 없는 것은? (아닌 것 고르기)
- ① 실시간 접근성
- ② 계속적 변화
- ③ 동시 공용
- ④ 위치에 의한 참조
정답 및 해설 보기
정답 ④
DB 4대 특징 = 실계동내 = 실시간 접근성·계속적 변화·동시 공용·내용에 의한 참조. 데이터의 물리적 위치(주소)가 아니라 값으로 찾는 것이 내용 참조이며, '위치에 의한 참조'는 파일 시스템 방식이다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 특징 | 실 — 즉시 응답 |
| ② | 특징 | 계 — 항상 최신 상태 |
| ③ | 특징 | 동 — 여러 사용자 동시 |
| ④ | 정답(아님) | '위치/주소 참조'=파일 시스템 — DB는 내용 참조 |
🔑 '위치·주소·오프셋' 단어가 보이면 무조건 파일 시스템 방식 — 4대 특징 1순위 함정.
[기출 3 출제] 다음 설명에 해당하는 데이터베이스의 특징은? (설명→용어 찾기)
데이터베이스는 삽입·갱신·삭제를 통해 동적으로 상태가 변하면서도, 매 순간 항상 정확한 값을 유지해야 한다.
- ① 실시간 접근성
- ② 계속적 변화
- ③ 동시 공용
- ④ 내용에 의한 참조
정답 및 해설 보기
정답 ②
상태가 동적으로 변하면서도 항상 정확한 값을 유지하는 성질이 계속적 변화(Continuous Evolution). Insert·Update·Delete가 끊임없이 데이터를 바꾼다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 오답 | 실시간 접근성 = 응답 시간 |
| ② | 정답 | 계속적 변화 = 동적 변화 + 항상 최신 |
| ③ | 오답 | 동시 공용 = 다중 사용자 접근 |
| ④ | 오답 | 내용 참조 = 값 기반 검색 |
🔑 '고정·불변·정적·스냅샷' 표현이 보이면 계속적 변화의 정반대 — 즉시 ❌.
[기출 4 출제] 다음 중 데이터베이스의 장점으로 가장 거리가 먼 것은? (아닌 것 고르기)
- ① 데이터 중복의 최소화
- ② 데이터 무결성 유지
- ③ 데이터 종속성 강화
- ④ 데이터 보안 향상
정답 및 해설 보기
정답 ③
DB는 응용과 데이터의 종속성을 제거(독립성 보장)하는 방향으로 발전했다. '종속성 강화'는 DB가 추구하는 방향과 정반대이며, 파일 시스템 시절의 단점이었다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 장점 | 중복 최소화 |
| ② | 장점 | 무결성 유지 |
| ③ | 정답(아님) | 종속성은 제거 대상 — DB 장점은 독립성 |
| ④ | 장점 | 보안 향상 (GRANT/REVOKE) |
🔑 장점 = 독무중보공표. '종속성 유지·강화'가 보이면 그게 곧 '아닌 것'.
[기출 5 출제] 다음 중 데이터베이스의 구성 3요소 중 현실 세계에서 구별되는 객체·사물을 나타내는 것은? (설명→용어 찾기)
- ① 속성(Attribute)
- ② 관계(Relationship)
- ③ 개체(Entity)
- ④ 도메인(Domain)
정답 및 해설 보기
정답 ③
개체(Entity) = 현실에서 구별 가능한 객체·사물(학생·과목 등), E-R 다이어그램에서 사각형으로 표기. 속성은 개체의 특성, 관계는 개체 간 연관이다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 오답 | 속성 = 개체의 고유 성질(학번·이름) |
| ② | 오답 | 관계 = 개체 간 연관(수강·소속) |
| ③ | 정답 | 개체 = 현실의 객체·사물 |
| ④ | 오답 | 도메인 = 속성값의 범위(제약) — 구성 요소 아님 |
🔑 구성 3요소 = 개체·속성·관계. '도메인'이 끼면 함정.
[기출 6 출제] 데이터·정보·지식의 위계에 대한 설명으로 옳지 않은 것은? (아닌 것 고르기)
- ① 데이터는 가공되지 않은 사실을 의미한다
- ② 정보는 데이터에 맥락과 의미를 부여한 결과이다
- ③ 지식은 정보가 모여 의사결정의 근거가 되는 단계이다
- ④ 데이터베이스는 정보·지식 계층까지 직접 관리한다
정답 및 해설 보기
정답 ④
DBMS는 데이터 계층만 직접 관할한다. 그 위의 정보·지식 계층은 응용 프로그램·BI 도구·데이터 웨어하우스가 담당한다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 옳음 | 데이터 = 가공 전 사실 |
| ② | 옳음 | 정보 = 의미 부여 결과 |
| ③ | 옳음 | 지식 = 의사결정 근거 |
| ④ | 정답(틀린 보기) | DBMS는 데이터 계층만 — 정보·지식은 응용·BI 몫 |
🔑 'DBMS 관할 = 데이터 계층', '정보·지식 = 응용·분석 도구'로 책임 범위 분리.
[기출 7 출제] 데이터베이스의 "통합된 데이터(Integrated Data)" 가 의미하는 바로 가장 적절한 것은? (개념 식별)
- ① 모든 데이터가 단 하나의 사본만 존재해야 함
- ② 데이터의 중복을 최소화한 상태
- ③ 모든 데이터를 단일 파일에 저장하는 것
- ④ 데이터의 유형을 모두 동일하게 통일하는 것
정답 및 해설 보기
정답 ②
통합된 데이터의 핵심은 중복 최소화이지 완전 제거가 아니다. 성능·가용성을 위해 인덱스·반정규화처럼 의도적 중복을 허용하기도 한다.
| 선지 | 판정 | 근거 |
|---|---|---|
| ① | 오답 | '단 하나의 사본만'은 절대 표현 — 통제된 중복 허용 |
| ② | 정답 | 중복 최소화 = 통합의 본질 |
| ③ | 오답 | 단일 파일 저장은 통합의 의미가 아님 |
| ④ | 오답 | 유형 통일은 표준화 — 통합과 다름 |
🔑 '모든·항상·완전히·100%' 같은 절대 표현은 함정인 경우가 많다. '최소화' 같은 정도성 표현이 정답 가능성 높음.
한 장 요약
| 영역 | 핵심 | 암기팁 |
|---|---|---|
| 데이터·정보·지식 | 가공 전 사실 → 의미 부여 → 의사결정 근거 | DBMS=데이터 계층만 |
| DB 정의 4키워드 | 공용·통합·운영·저장 (모두 충족) | 공통운저 (통신 ❌) |
| DB 4대 특징 | 실시간·계속적 변화·동시 공용·내용 참조 | 실계동내 (위치 ❌) |
| 파일 시스템 한계 | 종속성·중복성 → 독립성·중복 최소화 | DB가 푼 두 병 |
| 구성 3요소 | 개체·속성·관계 (도메인 ❌) | E-R 토대(23강) |
| 구조 2계층 | 논리적(사용자) ↔ 물리적(매체) | 3단계 스키마(22강) |
| DB 장점 6 | 독립성·무결성·중복최소·보안·공유·표준화 | 독무중보공표 (종속성 유지 ❌) |
| DB 단점 4 | 고비용·복잡성·시스템 취약성(SPOF)·백업 부담 | 한 곳이 죽으면 모두 마비 |
| DBMS | DB를 생성·관리·운용하는 SW (중간 관리자) | DB≠DBMS (21강 본격) |
🎯 합격 한 끗: 20강은 깊이가 아니라 분별력이다. 함정 4쌍 — 통신(↔공통운저)·위치 참조(↔내용 참조)·종속성 유지(↔독립성)·고정 스냅샷(↔계속적 변화) — 만 잡으면 통과. 점수밭 둘 = 공통운저 + 실계동내. DBMS의 필수 기능(정조제)·SQL 명령어 분류·DBMS 종류(계네관객)는 21강, 3단계 스키마는 22강에서 이어진다.
