Rebalance

PE Notes

DB

정보관리기술사 토픽을 도메인별로 모읍니다. 게시된 문서만 표시합니다.

배치·스트림 수집, 레이크·웨어하우스·서빙 저장, 배치·실시간 처리와 출력

DB

빅데이터 플랫폼 아키텍처

입출력·데이터·인프라 세 계층과 Bronze–Silver–Gold 영역, 레이크·웨어하우스·레이크하우스·메시 선택 기준을 정리합니다.

관측가능성 정의와 신선도·분포·볼륨·스키마·계보 다섯 축

DB

데이터 관측가능성

파이프라인 전 구간의 신선도·분포·볼륨·스키마·계보를 실시간으로 읽어 데이터 다운타임을 줄이는 관측가능성과, 품질관리와의 차이를 정리합니다.

비경합·결합가치·비소모 특성과 일반 재화 대비, 회계·거래·투자에 평가가 필요한 이유

DB

데이터 가치평가

비경합·비소모·결합가치 같은 데이터 재화 특성과, 비용·시장·수익 세 접근법, 품질을 반영한 평가 절차와 활용을 정리합니다.

인덱스 목적과 B+ 트리 루트·브랜치·리프, 키로 행에 닿는 탐색

DB

데이터베이스 인덱스

B+ 트리 인덱스와 클러스터드·논클러스터드 차이, 키 룩업을 없애는 커버링 인덱스, 선택도와 복합 키 설계를 정리합니다.

합성데이터 정의와 GAN·VAE·통계 생성, 완전·부분·하이브리드 유형

DB

합성데이터

원본 분포는 남기고 개인은 빼는 합성데이터의 통계·GAN·VAE 생성, 충실도·유용성·프라이버시 평가, 가명·익명처리와의 자리를 정리합니다.

체크포인트 이후 로그를 분석하고 REDO로 역사를 재현한 뒤 LOSER를 UNDO하는 ARIES 세 단계

DB

ARIES

WAL을 전제로 분석·REDO·UNDO 세 단계로 복구하는 ARIES의 Repeating History, CLR, LSN·더티 페이지 테이블이 재장애에도 멱등인 이유를 정리합니다.

규모·속도·다양성·정확성·가치 5V와 스타 스키마·문서·그래프 모델, 분류·회귀·군집 평가

DB

빅데이터 모델링, 평가, 시각화

5V와 스타·스노우플레이크·NoSQL 모델, 분류·회귀·군집 평가지표, 목적별 차트와 시각화 원칙을 정리합니다.

처리 패턴·데이터 특성·확장성·생태계·TCO 다섯 원칙과 배치·스트림 도구 매트릭스

DB

빅데이터 도구 선정, Hadoop V3, 카파 아키텍처

처리 패턴·데이터 특성·확장·생태계·TCO 선정 원칙, Hadoop 3의 EC·다중 NameNode, 람다와 카파 비교를 정리합니다.

갱신 손실·더티 리드·팬텀과 직렬성 목표, 비관적 잠금과 낙관적 MVCC·OCC 분류

DB

동시성제어 (병행제어)

다수 트랜잭션의 직렬성을 지키면서 처리량을 유지하는 잠금·2PL·데드락 처리와 MVCC·OCC를 비교합니다.

부모 PK가 자식 PK에 들어가는 식별 관계와 FK만 두는 비식별 관계, 선택 기준

DB

식별·비식별 관계와 ORDBMS·NoSQL 모델링

개념·논리·물리 모델링, 식별·비식별 관계 ERD, ORDBMS의 UDT·상속과 문서형 내장·참조 선택을 비교합니다.

정확성·완전성·일관성·유효성·유일성·적시성 여섯 차원과 프로파일링·클렌징·모니터링 절차

DB

데이터 품질관리와 데이터 거버넌스

정확성·완전성·일관성 등 품질 여섯 차원과, 프로파일링·클렌징·모니터링 절차, 정책·역할·계보를 묶는 데이터 거버넌스를 정리합니다.

국가·기업·개인 데이터 주권과 역외 이전·클라우드 집중 이슈

DB

데이터 주권과 거버넌스 전략

국가·기업·개인 세 층의 데이터 주권, GDPR·CLOUD Act 충돌, 현지화 수위와 CDO·스튜어드 중심 거버넌스를 정리합니다.

거버넌스 없는 적재가 레이크를 늪으로 만드는 정의와 원인, 레이크·늪·웨어하우스 비교

DB

데이터늪 (Data Swamp)

거버넌스와 메타데이터 없이 레이크가 쓰이지 못하는 데이터늪의 원인, 증상, 카탈로그·계보·품질 게이트·레이크하우스 탈출을 정리합니다.

원자성·일관성·격리성·지속성과 계좌 이체 트랜잭션 개념도

DB

트랜잭션 특성과 쿼리 오프로딩

ACID 네 특성과 상태 전이·TCL, 읽기를 복제본으로 보내는 오프로딩과 복제 지연·Read-Your-Writes를 정리합니다.

데이터 용량에 인덱스·로그·여유를 더하고 연간 증가율을 곱하는 DB 스토리지 산정

DB

DB 용량산정

데이터·인덱스·로그·여유를 더해 스토리지를 잡고, 기능점수 기반 TPS로 CPU·메모리를 잡는 HW 규모산정과 무엇을 다르게 보는지 비교합니다.

쿼리·인덱스·스키마 세 영역과 병목 진단, 하드웨어보다 소프트웨어를 먼저 고치는 우선순위

DB

데이터베이스 튜닝

쿼리·인덱스·스키마·인스턴스 순의 튜닝 계층과 실행 계획, 선택도·커버링 인덱스, 버퍼·슬로우 쿼리 지표를 정리합니다.

전환 동인, 상용·오픈소스 매핑, 분석부터 절체 단계

DB

DBMS 전환과 HA

상용에서 오픈소스 DBMS로 옮길 때 SQL 방언과 이중화를 가르고, Patroni 스트리밍 복제와 Galera 다중 마스터를 RAC와 같은 비교표에 올립니다.

여러 사이트를 하나의 논리 DB로 보는 구조와 위치·중복·분할·장애·병행 투명성

DB

분산 데이터베이스 — 투명성과 분할

여러 사이트에 두고도 하나로 보이게 하는 다섯 투명성, 수평·수직·혼합 분할과 복제, 2PC 분산 커밋을 정리합니다.

함수적 종속 유형, 다치 종속과 4NF, 조인 종속과 5NF

DB

FD·4NF·5NF와 샤딩·파티셔닝·쿼리 오프로딩

암스트롱 공리와 다치·조인 종속, 4NF·5NF, 단일 서버 파티셔닝과 다중 서버 샤딩, 읽기 복제 오프로딩을 정리합니다.

개체·참조·도메인·키·NULL·릴레이션 무결성 제약의 계층

DB

데이터 무결성 제약조건 여섯 가지

개체·참조·도메인·키·열·사용자 정의 무결성과 기본키·외래키·후보키, DB·트리거·애플리케이션 구현을 정리합니다.

트랜잭션·시스템·미디어 장애와 WAL 로그, UNDO·REDO 회복 원리

DB

데이터 무결성 회복기법

트랜잭션·시스템·미디어 장애와 WAL, UNDO/REDO, 체크포인트, 그림자 페이징, 즉시·지연 갱신, RPO/RTO 백업을 정리합니다.

단일 DB 규칙으로서의 무결성과 분산 복사본 일치로서의 정합성 비교

DB

무결성 vs 정합성, 프로파일링과 클렌징

한 저장소 안의 무결성과 여러 저장소 사이의 정합성을 가르고, 진단으로서의 프로파일링과 처방으로서의 클렌징을 비교합니다.

삽입·삭제·갱신 이상과 원자값부터 결정자=후보키까지의 정규화 단계 개요

DB

이상현상과 정규화·반정규화

삽입·삭제·갱신 이상과 1NF부터 BCNF까지의 분해, 읽기 성능을 위한 반정규화 기법과 트레이드오프를 정리합니다.

일관성·가용성·분단 내성 삼각형에서 분단 시 CP와 AP로 갈라지는 CAP

DB

NoSQL, CAP, BASE, PACELC

분산에서 C·A·P를 동시에 못 지키는 CAP, 분단 없을 때의 지연 트레이드오프 PACELC, AP 쪽 BASE와 네 데이터 모델, ACID를 지키는 NewSQL을 한 줄로 잇습니다.

더티 리드, 반복 불가 읽기, 팬텀 리드가 격리 수준이 올라갈수록 사라지는 대응표

DB

팬텀 충돌과 트랜잭션 격리수준

더티 리드·반복 불가 읽기·팬텀 리드를 격리 네 수준에 대응시키고, 범위 잠금과 MVCC가 팬텀을 어떻게 다르게 막는지 정리합니다.

공공데이터 정의와 포맷 체계, Tim Berners-Lee 5성급 개방 모델

DB

공공데이터, LOD, 마이데이터

공공데이터 개방 원칙과 기계 가독 포맷, 5성급 모델과 LOD(RDF·SPARQL), 개인 전송요구권 중심의 마이데이터를 비교합니다.

바인드 변수로 값이 들어가는 정적 SQL과 문자열 연결 동적 SQL, 보안·성능 비교

DB

정적 SQL과 동적 SQL

컴파일 시 구조가 고정되는 정적 SQL과 실행 시 문자열로 만드는 동적 SQL을 보안·성능·유연성으로 비교하고, 바인딩과 화이트리스트를 정리합니다.

← PE Notes 개요