데이터베이스·빅데이터
DB 이론·설계, 빅데이터 처리, 데이터 엔지니어링
326 POSTS · 9 / 11
PostgreSQL 아키텍처와 엔터프라이즈 고가용성 운영 전략
PostgreSQL의 MVCC·WAL·JSONB·확장 구조와 Patroni, pgBackRest, 파티셔닝을 활용한 엔터프라이즈 운영 전략을 정리한다.
2026-04-25
Flink냐 Spark냐보다 먼저 정해야 하는 것 — 실시간 분석 파이프라인 설계
실시간 분석·스트림 처리·데이터 파이프라인 자동화를 엔진 선택 이전의 설계 원칙, 일관성·오류 처리 전략 중심으로 정리한다.
2025-12-13
RDF 데이터 거버넌스 — SHACL 검증부터 접근제어·버전 롤백까지
RDF 그래프를 조직 자산으로 운영할 때 필요한 SHACL 품질 게이트, 네임드 그래프 단위 접근제어·PII 마스킹, 스키마 버전·롤백 정책을 RDF vs 프로퍼티 그래프 vs RDBMS 비교와 함께 정리한다.
2025-12-03
RDF 트리플스토어를 데이터베이스로 운영한다는 것
RDF 트리플스토어를 RDBMS·프로퍼티 그래프와 비교하고, 추론 전략 선택·인덱싱·Named Graph 거버넌스 등 운영 관점의 설계 결정을 정리한다.
2025-12-03
RDF란: 웹의 모든 것을 주어-술어-목적어 삼중으로 그리는 법
웹 메타데이터를 주어-술어-목적어 삼중으로 표현하는 RDF의 그래프 데이터 모델과 직렬화·RDFS 비교·SHACL 검증·실무 적용 사례를 Turtle 예제와 함께 정리한다.
2025-11-26
포인트 프로세스로 이벤트 발생 패턴 모델링하기
Poisson·Hawkes·Cox 포인트 프로세스의 조건부 강도, 군집성, 안정성 조건과 이벤트 로그 모델링·검증 방법을 정리한다.
2025-10-14
프로세스마이닝으로 실제 업무 흐름을 분석하는 방법
프로세스마이닝의 이벤트 로그, 발견·순응도·확장 기법과 운영 개선, 데이터 품질 관리 방식을 정리한다.
2025-10-14
공개 데이터셋·Kafka·웨어하우스를 연결하는 데이터 파이프라인 설계
공개 데이터셋, Kafka 스트리밍, 데이터 웨어하우스를 결합해 수집·검증·적재하는 데이터 파이프라인 설계 전략을 정리한다.
2025-10-14
RDBMS와 NoSQL을 조합하는 데이터베이스 아키텍처 설계
RDBMS와 MongoDB·Cassandra·Redis의 데이터 모델, 일관성, 확장성 차이를 비교하고 워크로드별 데이터 계층 설계 기준을 정리한다.
2025-10-14
추천 시스템 설계: 협업 필터링·콘텐츠 기반·행렬 분해의 역할
협업 필터링, 콘텐츠 기반 추천, 행렬 분해를 후보 생성·재랭킹·서빙 흐름과 함께 정리한 추천 시스템 설계 가이드
2025-10-14
규제 산업을 위한 도메인 특화 AI 분석 설계
EHR 분석·의료영상 AI·이상거래탐지를 대상으로 데이터 거버넌스, 모델 선택, 설명가능성, MLOps 운영 원칙을 정리한다.
2025-10-14
REST API 설계: 리소스와 HTTP 의미론으로 만드는 분산 인터페이스
REST 아키텍처의 리소스 모델링, HTTP 메소드 의미론, 캐시·동시성·보안 설계 원칙을 실무 API 관점에서 정리한다.
2025-10-14
물리 모델링으로 DBMS 저장 구조와 성능 설계하기
물리 모델링에서 테이블스페이스, 반정규화, 파티셔닝, 인덱스와 데이터 변환을 설계해 DBMS 성능과 운영성을 함께 확보하는 방법
2025-08-10
Primary Key와 Unique Index로 데이터 무결성 설계하기
Primary Key와 Unique Index의 차이, NULL 처리와 외래 키 참조, 성능 영향 및 데이터베이스 설계 시 고려할 기준을 정리한다.
2025-08-10
RDB와 NoSQL의 구조·일관성·확장성 비교
RDB와 NoSQL의 데이터 모델, 분산 처리, CAP 특성, ACID·BASE와 활용 환경을 비교해 저장소 선택 기준을 정리한다.
2025-08-10
참조무결성으로 관계형 데이터의 연결을 지키는 방법
참조무결성의 기본 키·외래 키 관계와 CASCADE, SET NULL, RESTRICT 옵션을 통해 관계형 데이터베이스의 일관성을 관리하는 방법
2025-08-10
관계대수로 읽는 SQL 질의 처리와 최적화
관계대수의 선택·투영·조인·집합 연산을 중심으로 SQL 질의 처리와 DBMS 실행 계획 최적화의 기반을 정리한다.
2025-08-10
관계형 데이터 모델링으로 설계하는 데이터베이스 구조
관계형 데이터 모델의 엔티티·속성·관계와 정규화, 식별자, 물리 설계까지 데이터베이스 구조를 설계할 때 필요한 핵심 원칙을 정리한다.
2025-08-10
Relation으로 이해하는 관계형 데이터베이스의 구조와 연산
Relation의 속성·튜플·스키마와 관계 대수, 무결성 제약조건을 중심으로 관계형 데이터베이스의 동작 원리를 정리합니다.
2025-08-10
릴레이션 무결성 제약으로 데이터 일관성 지키기
도메인·개체·참조·키·사용자 정의 무결성 제약의 역할과 강제 방법, 위반 처리 방식을 데이터베이스 설계 관점에서 정리합니다.
2025-08-10
M:N 관계를 해소해 데이터 무결성을 지키는 모델링 방법
데이터베이스 M:N 관계에서 발생하는 이상현상을 줄이고 관계 엔터티, 식별자 통합, 속성 추가로 무결성을 확보하는 방법을 다룬다.
2025-08-10
행 기반과 열 기반 데이터베이스, 워크로드에 맞춘 선택 기준
Row-Based와 Column-Based 데이터베이스의 저장 구조, OLTP·OLAP 특성, 하이브리드 접근법과 선택 기준을 정리한다.
2025-08-10
로우기반과 컬럼기반 DB 저장 구조, 워크로드에 맞게 고르기
로우기반과 컬럼기반 데이터베이스의 물리 저장 구조, OLTP·OLAP 성능 특성, 압축 방식과 하이브리드 운영 방식을 비교한다.
2025-08-10
RPD로 반복 패턴을 찾아내는 시계열 데이터 분석
RPD(Recurrent Pattern Detection)의 처리 흐름과 통계·기계학습 접근법, 산업별 반복 패턴 탐지 활용 방안을 정리한다.
2025-06-28
PIT와 PET로 설계하는 시간 기준 데이터 관리
PIT와 PET의 시간 기준 차이, 이력·감사·정책 관리 활용 방식, 시간 차원 데이터 모델링과 SQL 구현 예시를 정리한다.
2025-06-15
PIT와 PET로 다루는 시간 기반 데이터 조회와 추적
PIT와 PET의 시간 차원 데이터 관리 방식, 조회·복원·감사 추적 활용과 분산 및 클라우드 환경의 구현 고려사항을 정리한다.
2025-05-25
BI 예측 분석과 자연어 질의를 연결하는 설계
예측 분석과 자연어 질의를 BI에 통합할 때 필요한 의미계층, MLOps, 가드레일, 성능·보안 운영 설계를 정리한다.
2024-04-29
공공데이터 활용을 위한 개방 경로·품질·준수 설계
공공데이터를 OpenAPI·파일·대용량 경로로 활용할 때 필요한 거버넌스, 품질 검증, 보안 운영과 법적 준수 설계
2024-04-29
Redis 캐싱과 Elasticsearch 검색·분석 아키텍처
Redis 캐시와 Elasticsearch 검색·분석을 함께 운영할 때의 일관성, 확장, 장애 복구, 용량 산정 기준을 정리한다.
2024-04-29
소매 분석으로 수요·가격·재고를 함께 운영하는 방법
수요 예측, 가격 최적화, 재고 관리를 연결하는 소매 분석 운영 체계와 모델 선택, 거버넌스, 재주문점 계산 예시를 정리한다.
2024-04-29