데이터베이스·빅데이터
DB 이론·설계, 빅데이터 처리, 데이터 엔지니어링
326 POSTS · 8 / 11
MongoDB와 PostgreSQL 사이: JSONB·pgvector·TCO로 보는 데이터베이스 선택
JSONB와 pgvector, 쿼리 특성, 운영 비용을 기준으로 MongoDB와 PostgreSQL의 선택 및 마이그레이션 전략을 비교한다.
2026-04-23
MPEG-21 디지털 아이템 프레임워크로 콘텐츠 권리와 유통 표준화하기
MPEG-21의 디지털 아이템 선언·식별·권리표현·보호·적응 구조를 정리하고, OTT·출판·교육·공공 분야에서 콘텐츠 권리와 유통을 표준화하는 접근법을 설명한다.
2025-12-03
MPEG-A로 음악·사진·AR 자산을 표준 애플리케이션 포맷 하나로 묶기
ISO/IEC 23000 MPEG-A가 코덱·컨테이너·메타데이터·권리 기술을 도메인별 애플리케이션 포맷으로 묶는 방식과 제작→검증→배포 파이프라인 구축법을 정리한다.
2025-12-03
MPEG-7 CDVS를 서비스에 앉히는 법: 파이프라인 설계와 운영 트레이드오프
MPEG-7 CDVS 표준을 실제 시각 검색 서비스에 도입할 때의 파이프라인 설계, KPI 정의, 파라미터 튜닝, 장애 폴백 전략을 정리한다.
2025-12-03
OOXML: OPC 패키징으로 오피스 문서 상호운용성 설계하기
ISO/IEC 29500 OOXML의 OPC 패키징 구조와 워드·셀·프레젠테이션 마크업 계층을 정리하고, 대량 문서 자동화와 ODF 상호운용 전략을 설명한다.
2025-12-03
MPEG-21 사용자정보 서술체계(UD)로 미디어 개인화 설계하기
MPEG-21 디지털 아이템 프레임워크와 사용자정보 서술체계(UD), MPEG-A 패키징 연계로 미디어 개인화·접근성을 설계하는 방법을 정리한다.
2025-11-26
MPEG-7 CDVS, 이미지를 2KB 이하로 압축해 검색하는 표준
MPEG-7 CDVS의 SCFV 전역 기술자와 압축 SIFT 국소 기술자 구조, 스케일러블 비트스트림, 모바일 시각 검색 적용 사례를 정리한다.
2025-11-26
온톨로지는 텍소노미·토픽맵과 무엇이 다른가
온톨로지의 정의와 구성요소, 텍소노미·토픽맵과의 경계를 비교하고, 구축 절차와 OWL·SPARQL 코드 예시로 언제 온톨로지가 필요한지 정리한다
2025-11-26
온톨로지를 어떤 언어로 명세할 것인가 — XML부터 OWL까지
XML/XML Schema, RDF/RDFS, DAML+OIL, OWL, XOL을 표현력·성능·도구 생태계 기준으로 비교하고 RDFS에서 OWL로 단계적으로 도입하는 절차를 정리한다
2025-11-26
멀티미디어 DB 설계: 객체 저장소·벡터 검색·스트리밍
멀티미디어 DB에서 객체 저장소, 메타데이터, 벡터 인덱스, 적응형 스트리밍을 결합하는 설계와 운영 방안을 정리한다.
2025-10-14
비선형 회귀 모델 선택: 다항식·스플라인·GAM의 적용 기준
비선형 회귀에서 다항 회귀, 스플라인 회귀, GAM을 선택하는 기준과 복잡도 제어, 검증 및 운영 진단 방법을 정리한다.
2025-10-14
NoSQL 데이터 모델링: 읽기 경로를 설계하는 패턴
Denormalization, Aggregation, Application Join을 중심으로 NoSQL 데이터 모델링에서 읽기 성능과 확장성을 설계하는 방법을 정리합니다.
2025-10-14
NoSQL 모델링: 액세스 패턴에서 시작하는 데이터 설계
NoSQL 모델링을 도메인, 쿼리 결과, 파티션 설계와 워크로드 검증 흐름으로 정리하고 주요 패턴과 운영 고려사항을 다룹니다.
2025-10-14
NoSQL 데이터 모델링을 쿼리 중심으로 설계하는 방법
NoSQL 데이터 모델링에서 도메인 분석, 쿼리 결과 설계, 파티션 전략, 제품 검증과 운영 최적화까지 정리합니다.
2025-10-14
OLAP으로 다차원 데이터를 탐색하는 방법
OLAP의 다차원 큐브와 탐색 기능, ROLAP·MOLAP·HOLAP 유형별 특성 및 운영 설계 관점을 정리한다.
2025-10-14
ODS 설계: 운영계와 DW 사이의 최신 데이터 완충층
ODS의 역할과 ER 모델, CDC·Upsert 적재 방식, DW 연계 구조를 운영 데이터 공급망 관점에서 정리합니다.
2025-10-14
병렬 DB와 분산 DB, 처리 성능과 가용성의 설계 선택
병렬 데이터베이스와 분산 데이터베이스의 구조, 쿼리 처리 방식, 트랜잭션 제어와 활용 환경의 차이를 정리한다.
2025-10-14
Parquet·ORC와 Snappy·Zlib로 분석 데이터 압축 설계하기
Parquet·ORC 컬럼형 포맷과 Snappy·Zlib 코덱의 구조, 성능 특성, Spark·Hive 운영 설정을 정리한다.
2025-10-14
MVCC로 읽기와 쓰기를 함께 처리하는 방법
MVCC의 버전 관리 원리와 MGA, Rollback Segment, SCN 기반 읽기 일관성을 정리하고 운영 시 고려할 점을 설명한다.
2025-08-10
MVCC로 읽기와 쓰기 충돌 줄이는 데이터베이스 동시성 제어
MVCC의 스냅샷 읽기와 데이터 버전 관리 방식, 장단점, PostgreSQL·Oracle·InnoDB 구현 차이를 정리합니다.
2025-08-10
New SQL: 정합성과 수평 확장을 함께 다루는 분산 데이터베이스
New SQL의 SQL·ACID·수평 확장 특성과 RDBMS·NoSQL의 차이, 인메모리 및 분산 아키텍처 적용 관점을 정리한다.
2025-08-10
NoSQL 데이터 모델링과 CAP·BASE 선택 기준
NoSQL의 저장 모델, CAP·BASE 특성, RDBMS와의 차이, 쿼리 중심 데이터 모델링 원칙과 운영 설계 흐름을 정리한다.
2025-08-10
객체관계형 DBMS로 복잡한 데이터 모델 다루기
객체관계형 DBMS의 UDT, 참조 타입, LOB, 테이블 상속과 중첩 테이블을 관계형 모델 및 ORM 관점에서 정리한다.
2025-08-10
OLAP으로 다차원 데이터를 분석하는 방법
OLAP의 다차원 분석 구조와 ROLAP·MOLAP·HOLAP 차이, 큐브와 드릴다운 등 분석 기법, OLTP와의 구분을 정리합니다.
2025-08-10
낙관적 검증으로 트랜잭션 충돌을 다루는 방법
낙관적 검증의 판독·검증·기록 단계와 충돌 조건, 비관적 검증과의 차이, 구현 시 운영 고려사항을 정리합니다.
2025-08-10
ORA-1555 Snapshot too old와 Oracle UNDO 관리
Oracle ORA-1555 Snapshot too old 오류의 원인과 읽기 일관성, UNDO 관리, 커밋 패턴 및 예방 방법을 정리합니다.
2025-08-10
외부조인으로 누락 행까지 포함하는 SQL 조회
외부조인의 LEFT, RIGHT, FULL JOIN 동작과 NULL 처리, DBMS별 문법 차이 및 다중 테이블 조인 시 주의점을 정리한다.
2025-08-10
NoSQL: 스키마 없는 데이터베이스가 필요했던 이유
관계형 DB의 한계를 넘어서려 나온 NoSQL의 CAP·BASE 설계 원칙, 키-값·문서형·컬럼·그래프 저장 모델과 실제 도입 사례를 정리한다.
2025-05-23
MongoDB·Cassandra·Neo4j로 보는 NoSQL 데이터 모델과 쿼리 설계
MongoDB, Cassandra, Neo4j의 데이터 모델과 분산 구조, 일관성 제어, 인덱스 및 쿼리 설계 방식을 비교한다.
2024-04-29
Pandas·NumPy·Scikit-learn으로 데이터 처리 파이프라인 구성하기
Pandas 집계와 피벗, NumPy 벡터화, Scikit-learn Pipeline을 결합해 재현 가능한 데이터 처리와 모델 학습 흐름을 구성하는 방법
2024-04-29