알고리즘·통계
알고리즘, 자료구조, 통계, 수학
417 POSTS · 4 / 14
데이터 압축 기술: 무손실·손실 방식과 멀티미디어 표준
데이터 압축의 중복성 제거 원리와 무손실·손실·혼합 방식의 차이, RLE·Huffman·DCT·JPEG·MPEG 표준을 정리한다.
2025-12-25
제약 최적화에서 LP·MIP·라그랑주 승수법을 고르는 기준
선형계획, 혼합정수계획, 라그랑주 승수법의 모델링 방식과 솔버 선택 기준, 운영 검증 및 성능 튜닝 전략을 정리한다.
2025-10-14
데이터 기반 의사결정: 트리·베이지안·효용이론을 잇는 운영 프레임워크
의사결정나무, 베이지안 업데이트, 효용이론을 결합해 불확실성과 비용·리스크를 운영 정책으로 전환하는 데이터 기반 의사결정 프레임워크
2025-10-14
의사결정트리로 분류 규칙을 설계하는 방법
의사결정트리의 분할 기준, 가지치기, 결측값 처리와 규칙 추출 방식을 정리하고 분류·회귀 모델 운영 시 고려할 사항을 다룬다.
2025-10-14
기술통계로 데이터 분포를 읽는 방법
평균·중앙값·최빈값과 분산·표준편차, 왜도·첨도로 데이터 분포를 요약하고 이상 변화를 진단하는 기술통계 분석 체계
2025-10-14
데이터 이상값 탐지와 처리: 통계 지표부터 마할라노비스 거리까지
데이터 이상값의 발생 원인, 통계값·시각화·마할라노비스 거리·LoF·iForest 기반 검출법, 삭제·대체·변환·박스플롯 처리 방법을 정리한다.
2025-05-23
DBSCAN — 군집 수를 몰라도 밀도로 경계를 찾는 알고리즘
DBSCAN이 Eps·MinPts로 Core/Border/Noise 포인트를 구분해 군집을 형성하는 원리, 파라미터 선정법, 시간복잡도, OPTICS·HDBSCAN 등 변형과 실제 활용 사례를 정리한다.
2025-05-23
기술통계학으로 데이터를 요약하는 법 — 중심경향·분산·분포 측도
평균·중앙값·최빈값부터 분산·표준편차·왜도·첨도까지, 데이터의 특성을 수치와 그래프로 요약하는 기술통계학의 핵심 측도와 IT·금융·제조 현장의 활용 사례를 정리한다.
2025-05-23
연속 확률 변수에서 PDF·CDF·기대값 적분 다루기
연속 확률 변수의 PDF와 CDF 관계, 기대값 적분, 수치 안정성 검증 절차를 실무 관점에서 정리합니다.
2024-04-29
CTM과 DTM으로 토픽 상관성과 시간 변화를 분석하는 방법
CTM과 DTM의 확률 구조, 추론 방식, 전처리와 튜닝, 운영 진단을 통해 토픽 상관성과 시계열 변화를 분석하는 방법
2024-04-29
대응 분석과 다중 대응 분석: χ² 거리로 범주형 관계 읽기
대응 분석과 다중 대응 분석의 χ² 거리, 관성, SVD 기반 좌표 산출 과정을 정리하고 설문·품질·마케팅 데이터 해석 시 확인할 지점을 다룬다.
2024-04-29
Cox Process와 Marked Point Process로 공간 이벤트 모델링하기
Cox Process와 Marked Point Process의 랜덤 강도·마크 모델을 바탕으로 공간 및 시공간 이벤트의 클러스터링과 이질성을 분석하는 방법을 정리한다.
2024-04-29
CPU 스케줄링 알고리즘: FCFS·SJF·Round-Robin·MLFQ 선택 기준
FCFS, SJF/SRTF, Round-Robin, MLFQ의 선점 방식과 대기 시간, 응답성, 기아 위험, 운영 튜닝 기준을 정리한다.
2024-04-29
CPU 스케줄링·페이지 교체·I/O를 함께 튜닝하는 방법
CPU 스케줄링, 메모리 페이지 교체, I/O 스케줄러를 하드웨어와 OS 메커니즘에 맞춰 조정하는 실무 튜닝 기준
2024-04-29
교차검증과 부트스트랩으로 모델 일반화 성능 검증하기
K-fold, LOOCV, 부트스트래핑을 활용해 모델 성능의 불확실성을 추정하고 과적합과 데이터 누수를 줄이는 평가 방법을 다룬다.
2024-04-29
CUDA로 구현하는 병렬 그래프 탐색과 BFS·DFS 설계
CUDA 기반 병렬 BFS·DFS의 실행 구조와 CSR 데이터 구성, 로드밸런싱, 동기화 및 운영 점검 항목을 정리한다.
2024-04-29
설문·관찰·실험·빅데이터를 잇는 데이터 수집 설계
설문조사, 관찰, 실험, 빅데이터 소스를 목적과 편향, 품질, 개인정보 거버넌스 관점에서 비교하고 수집 파이프라인 설계에 적용하는 방법
2024-04-29
히스토그램·박스플롯·바이올린 플롯·산점도 매트릭스로 데이터 분포 읽기
히스토그램, 박스플롯, 바이올린 플롯, 산점도 매트릭스를 활용해 분포·이상치·변수 관계를 분석하는 방법과 운영 기준을 정리한다.
2024-04-29
데이터 변환으로 모델 입력 분포를 다루는 방법
스케일링, 로그 변환, Box-Cox 변환의 선택 기준과 데이터 누수 방지, 역변환, 분포 시프트 운영 방식을 정리합니다.
2024-04-29
자료형 설계로 API 계약과 도메인 제약 다루기
기본형·사용자정의형·열거형을 활용해 메모리 모델, API 계약, 도메인 제약과 타입 검증 전략을 설계하는 방법
2024-04-29
DCC-GARCH와 Realized GARCH로 변동성과 상관 리스크 다루기
DCC-GARCH와 Realized GARCH의 구조, 데이터 요건, 진단 방법을 바탕으로 변동성·상관 리스크 측정에 적용하는 방법을 정리한다.
2024-04-29
Deap과 Binomial Heap: 양단 조회와 힙 병합의 설계 차이
Deap과 Binomial Heap의 구조, 시간 복잡도, meld 특성을 비교해 양단 조회와 병합 중심 우선순위 큐의 선택 기준을 정리한다.
2024-04-29
의사결정을 움직이는 보고서와 KPI 설계
데이터 기반 인사이트, 스토리텔링, KPI 정의를 연결해 재현 가능하고 실행력 있는 보고서 운영 체계를 설계하는 방법
2024-04-29
불확실한 선택을 설계하는 결정 이론과 베이즈 의사결정
효용 함수, 의사결정나무, 베이즈 의사결정과 정보 가치를 활용해 불확실한 운영 선택을 설계하는 방법을 정리한다.
2024-04-29
VAE와 그래프 신경망으로 설계하는 고급 이상 탐지
VAE 기반 이상 점수화와 그래프 이상 탐지의 모델 구조, 임계값 설정, 드리프트 관리와 운영 트레이드오프를 정리한다.
2024-04-29
DFS와 BFS 그래프 탐색 구현: 스택·큐와 경로 복원
DFS와 BFS의 탐색 방식, 인접 리스트 구현, 스택·큐 선택 기준과 비가중치 최단 경로 복원 방법을 정리한다.
2024-04-29
다익스트라 알고리즘으로 단일 시작점 최단 경로 계산하기
다익스트라 알고리즘의 거리 이완 방식, 음수 가중치 제약, 우선순위 큐 구현과 OSPF·경로 탐색 활용 방법을 정리한다.
2024-04-29
다익스트라 알고리즘으로 단일 출발점 최단경로 구하기
비음수 가중 그래프에서 다익스트라 알고리즘으로 최단거리와 경로를 계산하는 원리, 구현, 운영 시 유의사항을 정리한다.
2024-04-29
이산 확률 변수에서 PMF·기대값·분산을 계산하는 법
이산 확률 변수의 PMF 검증, 기대값과 분산 계산식, 표준 분포별 활용 방식과 운영상 주의점을 정리한다.
2024-04-29
분산 정렬과 병렬 그래프 처리, 확장성 설계의 병목과 선택
분산 정렬과 병렬 그래프 처리에서 파티셔닝, 셔플, 장애 복구, 확장성 병목을 설계하는 방법을 정리한다.
2024-04-29