AI 도구·에이전트
로컬 LLM, 코딩 에이전트, MCP, 모델 비교·선택 — 최대 군집이자 트래픽 성장 축
862 POSTS · 19 / 29
GPT-5.6 컨텍스트 확장과 프론티어 LLM 운영의 변화
GPT-5.6의 컨텍스트 윈도우 확장, KV 캐시 최적화, 모델 자동 전환 정책이 엔터프라이즈 LLM 아키텍처에 미치는 영향을 다룬다.
2026-08-02
Grok 4.5의 에이전트 성능과 모델 선정 기준
Grok 4.5의 V9 MoE, 에이전틱 벤치마크, 토큰 효율과 멀티벤더 도입 시 검증해야 할 기준을 정리한다.
2026-08-02
Grok Build 도입 전 점검할 코딩 에이전트 아키텍처와 보안 리스크
Grok Build의 Plan Mode, 서브에이전트, MCP·ACP 연동 구조와 X 구독 종속성, 데이터 전송 보안 검수 항목을 정리한다.
2026-08-02
headroom 컨텍스트 압축으로 LLM 에이전트 비용 줄이기
headroom의 의미론적 컨텍스트 압축 구조와 에이전트 통합 방식, 품질·비용 조정 기준과 운영 시 검증 절차를 정리한다.
2026-08-02
Hugging Face 모델 100만 개 시대, 기업은 오픈소스 LLM을 어떻게 도입해야 하나
Hugging Face Hub가 모델 280만 개를 넘어선 지금, 기업이 vLLM·Ollama 자체 호스팅과 PEFT·LoRA 파인튜닝, 보안·라이선스 검증을 통해 오픈소스 LLM을 도입하는 전략을 정리한다.
2026-08-02
호스티드 코딩 에이전트의 실행 격리와 통제 설계
호스티드 코딩 에이전트의 원격 컨테이너 실행을 위한 토큰·시크릿·이그레스 통제와 자체 러너 선택 기준을 정리한다.
2026-07-27
태국 리전에 배치된 Huawei Cloud CodeArts Agent의 도입 검토
Huawei Cloud CodeArts Agent의 태국 리전 오픈 베타와 Agentic Infra 구조를 바탕으로 데이터 소재지, 개발 거버넌스, 벤더 종속 관리 항목을 정리한다.
2026-07-26
HubSpot Agent Hub로 설계하는 공유 컨텍스트 다중 에이전트 운영
HubSpot Agent Hub의 공유 고객 컨텍스트 기반 다중 에이전트 아키텍처와 권한, 감사, 개인정보 거버넌스 설계 방법
2026-07-26
Grok Build와 Grok 4.5: 터미널 코딩 에이전트의 구조와 운영 기준
Grok Build와 Grok 4.5의 터미널 에이전트 구조, Cursor 인터랙션 데이터, 승인 게이트와 기업 운영 거버넌스를 정리한다.
2026-07-21
GPT-5.5·Qwen 3.7 Max·SubQ로 읽는 LLM 경쟁 구도
GPT-5.5의 환각 제어, Qwen 3.7 Max의 장기 에이전트, SubQ의 12M 토큰 아키텍처를 성능·가격·검증 수준으로 비교한다.
2026-06-10
하네스 엔지니어링으로 설계하는 에이전트 오케스트레이션과 가드레일
에이전트 오케스트레이션, 가드레일, 인간 개입 게이트와 피드백 루프를 하네스 엔지니어링 관점에서 설계한다.
2026-06-10
AI 에이전트의 자율성과 통제를 설계하는 Harness Engineering
AI 에이전트의 자율성 수준과 승인 게이트, 정확도 검증, 폴백, 오류 복구를 함께 설계하는 Harness Engineering을 다룬다.
2026-05-24
HiDream-O1-Image 통합 VAE 구조와 로컬 배포 설계
HiDream-O1-Image의 통합 VAE·플로우 매칭 구조부터 LoRA 파인튜닝, 양자화, 로컬 배포 조건과 라이선스까지 분석한다.
2026-05-19
Hugging Face ML Intern이 바꾸는 AutoML 에이전트와 ML 파이프라인
Hugging Face ML Intern의 데이터 전처리, 모델 학습, 실험 추적, Hub 연동 구조를 기존 AutoML 및 MetaGPT ML Agent와 비교한다.
2026-05-19
Hermes Agent는 실패를 스칼라 점수가 아니라 문장으로 읽는다
NousResearch Hermes Agent의 자가 진화 루프, GEPA 유전자-파레토 프롬프트 진화 알고리즘, 인간 레이블 없는 자기 지도 학습과 OpenAI RL 접근법 비교
2026-05-17
HiDream-O1은 VAE를 없애고 8B로 56B FLUX.2를 이겼다
HiDream-O1-Image의 VAE·외부 텍스트 인코더 없는 Pixel-level Unified Transformer 아키텍처, FP8 양자화·증류 최적화, FLUX 1.1·SD 3.5 대비 벤치마크
2026-05-17
Hermes Agent의 자가 진화 엔진: GEPA 유전-파레토 프롬프트 진화와 안전성 설계
실행 트레이스를 반성해 스킬·프롬프트를 스스로 개선하는 Hermes Agent의 GEPA 알고리즘 구조와 인간 리뷰 게이트 기반 안전성 제약을 정리한다
2026-05-14
Harmonist — "완료했습니다"를 믿지 않는 186개 에이전트 오케스트레이션 프레임워크
훅 기반 게이트로 리뷰·메모리·공급망 무결성을 기계적으로 강제하는 Harmonist의 에이전트 레지스트리 설계와 엔터프라이즈 감사 추적 아키텍처
2026-05-12
하네스 엔지니어링 — 에이전트는 쉽다, 하네스가 어렵다
Martin Fowler의 Agent = Model + Harness 공식을 중심으로 태스크 스코핑·샌드박스 런타임·리뷰 게이트·체크포인트로 구성되는 하네스 설계 원칙을 정리한다.
2026-05-11
같은 모델인데 순위가 30등에서 5등으로 — Addy Osmani가 말하는 하네스 엔지니어링
Addy Osmani가 제시한 하네스 엔지니어링 개념을 중심으로 시스템 프롬프트·툴 스펙·메모리·평가 루프·HITL 다섯 레이어와 프로덕션 오류 처리·비용 관리·장기 실행 에이전트 설계 원칙을 정리한다.
2026-05-02
하네스 엔지니어링 — AI 에이전트 성과를 좌우하는 작업 환경 설계
시스템 프롬프트·툴 스펙·메모리·평가 루프·인간 개입 지점으로 구성되는 에이전트 하네스 설계와 컨텍스트 엔지니어링 실무 원칙
2026-05-01
Hermes Agent: 스스로 스킬을 쌓아가는 자율 에이전트의 폐쇄 학습 루프
Nous Research가 공개한 오픈소스 에이전트 Hermes Agent의 4모듈 아키텍처, 폐쇄 학습 루프, 영속 메모리, 멀티 플랫폼 게이트웨이와 v0.6.0 업데이트를 정리한다.
2026-04-08
Grok 4.20: Captain·Harper·Benjamin·Lucas가 내부 토론 끝에 답을 낸다
xAI Grok 4.20의 네이티브 멀티에이전트 병렬 아키텍처, Captain·Harper·Benjamin·Lucas 각 에이전트의 역할, 벤치마크 성능과 실무 적용 시 고려사항을 정리한다.
2026-04-03
Hermes Agent, 도구를 5회 넘게 부르면 그 경험을 스킬로 저장한다
Nous Research가 공개한 오픈소스 자율 AI 에이전트 Hermes Agent의 자기 학습 루프, 3계층 메모리 시스템, agentskills.io 스킬 표준과 경쟁 에이전트 비교를 정리한다.
2026-04-03
GPT-5.4·Gemini 3.1 Ultra·Grok 4.20이 한 달 만에 몰아쳤다
2026년 3월 잇따라 출시된 GPT-5.4·Gemini 3.1 Ultra·Grok 4.20의 벤치마크와 강점, 출시 주기 가속화의 구조적 원인을 정리한다
2026-03-29
Garry Tan이 공개한 Claude Code 워크플로우, 48시간 만에 스타 1만 개
YC CEO Garry Tan이 오픈소스로 공개한 gstack의 역할 기반 Claude Code 팀 구조와 생산성 수치, 엇갈린 커뮤니티 반응을 정리한다
2026-03-25
gstack, Claude Code 하나로 꾸리는 가상 엔지니어링 팀
PM·아키텍트·구현·리뷰어·테스터 역할을 나눠 맡는 Claude Code 기반 AI 에이전트들이 협업하는 오픈소스 프로젝트 gstack의 구조와 동작 방식, 현실적 제약을 정리한다
2026-03-23
GSD — AI 코딩 세션이 부패하기 전에 끊어내는 법
AI 코딩 세션의 응답 품질이 점진적으로 저하되는 Context Rot 현상의 원인과, 단일 책임 세션·체크포인트·빠른 리셋으로 대응하는 GSD 방법론, 도구별 적용 패턴을 정리한다.
2026-03-19
Steerling-8B: 모든 토큰의 출처를 훈련 데이터까지 역추적하는 해석 가능한 LLM
Guide Labs가 오픈소스로 공개한 Steerling-8B의 임베딩 분해 아키텍처, 개념 제어 기능, 기존 해석 가능성 방식과의 차이, 성능 트레이드오프를 정리한다.
2026-03-13
코드 한 줄 없이 100만 줄 — OpenAI 5개월 하네스 엔지니어링 실험
OpenAI 엔지니어 3명이 수동 코드 없이 5개월 만에 100만 줄 서비스를 출시한 실험의 규모와 방법론, AGENTS.md·기계적 불변성·옵저버빌리티·피드백 루프 요소를 정리한다.
2026-03-13