AI 도구·에이전트
로컬 LLM, 코딩 에이전트, MCP, 모델 비교·선택 — 최대 군집이자 트래픽 성장 축
898 POSTS · 28 / 30
세션 상태를 남겨 장기 에이전트 작업을 재개하는 설계
컨텍스트 압축과 세션 중단 뒤에도 작업을 이어가기 위한 상태 외부화, 체크포인트, 잠금, 전제 재검증 설계 원칙을 다룬다.
2026-08-31
장기 실행 코딩 에이전트의 작업 위임과 통제 설계
장기 실행 코딩 에이전트의 작업 위임 구조를 이벤트 로그, 권한 제한, 검토 게이트, 자원 상한과 함께 설계하는 방법
2026-08-06
자기개선 AI 하네스의 성능 귀속 분석 설계
자기개선 AI 하네스에서 모델과 스캐폴딩의 성능 기여를 분리하고, 토큰 효율과 회귀를 함께 측정하는 방법
2026-08-06
Project Mariner와 관리형 MCP로 보는 엔터프라이즈 웹 에이전트 아키텍처
Project Mariner의 웹 브라우징 구조와 관리형 MCP, Apigee 인가 게이트웨이를 중심으로 엔터프라이즈 에이전트 통제 체계를 정리한다.
2026-08-02
로봇 추론과 제어를 분리하는 응답 주기 설계
Gemini Robotics ER 2와 VLA 제어를 분리해 응답 주기, 인계 스키마, 지연 버퍼, 계획 무효화를 설계하는 방법
2026-08-02
Runway Gen-4.5와 Kling 3.0, 제어 정밀도와 생성 비용 비교
Runway Gen-4.5와 Kling 3.0의 아키텍처, 장면 일관성, 모션 제어, 오디오, 해상도와 비용 구조를 비교한다.
2026-08-02
Runway의 멀티모델 영상 플랫폼 전략과 통합 아키텍처
Runway가 Gen-4.5와 경쟁사 모델을 통합한 영상 생성 플랫폼의 아키텍처, 수익 구조, 엔터프라이즈 도입 기준을 분석한다.
2026-08-02
재후학습 모델 성능 개선과 조용한 업그레이드 대응
재후학습으로 성능이 달라지는 모델의 데이터 품질 관리, 재현성 확보, 빌드 식별과 동작 편차 감지 운영 전략을 정리한다.
2026-08-01
프롬프트·컨텍스트·하네스 엔지니어링을 분리해 AI 에이전트 역량 설계하기
프롬프트·컨텍스트·하네스 엔지니어링의 중첩 구조를 바탕으로 AI 에이전트의 권한, 메모리, 검증과 관측 체계를 설계하는 방법
2026-07-28
실시간 음성 에이전트의 턴테이킹과 스트리밍 지연 설계
GPT-Live 기반 실시간 음성 에이전트에서 턴테이킹, 바지인, 지연 예산, 개인정보 통제를 설계하는 방법을 정리한다.
2026-07-28
Qwen3.8 Max 프리뷰의 오픈웨이트 도입 판단
Qwen3.8-Max-Preview의 멀티모달 MoE 구조, 온프레미스 TCO, 데이터 주권과 벤더 종속 리스크를 검토한다.
2026-07-21
Paseo: Claude Code·Codex를 내 서버에서 돌리는 오픈소스 오케스트레이션 레이어
로컬 데몬 하나로 30개 이상의 AI 코딩 에이전트를 관리하는 Paseo의 아키텍처, 워크트리 격리, 원격 접근 방식, 클라우드 대비 트레이드오프를 정리한다.
2026-06-10
프로덕션 LLM 에이전트의 신뢰성을 설계하는 12-Factor Agents
12-Factor Agents를 바탕으로 LLM 에이전트의 상태 관리, 멱등성, 제어 흐름, 관찰가능성을 설계하는 방법을 정리한다.
2026-06-10
Qwen 3.7 Max와 에이전트 LLM 경쟁 구도
Qwen 3.7 Max의 장문 추론, 에이전트 실행, API 호환성, 멀티모달 전략과 2026년 LLM 시장의 다극화 구도를 분석한다.
2026-06-10
Seedance 2.0과 Runway Gen-4.5의 내러티브·제어 설계
Seedance 2.0의 다중 샷 내러티브와 Runway Gen-4.5의 카메라·모션 제어 구조를 제작 워크플로우 관점에서 비교한다.
2026-05-22
Scion: Git worktree·컨테이너·크레덴셜을 겹으로 격리해 AI 에이전트를 병렬로 돌리다
Google Cloud Platform이 오픈소스로 공개한 Scion의 3중 격리 아키텍처(Git worktree·컨테이너·크레덴셜)와 태스크 분해 원칙, 단일 에이전트 순차 실행 대비 속도·충돌 분석을 정리한다.
2026-05-18
Seedance 2.0 물리 기반 모션과 멀티모달 영상 생성 아키텍처
Seedance 2.0의 물리 기반 모션 동역학, 시간적 일관성, 멀티모달 생성 파이프라인과 SeedVideoAI의 경쟁 구도를 분석한다.
2026-05-18
Salesforce Agentforce로 보는 엔터프라이즈 AI 거버넌스와 데이터 컨텍스트
Salesforce Agentforce의 확산 지표를 바탕으로 에이전트 권한, 데이터 컨텍스트, 감사 추적과 운영 비용 관리 과제를 짚는다.
2026-05-08
반도체 설계에 침투한 AI 에이전트: Siemens Fuse EDA가 택한 방식
Siemens Fuse EDA AI Agent의 도메인 스코프 에이전트 설계, Physical AI로서의 EDA, DRC 자동화와 기존 툴체인 오케스트레이션 통합 전략
2026-05-04
Runway Gen-4.5가 Elo 1위에 오른 이유: 물리 법칙을 내재화한 영상 생성
Runway Gen-4.5의 Artificial Analysis Elo 1위 벤치마크 방법론과 Physically-Informed Diffusion 아키텍처, 인간 동작·카메라 제어·이미지 컨디셔닝 기술을 정리한다.
2026-05-03
발소리가 걸음걸이와 어긋나지 않는 이유 — Seedance 2.0의 오디오-비주얼 공동 생성
ByteDance Seedance 2.0의 오디오-비주얼 단일 패스 공동 생성 아키텍처, 멀티모달 입력 시스템, Veo 3.1·Runway Gen-4.5와의 비교와 벤치마크 결과를 정리한다.
2026-05-02
27B가 397B를 이기고, 오픈소스가 처음으로 독점 모델 위에 섰다
Alibaba Qwen3.6-27B와 Z.ai GLM-5.1이 SWE-Bench에서 거둔 성과와 코딩 데이터 큐레이션 전략, 오픈소스·독점 모델 격차 소멸, 기업 AI 도입 전략 변화를 정리한다.
2026-04-24
인터넷 없이도 되는 멀티모달 대화, Parlor는 로컬에서 해낸다
Gemma 4 E2B와 Kokoro TTS로 완전한 온디바이스 실행을 구현한 오픈소스 멀티모달 대화 앱 Parlor의 아키텍처, 음성·비전 기능, 설치 방법을 정리한다.
2026-04-11
프롬프트에서 하네스로, AI 개발 패러다임이 옮겨간 길
Prompt Engineering에서 Context Engineering을 거쳐 Harness Engineering으로 이어진 AI 에이전틱 개발 패러다임의 전환 과정과 하네스의 핵심 구성 요소, 앞으로의 방향을 정리한다
2026-04-11
RTS 게임으로 LLM을 겨루게 했더니: 1대1 벤치마크가 드러낸 순위
microRTS 기반 1대1 LLM 벤치마크의 평가 설계와 2026년 3월 기준 ELO 순위, 모델별 강점, 흥미로운 발견을 조건 그대로 정리한다.
2026-03-24
Qwen 3.5 vs DeepSeek V4: 오픈소스 멀티모달 에이전트 실전 비교
알리바바 Qwen 3.5와 DeepSeek V4의 아키텍처·벤치마크·라이선스를 비교하고, 로컬 실행과 API 활용까지 실전 관점에서 정리한다.
2026-03-23
Qwen 3.5: 16일 만에 9개 모델을 낸 오픈소스 에이전틱 AI 롤아웃
알리바바가 16일 만에 9개 출시한 Qwen 3.5 오픈소스 에이전틱 AI 시리즈의 Qwen3-Next 하이브리드 아키텍처, 모델 라인업, 벤치마크, 오픈소스 전략을 정리한다.
2026-03-15
Scrapling MCP로 로그인 세션 유지하며 웹 스크래핑하기
Scrapling MCP의 4가지 방법(CDP 연결·real_chrome·쿠키 전달·additional_args)으로 로그인 세션을 유지하며 스크래핑하는 실무 비교 가이드
2026-03-13
Simon Willison의 에이전틱 엔지니어링 패턴: 전문 엔지니어가 코딩 에이전트를 다루는 법
Django 공동 창시자 Simon Willison이 2026년 공개한 에이전틱 엔지니어링 패턴 가이드의 챕터별 내용, 바이브 코딩과의 차이, 커뮤니티 논쟁을 정리한다.
2026-03-13
Perplexity Computer: 19개 AI 모델을 통합한 완전 자율 에이전트
Perplexity Computer의 19개 모델 오케스트레이션과 서브에이전트 자동 생성 구조, Computer Use·Operator 대비 포지셔닝과 아직 검증되지 않은 한계를 정리한다
2026-03-03