AI 도구·에이전트
로컬 LLM, 코딩 에이전트, MCP, 모델 비교·선택 — 최대 군집이자 트래픽 성장 축
898 POSTS · 27 / 30
OpenAI Operator와 Codex로 읽는 에이전틱 AI 전략
GPT-5.5와 Operator, Codex의 자동화 성능부터 엔터프라이즈 파트너십, 플러그인 생태계, API 가격까지 OpenAI의 에이전틱 AI 전략을 분석한다.
2026-08-02
OSWorld 2.0으로 장기 컴퓨터 사용 에이전트 평가하기
OSWorld 2.0의 크로스플랫폼 실행 환경, 장기 멀티앱 태스크, 자동 채점 체계를 바탕으로 컴퓨터 사용 에이전트의 업무 수행 능력을 평가하는 방법을 정리한다.
2026-08-02
OpenAI Presence로 보는 기업 에이전트 통제와 휴먼 핸드오프 설계
OpenAI Presence의 정책 엔진, 가드레일, 승인 작업, 휴먼 핸드오프 구조를 바탕으로 기업 에이전트 운영 통제를 정리한다.
2026-07-26
OpenRouter 실사용 데이터로 본 LLM 라우팅과 오픈웨이트 모델 선택
OpenRouter 토큰 소비 데이터를 바탕으로 오픈웨이트와 상용 LLM의 비용·성능, 폴백, 데이터 주권을 고려한 라우팅 전략을 정리한다.
2026-07-25
Codex Sites가 바꾸는 자연어 웹 앱 구축과 배포 흐름
OpenAI Codex Sites의 자연어 웹 앱 생성·배포 흐름과 D1·R2 스토리지, 멀티에이전트 및 직무 플러그인 확장 전략을 분석한다.
2026-06-10
에이전트의 도구 선택을 개선하는 MCP 설명 설계와 평가
MCP 도구 설명의 의도, 인자, 오류, 검색 키워드와 워크플로우 힌트를 설계하고 에이전트 선택 성능을 평가하는 방법을 다룬다.
2026-06-10
OpenHands 아키텍처 해부: SDK·CLI·GUI·클라우드를 하나로 묶은 오픈소스 코딩 에이전트
OpenHands의 네 가지 설계 원칙과 Tool Registry, 격리 수준 3단계, Claude Code·Codex CLI와의 아키텍처 차이를 정리한다.
2026-05-17
OpenAI Workspace Agents 아키텍트 가이드: 레지스트리·RBAC·멀티테넌트 격리로 조직에 배포하기
OpenAI Workspace Agents의 SaaS 연결 아키텍처, 에이전트 레지스트리 기반 3단계 RBAC, 멀티테넌트 격리, Custom GPT 대비 ROI 구조를 엔터프라이즈 아키텍트 관점에서 분석한다.
2026-05-16
Codex가 화면을 보기 시작했다: OpenAI의 멀티에이전트·Computer Use 업그레이드
OpenAI Codex에 추가된 병렬 멀티에이전트 워크플로우와 Computer Use 데스크톱 제어 아키텍처, Claude Code와의 경쟁 구도를 정리한다.
2026-05-02
Ouroboros: 스스로 비판하고 고치는 루프가 Claude Plan Mode를 이긴 자리
오픈소스 프로젝트 Ouroboros의 재귀적 자기개선 루프 아키텍처, Claude Plan Mode와의 설계 차이, 모델링·시뮬레이션 벤치마크에서의 성과를 정리한다.
2026-05-02
OpenChronicle: LLM 에이전트 메모리를 클라우드 없이 공유하는 로컬 퍼스트 아키텍처
오픈소스 메모리 계층 OpenChronicle의 SQLite FTS5+Markdown 기술 스택, macOS AX 트리 캡처, 멀티 에이전트 동시성·일관성 모델과 MCP 호환성을 정리한다.
2026-04-26
opencode CLI 실무 명령어 정리 — 세션·서버·MCP·플러그인
opencode CLI의 실행 모드, 세션 관리, 헤드리스 서버, MCP·ACP 연동, 운영 명령을 실전 예제로 정리한 레퍼런스
2026-04-26
opencode TUI에서 슬래시 커맨드와 키바인딩으로 빠르게 작업하기
opencode 터미널 UI의 입력 방식, 슬래시 커맨드, 리더 키, 커스텀 커맨드, tui.json 설정과 Vim 키바인딩을 정리한 가이드
2026-04-26
OpenHarness, Claude Code를 11,733줄로 다시 쓰다
홍콩대 Data Intelligence Lab이 만든 경량 AI 에이전트 프레임워크 OpenHarness의 설계 철학, Claude Code와의 비교, 서브시스템 구성과 퍼스널 에이전트 Ohmo를 정리한다.
2026-04-11
paper2code — 논문 URL 하나로 PyTorch 리포지토리를 뽑아내다
arXiv 논문을 PyTorch 구현 코드로 자동 변환하는 멀티에이전트 프레임워크 PaperCoder의 계획-분석-생성 파이프라인과 에이전트 역할 분담, 인간 평가·실행 가능성 벤치마크를 정리한다.
2026-04-11
OpenClaude: Claude Code UI로 200개 이상 모델을 쓰는 오픈소스 대안
소스맵 유출로 시작된 OpenClaude가 어떻게 Claude Code UI에 OpenAI 호환 API 심을 붙여 200개 이상 모델을 지원하게 됐는지, 구조와 대체재 비교, 법적 리스크를 분석한다.
2026-04-03
대화로 훈련하는 에이전트와 스스로 하네스를 짜는 에이전트
Gen-Verse의 비동기 강화학습 프레임워크 OpenClaw-RL과 구글 딥마인드의 코드 하네스 자동 합성 연구 AutoHarness를 비교 정리한다.
2026-03-27
OpenYak: 클라우드 없이 실행하는 데스크탑 AI 에이전트
완전히 로컬에서 실행되는 오픈소스 데스크탑 AI 에이전트 OpenYak의 오피스 자동화·데이터 분석 기능, 내장 도구, 모델 선택 옵션과 프라이버시 의미를 정리한다.
2026-03-25
오픈소스 AI 에이전트 프레임워크, GitHub 트렌딩이 보여주는 지형
LangGraph·CrewAI·AutoGen·OpenHands 등 GitHub 트렌딩 상위 AI 에이전트 프레임워크의 강점·약점과 상업화 경로, 신뢰성·보안·표준화 관련 미성숙 영역을 정리한다.
2026-03-24
OpenAI Codex — 자동완성을 넘어 프로젝트 전체를 추론하다
OpenAI의 Codex for Software Engineers 웨비나를 바탕으로 멀티파일 리팩토링·테스트 자동 생성·CI/CD 통합 기능과 API 활용법, 실제 도입 사례를 정리한다.
2026-03-19
Codex, Subagents 지원 시작: OpenAI Codex의 서브에이전트 지원 공식화
OpenAI Codex의 서브에이전트 지원 공식화가 가져온 오케스트레이터-서브에이전트 설계, Responses API 구현, 대규모 리팩터링 등 실제 활용 사례를 정리한다.
2026-03-17
OpenAI GPT-5.1 서비스 종료: GPT-5.3·5.4 마이그레이션 가이드
OpenAI가 발표한 GPT-5.1 서비스 종료 일정과 GPT-5.3·GPT-5.4의 차이, API 호환성 변경사항, 비용 영향과 개발자 마이그레이션 체크리스트를 정리한다.
2026-03-17
OpenDev: 순차 실행이 기본인 에이전트 프레임워크에 던지는 반론
DAG 기반 태스크 그래프로 AI 에이전트를 동시에 실행하는 오픈소스 프레임워크 OpenDev의 아키텍처와 LangChain·AutoGen·CrewAI 대비 위치를 정리한다.
2026-03-17
OpenAI 에이전트 구축 가이드: 언제, 어떻게 만들 것인가
OpenAI의 34페이지 실용 가이드가 제시하는 에이전트의 정의, 도입 판단 기준, 모델·툴·지침 설계, 오케스트레이션 패턴, 가드레일을 정리한다.
2026-03-15
OpenChrome: 실제 Chrome 브라우저를 그대로 쓰는 AI 에이전트용 MCP 서버
실제 Chrome 세션을 그대로 제어해 로그인 상태를 유지하고 봇 탐지를 피하는 오픈소스 MCP 서버 OpenChrome의 구조와 설치·활용법을 정리한다
2026-03-13
OpenChrome MCP로 Chrome 로그인 세션 유지하며 브라우저 조작하기
Claude Code에서 OpenChrome MCP로 Chrome 프로필 쿠키를 동기화해 로그인 상태를 유지한 채 웹 페이지를 조작하는 설정과 트러블슈팅
2026-03-13
OpenFang: Python 래퍼가 아니라 Rust로 처음부터 지은 에이전트 운영체제
RightNow-AI가 오픈소스로 공개한 OpenFang의 5개 크레이트 아키텍처, 7개 자율 Hand, 16개 보안 시스템, Rust 선택 이유와 활용 시나리오를 정리한다.
2026-03-13
Page-Agent: 스크립트 한 줄로 웹사이트를 AI 에이전트가 조작하게 만드는 법
알리바바가 공개한 인페이지 GUI 에이전트 Page-Agent의 DOM Dehydration 아키텍처와 Playwright·Browser-Use 대비 차별점을 정리한다.
2026-03-13
OpenAI o1, 답변 전에 생각하는 추론 모델은 어떻게 작동하나
OpenAI o1의 Chain-of-Thought 추론 메커니즘, 강화학습 훈련 방식, AIME·오류 감소 벤치마크, GPT-4o와의 차이, o1 시리즈 비교를 정리한다.
2026-02-10
OpenClaw, 로컬 AI 에이전트의 급성장과 스킬 마켓플레이스의 보안 리스크
GitHub 스타 157,000개 이상을 기록한 오픈소스 AI 에이전트 플랫폼 OpenClaw의 아키텍처, ClawHub 마켓플레이스, 악성 스킬 위협과 대응책을 정리한다.
2026-02-10