AI 도구·에이전트
로컬 LLM, 코딩 에이전트, MCP, 모델 비교·선택 — 최대 군집이자 트래픽 성장 축
829 POSTS · 3 / 28
Gemini CLI 종료 이후 Antigravity CLI 이주와 벤더 락인
Gemini CLI 종료와 Antigravity CLI 전환에서 드러난 폐쇄형 바이너리, 무료 티어 축소, 벤더 락인 리스크와 CLI 이주 대응 방안을 정리한다.
2026-08-02
Antigravity CLI 전환: Gemini CLI 종료 이후의 Go 멀티에이전트 운영
Gemini CLI 종료 이후 Antigravity CLI의 Go 동시성 런타임, 플러그인 SDK, CI/CD 이전과 경쟁 도구 선택 기준을 정리한다.
2026-08-02
Gemini CLI에서 Antigravity 2.0으로 전환하는 아키텍처와 마이그레이션
Gemini CLI 종료 뒤 Go로 재작성된 Antigravity 2.0의 병렬 에이전트 구조, 플러그인 SDK, CI/CD 마이그레이션과 운영 기준을 다룬다.
2026-08-02
Antigravity 2.0의 Go 기반 멀티 에이전트 아키텍처
Go로 재작성된 Antigravity 2.0의 멀티 에이전트 병렬 실행, 플러그인 SDK, 백그라운드 작업과 Gemini CLI 마이그레이션을 실무 관점에서 정리한다.
2026-08-02
Apodex-1.0의 검증 중심 딥리서치 에이전트 아키텍처
Apodex-1.0이 오케스트레이터와 전문 서브에이전트, 증거 그래프로 딥리서치의 신뢰성과 감사 가능성을 확보한 방식을 분석한다.
2026-08-02
Apple Foundation Models와 Claude API로 설계하는 iOS·macOS 혼합 추론
Apple Foundation Models와 Claude API를 Swift에서 통합해 복잡도·개인정보·연결 상태·비용에 따라 추론 경로를 전환하는 설계를 다룬다.
2026-08-02
카페24 LLM 라우터의 멀티프로바이더 API 게이트웨이 설계
카페24 LLM 라우터의 모델 추상화, 동적 라우팅, 장애 폴백과 비용 통제 구조를 실무 관점에서 분석한다.
2026-08-02
중국 오픈웨이트 LLM 경쟁과 AI 플랫폼 선택 전략
DeepSeek, Qwen, GLM, ERNIE를 중심으로 중국 LLM의 비용·성능, 데이터 주권, 온프레미스 배포와 라우터 전략을 분석한다.
2026-08-02
업무 목적에 맞는 AI 이미지 생성 모델 선택법
GPT Image 2·FLUX.2·Midjourney의 아키텍처와 품질, 비용, 배포 방식을 비교해 실무에 맞는 이미지 생성 모델을 고른다.
2026-08-02
AI 이미지 생성 모델은 왜 용도별로 갈리는가
Nano Banana Pro, Seedream 4.5, FLUX.2의 설계 차이와 편집·텍스트·셀프 호스팅 기준을 비교하고 멀티모델 운영 전략을 설명한다.
2026-08-02
ChatGPT Work 기반 장시간 자율 에이전트 운영 아키텍처
ChatGPT Work와 Presence·Frontier를 중심으로 장시간 자율 에이전트의 계획·실행·검증 구조, 앱 연동, 권한과 감사 거버넌스를 정리한다.
2026-07-24
OpenRouter 호출량으로 본 중국 오픈웨이트 LLM과 멀티벤더 전략
OpenRouter 호출량을 바탕으로 중국 오픈웨이트 LLM의 비용 우위, 라우팅 구조, 데이터 주권과 멀티벤더 거버넌스 판단 기준을 정리한다.
2026-07-23
Cerebras Knowledge로 보는 PostgreSQL 기반 엔터프라이즈 RAG
pgvector, RRF, MCP를 결합한 Cerebras Knowledge의 엔터프라이즈 RAG 아키텍처와 하이브리드 검색 운영 방식을 정리한다.
2026-07-21
Anthropic의 Stainless 인수와 MCP SDK 자동 생성 전략
Anthropic의 Stainless 인수가 MCP SDK 자동 생성, Claude API 개발 경험, 개발자 플랫폼 전략에 미치는 영향을 분석한다.
2026-05-24
Antigravity 2.0과 WebMCP가 연결하는 에이전트 개발과 웹
Google Antigravity 2.0의 멀티에이전트 실행 구조와 WebMCP의 브라우저 도구 연결 방식, 보안 과제를 함께 분석한다.
2026-05-20
ChatGPT Images 2.0은 그림이 아니라 인포그래픽을 그린다: 추론 기반 이미지 생성의 구조
gpt-image-2의 자기회귀·확산 하이브리드 추론 루프, 다국어 텍스트 렌더링 파이프라인, 인포그래픽·슬라이드 자동 생성 아키텍처와 앱 시장 파급 효과를 분석한다.
2026-05-16
Anthropic이 자기 평가 도구 Petri를 남에게 넘긴 이유 — Petri 3.0과 Meridian Labs 이관
감사 모델과 평가 대상 모델을 분리한 Petri 3.0의 아키텍처, Dish의 eval-awareness 대응, Anthropic의 Meridian Labs 기증이 갖는 거버넌스 의미
2026-05-12
Book-to-SKILL: 기술서적을 Claude Code 스킬로 바꾸는 지식 구조화 파이프라인
PDF·EPUB 기술서적을 Claude Code 스킬 포맷으로 변환하는 오픈소스 Book-to-SKILL의 문서 파싱·트리거 설계·프로그레시브 디스클로저 구조와 Tool RAG 관점의 도메인 지식 통합 전략을 정리한다
2026-05-11
12일 만에 쏟아진 중국 오픈웨이트 코딩 모델 4종: GLM·MiniMax·Kimi·DeepSeek 비교
GLM-5.1·MiniMax M2.7·Kimi K2.6·DeepSeek V4의 MoE 아키텍처·SWE-bench 성능·추론 비용을 비교하고 vLLM·SGLang·TensorRT-LLM 자체 호스팅 전략과 벤치마크 오염 논란을 정리한다
2026-05-11
ChatGPT 워크스페이스 에이전트: Codex 위에 구축된 엔터프라이즈 자동화 플랫폼
OpenAI 워크스페이스 에이전트의 Codex 기반 아키텍처와 OAuth·SSO 인증, 장기 실행 오케스트레이션, 60개 이상 앱 커넥터 보안 설계와 요금 구조를 정리한다.
2026-05-03
AWS가 에이전트 스프롤에 내놓은 답: Bedrock AgentCore 레지스트리
AWS Bedrock AgentCore 에이전트 레지스트리의 인덱싱 구조와 MCP·A2A 통합, 멀티클라우드 지원, Microsoft·Google 대비 포지셔닝을 정리한다.
2026-04-19
Arcee Trinity: 30명 팀이 2,000만 달러로 만든 Apache 2.0 추론 모델
Arcee Trinity-Large-Thinking의 초희소 MoE 아키텍처와 SMEBU 라우팅 안정화, 에이전트 벤치마크 성능, Apache 2.0 라이선스 전략을 정리한다
2026-04-17
이미 맥에 들어있던 무료 AI를 터미널로 꺼내 쓰는 도구, apfel
apfel이 Apple의 FoundationModels 프레임워크를 래핑해 macOS 내장 AI를 CLI·HTTP 서버·채팅으로 활용하는 방식과 강점·한계를 정리한다.
2026-04-08
CatchMe는 벡터 검색을 버리고 활동 트리를 순회하는 쪽을 택했다
홍콩대학교 Data Intelligence Lab이 공개한 오픈소스 AI 메모리 시스템 CatchMe의 캡처·인덱스·검색 아키텍처와 벡터 검색을 쓰지 않는 설계 철학, 프라이버시 고려사항을 정리한다.
2026-04-03
Chops: Claude Code·Cursor·Codex AI 에이전트 스킬을 통합 관리하는 macOS 앱
macOS 앱 Chops가 Claude Code·Cursor·Codex 등 여러 AI 코딩 도구의 스킬 파일을 통합 관리하는 방식과 기능, 기술 스택, 유사 도구 비교를 정리한다.
2026-03-27
AutoResearchClaw: 논문 작성을 자동화한 멀티에이전트, 학계는 왜 갈렸나
학술 논문 작성을 자율 수행하는 멀티에이전트 AutoResearchClaw의 검색·분석·작성·검토 파이프라인, 기술 스택, 학계의 윤리 논쟁을 정리한다.
2026-03-24
BitNet: Microsoft의 1비트 LLM 추론 프레임워크, CPU에서 LLM을 돌리다
Microsoft BitNet의 1.58비트 네이티브 양자화 원리, BitNet b1.58-2B-4T 스펙, 실측 성능, 설치 방법과 기술적 한계를 정리한다.
2026-03-15
CanIRun.ai: 내 컴퓨터에서 AI 모델을 돌릴 수 있는지 확인하는 법
CanIRun.ai의 브라우저 기반 하드웨어 감지 원리, S~F 등급 체계, VRAM·양자화·MoE 개념과 유사 도구 비교, 활용법을 정리한다.
2026-03-15
ChatGPT가 8억 주간 사용자를 등에 업고 업무 허브로 확장하는 법
OpenAI의 Apps SDK·App Directory 아키텍처와 액션 실행형·컨텍스트 제공형 앱 구조, 엔터프라이즈 거버넌스, 파트너 성과를 정리한다
2026-03-15
AutoKernel, GPU 커널 최적화를 AI 에이전트에게 맡기면 생기는 일
RightNow AI가 공개한 AutoKernel의 Profile-Extract-Optimize-Verify 루프와 최적화 기법, Qwen 3.5 대상 12배 성능 향상 사례를 정리한다
2026-03-14