AI 도구·에이전트
로컬 LLM, 코딩 에이전트, MCP, 모델 비교·선택 — 최대 군집이자 트래픽 성장 축
862 POSTS · 15 / 29
Gemini 3.5 Flash와 3.1 Ultra의 에이전트 모델 라우팅 설계
Gemini 3.5 Flash와 3.1 Ultra의 속도·컨텍스트·멀티모달 차이와 Managed Agents API 기반 에이전트 라우팅을 분석한다.
2026-08-02
Gemini 3.5 Flash·Imagen 4와 SynthID 기반 멀티모달 이미지 스택
Gemini 3.5 Flash와 Imagen 4의 모델 티어, 비용 구조, SynthID 워터마크, 멀티모달 성능을 실무 도입 관점에서 정리한다.
2026-08-02
Gemini Spark 상시 동작 개인 AI 에이전트의 설계 구조
Gemini Spark의 상태 지속성, 이벤트 실행, 장기 메모리, 프라이버시 보호와 MCP 기반 홈 자동화 구조를 분석한다.
2026-08-02
Gemini Spark의 클라우드 자율 개인 AI 에이전트 아키텍처
Gemini Spark의 기기 독립 클라우드 런타임, 상시 실행 파이프라인, 승인 워크플로우와 데이터 거버넌스 설계를 다룬다.
2026-08-02
Gemini Spark macOS 백그라운드 에이전트 아키텍처와 거버넌스
Gemini Spark의 기기 독립 실행 구조와 로컬 권한 격리, SaaS 연동 방식, 개인 AI 에이전트 운영 거버넌스를 분석한다.
2026-08-02
국내 AI 검색에서 제미나이가 앞선 배경: 멀티모달과 배치 추론
국내 AI 검색에서 제미나이 만족도가 챗GPT를 앞선 배경을 멀티모달 임베딩, 배치 추론, 모델 라우팅과 거버넌스 관점에서 정리한다.
2026-07-25
Gemini Flash 티어링과 에이전트 워크로드 라우팅 설계
Gemini Flash 계열의 저지연·저비용 모델 티어링과 토큰 효율, 라우팅·폴백·비용 거버넌스 설계 방법을 정리한다.
2026-07-23
Gemini Spark와 Antigravity 상시 실행 에이전트의 권한 아키텍처
Gemini Spark가 Antigravity 하네스와 클라우드 VM, Workspace API, OAuth 권한 제어로 상시 실행되는 구조를 분석한다.
2026-06-10
Gemini Spark와 Antigravity로 설계한 상시 구동 개인 AI 에이전트
Gemini Spark의 장기 메모리, 이벤트 브릿지, VM 슬립-웨이크, OAuth 권한 통제를 중심으로 상시 구동 개인 AI 에이전트 구조를 분석한다.
2026-06-10
Gemma 4 12B, 인코더를 없앤 멀티모달 모델이 노트북에서 돌아가기까지
Google DeepMind의 Gemma 4 12B가 비전·오디오 인코더 없이 단일 트랜스포머로 멀티모달을 처리하는 구조와 16GB 노트북 구동 방법을 정리한다.
2026-06-10
Gemini Spark와 Omni로 설계하는 상시 실행 개인 AI 에이전트
Gemini Spark의 퍼시스턴트 세션과 Gemini Omni 세계 모델이 상시 추론, 장기 메모리, 선제적 행동을 구성하는 방식을 분석한다.
2026-05-24
Gemini Omni의 대화형 영상 편집과 네이티브 멀티모달 아키텍처
Gemini Omni가 텍스트·이미지·오디오·비디오를 공유 잠재 공간에서 처리하고 자연어로 영상을 편집하는 구조와 활용 방향을 분석한다.
2026-05-22
Gemini Spark의 상시 실행 개인 AI 에이전트 아키텍처
Google Cloud VM에서 지속 실행되는 Gemini Spark의 크로스앱 추론 구조와 자동화 방식, 권한 통제 및 보안 과제를 분석한다.
2026-05-22
Gemini Spark 상시 실행 에이전트의 크로스앱 추론 아키텍처
Gemini Spark가 클라우드 VM과 MCP 연결, 이벤트 트리거, 승인 게이트를 통해 잠금 상태에서도 크로스앱 작업을 수행하는 구조를 분석한다.
2026-05-21
GitHub Agent HQ에서 Claude와 Codex를 운영하는 멀티 에이전트 구조
GitHub Agent HQ의 Claude·Codex 통합, Agent Control Plane 거버넌스, Copilot 기반 멀티 에이전트 코드 생성 구조를 정리한다.
2026-05-21
Gemini Intelligence가 Android 화면을 이해하고 앱을 넘나드는 방식
Android용 Gemini Intelligence가 화면을 해석하고 앱 사이를 이동해 멀티스텝 태스크를 수행하는 구조와 프라이버시·확인 요청 설계를 Apple Intelligence와 비교해 분석한다.
2026-05-19
Gemini Spark의 상시 프로액티브 에이전트와 연결 앱 실행 구조
Gemini Spark가 이벤트 트리거와 연결 앱, 권한·실행 취소 체계를 바탕으로 상시 프로액티브 태스크를 처리하는 구조를 분석한다.
2026-05-19
GLM-5.1이 SWE-Bench Pro에서 프런티어 모델을 넘어선 방법 — 754B MoE와 202,752 토큰 컨텍스트
Z.ai GLM-5.1의 7,540억 파라미터 MoE 구조와 202,752 토큰 컨텍스트 윈도우가 SWE-Bench Pro에서 Claude Opus 4.6·GPT-5.4를 상회한 기술적 배경과 오픈소스 LLM의 상용 경쟁력 조건을 정리한다.
2026-05-05
Gemma 4가 20배 큰 모델을 이기는 법: 지식 증류와 Apache 2.0 라이선스 전략
Google Gemma 4 31B Dense가 지식 증류로 대형 모델을 능가한 원리, Apache 2.0 라이선스가 갖는 전략적 함의, Llama 4·Mistral과의 경쟁 구도, 엣지 배포 기술을 정리한다.
2026-04-24
VLA 엔드투엔드 vs Cascade: Gemini Robotics ER 1.6이 고른 로봇 제어 아키텍처
Gemini Robotics ER 1.6과 Boston Dynamics Spot 공동 데모를 바탕으로 엔드투엔드 VLA 설계 원칙, Cascade 파이프라인과의 비교, 로봇 제어용 LLM 통합 패턴을 정리한다.
2026-04-18
Gemma 4가 Apache 2.0으로 바뀌자 벌어진 일: 파생 모델 폭증과 로컬 Codex 워크플로우
Google이 Gemma 4를 Apache License 2.0으로 재라이선스하며 생긴 커뮤니티 파생 모델 생태계와 Codex CLI 로컬 통합, 개인용 LLM 워크플로우 설계를 정리한다.
2026-04-18
Gemini Robotics-ER 1.6: 계측기 판독 23%에서 93%로 끌어올린 체화 추론 모델
Google DeepMind가 공개한 Gemini Robotics-ER 1.6의 체화 추론 아키텍처와 계측기 판독 벤치마크, Boston Dynamics Spot 통합, 안전 거부 행동, 산업 활용 사례를 정리한다.
2026-04-17
Gemma 4가 Apache 2.0을 고른 이유 — 라이선스가 벤치마크만큼 중요한 순간
Gemma 4의 함수 호출 에이전틱 능력, Llama 4 대비 Apache 2.0 라이선스 비교, Google AI Studio부터 Ollama까지 배포 채널을 정리한다.
2026-04-17
Mac에서 Gemma 4를 직접 파인튜닝하기, gemma-tuner-multimodal 성능은 어느 정도일까
Apple Silicon MPS 백엔드로 Gemma 4·3n을 로컬 파인튜닝하는 gemma-tuner-multimodal의 메모리 관리 전략과 M3 Max 학습 벤치마크, 실전 활용 시나리오를 정리한다.
2026-04-17
gemma-tuner-multimodal — Apple Silicon만으로 Gemma 4를 파인튜닝하다
PyTorch MPS 백엔드로 Gemma 4·3n을 텍스트·이미지·오디오 세 모달리티에서 로컬 파인튜닝하는 gemma-tuner-multimodal의 부트스트랩 구조와 LoRA·QLoRA 전략, Apple Silicon 제약을 정리한다.
2026-04-11
Gemma 4 뜯어보기: MoE 라우팅부터 비전 인코더까지, 40장의 그림이 그려낸 구조
Maarten Grootendorst의 비주얼 가이드를 바탕으로 Gemma 4의 모델 패밀리, MoE 라우팅, 하이브리드 어텐션, Per-Layer Embeddings, 비전 인코더 구조를 정리한다.
2026-04-08
GitAgent: Git 리포지토리를 AI 에이전트로 만드는 프레임워크 무관 표준
LangChain·AutoGen·Claude Code 사이의 에이전트 파편화를 Git 네이티브 방식으로 해소하려는 오픈 표준 GitAgent의 구조와 활용법을 정리한다.
2026-03-27
Google Gemini Pro 2.5 벤치마크 신기록: 1M 토큰 컨텍스트가 만든 격차
Google Gemini Pro 2.5의 MMLU·HumanEval·MATH 벤치마크 신기록과 GPT-4o·Claude Opus 4.6 대비 성능, 멀티모달 능력, 기업 도입 시 고려사항을 정리한다
2026-03-19
Gemini Voyager: 여러 Gemini 모델을 한 곳에 모으는 브라우저 확장
Google AI Studio API 키로 동작하는 오픈소스 확장 Gemini Voyager의 기능·인증 구조·비용 관리 방식을 정리한다.
2026-03-19
Glean: LLM과 기업 시스템 사이를 잇는 엔터프라이즈 AI 추상화 레이어
Glean이 챗봇에서 벤더 중립적 엔터프라이즈 AI 추상화 레이어로 전략을 전환한 배경과 5계층 아키텍처, Copilot·Workspace AI 대비 포지셔닝을 정리한다
2026-02-21