본문으로 건너뛰기

AI 코딩 에이전트 비교표

단순한 코드 자동완성(Copilot)을 넘어, 스스로 파일을 수정하고 명령어를 실행하며 프로젝트 전체를 설계·품질 검증까지 수행하는 대표적인 글로벌 AI 코딩 에이전트 11종의 핵심 기능과 로컬 LLM 지원 여부를 대조 분석했습니다.

최종 업데이트:

에이전트 (추천순) 유형 실행 환경 로컬 LLM 멀티 에이전트 주 인터페이스 비용 / 라이선스 핵심 강점 및 추천
by Google DeepMind
자율형 코딩 에이전트 격리된 보안 샌드박스 (안전한 자율 코드 실행) 제한적 (엔터프라이즈 맞춤 연동) 강력함 (서브 에이전트 병렬 협업 지원) 전용 작업 캔버스 및 웹 채팅 엔터프라이즈 / 베타 제공
Gemini 기반 계획·코드 실행·파일 관리·웹 탐색을 하나의 격리된 Linux 샌드박스에서 수행
🎯 대규모 아키텍처 재설계, 복잡한 기능 구현 및 자율 품질 검증
OpenAI Codex CLI Featured
by OpenAI
오픈소스 CLI 코딩 에이전트 로컬 터미널 / 샌드박스 (승인 모드 선택) 미지원 (OpenAI 모델 중심) 지원 (멀티 에이전트 CLI 버전에서 제공) 터미널 CLI 및 IDE 확장 오픈소스 CLI, 모델 사용량은 계정/API 정책에 따름
로컬 파일 읽기·수정·실행, 멀티모달 입력, Suggest/Auto Edit/Full Auto 승인 모드
🎯 터미널 중심 개발과 안전한 자동화된 코드 수정·검증
by Cline (Open Source)
IDE 확장 플러그인 로컬 터미널 / OS 환경 (안전모드 승인식) 지원 (Ollama/LM Studio 연동) 지원 (에이전트 팀 및 태스크 위임) VS Code, JetBrains, Cursor, Windsurf, Zed, Neovim 등 IDE 사이드바 패널, macOS/Linux CLI 프리뷰 및 데스크톱 앱 오픈소스 (개인 무료, API 비용 별도 - BYOK, 일반적인 월 $10~$80, Claude Sonnet 집중 사용 시 $150 이상), 팀 $20/월/사용자 (처음 10개 좌석 영구 무료), 엔터프라이즈 맞춤형 (온프레미스/에어갭 배포, SSO, SLA, 감사 로그, 전용 지원), Cline Provider (BYOK-optional, 종량제 추론)
오픈소스 (Apache 2.0), 다양한 IDE 및 CLI 지원 (Claude (Sonnet, Opus, Haiku), OpenAI (GPT-4o, o3), Google Gemini, DeepSeek, AWS Bedrock, Azure OpenAI, OpenRouter (100+ 모델), Ollama 로컬 모델 등 30+ LLM 공급자), Human-in-the-Loop 승인 시스템 (자동 승인 모드 포함), Plan/Act 모드 통한 안전한 실행, 터미널 실행 및 자동 디버깅, 브라우저 자동화 (승인식, Puppeteer 기반), MCP Marketplace 지원, 칸반을 통한 멀티 에이전트 오케스트레이션, 활발한 개발, `.clinerules` 파일 통한 에이전트 동작 제어, 실시간 Diff 미리보기, 향상된 컨텍스트 관리, 체크포인트 시스템 (섀도우 Git 저장소 기반 ‘두 단계 되돌리기’ 기능), 다중 탭 편집, 비용 투명성, Slack·Telegram·Discord 등 팀 커뮤니케이션 도구 통합, 이미지 입력 (UI 목업/스크린샷 기반 앱 변환 및 버그 수정), 향상된 모니터링 및 디버깅 (린터/컴파일러 오류 사전 수정, 로그 수집, 호출 체인 검사, 다중 파일 패치 제안), VS Code 마켓플레이스 5백만+ 설치 (가장 많이 설치된 AI 코딩 에이전트), 6.1만+ GitHub 스타, 클라이언트 측 아키텍처 (보안 및 개인 정보 보호 강화), ClinePass (오픈 웨이트 모델 연동, Cline Provider를 통한 종량제 추론), Cline SDK 도입 (모듈화된 아키텍처, 장기 실행 작업, 세션 이식성 지원)
🎯 다양한 IDE 환경에서의 프론트엔드 및 풀스택 개발, 안전한 AI 기반 빠른 기능 구현
by Anthropic
CLI 코딩 에이전트 로컬 터미널 / OS 환경 (승인식) 미지원 (Claude API 전용) 지원 (서브 에이전트 오케스트레이션) 터미널 커맨드 라인 (CLI) Claude Pro/Max 구독에 포함 (Pro $20/월, Max 5x $100/월, Max 20x $200/월) 또는 API 종량제 별도 결제
Anthropic 공식 CLI 에이전트. Claude 모델 기반 파일 분석·편집, 테스트·빌드 실행, 서브에이전트 오케스트레이션
🎯 터미널 환경에서 Anthropic 공식 도구 기반 빠른 로컬 코드 수정 및 검증을 원하는 개발자
by Anysphere
AI 특화 IDE / 에디터 로컬 터미널 / OS 환경 및 클라우드 샌드박스 제한적 (Ollama 등 우회 연동 가능) 지원 (병렬 에이전트 및 통합 작업 공간) 전용 에디터 내 Composer 패널 (Cmd+I), JetBrains 플러그인 (2026년 정식 출시), 에이전트 창, iOS/Android 앱 (iPhone/iPad 재설계된 레이아웃, PR 검토, 받은 편지함 기능 지원), CLI 상용 구독 (크레딧 기반, 모든 유료 플랜에 구독료와 동일한 크레딧 포함, 자동 모드 무제한, 연간 결제 시 20% 할인). Hobby 무료 / Pro $20/월 (연간 $16/월, $20 크레딧 포함) / Pro+ $60/월 (연간 $48/월, $70 크레딧 포함) / Ultra $200/월 (연간 $160/월, $400 크레딧 포함, 신기능 우선 액세스) / Teams $40/사용자/월 (연간 $32/사용자/월, 2026년 6월 업데이트로 사용 한도 증가 및 새로운 프리미엄 시트 티어 도입, 공유 채팅/명령/규칙/중앙 청구/사용량 분석 포함) / Teams Premium $120/사용자/월 (연간 $96/월, Teams Standard 사용량의 5배) / Enterprise 맞춤형. (인도 개발자용 Cursor Start 월 ₹649 별도)
에이전트 우선 워크플로우 (Composer를 넘어선 기본, 다중 파일 리팩토링 및 코드베이스 전체 채팅), 병렬 빌드 서브 에이전트, 클라우드 에이전트 (격리된 클라우드 VM에서 전체 터미널/브라우저/데스크톱에 완전히 접근하여 여러 리포지토리에서 병렬 작업 및 비동기 결과 보고), 백그라운드 에이전트, 에이전트 창 (로컬/워크트리/클라우드/원격 SSH 환경에서 병렬 에이전트 실행), Bugbot (PR 검토, 버그 발견 시 자체 클라우드 에이전트 실행 및 수정 테스트 후 PR 직접 제안), Composer 2.5 (파일 트리 규모 다중 파일 리팩토링), 고정 스킬 필 (자주 사용하는 스킬 컴포저 바에 직접 표시), 지속성 메모리, 다중 모델 지원 (OpenAI (GPT-4o, o1, o3), Anthropic (Claude Sonnet, Claude Opus), Google (Gemini 2.0), xAI (Grok), Cursor 독점 모델 (Tab) 등), 자체 호스팅 머신 지원, 명명된 다중 저장소 환경 지원, Google Workspace (Gmail, Google Drive, Calendar, Docs, Sheets) 플러그인 (2026년 8월 3일), MCP (200개 이상의 커뮤니티 서버 등록, GitHub, Linear, Sentry, Postgres, Notion, Stripe 등 엄선된 카탈로그에서 원클릭 설치 지원, 실제 시스템 접근), Jira 통합, .cursorrules, 탭 완성 (Supermaven 기반), 전체 코드베이스 컨텍스트 창, 향상된 AI 통합 (상황 이해, 정확도/속도 개선), 취약점 스캐너, 자동화 (`/automate` 스킬, GitHub/Slack 트리거, Slack에서 계획 공유/다중 리포지토리 작업/채널 및 스레드 간 작업 지원), 디버그 모드 (AI 기반 버그 찾기/수정), 통합 브라우저 (라이브 미리보기 및 시각적 디버깅), Side Chats 및 대화 검색, 디자인 모드 개선, 클라우드 환경 설정, 엔터프라이즈용 조직 관리, Varonis Atlas 통합, TypeScript SDK (프로그래밍 방식 에이전트 구축), Cursor Router (데스크톱/웹/iOS/CLI/SDK 지원, Teams 플랜 기본 활성화), iPad용 Cursor (2026년 7월 29일, 재설계된 레이아웃, 사이드바 채팅 고정, 분할 화면, PR 검토, 받은 편지함 기능 지원), Slack 연동 개선 (계획 공유, 다중 저장소 작업, 채널/스레드 지원), 계획 모드 (Shift+Tab으로 전환, 실행 전 명확한 질문 및 계획 수립), Cursor 사용자 지정 페이지 (플러그인/스킬/MCP/서브 에이전트/규칙/명령/훅 관리), 리포지토리 없이 시작, Cursor Harness 개선
🎯 에이전트 중심의 자율적인 소프트웨어 개발, 다중 파일 변경 및 PR 자동화
by Cognition Labs (구 Codeium)
AI 네이티브 IDE / 데스크톱 앱 로컬 IDE 환경 (VS Code 기반 포크) 및 OS 환경 지원 (오픈소스 모델 인덱싱 및 사용, Ollama 연동) 강력함 (Devin Local 에이전트, 다단계 코드 변경 계획) 전용 IDE UI (VS Code 기반), CLI, 웹 브라우저 크레딧 기반 (개인 무료 티어: 무제한 자동 완성 및 채팅, Devin Local 에이전트 작업 일 5회 제한, 모든 주요 모델 포함 / Pro $15/월 (무제한 Devin Local 에이전트, 모든 AI 모델 접근, 고급 컨텍스트 이해, 우선 지원, 월 500 크레딧) / Pro Plus $35/월 (플래그십 모델 우선 접근, 더 높은 사용 한도) / Teams $25/사용자/월 (관리자 대시보드/분석/RBAC/SSO/좌석 관리 포함) / Enterprise 맞춤형 (VPC 배포, 제로 데이터 보존, 전담 지원 포함). 크레딧은 일별/주별 갱신.
독립형 AI 네이티브 IDE (VS Code 기반 포크), Devin Local (구 Cascade 에이전트, 2026년 7월 1일 대체, 다단계 코드 변경 계획, 터미널 실행, 디버깅, 명령 실행, 린터 읽기, 전체 코드베이스 인식, 신뢰성/컨텍스트 보존/대규모 코드베이스 처리 능력 개선), Supercomplete (무제한 자동 완성 및 미리보기), Flows (컨텍스트 채팅), 심층 코드베이스 이해/인덱싱, 자체 SWE-1.5 모델, 코드 무결성 레이어 (취약점/규정 준수 스캔), Zero Data Retention 모드, 다중 모델 지원 (Claude, GPT-4, Gemini 등), 다중 파일 편집, 메모리 (세션 간 컨텍스트 정보 저장), 자연어 터미널, Command Mode (IDE 내 터미널 명령 실행), Notion·Jira/Linear 통합, Context API (IDP 도구 통합), 관리자 대시보드/분석/RBAC/우선 지원 (팀 플랜), 70개 이상의 프로그래밍 언어 지원
🎯 Devin Desktop 환경에서 코드베이스 전체를 이해하는 자율 에이전트 개발 및 빠른 기능 구현
by Paul Gauthier
CLI 코딩 어시스턴트 로컬 터미널 (Git 저장소 직접 연동) 지원 (Ollama/LM Studio/로컬 API) 미지원 (단일 대화 세션) 터미널 커맨드 라인 (CLI) 오픈소스 (로컬 무료, SaaS 개인 무료, Cloud Growth $500/월, API 비용 별도)
Git 커밋 로그 자동 생성, 초정밀 diff 매치 패치(최소 변경), 오버헤드 없는 가볍고 빠른 터미널 작동
🎯 터미널 선호형 개발자, 신속한 Git 점진적 버그 수정 및 리팩토링
by Cognition Labs
자율형 소프트웨어 엔지니어 클라우드 격리 샌드박스 (Full Linux/Windows VM) 및 Devin Outposts (사용자 자체 환경) 미지원 (클라우드 전용) 강력함 (병렬 세션, 관리형 팀 위임, 내부 계획 및 서브태스크 분할) 전용 클라우드 웹 워크스페이스 상용 서비스 (ACU 기반 사용량 청구, 1 ACU당 $2.25, 약 15분 활성 작업). Free: 제한된 할당량 (Ask Devin, DeepWiki, Devin Review 포함) / Pro $20/월 (일일/주간 할당량, 최대 10세션, 프론티어 모델 접근, 추가 사용량 종량제) / Max $200/월 (더 큰 주간 할당량, 일일 제한 없음, 최대 10세션) / Teams $80/월부터 (전체 좌석당 $40 추가, 공유 크레딧, 250 ACU 포함 시 월 $500) / Enterprise 맞춤형 (VPC 배포, SSO, 전담 계정 팀 포함). 모든 플랜 사용자 수 무제한.
Devin 3.0 (동적 재계획 강화), Devin 2.2 (컴퓨터 사용 통한 작업 테스트, 자체 검증 및 코드 자동 수정, 시작 속도 3배 향상, UI 개선, 새로운 API 통합, 고급 ML 도구, 파일 탭 ‘최신 버전 보기’, Ask Devin 보안 결과, Devin Review Autofix), Devin Fusion (메인 에이전트와 사이드킥 모델을 통한 비용 효율적인 고품질 코딩), 대화형 계획 (작업 성공률 83% 증가), 컴퓨터 사용을 통한 엔드투엔드 테스트 (데스크톱 앱 실행 및 화면 녹화), Devin 검토 자동 수정 (GitLab Merge Request 지원, Ask Devin 보안 컨텍스트 포함), 레거시 코드 마이그레이션 (COBOL, Fortran, Objective-C → Rust, Go, Python 등), 자체 복구 코드, 영구 메모리 및 자동 분류 (컨텍스트 유지 향상), 병렬 세션, 다중 모달 컨텍스트, Devin Security Swarm, Devin Search (인용된 답변), Devin Wiki (코드베이스 문서 자동 생성), 풀 리눅스 데스크톱 지원, ACU 효율성 83% 향상, Zapier/Make.com 통합, 1천만 토큰 컨텍스트 창 (전체 리포지토리), GitHub·GitLab·Jira·Slack 기본 통합, 기술 스택 불가지론, GPT-6 Astra, Fable 5.1, Gemini 3.7 Flash, GPT-5.6 통합 (성능 개선 및 토큰 소비 감소), SWE 1.7 모델, Devin v3 API (역할 기반 액세스 제어, 세션 속성 지정), Devin Review API (REST API를 통한 프로그래밍 방식 트리거), Mermaid 다이어그램 렌더링, Git 기반 청사진, Devin Desktop (@-멘션 알약, 재설계된 명령 팔레트, Windows 자동 업데이트 개선), Devin Cloud (긴 세션에서 더 빠른 렌더링/스크롤링/타이핑, 구성 가능한 네트워크 정책, 대규모 세션 로딩 속도 향상), Devin Local (Hooks 탭, 타임라인 내비게이터, Fast Context 지원), 협업 엔지니어링 플랫폼으로의 진화 (엔지니어의 실시간 관찰 및 개입 가능), 동적 라우팅 시스템 (적응형 모드), Lifeguard 버그에 ‘Repo Rule’ 배지 표시, 명령 팔레트 개선 (세션 보관/고정, 일회성 자동화 스케줄, Post-Build 섹션 등)
🎯 복잡한 레거시 코드 마이그레이션, 엔드투엔드 테스트 및 장시간 자율 에러 해결
by All Hands AI (Open Source)
자율형 에이전트 작업 공간 로컬 또는 클라우드 Docker/Kubernetes 컨테이너 지원 (Ollama/LiteLLM 연동) 지원 (이벤트 기반 마이크로 에이전트, 전문 에이전트에게 하위 작업 위임) 웹 브라우저 기반 UI, 터미널 UI, CLI 오픈소스 (무료, MIT 라이선스, API 비용 별도 (Claude 4.5 기준 작업당 약 $0.15~$0.60 추정)) / 클라우드 (개인용 SaaS 무료 티어 (app.all-hands.dev에서 호스팅, BYOK 또는 원가 모델 가격, GitHub/GitLab/Bitbucket/Jira/Slack/Linear 통합, 무제한 일일 대화 포함, 최첨단 에이전트 코딩 모델 원가 접근), 클라우드 성장 플랜 (호스팅된 팀 기능 월 $500), 엔터프라이즈 맞춤형 (Kubernetes 자체 호스팅 VPC, Agent Control Plane, Large Codebase SDK, SAML/SSO, 다중 사용자 RBAC, 예산 관리, 우선 지원 포함))
솔루션 계획, 코드 작성, 테스트 실행, 디버깅, 풀 리퀘스트 제출 등 전체 개발자 워크플로우를 엔드투엔드로 처리하는 자율 소프트웨어 엔지니어링 에이전트 (Devin의 오픈소스 대안), Planning Mode (실행 전 상세 계획 수립 및 승인, `PLAN.md` 생성, 모호한 프롬프트에 질문), 플래너 워크플로우 (계획 생성/검토 후 실행), Kubernetes 지원, Agent Canvas/SDK (AI 코딩 에이전트 자동화를 위한 자체 호스팅 가능한 작업 공간, Slack·GitHub·Linear 연동), 대화 중 LLM 모델 선택 및 프로필 관리 (클라우드/SaaS 에이전트 프로필 포함, Claude·GPT-4o·Gemini·OpenRouter·NVIDIA Nemotron 3.5 Lightning 등 다중 모델 지원), GitHub 통합 (이슈 읽기, 수정, PR 생성) 및 Bitbucket 통합, GUI 슬래시 메뉴 (사용자 지정 스킬 생성), 활동 로그 및 내보내기에서 실행별 LLM 비용 표시, 로컬 또는 클라우드 하위 대화를 시작하기 위한 유형화된 에이전트 작업 추가, OpenHands Index, KVM 하드웨어 가상화, Windows/PowerShell 터미널 지원, ACP (Agent Client Protocol) 지원, 검증 스택 (코드 품질 및 정확성 보장), 향상된 보안 및 편의성, Azure DevOps 및 Jira DC 통합, 에이전트 제어 플레인, 예산/사용량 대시보드, 저장소 메타데이터 전달, 대규모 코드베이스 SDK (대규모/복잡한 레거시 코드베이스 처리, 시스템 종속성 매핑, 병렬 에이전트 작업 조정), 평가 프레임워크 (15+ 벤치마크 포함), Open Secure AI Alliance 합류, 엔터프라이즈 기능 (예약/이벤트 트리거 자동화, 조직별 애드온 마켓플레이스, 역할 관리, API 키/비밀 저장소, 비용 가시성 대시보드)
🎯 도커/Kubernetes 기반 격리 환경에서 오픈소스 자율 에이전트 시스템을 커스텀하여 운영
by Amazon Web Services (AWS)
AI 특화 IDE (Spec-Driven) 로컬 IDE 환경 (VS Code 기반 포크) 미지원 (Claude API 기반) 지원 (AWS Transform 에이전트, Kiro Powers 통합) VS Code 기반 전용 IDE, CLI, 웹 브라우저 프리뷰 무료 (크레딧 기반), 정식 출시 시 상용 예정
Spec-Driven 개발 (요구사항→설계→코드 자동화), .spec 파일로 구조적 개발 유도, Quick Plan 경량 모드, Kiro Powers (Stripe·Figma·Datadog 통합), AWS Transform 에이전트 지원, AWS 생태계 네이티브 통합
🎯 AWS 생태계 기반 팀 개발, 요구사항-설계-코드 일관성이 필요한 프로덕션 프로젝트
by GitHub / Microsoft
AI 코딩 에이전트 (IDE/클라우드 통합) GitHub Actions (클라우드 샌드박스), GitHub Codespaces, 독립형 데스크톱 앱 미지원 (Copilot API 종속) 지원 (다중 에이전트 세션 오케스트레이션) GitHub 웹 UI, VS Code/JetBrains/Visual Studio/Eclipse/Xcode IDE, 독립형 Copilot 앱 (macOS, Windows, Linux 지원), CLI 상용 구독 (AI 크레딧 기반, 1 크레딧당 $0.01, 유료 플랜 코드 완성 및 다음 편집 제안 무료, 월별 할당 크레딧 소진 시 추가 사용량 청구). Free: 월 $0 (제한된 월별 사용량, 소량의 AI 크레딧 할당량, 코드 완성) / Pro $10/월 ($100/년, 무제한 코드 완성 및 월 $15 상당의 AI 크레딧 할당량) / Pro+ $39/월 (무제한 코드 완성, 월 $70 상당의 AI 크레딧 할당량, 프리미엄 모델 접근) / Max $100/월 (지속적인 에이전트 사용자, 월 $200 상당의 AI 크레딧 할당량). 팀/조직 플랜: Business $19/사용자/월 (월 $19 상당의 AI 크레딧 포함, 제어 및 IP 면책, 2026년 9월 1일부터 신규 가입 재활성화, 2026년 10월 1일부터 선불 청구) / Enterprise $39/사용자/월 (GitHub Enterprise Cloud 별도, 월 $39 상당의 AI 크레딧 포함, 사용자 지정 모델 및 심층 GitHub 통합, 2026년 9월 1일부터 신규 가입 재활성화, 2026년 10월 1일부터 선불 청구). AI 크레딧은 월별 갱신되며 이월되지 않음. 포함된 크레딧 소진 시 추가 사용량은 게시된 모델 요율에 따라 청구됨. (Copilot Chat, 에이전트 모드, CLI, 코드 검토 및 Copilot Apps는 AI 크레딧 소모, Copilot 코드 검토는 AI 크레딧 외에 GitHub Actions 시간도 소모)
이슈를 PR로 전환 (GitHub Actions 기반 비동기 에이전트), 에이전트 모드 (IDE 내 자율 다중 파일 편집, 터미널/테스트 실행, 자동 수정 루프), 에이전트 기반 코드 검토 (변경 사항 제안 전 전체 프로젝트 컨텍스트 수집, 수정 PR 자동 생성, 2026년 9월 28일부터 기본 노력 수준 'Lite'에서 'Balanced'로 변경), 다중 모델 지원 (GPT-4o, o1, o3-mini, Claude 3.5 Sonnet, Gemini 2.0 Flash, Gemini 3.8 Flash, Claude Opus 4, Claude Fable 5.1, GPT-5 Chat (Copilot Studio) 등, 단 2026년 7월 31일부로 Gemini 2.5 Pro·3 Flash 사용 중단, 2026년 9월 1일부로 Gemini 3.1 Pro·Claude Opus 4.5/4.6·Claude Sonnet 4.5/4.6 (연간 구독 개인 사용자 제외)·Raptor Mini 폐기 예정), GitHub Spark (Pro+ 및 Enterprise 전용, 자연어로 앱 설명 시 라이브 미리보기와 함께 코드 생성), Project Polaris (2026년 8월부터 기본 추론 엔진), 100만 토큰 컨텍스트 창, 구성 가능한 추론 수준, AI 기반 코드 커버리지 설정 (공개 미리 보기), Copilot Edits의 일반 공급, Project Padawan (독점 공개), JetBrains AI Assistant 통합 (채팅, 프로젝트 요약, README, 테스트 실행, 코드 커버리지 평가), 무제한 코드 완성 및 다음 편집 제안 (AI 크레딧 미소모, 다음 편집 위치 예측 및 제안), 독립형 Copilot 앱 (데스크톱 제어 센터, ‘My Work’ 대시보드, Canvases 기능), Copilot SDK, Copilot 확장 (타사 도구 연동), 사용자 지정 지침 (.copilot 파일 및 조직 수준), Copilot Spaces (세션 간 지속 컨텍스트를 위한 협업 컨테이너), @workspace 에이전트 (VS Code에서 전체 인덱싱 없이 코드베이스 질문), Visual Studio 에이전트 (SDK 기반, .NET 및 Azure 내장 기술), 선택한 코드 검토 (인라인 주석 및 제안), Copilot Canvases (시각화/필터링/점진적 편집), Copilot Vision (UI 목업 분석, 2026년 7월 8일 정식 출시), 에이전트 기반 브라우저 도구 (VS Code 내 웹 페이지 탐색, 콘텐츠 검사, 스크린샷 캡처, 웹 앱 검증, 2026년 6월/7월 정식 출시), Agents Window (다중 프로젝트 작업 관리, 중앙 집중식 대시보드 및 병렬 세션 지원), 병렬 에이전트 세션 및 다중 채팅 지원, Linear 클라우드 에이전트 통합 (GA), 비용 가시성 (`/cost` 명령 지원), 스마트한 Pull Request 생성, 복구 에이전트, Autopilot 개선, 플랜 에이전트 (코드 작성 전 구현 계획 수립 지원), 시맨틱 코드 검색, 엔터프라이즈 제어 기능 (세션 스트리밍, 크레딧 상한선, CLI `GITHUB_TOKEN` 지원, `gh copilot` 명령어를 통한 셸 스크립팅/Git 명령/IaC 설명 지원, 모델 정책 타겟팅), JetBrains IDE용 Codex 에이전트 공급자 (공개 미리보기), GitHub Mobile 업데이트 (세션 목록 필터링/정렬, 모바일 알림), 클라우드 에이전트 자동화 (이슈/PR 댓글 트리거), 클라우드 에이전트 추론 수준 사용자 지정, Copilot Studio의 GitHub Copilot 하네스 (Opus 5, GPT-5.6 Sol, Fable 5 등 고급 추론 모델 활용, 복잡한 비즈니스 프로세스 처리), 전역 자동 승인 (JetBrains), Repo Grokking, AI 기반 보안 및 자동 수정, 모델 컨텍스트 프로토콜 (MCP), 받아쓰기, 통합된 Copilot 경험 (2026년 9월 28일 이전 통합 예정, 채팅 데이터 계정 수명 동안 보존), 관리 기능 강화 (2026년 7월부터 Copilot Studio가 새로운 에이전트마다 Microsoft Entra Agent ID 자동 생성, 조직 수준 사용자 지정 에이전트 게시 가능), 모델 제어 및 노력 수준 (지원 모델에 대해 '낮음', '중간', '높음'의 사고 노력 수준 조정, 선호 모델 고정 또는 자주 사용하지 않는 모델 접기 가능).
🎯 GitHub 이슈/PR 중심의 자율 개발, IDE 통합 환경에서 코드 검토 및 수정
by Nous Research
자율형 에이전트 프레임워크 로컬 서버 / Docker 컨테이너 지원 (Ollama/로컬 LLM 최적화) 지원 (병렬 분산 작업 지원) 웹 UI, CLI, API 호출 오픈소스 (무료)
세션을 넘아서는 지속성 메모리(Persistent Memory), 자동 스킬 학습 및 저장 시스템, 로컬 LLM을 포함한 폭넓은 백엔드 연동
🎯 학습형 비서 및 맞춤형 자동화 워크플로우 솔루션을 자체 호스팅하려는 개발자

상황별 에이전트 추천 시나리오

  • VS Code 통합 개발 최우선: Cline 혹은 Cursor (Composer)를 권장합니다. 에디터나 전용 IDE 내에서 실시간 파일 연동과 편집 성능이 압도적으로 직관적입니다.
  • 안전한 샌드박스 기반 대형 아키텍처 리팩토링: Codex Antigravity가 유리합니다. 악성 코드 실행 위험이 없는 보안 샌드박스 환경을 제공하고, 여러 하위 에이전트들을 생성하여 대규모 엔지니어링 작업을 자율 분담 처리합니다.
  • 터미널 CLI 기반 초정밀 파일 수정: Claude Code 혹은 Aider가 최상의 선택입니다. Git 히스토리를 분석하여 정확히 필요한 라인만 Patch하고 수정을 마친 후 커밋 메시지까지 자율 작성하여 워크플로우 속도가 매우 빠릅니다.
  • 완전 자율형 엔지니어 및 독립 과제 해결: Devin 또는 오픈소스 대안인 OpenHands가 최적입니다. 격리된 샌드박스 전체(VM/Docker)를 조작하여 복잡한 로컬 실행, 빌드 테스트 및 디버깅을 자율 완료합니다.

에이전트 도입 시 핵심 체크리스트

  • 실행 경로 승인 및 보안: 터미널 명령어를 직접 수행하는 에이전트의 경우, 중요 로컬 파일을 훼손하거나 악성 스크립트를 실행하지 않도록 반드시 보안 격리(Sandbox) 상태이거나 사용자가 실행 여부를 검토 승인하는 환경이어야 합니다.
  • API 비용 관리: 루프가 길어질수록 컨텍스트 창이 비대해지고 수십 번의 API 호출이 발생해 비용이 과도하게 청구될 수 있습니다. 최대 이터레이션(Loop Limit) 설정이 필수적입니다.
  • 컨텍스트 창 크기: 대규모 프로젝트일수록 코드베이스 전체를 에이전트에 주입하는 기술(RAG 또는 AST 분석)이 필수적입니다. 프로젝트 분석 방식(예: Aider의 map-repository, Antigravity의 multi-agent)이 적합한지 확인하세요.

자주 묻는 질문

Q. 코파일럿(GitHub Copilot)과 에이전트(Agent)의 차이는 무엇인가요?

기존 코파일럿은 주로 개발자의 키보드 입력을 이어받아 해당 라인의 코드를 제안하는 자동완성 도구였으나, 최근 GitHub Copilot Workspace는 자율형 에이전트 기능을 통합하여 목표 달성을 위한 의사 결정 및 실행 능력을 갖추게 되었습니다. 반면, 에이전트는 기획 단계부터 파일 생성, 수정, 터미널 컴파일 테스트, 에러 수정, 빌드 완료에 이르기까지 **목표(Goal)를 향해 스스로 의사 결정을 내리고 실행하는 자율성**을 갖추고 있습니다.

Q. 에이전트 실행 시 컴퓨터에 영향이 없나요? 보안 위험은?

로컬 터미널 권한을 가진 에이전트는 시스템 파일 삭제나 의도치 않은 서비스 기동 등을 수행할 수 있어 주의해야 합니다. Cline 및 Claude Code 등은 명령어 실행 전 항상 사용자의 명시적 승인을 요청하며, **Codex Antigravity** 및 **Devin**과 같은 보안 최적화 에이전트는 **격리된 샌드박스 가상환경(Docker 또는 VM)**에서 실시간 코드 실행 및 빌드를 수행하여 시스템의 안전을 완벽히 보장합니다.

Q. 어떤 LLM을 사용하는 것이 좋은가요?

대부분의 에이전트는 코딩 지시 이행 능력과 도구 사용(Tool Calling) 성능이 가장 탁월한 **Claude Sonnet 5** 또는 **GPT-5.6 Sol**에 최적화되어 있습니다. Cline, Cursor, Copilot Workspace 등 많은 에이전트가 이제 다중 모델을 지원하여 사용자가 작업에 따라 Claude, GPT, Gemini, DeepSeek 등 다양한 모델을 선택할 수 있습니다. Claude Code는 Anthropic의 공식 도구이므로 전적으로 Claude 모델 군에 특화되어 최적의 성능을 냅니다. Aider나 Nous Hermes, OpenHands 등은 오픈소스를 지향하므로 Llama 4 Maverick이나 Gemma 시리즈 같은 고성능 오픈가중치 로컬 모델과도 연계가 활발합니다.

다른 비교 도구도 확인해보세요