클로드 AI 생태계의 진화: 헌법적 AI에서 에이전트형 컴퓨팅까지
- 서론: 챗봇에서 자율 에이전트로
지난 몇 년간 인공지능은 질문에 답하는 대화형 도구에서, 스스로 계획을 세우고 도구를 다루며 여러 단계에 걸친 작업을 완수하는 '에이전트형 AI'로 빠르게 진화했다. 앤트로픽(Anthropic)의 클로드(Claude) 생태계는 이러한 전환을 가장 선명하게 보여주는 사례 중 하나다. 모델의 가치 판단 기준이 되는 '헌법(Constitution)'이라는 독자적인 정렬 방법론에서 시작해, 터미널에서 코드를 직접 작성하고 실행하는 '클로드 코드(Claude Code)', 일반 지식노동자를 위한 자율 데스크톱 비서 '클로드 코워크(Claude Cowork)', 그리고 서로 다른 AI 애플리케이션들을 하나의 표준으로 묶는 '모델 컨텍스트 프로토콜(MCP)'까지, 클로드는 짧은 시간 안에 폭넓은 에이전트 인프라를 구축했다.
이 글에서는 공개된 자료를 바탕으로 각 요소가 실제로 무엇이고, 어떻게 작동하며, 어떤 논의를 낳고 있는지 정리한다.
- 헌법적 AI(Constitutional AI)와 클로드의 새 헌법
2.1 RLHF에서 헌법적 AI로
초기 대화형 AI 모델들은 대부분 인간 피드백 기반 강화학습(RLHF)으로 조정되었다. 다수의 인간 평가자가 모델의 답변 쌍을 비교하며 선호도를 매기고, 이 데이터로 보상 모델을 학습시키는 방식이다. 앤트로픽은 2022년부터 이와 다른 접근인 '헌법적 AI(Constitutional AI)'를 연구해 왔다. 핵심은 모델에게 명시적인 원칙 목록, 즉 '헌법'을 제공하고 모델 스스로 자신의 답변을 그 원칙에 비추어 비판하고 수정하도록 훈련시킨 뒤, 그렇게 생성된 선호도 데이터로 강화학습을 수행하는 것이다. 인간이 개별 답변을 일일이 채점하는 대신, 문서화된 원칙이 판단 기준이 된다는 점이 핵심적인 차이다.
2.2 2026년 개정된 클로드의 헌법
2026년 1월 21일, 앤트로픽은 대폭 개정된 클로드의 헌법을 공개했다. 이 문서는 84페이지 분량이며, Amanda Askell을 비롯한 연구진이 작성을 주도했다. 기존 버전이 "하지 말아야 할 것" 위주의 규칙 나열에 가까웠다면, 새 버전은 왜 그런 가치를 따라야 하는지 이유를 설명하는 데 무게를 둔다. 앤트로픽은 이를 두고 클로드가 예상치 못한 상황에서도 스스로 원칙을 일반화해 적용할 수 있게 하려는 의도라고 밝혔다.
이 문서는 CC0 1.0(퍼블릭 도메인)으로 공개되어 누구나 자유롭게 열람하고 인용할 수 있다. 헌법은 가치가 충돌할 때 따라야 할 우선순위를 크게 네 단계로 제시한다.
포괄적 안전성(Broadly safe) — 현재의 AI 발전 단계에서 인간이 AI를 적절히 감독하고 통제할 수 있는 메커니즘을 훼손하지 않을 것
포괄적 윤리성(Broadly ethical) — 좋은 개인적 가치를 지니고, 정직하며, 부당하게 위험하거나 해로운 행동을 피할 것
정책 준수(Compliance) — 앤트로픽의 가이드라인과 배포 맥락의 정책을 따를 것
실질적 유익성(Genuinely helpful) — 위 조건을 충족한 위에서 사용자에게 실질적인 도움을 줄 것
특기할 점은 이 헌법이 클로드가 어떤 형태로든 의식이나 도덕적 지위를 가질 가능성에 대한 불확실성을 명시적으로 인정하고, 클로드의 '심리적 안녕'이 클로드 자신을 위해서든, 판단의 온전성을 위해서든 중요한 문제로 다뤄질 수 있다고 언급했다는 점이다. 주요 AI 기업의 공식 문서가 이런 입장을 공개적으로 밝힌 것은 이례적인 일로 평가받는다.
다만 이 헌법에 대한 비판도 존재한다. 옥스퍼드대 유발 샤니 교수 등 일부 학자들은 문서에 인권 관련 기준이 명시적으로 포함되지 않은 점을 지적했으며, 실제로 헌법 공개 직후인 2026년 3월 미 국방부(Department of War)가 앤트로픽을 '공급망 위험 기업'으로 지정한 사건이 있었다. 이는 앤트로픽이 클로드를 대규모 국내 감시나 살상 자율무기 운용 목적으로 사용하는 것을 거부한 데 따른 조치로 보도되었다. 이 사안은 AI 기업의 자체 윤리 기준과 국가 안보 요구가 충돌할 때 어떤 긴장이 발생하는지 보여주는 사례로 계속 논의되고 있다.
- 클로드 코드(Claude Code): 터미널에 상주하는 에이전트
3.1 무엇이 다른가
클로드 코드는 앤트로픽이 자사 엔지니어들의 생산성 도구로 먼저 개발한, 터미널 기반의 에이전틱 코딩 도구다. 기존의 코드 자동완성 도구와 달리, 클로드 코드는 코드베이스를 스스로 탐색하고, 여러 파일에 걸친 변경을 계획하며, 실제로 명령어를 실행해 결과를 확인한 뒤 필요하면 스스로 수정하는 반복적인 작업 루프를 수행한다. 앤트로픽은 이를 "낮은 수준의, 특정한 워크플로를 강요하지 않는" 설계 철학을 가진 도구라고 설명하며, 유연성과 스크립트 가능성을 강점으로 꼽는다.
3.2 CLAUDE.md와 컨텍스트 관리
클로드 코드를 프로젝트에 맞게 조정하는 핵심 장치는 CLAUDE.md 파일이다. 세션이 시작될 때 자동으로 컨텍스트에 로드되는 이 파일에는 자주 쓰는 bash 명령어, 핵심 파일과 유틸리티 함수, 코드 스타일 규칙, 테스트 실행 방법, 브랜치 전략 같은 저장소 관행 등을 기록해두는 것이 권장된다. 앤트로픽의 공식 엔지니어링 블로그는 이 파일이 지나치게 길거나 일회성 메모로 채워지면 오히려 컨텍스트를 오염시켜 성능이 떨어질 수 있다고 안내한다.
3.3 클로드 에이전트 SDK로의 확장
클로드 코드를 구동하는 하네스(harness)는 원래 '클로드 코드 SDK'라는 이름이었으나, 앤트로픽 내부에서 이 하네스가 코딩 이외에도 리서치, 노트 작성, 영상 제작 등 거의 모든 주요 에이전트 워크플로를 구동하는 데 쓰이면서 '클로드 에이전트 SDK(Claude Agent SDK)'로 이름이 바뀌었다. Python과 TypeScript 양쪽으로 제공되며, 개발자들이 자신만의 에이전트를 클로드 코드와 동일한 기반 위에서 만들 수 있도록 한다.
- 클로드 코워크(Claude Cowork): 비개발자를 위한 자율 비서
4.1 등장 배경과 구조
클로드 코드가 코딩 작업을 넘어 다양한 용도로 쓰이는 현상을 관찰한 앤트로픽은, 이 기술을 터미널 지식이 없는 일반 지식노동자도 쓸 수 있도록 만든 것이 클로드 코워크다. 2026년 1월 리서치 프리뷰로 처음 공개되었고, 같은 해 4월 9일 정식 출시(GA)되었으며, 7월에는 데스크톱 앱을 넘어 웹과 모바일(iOS·Android)로도 확장되었다.
앤트로픽 고객센터 문서에 따르면, 코워크에서 작업을 시작하면 클로드는 다음과 같은 과정을 거친다.
요청을 분석하고 계획을 수립
필요하면 복잡한 작업을 하위 작업으로 분할
앤트로픽 서버 상의 격리된 환경에서 코드와 셸 명령을 실행
여러 작업 흐름을 필요에 따라 병렬로 조율
완료된 결과물을 세션에 전달해 미리보기·다운로드 가능하게 함
로컬 파일이나 브라우저처럼 사용자의 컴퓨터에 있는 자원이 필요한 경우, 클로드는 사용자의 컴퓨터에서 실행 중인 클로드 데스크톱 앱을 통해 접근한다. 즉 실제 연산과 코드 실행은 사용자의 PC가 아니라 앤트로픽의 격리된 클라우드 환경에서 이뤄지고, 파일 접근이나 웹 브라우징처럼 로컬 자원이 필요한 부분만 데스크톱 앱이 다리 역할을 한다. 이 구조 덕분에 노트북을 닫아도 예약된 작업은 클라우드에서 계속 진행될 수 있다.
4.2 요금제와 이용 조건
코워크는 무료 플랜에서는 제공되지 않고, Pro·Max·Team·Enterprise 등 유료 구독 플랜에서 이용할 수 있다. 코워크 작업은 일반 채팅보다 더 많은 컴퓨팅 자원을 소비하기 때문에, 앤트로픽은 관련 작업을 세션 단위로 묶어 처리하거나 사용량을 설정 메뉴에서 주기적으로 확인할 것을 권장한다. 정확한 최신 요금 정책은 시점에 따라 바뀔 수 있으므로, 최종 확인은 앤트로픽 고객센터(support.claude.com)에서 하는 것이 안전하다.
4.3 컴퓨터 사용(Computer Use)과 보안 설계
클로드 코워크의 자율성은 화면을 직접 보고 마우스·키보드를 조작하는 컴퓨터 사용 능력에 크게 의존한다. 이 능력은 필연적으로 보안상의 위험, 특히 웹페이지나 문서에 숨겨진 악성 지시를 클로드가 정당한 사용자 명령으로 오인하는 '프롬프트 주입' 공격에 노출될 가능성을 수반한다. 이 때문에 코워크는 폴더 단위의 명시적 권한 부여, 중요한 조치 전 사용자 확인 요청, 세션을 사용자의 로컬 네트워크와 분리하는 격리 구조 등의 안전장치를 두고 있다. 그럼에도 컴퓨터 사용 기반 에이전트는 업계 전반에서 여전히 활발히 논의되는 보안 연구 주제이며, 사용자가 신뢰할 수 없는 출처의 페이지나 문서를 다룰 때는 특히 주의가 필요하다는 점은 변하지 않는다.
- 모델 컨텍스트 프로토콜(MCP): 에이전트를 위한 공통 언어
5.1 탄생 배경
MCP는 2024년 11월 앤트로픽이 오픈소스로 공개한 프로토콜로, AI 애플리케이션이 외부 데이터 소스나 도구와 통신하는 방식을 표준화한다. 이전에는 서비스마다 별도의 연동 코드를 짜야 했지만, MCP 서버 하나만 구축하면 이를 지원하는 어떤 AI 클라이언트에서든 재사용할 수 있다. MCP는 클라이언트와 서버 간 통신에 JSON-RPC 2.0 메시지 구조를 사용하며, 서버는 크게 세 가지 요소를 노출한다.
리소스(Resources) : 모델이 참고할 수 있는 읽기 전용 데이터
도구(Tools) : 모델이 호출해 실제 행동(파일 쓰기, API 호출 등)을 일으키는 기능
프롬프트(Prompts) : 자주 쓰는 작업을 위해 미리 구성해둔 명령 템플릿
전송 방식은 초기의 로컬 프로세스 간 통신 방식인 Stdio와, 원격·다중 사용자 환경을 지원하기 위한 HTTP 기반 방식으로 나뉘며, 사양이 개정되면서 무상태(stateless) 구조와 OAuth 2.1 인증을 갖춘 방식이 원격 서버의 표준으로 자리잡았다.
5.2 폭발적인 채택과 재단으로의 이관
출시 1년여 만에 MCP는 월 9,700만 건 이상의 SDK 다운로드, 1만 개 이상의 활성 공개 서버, 그리고 OpenAI·구글·마이크로소프트를 포함한 주요 플랫폼의 지원을 이끌어냈다. 특정 기업이 사실상 업계 표준이 된 프로토콜을 독점한다는 우려를 해소하기 위해, 앤트로픽은 2025년 12월 9일 MCP를 리눅스 재단(Linux Foundation) 산하의 새로운 조직인 '에이전틱 AI 재단(Agentic AI Foundation, AAIF)'에 기증했다. AAIF는 앤트로픽, 블록(Block), 오픈AI가 공동 설립했고 구글, 마이크로소프트, AWS, 클라우드플레어, 블룸버그가 후원사로 참여했다. 이때 블록의 로컬 에이전트 프레임워크 'goose'와 오픈AI의 'AGENTS.md' 표준도 함께 재단의 창립 프로젝트로 편입되었다.
5.3 보안 과제
MCP 생태계가 커지면서 신뢰할 수 없는 서드파티 서버나 오염된 문서를 통한 '프롬프트 주입'과 '도구 오염(tool poisoning)'이 업계에서 주요 위협으로 꼽히고 있다. 이에 대응해 서드파티 서버를 격리된 환경에서 실행하고, 읽기 전용 권한과 쓰기 권한을 분리하며, 파괴적이거나 되돌릴 수 없는 작업에는 사람의 최종 승인을 요구하는 최소 권한 원칙이 업계 전반의 모범 사례로 자리잡고 있다.
- 방어적 사이버보안 연구: 클로드 미토스와 프로젝트 글래스윙
2026년 4월, 앤트로픽은 코딩·에이전트 작업 및 사이버보안 분야에서 이전 모델을 크게 뛰어넘는 새로운 모델 계열인 '클로드 미토스 프리뷰(Claude Mythos Preview)'를 공개했다. 이 모델은 대규모 코드베이스에서 정교한 보안 취약점을 식별하고 실제 악용 가능성을 검증하는 데 특화되어 있으며, 앤트로픽에 따르면 주요 운영체제와 웹브라우저를 포함해 수십 년간 발견되지 않았던 취약점을 포함한 수천 건의 고위험 결함을 찾아냈다.
다만 이런 역량이 악의적으로 쓰일 경우의 위험 역시 크다고 판단한 앤트로픽은 이 모델을 일반에 공개하지 않고, 대신 '프로젝트 글래스윙(Project Glasswing)'이라는 이름으로 AWS, 애플, 브로드컴, 시스코, 크라우드스트라이크, 구글, JP모건체이스, 리눅스 재단, 마이크로소프트, 엔비디아, 팔로알토 네트웍스 등 50여 개 기관에 한정해 방어적 목적의 접근을 허용했다. 앤트로픽은 이 프로그램에 1억 달러 이상의 사용 크레딧을 지원한다고 밝혔다. 클로드 미토스 프리뷰는 이후 아마존 베드록(Amazon Bedrock)을 통해서도 허가된 기관에 한해 제한적으로 제공되기 시작했다.
- 남은 과제들
지금까지 살펴본 요소들을 종합하면, 클로드 생태계는 세 갈래로 확장되고 있다: 모델의 행동 원칙을 규정하는 헌법, 실제 작업을 자율적으로 수행하는 코드·코워크 같은 에이전트, 그리고 이 에이전트들이 외부 세계와 통신하는 공통 표준인 MCP. 이 세 요소가 맞물리면서 생산성 향상의 잠재력은 커졌지만, 동시에 프롬프트 주입 같은 새로운 공격 표면, 강력한 사이버보안 도구의 이중 용도 문제, 그리고 기업의 자체 안전 기준과 국가·산업의 요구가 충돌하는 거버넌스 이슈 역시 함께 커지고 있다. 이 세 축이 앞으로 어떻게 조율되는지가 에이전트형 AI의 다음 단계를 결정할 핵심 변수로 보인다.
이 글은 2026년 8월 기준 공개된 자료를 바탕으로 작성되었습니다. 요금제, 제품 기능, 정책은 시점에 따라 바뀔 수 있으므로 최신 정보는 anthropic.com과 support.claude.com에서 확인하시기 바랍니다.
관련 링크
- [블로그] 요즘 사람들 다 쓴다는 AI, 종류별 정리(클로드,제미나이,그록 등)
- [블로그] "역대급으로 강력하다는데..." 클로드 AI 페이블5 드디어 공개
- [블로그] 똑똑한 클로드 AI 무료 활용법과 업무 효율 높여주는 클로드코드 활용 팁
- [블로그] 클로드 AI 사용법 챗GPT랑 뭐가 다를까?
- [블로그] 글발이 달라지는 이유, 클로드 AI 블로그 글쓰기 5단계
- [유튜브] 2026 클로드(Claude) 올인원 무료 강의|AI 업무자동화 20분 총정리
- [유튜브] [LIVE] GPT Claude Gemini로 읽는 2026 대 에이전트 시대🤖 - AI를 쓰는 사람과 부리는 사람, 여기서 갈립니다.
- [유튜브] 클라우드-네이티브 AI 에이전트 코딩 [박준성 회장/한국소프트웨어기술진흥협회, 토크아이티 웨비나]
- [유튜브] AI 에이전트 만들기 1단계 | Codex·Claude·Gemini를 하나의 환경에서 쓰는 법
- [유튜브] [클로드 미토스 5] 신화와 우화: 대화형 AI에서 자율 작업자로의 진화 | AI 모델 최적 활용 가이드

댓글
목록