AI News

Anthropic은 대부분의 유료 고객이 Claude Code를 사용하는 방식을 바꾸고, 8월 14일부터 Pro, Max, Team 계정의 기본값을 Auto Mode로 설정한다. 이 설정은 코딩 에이전트가 모든 작업마다 승인을 요청하지 않고 계속 작업할 수 있게 해주며, 작업이 되돌릴 수 없거나 파괴적이거나 사용자의 환경 밖으로 보이는 경우에는 안전 분류기가 개입한다.

이 조치는 개발자가 보는 일상적인 권한 요청 수를 줄이고, Claude Code가 파일 편집, 명령 실행, 다단계 작업 진행을 더 자유롭게 하도록 한다. The Decoder에 따르면 엔터프라이즈 고객은 여전히 직접 활성화해야 한다. 엔지니어링 팀에게 이 변화는 새로운 코딩 기능이라기보다 책임이 어디에 있는가의 문제다. 개발자는 개별 작업을 승인하기보다 에이전트의 작업을 점점 더 감독하게 될 것이다.

Auto Mode가 Claude Code를 어떻게 바꾸는가

Anthropic은 3월에 Auto Mode를 시험 기능으로 처음 도입하며, 자율 실행과 수동 제어 사이의 절충안으로 제시했다. 이전의 승인 기반 워크플로에서는 Claude Code가 자주 멈춰 사용자에게 제안된 작업의 승인을 요청했다. 반면 Auto Mode는 시스템 분류기가 유의미한 위험을 식별하지 않는 한 기본적으로 작업을 허용한다.

Anthropic은 TechCrunch 보도에 따르면 보호되는 범주를 “되돌릴 수 없고, 파괴적이거나, 사용자의 환경 밖을 향한” 작업이라고 설명했다. 정확한 경계는 분류기의 판단과 프로젝트 구성에 따라 달라지므로, Auto Mode가 에이전트가 접근할 수 있는 대상을 이해할 필요를 없애는 것은 아니다.

Anthropic은 또한 프롬프트 인젝션 필터링과 사용자 지정 가능한 하드 디나이 규칙을 추가했다고 밝혔다. 이러한 제어는 코드, 문서 또는 기타 프로젝트 콘텐츠에 숨겨진 적대적 지시가 데이터 유출과 같은 행동으로 에이전트를 유도하는 것을 막기 위한 것이다.

회사 내 Claude Code 책임자인 Boris Cherny는 X에서 자신과 팀이 수개월 동안 Auto Mode만 사용해 왔고 권한 요청으로 돌아가고 싶지 않다고 말했다. 이는 경영진의 지지일 뿐, 이 설정이 모든 개발 환경에 적합하다는 독립적인 증거는 아니다.

Anthropic의 테스트가 보여주는 것

Anthropic은 Auto Mode가 1,053명의 유료 테스터를 대상으로 한 연구에서 수동 승인보다 더 나은 성과를 보였다고 말한다. 회사는 자동화 시스템이 유해한 작업의 89%를 식별한 반면, 인간 검토를 통해서는 13.6%만 포착됐다고 보고했다. Anthropic은 또한 사용자가 Claude Code 권한 요청의 97%를 승인했다고 밝혔는데, 이는 반복적인 승인이 신중한 평가보다 습관화될 수 있음을 시사한다.

이 수치들은 벤더가 보고한 결과다. 공개된 보도만으로는 전체 테스트 방법론, 유해한 작업의 정의, 혹은 이 연구가 실제 프로덕션 소프트웨어 팀을 얼마나 잘 반영하는지 판단할 만큼의 세부 정보가 제공되지 않는다. 따라서 이 결과는 기본값 변경을 주장하는 Anthropic의 논거를 뒷받침하지만, 모든 저장소나 배포 파이프라인에서 자동 승인이 더 안전하다는 일반적 증거는 아니다.

The Decoder는 또한 Auto Mode를 사용하는 팀이 약 25% 더 많은 pull request를 생성했다는 Anthropic의 주장도 보도했다. 이는 처리량 증가를 의미할 수 있지만, pull request 수가 유용하고 안전하며 유지보수 가능한 소프트웨어와 같은 뜻은 아니다. 더 자율적인 실행은 출력을 늘릴 수 있지만, 생성된 변경 사항을 이해하기 어려울 경우 검토 부담도 함께 늘릴 수 있다.

The Decoder는 별도로 Trajectory Labs의 72개 프롬프트 인젝션 시나리오에 대한 독립 감사도 인용했으며, 각 시나리오는 10회씩 테스트됐다. 보도에 따르면 Auto Mode에서 테스트된 Claude 모델에 대해서는 720번의 시도 중 단 한 번도 성공하지 못했으며, OpenAI의 Codex Auto-Review mode에서는 일부 시도가 성공했다. 다만 증거가 제공된 감사 보고서가 아니라 언론 보도를 통해 제시된 만큼, 독자들은 이를 확정적인 순위가 아닌 보고된 테스트 결과로 받아들여야 한다.

Anthropic은 Auto Mode가 Claude가 기밀 데이터를 공개 페이지에 업로드하는 것을 막았고, GPU 학습 작업에 방해가 될 수 있는 약 2,000개의 프로세스를 종료시킨 내부 사례를 설명했다. 이는 분류기의 가치를 보여주는 회사 사례이지, 독립적으로 검증된 신뢰성 측정치는 아니다.

기본값이 엔지니어링 팀에 중요한 이유

Pro, Max, Team 고객에게 즉각적인 영향은 행동의 변화다. 설정을 바꾸지 않는 개발자는 8월 14일 이후 더 자율적인 Claude Code 경험을 받게 된다. 팀은 새로운 기본값을 일상적인 생산성 향상으로 받아들이기 전에 에이전트가 어떤 저장소, 자격 증명, 셸 명령, 네트워크 경로를 사용할 수 있는지 결정해야 한다.

제품 팀과 스타트업에게 Auto Mode는 장시간 걸리는 작업의 위임을 더 쉽게 만들 수 있다. 에이전트는 사람이 각 저위험 단계를 승인할 때까지 기다리지 않고 수정과 테스트의 연속 과정을 진행할 수 있다. 이는 반복적인 리팩터링, 테스트 생성, 문서 수정 및 기타 범위가 정해진 작업에 도움이 될 수 있다.

그 대가는 실행 속도가 빨라지면 실패도 더 빠르게 확산될 수 있다는 점이다. Anthropic은 여전히 고위험 프로덕션 인프라에 대해서는 Claude의 작업을 검토할 것을 권장한다. 이 경고는 중요하다. 분류기는 명백히 파괴적인 행동은 막을 수 있지만, 유효한 명령의 비즈니스 영향, 미묘한 보안 회귀, 또는 기술적으로는 되돌릴 수 있지만 운영상 비용이 큰 변경은 이해하지 못할 수 있다.

엔터프라이즈와 비엔터프라이즈 계정의 구분도 중요하다. 기업 구매자는 종종 더 엄격한 제어, 감사 가능성, 신원 통합, 그리고 많은 저장소에 걸친 예측 가능한 정책을 필요로 한다. Auto Mode를 그런 고객에게 옵트인으로 유지한 것은 Anthropic이 자율 기본값이 규제되거나 프로덕션이 중요한 환경에서 더 높은 기준을 충족해야 함을 인식하고 있음을 시사한다.

이 변화는 또한 AI 코딩 도구 간 경쟁을 심화시킨다. Claude Code 사용자가 개별 명령을 승인하기보다 에이전트를 감독하는 데 익숙해지면, 경쟁 제품은 자동완성 품질보다 안전 분류기, 정책 제어, 추적 가능성, 그리고 실수에서 복구하는 능력으로 평가될 수 있다. 이는 시장을 핵심 제품 역량으로서의 에이전트 거버넌스 쪽으로 이동시킨다.

다음에 주목할 점

첫 번째 신호는 기본값 변경 후 얼마나 많은 고객이 Auto Mode를 계속 켜 두는가이다. Anthropic은 독립적인 채택 데이터를 제공하지 않았으므로, 향후 사용 수치는 회사가 보고한 생산성 주장과 분리해서 봐야 한다.

개발자들은 프롬프트 인젝션, 우발적 데이터 노출, 파괴적 명령, 프로덕션 인프라 변경과 관련된 사고 보고도 주시해야 한다. 실제 시험대는 분류기가 명백히 위험한 셸 작업뿐 아니라 미묘한 실패도 잡아낼 수 있는지 여부다.

그 밖의 중요한 신호에는 Anthropic이 Auto Mode를 Enterprise 계정으로 확장하는지, 테스트 방법론에 대한 더 많은 세부 정보를 공개하는지, 관리자에게 저장소, 도구, 자격 증명, 네트워크 액세스에 대한 더 나은 제어 기능을 제공하는지가 있다. 기능을 평가하는 팀은 pull request 수와 함께 검토 시간, 롤백 빈도, 결함률, 보안 이슈도 측정해야 한다.

Creati.ai 관점

Anthropic의 결정은 대부분의 유료 사용자에게 자율성을 Claude Code의 정상 워크플로로 만들지만, 감독을 선택 사항으로 만들지는 않는다. 감독은 일련의 미세 승인에서 벗어나, 권한 구성, diff 검토, 결과 검증이라는 더 넓은 책임으로 바뀐다.

반복적인 프롬프트가 자동 승인을 유도하는 상황에서는 합리적인 방향이지만, 생산성 향상이 실제인지 여부는 안전 계층의 품질에 달려 있다. 빌더들은 Auto Mode를 전면적 신뢰 결정이 아닌 통제된 배포 설정으로 다뤄야 한다. 범위가 제한된 저장소부터 시작하고, 하드 디나이 규칙을 적용하며, 민감한 시스템 접근을 제한하고, 프로덕션 변경에는 사람의 검토를 유지해야 한다.

추천

Anthropic은 Claude Code의 Auto Mode를 대부분의 유료 사용자에게 기본값으로 설정할 예정이다

Anthropic은 8월 14일 Pro, Max, Team 사용자에게 Claude Code의 Auto Mode를 기본값으로 적용해 코딩 감독을 AI가 관리하는 승인 방식으로 전환한다.