Claude Code, Team·Enterprise용 멀티 에이전트 Code Review 출시
Claude는 Claude Code에 Code Review를 추가하고 PR마다 여러 agent가 병렬로 버그를 찾는 구조를 도입했다고 밝혔다. 기능은 Team과 Enterprise 대상 research preview로 제공된다.
원문: Introducing Code Review, a new feature for Claude Code. 원문 보기 →
2026년 3월 9일 Claude는 X를 통해 Claude Code에 Code Review 기능이 추가됐다고 발표했다. 이 기능은 pull request가 열릴 때마다 여러 agent를 투입해 버그를 찾는 방식이며, Anthropic은 자사 내부 PR 대부분에서 이미 사용 중인 review workflow를 제품화한 것이라고 설명했다. 현재 Team과 Enterprise 대상 research preview로 제공된다.
Anthropic에 따르면 이 시스템은 속도보다 depth를 우선한다. PR이 생성되면 여러 agent가 변경 사항을 병렬로 읽고, 의심되는 이슈를 다시 검증해 false positive를 줄인 뒤, severity 기준으로 우선순위를 정리해 하나의 high-signal 요약 댓글과 필요한 inline comment를 남긴다. 또 PR 규모와 복잡도에 따라 review 강도를 조절해, 작은 수정에는 가벼운 검토를, 큰 변경이나 위험한 diff에는 더 많은 agent와 더 깊은 분석을 적용한다.
Anthropic은 내부 운영 지표도 공개했다. 이 시스템 도입 전에는 substantive review comment가 달리는 PR 비중이 16%였지만 도입 후에는 54%로 올라갔다고 한다. 1,000줄 이상 바뀐 PR에서는 84%가 finding을 받았고 평균 7.5개의 이슈가 나왔으며, 50줄 미만 PR에서는 31%가 finding을 받았고 평균 0.5개 수준이었다. Anthropic은 엔지니어가 incorrect로 표시하는 finding 비율도 1% 미만이라고 밝혔다.
X 스레드에는 구매 판단에 필요한 운영 정보도 담겼다. review 한 건의 평균 소요 시간은 약 20분, beta 기간 평균 가격은 token usage 기준으로 $15-25 수준이다. Anthropic은 이를 기존 open-source Claude Code GitHub Action을 대체하는 기능이 아니라, 더 비싸지만 더 깊게 보는 선택지로 소개했다. 제품 개요는 Claude의 Code Review 안내문에서 확인할 수 있다.
관련 기사
코드 리뷰 품질 2.17배, OpenCodeReview 통제형 에이전트로 토큰 5~15배 절감
에이전트에게 더 많은 자유를 주는 대신 탐색과 검증을 의도적으로 제한하자 코드 리뷰 품질은 최대 2.17배로 높아지고 토큰 사용량은 5~15분의 1로 줄었다. 200개 실제 PR과 1,505개 검증 의견을 사용한 Alibaba 연구팀의 결과는 모델 크기보다 워크플로 설계가 중요할 수 있음을 보여준다.
Anthropic, Claude Sonnet 4.6 공개... 1M token context와 agent workflow 강화
Anthropic는 Feb 17, 2026, Claude Sonnet 4.6를 공개하며 coding, computer use, long-context reasoning, agent planning 전반을 강화했다고 밝혔다. 가격은 Sonnet 4.5와 같은 $3/$15를 유지하면서 1M token context window와 다수 tool 기능을 추가했다.
Claude Opus 4.7, 더 큰 이미지와 코딩 안정성으로 GA 진입
Anthropic이 Claude Opus 4.7을 모든 Claude 제품, API, Amazon Bedrock, Vertex AI, Microsoft Foundry에 GA로 풀었다. $5/$25 per million token 가격은 유지하면서 2,576px 장변 이미지와 xhigh effort를 더해 coding agent와 multimodal 업무의 기준선을 끌어올렸다.