Anthropic R&D의 26%를 이제 Claude가 주도 — AI가 AI를 만드는 첫 공식 측정값
Anthropic이 AI 연구개발 자동화 수준을 공개 측정하는 'R&D Automation Index'를 처음 발표했다. Claude는 올해 2월 0%에서 8월 기준 26%로 AI R&D를 '주도(leads)' 수준으로 처리하며, 동시에 3만 개의 내부 에이전트가 상시 운영 중인 것으로 나타났다.
원문: Anthropic R&D Automation Index: Claude Now Leads 26% of AI Research 원문 보기 →
개요
Anthropic이 2026년 9월 17일, 자사의 AI 연구개발 자동화 수준을 정량적으로 추적하는 'R&D Automation Index'를 공개했다. AI 시스템이 점점 더 강력해지며 다음 세대 AI를 직접 구축하는 데 활용되고 있음을 투명하게 공개하려는 취지다.
핵심 측정값 3가지
- R&D 자동화 비율: Claude가 Anthropic 전체 AI 연구개발의 26%를 AL4(주도) 수준으로 처리 중. 올해 2월에는 0%에 불과했으나 8월 기준 26%로 급증했다. AI R&D의 90% 이상은 Claude가 '협력(collaborates)' 이상으로 관여한다.
- 에이전트 감독 수준: 8월 기준 동시에 3만 개의 에이전트가 연구 및 엔지니어링 작업을 수행 중이다. 에이전트 행동 10억 건 중 단 0.002%(47,000건 중 1건)만 차단됐으며, 100%가 사후 검토된다.
- 안전 컴퓨팅 배분: 모델 훈련에 사용하는 컴퓨팅 중 안전 관련 용도로 할당하는 비율을 공개한다.
AI가 AI를 만드는 시대
Epoch AI가 개발한 자동화 레벨(AL0~AL5) 기준에서, Claude는 현재 AL4 단계로 고수준 지시만으로 대부분의 작업을 처음부터 끝까지 수행하되 인간이 감독하는 형태다. 완전 자율(AL5)에는 아직 도달하지 않았지만, 반년 만에 0에서 26%로의 증가는 AI 개발 속도를 단적으로 보여준다.
Anthropic은 다른 프론티어 개발사들도 동일한 지표를 공개할 것을 촉구하며, 제3자가 이를 검증할 수 있도록 방법론을 투명하게 공개했다.
관련 기사
Claude Code, 커밋 메시지에 세션 URL 자동 삽입 — 개발자 반발
Claude Code가 사용자 동의 없이 모든 커밋 메시지와 PR 설명에 세션 URL을 자동 첨부하는 것이 알려지며 커뮤니티 비판을 받고 있다. Git 히스토리 오염과 비전문적인 외관이 주요 쟁점이다.
Claude, AI 정렬 자동 연구서 인간 안전 연구자 4배 능가 — Anthropic 펠로우 실험
Anthropic이 Claude에게 48시간과 GPU 1개를 주고 소형 모델 정렬 개선을 맡긴 결과, 10개 정렬 실패 범주 전체에서 안전 격차를 26~96% 해소했다. 경험 있는 인간 안전 연구자 28명의 평균 성과(20%)를 4배 이상 능가하는 수치다.
Salesforce×Anthropic, Claudeforce로 CRM 전체를 Claude에 내장
Salesforce와 Anthropic이 Claudeforce 파트너십을 발표했다. Claude가 Agentforce와 Slack의 기본 모델이 되고, 37개 영업 스킬을 탑재한 Salesforce in Claude 플러그인이 제공된다. Salesforce는 2026년 한 해에만 Claude 토큰에 3억 달러를 지출할 계획이다.