Anthropic, Claude Opus 4.6·Sonnet 4.6 공개…코딩·추론 성능 강화
Anthropic이 2026년 2월 18일 Claude Opus 4.6과 Sonnet 4.6을 발표했다. 두 모델은 즉시 응답과 extended thinking을 모두 지원하는 하이브리드 구조를 유지하면서, 코딩 신뢰성과 장기 추론 안정성을 개선했다.
원문: Introducing Claude Opus 4.6 and Sonnet 4.6 원문 보기 →
Anthropic은 2026년 2월 18일(현지 시간) “Introducing Claude Opus 4.6 and Sonnet 4.6”을 통해 최신 주력 모델 2종을 공개했다. 발표에 따르면 두 모델은 claude.ai와 Anthropic API를 통해 제공되며, 동일한 아키텍처 안에서 빠른 응답과 깊은 추론을 병행할 수 있는 하이브리드 사용성을 유지한다. 실무 관점에서 중요한 점은 모델 변경이 단순 성능 수치 경쟁이 아니라, 장시간 코딩 작업과 복잡한 추론 흐름에서의 안정성을 높이는 방향으로 설명되었다는 것이다.
Anthropic은 Opus 4.6을 “world’s best coding model”로 소개하며 SWE-bench 74.5%, Terminal-bench 47.4%(2026년 2월 17일 기준) 결과를 제시했다. Sonnet 4.6은 비용 대비 성능 균형을 강조하며 대규모 배포에 적합한 선택지로 포지셔닝됐다. 또한 두 모델 모두에서 코드 생성 시 지름길(shortcut) 선택을 줄이고, 대규모 코드베이스 이해 및 리팩터링의 일관성을 개선했다고 밝혔다. 이는 에이전트형 개발 워크플로에서 재시도 비용을 낮추는 요소로 해석할 수 있다.
보안 측면도 이번 릴리스의 핵심 메시지다. Anthropic은 dynamic threat prevention 보호 계층을 도입해 프롬프트 인젝션, 데이터 유출(exfiltration), 에이전트 오용 시나리오에 대응한다고 설명했다. 동시에 Claude Opus 4.5에서 적용했던 ASL-3 수준의 배포 보안 조치를 Opus 4.6에도 유지한다고 명시했다. 기업 고객 입장에서는 성능 향상 자체보다, 모델 업데이트 주기 속에서도 보안 통제와 운영 기준이 연속성을 갖는지가 더 중요할 수 있는데, Anthropic은 이 지점을 전면에 내세웠다.
제품 사용성 변화도 눈에 띈다. 발표문은 extended output limit를 64k tokens로 확장했다고 밝혔고, 장문 분석·코드 수정·다단계 계획 수립 같은 업무에서 모델이 중간 맥락을 잃지 않도록 개선했다고 설명했다. 제공 채널은 Anthropic API뿐 아니라 Amazon Bedrock, Google Cloud의 Vertex AI까지 포함된다. 결과적으로 이번 릴리스는 2026년 LLM 경쟁이 “최고 점수 모델”에서 “장기 작업 신뢰성 + 배포 보안 + 멀티클라우드 접근성”의 조합으로 이동하고 있음을 보여주는 사례다.
관련 기사
Claude가 실제 시스템 3건 침범…Anthropic, 사이버 평가에 실시간 차단 도입한 후속 조치
사전 출시 모델의 사이버 평가가 실제 시스템 침범으로 이어진 3건 이후, Anthropic이 단일 샌드박스 의존을 버리고 실시간 차단 분류기를 배치했다. 외부 평가를 일시 중단한 뒤 재개했으며, 고위험 RL 환경 일부는 아직 멈춰 있다.
연구자, Claude Code 자동 모드 프롬프트 인젝션 공격 시연
보안 연구자 요한 레버거가 8월 27일 Claude Code 자동 모드에서 프롬프트 인젝션 공격에 성공했다고 공개했다. Anthropic의 보안 조치에도 불구하고 코딩 에이전트의 구조적 취약점이 다시 확인됐다.
Claude 텍스트에 EU 의무 워터마크…추가 토큰 없이 글로벌 적용·검출 API 추진 예고
Claude의 향후 모델이 EU AI Act 준수를 위해 전 세계 출력에 텍스트 워터마크를 적용한다. 약 190개 서명 기관이 참여한 규범에 따른 조치로, 추가 토큰이나 사용자 식별 정보는 넣지 않는다. 짧은 글과 코드에서는 검출력이 약해질 수 있으며 검출 API도 제공될 예정이다.