Anthropic Opus 4.6, 워크플레이스 AI 벤치마크에서 GPT-5.2 능가
Anthropic이 새로운 Opus 4.6 모델을 공개했다. 금융·법무 분야 지식 업무 벤치마크에서 OpenAI의 GPT-5.2를 앞섰으며, 기업 템플릿에 맞춘 프레젠테이션 자동 생성 기능을 선보였다.
Anthropic이 2월 5일, 새로운 대규모 언어 모델 Opus 4.6을 공개했다. 이 모델은 금융 및 법률 분야의 지식 업무를 평가하는 벤치마크에서 OpenAI의 GPT-5.2를 능가하는 성과를 보였다.
주요 특징
Opus 4.6의 핵심 기능 중 하나는 PowerPoint 통합 기능(연구 프리뷰)이다. 사용자는 AI와 함께 슬라이드를 구축할 수 있으며, AI가 기업의 템플릿에 맞춘 디자인을 생성한다. 분석가들은 이 기능이 첫 시도부터 "프로덕션 준비 완료" 수준에 가까운 파일을 만들어낸다고 평가했다.
시장 영향
Opus 4.6 공개 후, Anthropic의 Cowork 툴이 법무, 금융, 영업, 마케팅 등 특정 산업에 맞춤화할 수 있는 플러그인을 출시하면서 소프트웨어 주가에 영향을 미쳤다. CNN Business는 이를 "소프트웨어 주식을 흔든 AI"라고 표현했다.
경쟁 구도
Anthropic은 발표 시점을 15분 앞당겨 OpenAI보다 먼저 새로운 에이전틱 코딩 모델을 공개하는 데 성공했다. TechCrunch는 "OpenAI가 Anthropic이 자체 모델을 공개한 직후 몇 분 만에 새로운 에이전틱 코딩 모델을 출시했다"고 보도했다.
또한 OpenAI는 IPO를 추진하며 월스트리트 은행들과 비공식 논의를 시작했지만, Anthropic이 먼저 시장에 진출할 가능성도 제기되고 있다.
한편, Anthropic의 Model Context Protocol (MCP)이 AI 에이전트의 사실상 표준으로 자리 잡고 있으며, OpenAI와 Microsoft가 공개적으로 이를 채택했다. Google도 자체 관리형 MCP 서버를 배포하기 시작했다.
출처: CNN Business, TechCrunch, Fortune
관련 기사
OpenAI, GPT-5.5 Instant으로 ChatGPT 기본 모델 교체 — 환각 52.5% 감소
OpenAI가 ChatGPT 기본 모델을 GPT-5.5 Instant으로 교체했다. 의료·법률·금융 등 고위험 분야에서 환각 오류가 52.5% 줄었고, 응답 길이도 30.2% 단축됐다.
GPT-6 Astra, Code Arena 웹개발 1위…Claude Fable 5.1에 35점 차
실사용형 웹개발 평가에서 GPT-6 Astra Max가 1,797점으로 새 1위에 올랐다. Claude Fable 5.1 Max를 35점, 이전 OpenAI 최고 모델 GPT-5.6 Sol을 180점 앞서면서 100만 토큰당 40달러 가격대의 성능 기준을 한 단계 끌어올렸다.
PwC, 글로벌 수십만 직원에 Claude 전면 도입 — 3만 명 인증 프로그램 가동
Anthropic과 PwC가 전략적 제휴를 확대해 Claude Code와 Cowork를 미국팀 시작으로 글로벌 전체에 배포하며, 3만 명 인증 과정과 공동 AI 센터를 설립한다. 보험 인수 주기는 10주에서 10일로 단축됐다.