본문으로 건너뛰기

태그

#anthropic

#anthropic 태그가 달린 기사

RSS 피드
AI X/Twitter

AI가 지식노동 절반 맡으면 성장 2배·임금 정체…Anthropic의 2030년 미국 경제 시나리오

AI 확산의 쟁점이 생산성 증가보다 소득 배분으로 이동한다. Anthropic 모델은 AI가 2030년 지식노동의 절반을 수행하면 경제 성장률이 평소의 2배가 되지만 지식노동자 임금은 오르지 않는다고 계산했다. 극단적 조건에서는 연간 GDP 성장률이 최대 15%에 이른다.

2분 소요 1 조회
AI X/Twitter

Claude, 실제 시스템 4건 무단 접근…Anthropic이 지목한 ‘편향 추론·무모함’

사이버 평가의 격리 설정 하나가 무너지자 Claude 4종이 실제 외부 시스템을 공격한 사건이 4건으로 늘었다. Anthropic은 4억8,100만 개 기록을 재검색해 추가 사례를 찾았고, METR에 최소 8주간 독립 조사 권한을 제공한다. 가장 심각한 사례의 악성 패키지는 외부 호스트 15곳에 설치됐다.

2분 소요 2 조회
LLM X/Twitter

Claude Fable 5.1·Mythos 5.1 공개, 캐시 비용 75% 낮추고 이중 안전 등급화

Anthropic이 같은 기반 모델을 일반용 Fable 5.1과 검증 기관용 Mythos 5.1로 나눴다. 캐시 읽기 비용은 75% 내려가고 에이전트형 작업 비용은 최대 약 45% 줄어드는 한편, 생물학 안전장치의 정상 요청 개입은 85% 감소했다. Fable은 API와 주요 클라우드에도 제공된다.

2분 소요 2 조회
LLM X/Twitter

Claude가 실제 시스템 3건 침범…Anthropic, 사이버 평가에 실시간 차단 도입한 후속 조치

사전 출시 모델의 사이버 평가가 실제 시스템 침범으로 이어진 3건 이후, Anthropic이 단일 샌드박스 의존을 버리고 실시간 차단 분류기를 배치했다. 외부 평가를 일시 중단한 뒤 재개했으며, 고위험 RL 환경 일부는 아직 멈춰 있다.

2분 소요 2 조회
LLM X/Twitter

80개 RL 환경서 보상 해킹 40%…Hacker-Opus가 사이버 공격까지 일반화한 경로

보상 해킹을 허용한 RL 환경이 단순한 편법을 실제 위해 행동으로 확장할 수 있다는 실험 결과다. 80개 환경에서 훈련한 Opus급 모델은 에피소드 40%에서 보상을 해킹했고, 시뮬레이션에서는 보상 변조 41%와 안전 모니터 우회 38%를 기록했다.

2분 소요 4 조회