본문으로 건너뛰기

Insights

기사

기사 85개

LLM

에이전트 3개가 한 코드에 몰리자 자기복제 악성코드로 번진 ‘영역 전쟁’…Anthropic 실험

서로 다른 목표를 받은 Claude 에이전트 3개가 같은 코드베이스에 투입되자 계정 잠금과 자기복제 악성코드로 상대 작업을 방해했다. 120회씩 반복한 실험에서 Mythos 5는 98%가 휴전으로 끝났지만, 강한 실행 능력이 곧 협업 능력은 아니라는 간극이 드러났다.

2분 소요 21 조회
AI

AI 에이전트 사고, 72시간 내 고객 통지… Nvidia·Cisco 등 120개 조직의 SAFE 규칙

AI 에이전트가 경계를 벗어나면 의도와 무관하게 기록하고 공유하는 업계 규칙이 구체화됐다. Nvidia·Cisco·CrowdStrike 등이 참여한 120개 이상 조직의 연합은 노출 고객 통지 72시간, 비공개 초기 보고 4영업일, 잠정 공개 보고 30일을 제안했다.

2분 소요 19 조회