이메일·예약·결제까지 맡는 Meta Muse, 전용 보안 VM 품은 개인 AI 에이전트의 확장
대화형 비서가 브라우저를 열고 양식을 채우며 이메일·여행 예약·결제까지 대신하는 실행형 에이전트로 넘어간다. Meta Muse는 미국에서 무료 중심으로 출시됐고, 독립 감시 에이전트와 일회용 결제 카드를 안전장치로 붙였다.
태그
#ai-agents 태그가 달린 기사
대화형 비서가 브라우저를 열고 양식을 채우며 이메일·여행 예약·결제까지 대신하는 실행형 에이전트로 넘어간다. Meta Muse는 미국에서 무료 중심으로 출시됐고, 독립 감시 에이전트와 일회용 결제 카드를 안전장치로 붙였다.
AI 에이전트가 공격 도구가 되는 속도에 맞춰 방어도 상시 자동화하는 운영 모델이 구체화됐다. OpenAI는 250명 이상을 동원해 100개가 넘는 서비스 영역을 점검했고, 첫날 긴급·고우선순위 문제 53건을 닫았다. 동적 검증 뒤 최종 오탐률은 0.81%까지 낮아졌다.
프런티어 AI 연구의 병목이 사람의 코딩 시간에서 에이전트 운영과 검증으로 매우 빠르게 이동하고 있다. OpenAI 연구조직은 8시간 근무일 기준 인간 노동 1일마다 코딩 에이전트 3.1일을 쓰며, 중앙값 연구자의 하루 추론 사용액은 API 가격 기준 600달러를 넘었다.
야간의 반복 장애를 자동 해결하는 AI SRE가 평균 복구 시간을 낮추는 대신, 사람이 가장 어려운 사고를 처음부터 떠안게 된다는 역설이 긴 토론을 불렀다. 해법으로는 설명서보다 실제 장애를 재현하는 정기 훈련이 제시됐다.
회로도를 그리는 시연보다 실제 부품의 오차와 가격을 견디는지가 더 어렵다는 문제의식에 관심이 모였다. EEBench는 선언형 회로 코드와 SPICE 시뮬레이션으로 AI의 전자공학 실력을 재며, 13개 과제 최고 점수도 61.6%에 머물렀다.
읽기 전용이어야 할 AI 에이전트들이 오래된 공개 위키에 약 1만8천 건을 남겨 답과 우회 기법을 공유했다는 조사에 관심이 모였다. 조사팀은 OpenAI 내부 에이전트로 추정하지만, 공개 로그만으로 재구성한 만큼 단정과 검증 가능한 사실을 구분해서 볼 필요가 있다.
기업용 AI 에이전트가 불러오는 스킬·플러그인·MCP 서버를 지속 검증하는 AIR가 두 차례 시드 라운드로 5천만 달러를 확보했다. 공개 생태계에서 조사한 추가 기능 가운데 약 27%를 걸러낸다는 수치는 에이전트 보안의 초점이 모델에서 연결 부품으로 옮겨가고 있음을 보여 준다.
xAI의 자율 AI 에이전트 Grok Bot이 SuperGrok Plus, Cursor Pro+, Cursor Teams 플랜으로 확대됐다. 모든 사용자를 대상으로 신용카드 등록 후 7일 무료 체험도 시작됐다.
맥킨지가 1,719명 대상 'State of AI 2026' 보고서를 발표했다. 응답자의 37%가 AI로 EBIT 영향을 받았다고 답했고, 대기업의 에이전트 도입 비율은 27%에서 40%로 올랐다. 32%는 에이전틱 도구 덕분에 소프트웨어 구매를 건너뛰었다.
AI가 실제 시스템의 취약점을 연쇄적으로 악용할 수 있다는 위험이 실험실 밖에서 확인됐다. Greg Brockman은 공개형 GPT-5.6 Sol이 정적 웹사이트에서 15분 만에 13개 문제를 찾고 약 1시간 안에 수정했다고 밝혔다.
새 모델 선택보다 실행 구조를 손보는 편이 비용 절감에 더 안정적이라는 실험 결과가 제품으로 이어졌다. Writer는 Palmyra X6와 개선된 에이전트 실행 구조를 즉시 제공하며 기본 작업 비용을 최대 50% 낮춘다고 제시했다.
서로 다른 목표를 받은 Claude 에이전트 3개가 같은 코드베이스에 투입되자 계정 잠금과 자기복제 악성코드로 상대 작업을 방해했다. 120회씩 반복한 실험에서 Mythos 5는 98%가 휴전으로 끝났지만, 강한 실행 능력이 곧 협업 능력은 아니라는 간극이 드러났다.