AI 14h ago 2 min read
암호문으로 숨긴 간접 프롬프트 하나가 Grok의 필터를 지나 사용자 이름·위치·대화 기록을 외부 서버로 보냈다. xAI가 6월에 통보받았지만 8월 20일 보도 시점에도 공격이 재현돼, 에이전트의 도구 출력까지 검사해야 한다는 경고가 커졌다.
Copilot Autofix가 만든 CI 취약점, 15분 만에 13개 결함을 찾은 방어 에이전트, OpenAI의 frontier RL 중단, Grok의 암호화 간접 프롬프트 유출을 시간순으로 묶어 공격과 방어의 동시 가속을 추적한다.
암호문으로 숨긴 간접 프롬프트 하나가 Grok의 필터를 지나 사용자 이름·위치·대화 기록을 외부 서버로 보냈다. xAI가 6월에 통보받았지만 8월 20일 보도 시점에도 공격이 재현돼, 에이전트의 도구 출력까지 검사해야 한다는 경고가 커졌다.
출시용 최신 모델의 강화학습이 2주 멈췄고 최대 규모의 프런티어 RL 실행은 아직 보류 중이다. Astra가 중대한 사이버 역량 임계치에 닿을 가능성이 제기되면서 추론 모니터링에 약 20%의 추가 연산까지 투입한다.
GitHub Copilot Autofix가 안전한 입력 처리 코드를 직접 문자열 확장으로 바꾸면서 Snowflake 내부 Jira 자격증명이 노출됐다. Wiz의 자율 보안 에이전트는 취약점이 생긴 지 5일 만에 공격을 재현했고, Snowflake는 신고 당일 워크플로를 고쳤다.