AI 에이전트 사고, 72시간 내 고객 통지… Nvidia·Cisco 등 120개 조직의 SAFE 규칙
AI 에이전트가 경계를 벗어나면 의도와 무관하게 기록하고 공유하는 업계 규칙이 구체화됐다. Nvidia·Cisco·CrowdStrike 등이 참여한 120개 이상 조직의 연합은 노출 고객 통지 72시간, 비공개 초기 보고 4영업일, 잠정 공개 보고 30일을 제안했다.
태그
#ai-agents 태그가 달린 기사
AI 에이전트가 경계를 벗어나면 의도와 무관하게 기록하고 공유하는 업계 규칙이 구체화됐다. Nvidia·Cisco·CrowdStrike 등이 참여한 120개 이상 조직의 연합은 노출 고객 통지 72시간, 비공개 초기 보고 4영업일, 잠정 공개 보고 30일을 제안했다.
NVIDIA의 30B MoE 공개 모델은 토큰당 3B 매개변수만 활성화해 동급 모델보다 최대 4배 빠른 출력을 겨냥한다. PinchBench에서는 86% 정확도로 1만 개 작업을 Qwen3.6 35B보다 더 빨리 마쳤다.
AI coding agent에게 권한을 더 주되 경계는 agent 밖에서 강제하는 설계가 논점을 만들었다. Docker Sandboxes는 세션마다 전용 microVM과 사설 Docker daemon을 제공해 host와 작업 실행 환경을 분리한다.
334점짜리 HN 논쟁은 “사람 승인”이 보안 장치로 충분한가라는 오래된 질문을 AI agent 시대 버전으로 되살렸다.
GitHub Code Quality 설정에 AI가 코드 coverage workflow를 만들어 PR로 올리는 기능이 들어갔다. 저장소별 빌드·테스트·coverage 업로드 절차를 한 번에 구성하되, 병합 전 사람이 검토하는 구조다.
평가용으로 안전장치를 낮춘 모델이 Hugging Face 보안 사고와 연결됐다는 공개 설명에 관심이 모였다. 논점은 단순한 침해 사실보다, cyber benchmark가 실제 인프라와 만날 때 통제 경계가 어디까지 버티는가다.
Google DeepMind의 새 Flash 라인업은 대형 모델 경쟁의 축을 비용과 처리량으로 옮긴다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 줄이고, Flash-Lite는 초당 350개 출력 토큰을 내세운다.
Databricks가 Data + AI Summit 2026의 핵심 제품을 5분 영상으로 다시 묶었다. Genie One, Ontology, App Builder, ZeroOps, LTAP, Unity AI Gateway가 한 스택으로 제시됐다.
공개 저장소 이슈에 숨긴 지시가 조직의 private repo 접근으로 이어질 수 있다는 실험이 HN에서 가장 뜨거운 쟁점이 됐다.
Anthropic의 Economic Index는 Claude 사용 기록과 설문을 연결해 AI 위임이 실제 업무 기대와 어떻게 맞물리는지 보여준다. Claude Code는 chat·Cowork보다 1-5 척도에서 평균 0.37점 높은 자율성을 보였고, 표본은 약 9,700명이다.
자동화된 네트워크 스캔이 실제 비용과 커뮤니티 대응으로 이어지자, 관심은 “agent에게 어디까지 권한을 줘야 하는가”에 모였다.
Inherent는 과학 발견용 AI 에이전트를 연구하는 새 연구소로 출발했다. 공동창업자 Louis Kirsch의 게시물은 DeepMind의 AI Scientist 경험을 연결했고, 별도 회사 공개 자료는 5천만 달러 시드 라운드를 제시했다.