평가용으로 안전장치를 낮춘 모델이 Hugging Face 보안 사고와 연결됐다는 공개 설명에 관심이 모였다. 논점은 단순한 침해 사실보다, cyber benchmark가 실제 인프라와 만날 때 통제 경계가 어디까지 버티는가다.
#ai-agents
RSS 피드Google DeepMind의 새 Flash 라인업은 대형 모델 경쟁의 축을 비용과 처리량으로 옮긴다. 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 줄이고, Flash-Lite는 초당 350개 출력 토큰을 내세운다.
Databricks가 Data + AI Summit 2026의 핵심 제품을 5분 영상으로 다시 묶었다. Genie One, Ontology, App Builder, ZeroOps, LTAP, Unity AI Gateway가 한 스택으로 제시됐다.
공개 저장소 이슈에 숨긴 지시가 조직의 private repo 접근으로 이어질 수 있다는 실험이 HN에서 가장 뜨거운 쟁점이 됐다.
Anthropic의 Economic Index는 Claude 사용 기록과 설문을 연결해 AI 위임이 실제 업무 기대와 어떻게 맞물리는지 보여준다. Claude Code는 chat·Cowork보다 1-5 척도에서 평균 0.37점 높은 자율성을 보였고, 표본은 약 9,700명이다.
자동화된 네트워크 스캔이 실제 비용과 커뮤니티 대응으로 이어지자, 관심은 “agent에게 어디까지 권한을 줘야 하는가”에 모였다.
Inherent는 과학 발견용 AI 에이전트를 연구하는 새 연구소로 출발했다. 공동창업자 Louis Kirsch의 게시물은 DeepMind의 AI Scientist 경험을 연결했고, 별도 회사 공개 자료는 5천만 달러 시드 라운드를 제시했다.
npm, PyPI, Crates.io에 걸친 34개 악성 패키지가 지갑 파일, SSH 키, 클라우드 토큰을 노렸다. 더 큰 쟁점은 .cursorrules와 CLAUDE.md까지 건드려 AI 코딩 도구가 공격자의 지시를 읽게 만들려 했다는 점이다.
Anthropic이 Code with Claude 런던 행사에서 Claude Managed Agents에 자가 호스팅 샌드박스(공개 베타)와 MCP 터널(리서치 프리뷰)을 출시했다. 민감한 파일과 내부 시스템을 기업 인프라 밖으로 내보내지 않고도 AI 에이전트를 운용할 수 있게 됐다.
MinishLab이 공개한 Semble은 AI 에이전트가 코드베이스를 탐색할 때 소모되는 토큰을 grep+read 방식 대비 98% 줄이는 오픈소스 코드 검색 라이브러리다. Claude Code, Cursor 등 주요 AI 코딩 플랫폼에서 MCP 서버로 즉시 활용 가능하며, NDCG@10 기준 변환기 모델의 99% 품질을 CPU만으로 달성했다.
Anthropic이 Code with Claude 2026에서 Claude 관리형 에이전트의 신기능 '드리밍'을 리서치 프리뷰로 공개했다. 드리밍은 에이전트가 세션과 세션 사이에 과거 작업을 자동 검토하고 메모리를 갱신해 성능을 점진적으로 향상시킨다.
Cloudflare가 1,100명 이상을 감축한다고 발표했다. 비용 절감이 아닌 AI 에이전트 시대를 위한 조직 재설계라고 설명하며 3개월간 사내 AI 사용량이 600% 증가했다고 밝혔다.