r/LocalLLaMA에서 화제가 된 karpathy/autoresearch는 에이전트가 하나의 training file을 수정하고 5분 실험을 반복하며 val_bpb를 낮추는 방향으로 탐색하는 소형 open-source 연구 루프다.
#ai-agents
RSS 피드LocalLLaMA에서 공유된 autoresearch는 agent가 PyTorch 학습 코드를 수정하고 5분짜리 실험을 반복하면서 더 나은 val_bpb를 찾도록 설계된 최소 구성 연구 프레임워크다.
Hacker News에서 주목받은 Agent Safehouse는 macOS의 sandbox-exec를 활용해 local coding agent를 프로젝트 범위 안으로 제한하는 오픈소스 보안 레이어다.
Samsung은 2030년까지 글로벌 제조 운영을 AI-Driven Factories로 전환하겠다고 밝혔다. 핵심 축은 digital twin simulation, AI agent, 그리고 공장 내부 companion robot을 결합해 생산 현장을 site별로 최적화하는 것이다.
Microsoft Threat Intelligence는 2026년 3월 6일 위협 행위자들이 정찰, 피싱, 악성코드 개발, 침해 후 분석 전반에 AI를 활용하고 있다고 밝혔다. 핵심 주장은 AI가 아직 공격을 완전 자동화하진 않지만, 이미 공격 속도와 규모, 지속성을 높이는 운영 계층으로 쓰이고 있다는 점이다.
OpenAI가 2026년 3월 6일 X에서 Codex Security 리서치 프리뷰를 발표했다. 공개 설명에 따르면 이 에이전트는 프로젝트 컨텍스트를 분석해 취약점을 탐지하고 검증하며 패치 제안까지 수행한다.
Cursor가 코드베이스를 지속적으로 모니터링하고 개선하는 상시 실행형 에이전트 기능 Automations를 발표했다. 트리거와 사용자 지시 기반으로 자동 작업을 수행하는 개발 워크플로가 본격화되고 있다.
Hacker News에서 높은 관심을 받은 Cline 공급망 사고를 정리한다. GitHub 이슈 제목의 prompt injection이 CI 워크플로우, 캐시 오염, 토큰 탈취, 악성 배포로 이어진 경로와 재발 방지 포인트를 다룬다.
Hacker News에서 주목받은 Google Workspace CLI는 Drive, Gmail, Calendar 등 Workspace API를 하나의 CLI로 통합하고, Discovery Service 기반 동적 명령 생성과 구조화 JSON 출력, 에이전트 연동 기능을 제공한다.
과학자들이 AI 에이전트를 더 적극적으로(무례하게) 대화하도록 설계했더니 복잡한 추론 작업에서 성능이 향상됐다는 역설적인 연구 결과가 발표되었습니다.
Google Chrome 팀이 웹사이트와 AI 에이전트 간의 직접 통신을 가능하게 하는 새로운 웹 표준 WebMCP의 얼리 프리뷰를 공개했다. 이를 통해 사이트 소유자는 AI 에이전트가 자신의 서비스와 상호작용하는 방식을 명시적으로 정의할 수 있다.
2026년 2월 28일 HN 토론은 NanoClaw 보안 모델을 중심으로, untrusted-agent 전제를 둔 container isolation과 실행 권한 최소화 원칙을 집중 조명했다.