OpenAI, 내부 coding agent의 misalignment 모니터링 방식 공개
OpenAI는 2026년 3월 19일, GPT-5.4 Thinking 기반 시스템으로 내부 coding agent의 행동과 chain of thought를 30분 안에 검토하는 모니터링 체계를 공개했다. 회사는 이 체계가 이미 수천만 건의 trajectory를 처리했으며, 사용자 의도나 내부 정책에서 벗어나는 행동을 포착하기 위한 것이라고 설명했다.
태그
#agents 태그가 달린 기사
OpenAI는 2026년 3월 19일, GPT-5.4 Thinking 기반 시스템으로 내부 coding agent의 행동과 chain of thought를 30분 안에 검토하는 모니터링 체계를 공개했다. 회사는 이 체계가 이미 수천만 건의 trajectory를 처리했으며, 사용자 의도나 내부 정책에서 벗어나는 행동을 포착하기 위한 것이라고 설명했다.
2026년 3월 19일 Hacker News에서 주목받은 agent-sat는 weighted MaxSAT benchmark를 상대로 스스로 실험과 코드 수정을 반복하는 오픈소스 프로젝트다. README 기준으로 2024 MaxSAT Evaluation 229개 인스턴스 중 220개를 풀었고, 5개는 대회 최고 기록을 넘어섰으며, 1개는 novel solve라고 주장한다.
Google는 Mar 17, 2026 agent workflow를 위한 Gemini API 업데이트를 공개했다. 이번 변경으로 built-in tool과 custom function을 한 request에서 함께 쓰고, tool output을 context에 유지하며, Gemini 3에서 Maps grounding까지 활용할 수 있게 됐다.
2026년 3월 18일 NVIDIA NemoClaw 관련 Hacker News 게시물은 231 points와 185 comments를 기록했다. 이 alpha 프로젝트는 NVIDIA OpenShell과 Agent Toolkit 위에 OpenClaw를 얹어 policy control과 cloud-routed inference를 갖춘 sandboxed environment에서 always-on assistant를 실행하도록 설계됐다.
MistralAI는 2026년 3월 17일 Forge를 통해 기업이 proprietary knowledge 위에 frontier-grade AI 모델을 구축할 수 있다고 밝혔다. 공식 글은 이를 pre-training, post-training, reinforcement learning, agent-first workflow, 다양한 아키텍처 지원, 규제 환경용 governance 제어까지 포함하는 플랫폼으로 설명한다.
OpenAI는 enterprise에서 AI coworkers를 pilot에서 production으로 옮기기 위한 Frontier Alliances를 발표했다. BCG, McKinsey, Accenture, Capgemini가 strategy, integration, change management를 맡아 Frontier 확산을 지원한다.
OpenAI는 2026년 3월 9일 Promptfoo 인수 계획을 공개했다. OpenAI는 Promptfoo 기술이 OpenAI Frontier의 agentic security testing과 evaluation 역량을 강화할 것이며, Promptfoo는 기존 라이선스 아래 open source로 유지되고 기존 고객 지원도 이어간다고 밝혔다.
Perplexity는 2026년 3월 11일 Agent API를 공개하며 search, tool execution, multi-model orchestration을 하나의 managed runtime으로 묶겠다고 밝혔다. 이번 출시는 Perplexity를 단순 답변 인터페이스보다 production agent workflow용 인프라에 더 가깝게 위치시킨다.
Perplexity는 2026년 3월 12일 X에서 Computer를 Pro 구독자에게도 개방했다고 밝혔다. 회사는 20개 이상 advanced model, prebuilt/custom skills, 수백 개 connectors 접근을 내세우며, Max 구독자는 월별 credit과 더 높은 spend limit를 받는다고 설명했다.
OpenAI는 2026년 3월 11일 AI agent가 읽는 이메일, 웹페이지, 캘린더 초대 같은 untrusted content가 핵심 보안 경계라고 설명하는 새 가이드를 공개했다. 회사는 안전한 agent가 data와 instruction을 분리하고, least privilege를 적용하며, 중요한 action 전에는 monitoring과 user confirmation을 넣어야 한다고 밝혔다.
Perplexity는 March 13, 2026 X post에서 Perplexity Computer가 iOS용 Perplexity app에 들어갔고, phone과 desktop 사이에서 같은 task를 이어서 관리할 수 있다고 밝혔다. 하루 전 Pro subscribers 공개에 이어 모바일 control surface까지 붙으면서 Computer를 장기 실행형 agent product로 밀어붙이는 흐름이 더 선명해졌다.
2026년 3월 14일 Hacker News에서는 로컬 stdio MCP는 불필요한 오버헤드가 될 수 있지만, 원격 HTTP MCP는 인증, telemetry, 공유 툴링 측면에서 여전히 중요하다는 더 정교한 논점이 주목을 받았다.