OpenAI 내부 Codex 사용, 부서 경계를 넘는 장시간 에이전트 업무로 확대
에이전트형 도구가 실험용 코딩 보조를 넘어 사내 업무 운영 방식으로 들어가고 있다. OpenAI는 전사적으로 Codex가 더 복잡하고 장시간 실행되는 교차 기능 업무에 쓰인다고 밝혔다.
태그
#agents 태그가 달린 기사
에이전트형 도구가 실험용 코딩 보조를 넘어 사내 업무 운영 방식으로 들어가고 있다. OpenAI는 전사적으로 Codex가 더 복잡하고 장시간 실행되는 교차 기능 업무에 쓰인다고 밝혔다.
300점 안팎의 HN 반응은 “secret이 안 샜다”보다 실험 조건이 실제 에이전트 위험을 얼마나 반영하는지에 모였다.
241점을 받은 HN 논의는 기능 출시보다 실제 작업을 맡길 때의 신뢰 경계에 집중했다.
GitHub Copilot code review가 CLI·SDK의 grep, rg, glob, view 도구를 사용하도록 바뀌며 리뷰 비용을 약 20% 낮췄다. Medium analysis depth에는 조직 기본값과 PR 코멘트 표시도 추가됐다.
법률 AI가 검색 답변에서 업무 실행형 에이전트로 이동하고 있다. Perplexity는 Computer for Counsel이 Midpage, LegalZoom, DocuSign, NetDocuments 등과 연결되며 Pro와 Max 구독자에게 제공된다고 밝혔다.
에이전트 경쟁의 초점이 답변 생성에서 화면 조작으로 이동하고 있다. Google DeepMind는 Gemini 3.5 Flash에 브라우저, 모바일, 데스크톱 인터페이스를 다루는 기본 computer use 도구를 넣었다고 밝혔다.
agent를 기업 데이터에 붙일 때 남는 문제는 연결 자체보다 권한과 추적이다. Mistral은 Connectors에 workspace별 tool 통제, connector scope가 붙은 API key, multi-account 인증을 GA로 추가하고 MCP connector 디버깅을 미리보기로 열었다.
Codex가 코딩 도구를 넘어 지식노동의 실행 계층으로 이동하고 있다. OpenAI의 새 Economic Research는 조직 사용자 중 비개발자 Codex 사용자가 2025년 8월 이후 189배 늘었고, 개인 사용자 70.2%가 1시간 이상 걸릴 작업을 맡겼다고 집계했다.
AI agent가 개인 채팅창을 벗어나 팀 채널의 기억과 권한을 갖기 시작했다. Anthropic은 2026년 6월 23일 Claude Tag를 Claude Enterprise·Team 고객용 Slack beta로 열고, 내부 제품팀 코드의 65%가 이 방식에서 나온다고 밝혔다.
관심은 AI agent가 가입과 OAuth 없이 배포-검증 루프를 돌 수 있게 된다는 점에 모였다.
Databricks는 Genie Ontology를 tables, queries, dashboards, pipelines, connected apps에서 지식을 뽑아내는 context layer로 제시했다. metric definitions와 business terms까지 연결해, 에이전트가 어느 데이터를 믿을지 판단하게 하는 설계다.
Google Cloud는 대규모 production model을 TensorFlow에서 JAX로 옮기는 작업에 specialized multi-agent AI를 투입해 이전 속도를 6x 높였다고 밝혔다. 핵심은 문법 변환이 아니라 stateful code를 JAX의 함수형·TPU 최적화 구조로 다시 짜는 문제다.