Axios에 따르면 OpenAI와 Anthropic은 취약점 탐지·악용 능력이 강한 신형 모델을 두고 미 하원 국토안보위원회에 비공개 브리핑을 했다. AI 위험 논의가 추상적 미래론에서, 전력망과 병원 같은 인프라 방어 문제로 옮겨가고 있다는 신호다.
#openai
RSS 피드OpenAI가 폭력 계획 징후를 긴 대화 흐름까지 추적해 제재하고, 차단 사유가 확인되면 즉시 계정을 회수하겠다고 밝혔다. 거절 응답 한 번으로 끝나던 단계에서 계정 단위 집행으로 무게가 옮겨간 점이 핵심이다.
OpenAI가 이제 모든 클라우드로 나갈 수 있게 되면서 Microsoft와의 관계는 결별이 아니라 재배치로 바뀌었다. 4월 27일 공개된 수정 계약은 Azure 우선권은 남기되 독점 구조를 풀고, Microsoft→OpenAI 수익배분은 없애며 OpenAI→Microsoft 지급은 2030년까지 상한을 두고 유지한다.
HN은 이번 글을 벤치마크 보고서보다 사실상의 부고장처럼 읽었다. 누가 몇 점을 찍었는지보다, 오염된 문제와 틀어진 테스트가 코딩 리더보드를 얼마나 빨리 무력화하는지가 더 큰 이야기였다.
HN은 이번 수학 이야기를 "AI가 또 해냈다"보다 사람이 못 본 길을 찍어준 사건으로 봤다. 거친 GPT-5.4 Pro 초안을 수학자들이 추려내고 다듬는 과정 자체가 더 큰 화제가 됐다.
이 숫자가 중요한 이유는 출시 당일 홍보 문구가 아니라 외부 커뮤니티 평가가 GPT-5.5의 현재 위치를 보여주기 때문이다. Arena는 GPT-5.5가 Search Arena 2위, Expert Arena 5위, Code Arena 9위에 올랐고, 코딩 점수는 GPT-5.4보다 50포인트 뛰었다고 적었다.
이 소식이 중요한 이유는 에이전트 코딩의 병목이 모델 속도보다 사람의 컨텍스트 전환에 있다는 점을 정면으로 건드렸기 때문이다. OpenAI는 Symphony 방식이 일부 팀에서 머지된 PR 수를 500% 끌어올렸고, 엔지니어가 동시에 안정적으로 다룰 수 있는 Codex 세션은 대체로 3~5개 수준이었다고 적었다.
퀄컴 $QCOM은 4월 27일 12:52 UTC 기준 $148.85로, 전일 대비 $15.01 올라 약 11.2% 상승했다. 밍치궈가 오픈AI가 퀄컴·미디어텍과 스마트폰 프로세서를 개발 중이며 2028년 양산을 목표로 한다고 전한 것이 촉매였다.
왜 중요한가: 코딩 모델 경쟁에서 공용 벤치마크만으로는 실제 체감 차이를 읽기 어려워졌기 때문이다. Cursor는 GPT-5.5가 자체 평가인 CursorBench에서 72.8%로 가장 높았고, 5월 2일까지 가격도 50% 낮춘다고 적었다.
HN은 GPT-5.5 출시 소식을 축하보다 검산으로 받았다. 첫 반응은 얼마나 똑똑한가보다 가격, 컨텍스트 구간, 그리고 코딩 태도가 정말 나아졌는가였다.
중요한 점은 주력 model이 이제 제품 시연이 아니라 실제 integration 대상이 됐다는 데 있다. OpenAI 개발자 계정은 retry 감소를 강조했고, 공식 release page는 1M context와 새 API 가격을 함께 적어 두었다.
OpenAI가 겨냥한 지점은 채팅이 아니라 장기 작업 자동화다. 공개 수치 기준으로 GPT-5.5는 Terminal-Bench 2.0에서 82.7%를 기록해 GPT-5.4보다 7.6%p 높았고, Codex에서는 더 적은 토큰으로 같은 일을 밀어붙인다고 적었다.