LLM 해커뉴스
암호화했지만 모델끼리는 읽혔다…reasoning trace 격리의 빈틈
암호화된 reasoning block이 세션과 모델 경계를 넘어 재사용된다는 실험에 관심이 모였다. 강한 모델이 만든 trace를 약한 형제 모델에 넣고 jailbreak하면 숨겨진 추론과 민감정보가 평문으로 돌아오는 구조다.
2분 소요 16 조회
태그
#api-security 태그가 달린 기사
암호화된 reasoning block이 세션과 모델 경계를 넘어 재사용된다는 실험에 관심이 모였다. 강한 모델이 만든 trace를 약한 형제 모델에 넣고 jailbreak하면 숨겨진 추론과 민감정보가 평문으로 돌아오는 구조다.
HN이 크게 반응한 이유는 실패 패턴이 너무 익숙했기 때문이다. client-side key, 지연되는 cost reporting, hard stop이 아닌 budget alert가 한꺼번에 겹쳤다. Google AI Developers Forum 글은 Firebase AI Logic을 켠 뒤 몇 시간 만에 Gemini API 사용량이 €54,000+까지 갔다고 설명했고, 댓글은 small team에게 cloud billing 안전장치가 충분한지로 번졌다.
Cloudflare는 2026년 3월 9일 X를 통해 API Shield 고객용 Web and API Vulnerability Scanner 오픈 베타를 공개했다. 회사는 이 제품이 AI가 만든 API call graph를 바탕으로 BOLA 같은 logic flaw를 능동적으로 점검한다고 설명했다.