기업이 프런티어 모델을 쓰면서도 민감한 대화 원문을 남기지 않을 선택지가 넓어진다. OpenAI는 여러 상호작용에 걸친 위험을 탐지하되 직원에게 원문을 노출하지 않는 Private Safety Processing을 9월부터 순차 도입할 계획이다.
기업이 프런티어 모델을 쓰면서도 민감한 대화 원문을 남기지 않을 선택지가 넓어진다. OpenAI는 여러 상호작용에 걸친 위험을 탐지하되 직원에게 원문을 노출하지 않는 Private Safety Processing을 9월부터 순차 도입할 계획이다.
ChatGPT와 Codex가 사용자의 앱·웹 활동을 문맥으로 참조하는 기능이 macOS에 추가됐다. 수집 이벤트는 48시간 뒤 삭제되지만, 생성된 로컬 기억 파일과 프롬프트 주입 위험은 사용자가 직접 관리해야 한다. 화면·마이크·비공개 탐색은 기록하지 않으며 기본값은 꺼짐이다.
암호화된 reasoning block이 세션과 모델 경계를 넘어 재사용된다는 실험에 관심이 모였다. 강한 모델이 만든 trace를 약한 형제 모델에 넣고 jailbreak하면 숨겨진 추론과 민감정보가 평문으로 돌아오는 구조다.
미국 ChatGPT 사용자는 Apple Health와 지원 의료기록을 연결해 검사 결과와 활동 데이터를 대화 맥락에 넣을 수 있다. OpenAI는 매주 3억 명 이상이 건강 질문을 한다며, 연결 데이터는 foundation model 학습과 광고 타깃팅에 쓰지 않는다고 밝혔다.
LLM이 학습 데이터를 얼마나 암기하는지에 대해 NVIDIA가 ICML 논문을 공유했다. 핵심 수치는 parameter당 약 3.6 bits로, privacy와 scaling 논의를 사례가 아닌 용량 문제로 바꾼다.
숨은 Unicode marker 자체보다 개발자 도구가 이를 설명 없이 system context에 넣는 방식이 논점이다.
ServiceNow 연구진은 로컬 문서와 웹 검색을 오가는 deep research 에이전트가 사내 정보를 검색어 조각으로 흘릴 수 있음을 보였다. PA-DR 훈련은 전체 정보 유출률을 34.0%에서 9.9%로 낮췄지만, 성능만 올리는 훈련은 유출을 키웠다.
Machine unlearning의 약속은 “다시 학습하지 않고도 지운다”지만, 검증은 비쌌다. Google Research는 2026년 6월 10일 Regularized f-Divergence Kernel Tests를 공개하며 일부 privacy violation을 기존 수백만 샘플 대신 수천 샘플로 탐지했다고 밝혔다.
정밀 위치정보 판매를 막는 주 단위 개인정보 법안이 매사추세츠 하원에서 146-0으로 통과했다. 100,000명 이상 소비자 데이터를 다루는 기업이 적용 대상이라 광고·앱·데이터 브로커 업계의 데이터 거래 방식에 직접 압력이 간다.
구글 크롬이 사용자 동의 없이 4GB 크기의 Gemini Nano 모델 가중치를 디바이스에 자동 설치하고 있다는 사실이 밝혀졌다. 삭제해도 재설치되며, GDPR 위반 소지와 함께 수십만 톤 규모의 탄소 배출 문제까지 제기됐다.
개인정보 필터링은 이제 보안 옵션이 아니라 AI 파이프라인의 기본 인프라다. OpenAI의 1.5B 오픈웨이트 Privacy Filter는 128,000토큰을 로컬에서 처리하고, 보정된 PII-Masking-300k에서 F1 97.43%를 제시했다.
Hacker News는 이 이슈를 “쿠키 없이도 세션이 이어 붙는” 종류의 프라이버시 사고로 받아들였다. Mozilla는 Firefox 150과 ESR 140.10.0에서 수정했다고 밝혔지만, Tor Browser의 New Identity까지 흔들린다는 점이 토론을 키웠다.