미국 ChatGPT 사용자는 Apple Health와 지원 의료기록을 연결해 검사 결과와 활동 데이터를 대화 맥락에 넣을 수 있다. OpenAI는 매주 3억 명 이상이 건강 질문을 한다며, 연결 데이터는 foundation model 학습과 광고 타깃팅에 쓰지 않는다고 밝혔다.
미국 ChatGPT 사용자는 Apple Health와 지원 의료기록을 연결해 검사 결과와 활동 데이터를 대화 맥락에 넣을 수 있다. OpenAI는 매주 3억 명 이상이 건강 질문을 한다며, 연결 데이터는 foundation model 학습과 광고 타깃팅에 쓰지 않는다고 밝혔다.
LLM이 학습 데이터를 얼마나 암기하는지에 대해 NVIDIA가 ICML 논문을 공유했다. 핵심 수치는 parameter당 약 3.6 bits로, privacy와 scaling 논의를 사례가 아닌 용량 문제로 바꾼다.
숨은 Unicode marker 자체보다 개발자 도구가 이를 설명 없이 system context에 넣는 방식이 논점이다.
ServiceNow 연구진은 로컬 문서와 웹 검색을 오가는 deep research 에이전트가 사내 정보를 검색어 조각으로 흘릴 수 있음을 보였다. PA-DR 훈련은 전체 정보 유출률을 34.0%에서 9.9%로 낮췄지만, 성능만 올리는 훈련은 유출을 키웠다.
Machine unlearning의 약속은 “다시 학습하지 않고도 지운다”지만, 검증은 비쌌다. Google Research는 2026년 6월 10일 Regularized f-Divergence Kernel Tests를 공개하며 일부 privacy violation을 기존 수백만 샘플 대신 수천 샘플로 탐지했다고 밝혔다.
정밀 위치정보 판매를 막는 주 단위 개인정보 법안이 매사추세츠 하원에서 146-0으로 통과했다. 100,000명 이상 소비자 데이터를 다루는 기업이 적용 대상이라 광고·앱·데이터 브로커 업계의 데이터 거래 방식에 직접 압력이 간다.
구글 크롬이 사용자 동의 없이 4GB 크기의 Gemini Nano 모델 가중치를 디바이스에 자동 설치하고 있다는 사실이 밝혀졌다. 삭제해도 재설치되며, GDPR 위반 소지와 함께 수십만 톤 규모의 탄소 배출 문제까지 제기됐다.
개인정보 필터링은 이제 보안 옵션이 아니라 AI 파이프라인의 기본 인프라다. OpenAI의 1.5B 오픈웨이트 Privacy Filter는 128,000토큰을 로컬에서 처리하고, 보정된 PII-Masking-300k에서 F1 97.43%를 제시했다.
Hacker News는 이 이슈를 “쿠키 없이도 세션이 이어 붙는” 종류의 프라이버시 사고로 받아들였다. Mozilla는 Firefox 150과 ESR 140.10.0에서 수정했다고 밝혔지만, Tor Browser의 New Identity까지 흔들린다는 점이 토론을 키웠다.
HN의 관심은 telemetry 찬반보다 gh CLI가 CI/CD와 server 환경에서 움직일 때 opt-out이 얼마나 현실적인지에 쏠렸다.
HN이 뜨겁게 반응한 지점은 AI training 자체가 아니라, 업무용 기기에서 mouse movement와 keystroke가 데이터셋이 되는 순간의 신뢰 비용이다.
LocalLLaMA는 Claude identity verification을 단순한 account policy로 보지 않았다. local model, privacy control, 그리고 tool 접근 gate를 둘러싼 논쟁의 새 재료로 받아들였다.