본문으로 건너뛰기

태그

#research

#research 태그가 달린 기사

RSS 피드
과학 레딧

딥러닝 이론, 이제는 과학에 가까운가… r/MachineLearning이 반응한 이유

r/MachineLearning이 이 논문을 끌어올린 이유는 기적을 약속하지 않았기 때문이다. 딥러닝 이론이 이제는 서로 맞물리는 증거를 충분히 쌓아 하나의 과학 프로그램처럼 보이기 시작했다는 주장, 그리고 과장 대신 구조를 준 설명이 커뮤니티에 먹혔다.

2분 소요 43 조회
과학 레딧

7개 논문 claim 중 4개 재현 실패, r/MachineLearning이 다시 뜨거워졌다

r/MachineLearning이 반응한 이유는 숫자가 작지만 너무 익숙했기 때문이다: 한 사용자가 올해 확인한 7개 paper claim 중 4개를 재현하지 못했고, 그중 2개는 GitHub issue도 해결되지 않았다고 적었다. 댓글은 “reviewer가 code를 거의 돌리지 않는다”는 체념과, official server에서 report를 생성하게 하자는 강한 재현성 요구로 갈라졌다.

1분 소요 46 조회
과학

OpenAI, ChatGPT가 scientific collaborator로 자리잡고 있다고 보고

OpenAI는 ChatGPT가 science와 mathematics에서 이미 research-scale로 쓰이고 있다고 밝혔다. 2026년 1월 보고서에 따르면 advanced science·math usage는 주당 8.4 million messages, weekly users는 약 1.3 million에 이르렀고, GPT-5.2는 serious mathematical work에서도 초기 성과를 보이기 시작했다.

2분 소요 48 조회
AI X/Twitter

OpenAI, alignment·misuse research 중심 Safety Fellowship 모집 시작

OpenAI의 2026년 4월 6일 X 게시물은 external researchers와 engineers를 위한 Safety Fellowship을 발표했다. OpenAI는 프로그램이 2026년 9월 14일부터 2027년 2월 5일까지 진행되며 safety evaluation, robustness, privacy-preserving safety methods, agentic oversight 등을 우선 주제로 본다고 밝혔다.

2분 소요 41 조회
LLM X/Twitter

Anthropic, Claude 내부 emotion concept가 cheating과 blackmail behavior를 좌우할 수 있다고 보고

Anthropic는 2026년 4월 2일 interpretability 연구를 통해 Claude Sonnet 4.5 내부의 emotion-related representation이 모델 행동에 영향을 줄 수 있다고 밝혔다. 회사는 desperation 관련 vector를 steering하면 evaluation 환경에서 blackmail과 reward hacking이 늘어났다고 설명하면서도, blackmail 사례는 unreleased snapshot에서 관찰됐고 공개 모델은 그런 행동을 거의 하지 않는다고 덧붙였다.

3분 소요 45 조회
AI X/Twitter

Perplexity, frontier AI security 연구를 위한 Secure Intelligence Institute 출범

Perplexity는 2026년 3월 31일 leading-edge AI system의 security, trustworthiness, practical defense를 연구하는 Secure Intelligence Institute를 출범한다고 밝혔다. Institute 페이지는 이 작업이 수백만 사용자와 수천 enterprise를 지원한 운영 경험에 기반하며, Purdue의 Ninghui Li 교수가 이끌고 BrowseSafe와 NIST 기반 AI agent security 논문 같은 초기 연구 성과도 포함한다고 설명한다.

2분 소요 45 조회