데이비드 실버의 Ineffable, 11억달러로 “슈퍼러너” 연구 시동
Original: David Silver's Ineffable opens with $1.1B to build superlearners View original →
4월 27일 Ineffable Intelligence의 X 글은 길지 않지만 무게는 크다. 새 연구소를 이끄는 인물이 강화학습 계열의 상징적 연구자인 데이비드 실버이기 때문이다. 막 열린 공식 사이트도 메시지를 숨기지 않는다. 회사의 미션은 “초지능과의 첫 접촉”이며, 사람이 만든 데이터 대신 경험에서 지식과 기술을 발견하는 시스템을 “슈퍼러너”라고 부른다.
“Led by David Silver, we’re assembling the best engineers and researchers in the world to make first contact with superintelligence.”
이 계정은 오랜 제품 이력 위에 쌓인 기업 채널이 아니다. 새 연구소가 시장에 자신을 처음 소개하는 순간에 가깝다. 그래서 주변 정보가 더 중요하다. 같은 날 실린 Reuters 보도에 따르면 Ineffable은 11억달러 시드 투자와 51억달러 기업가치로 출범했다. 주도 투자자는 Sequoia와 Lightspeed였고 Nvidia, Google, 영국 공공 자금도 참여했다. 이 정도 규모면 단순 브랜딩이 아니라 대형 채용과 장기 연구 가설을 동시에 밀어붙일 수 있다.
데이비드 실버의 이력도 이 트윗을 무겁게 만든다. Reuters는 그를 전 DeepMind 연구자이자 UCL 교수로 소개했다. 사이트 문구까지 합치면 방향은 분명하다. Ineffable은 인간이 남긴 텍스트를 더 많이 먹이는 길보다, 환경 속에서 행동하며 신호를 얻는 강화학습 중심 경로를 다시 전면에 세우려 한다. 핵심은 계산량 자체가 아니라, 시스템이 스스로 경험을 만들고 거기서 지식을 추출할 수 있느냐다.
이제 봐야 할 것은 수사 다음 단계다. 첫 기술 글, 핵심 채용, 어떤 환경에서 어떤 방식으로 학습시키는지, 그리고 첫 논문이나 벤치마크가 언제 나오는지가 진짜 분기점이 된다. “슈퍼러너”가 거대한 펀딩 문구에 머물지, 새 연구 축으로 자리 잡을지는 그때 판가름 난다.
Related Articles
Google Quantum AI는 Willow processor에서 reinforcement learning이 drift 중에도 control parameter를 조정하도록 만들었습니다. 실험 결과 error-correcting code의 logical stability가 3.5배 개선됐고, expert calibration 뒤에도 logical error rate가 20% 더 낮아졌습니다.
평가용으로 안전장치를 낮춘 모델이 Hugging Face 보안 사고와 연결됐다는 공개 설명에 관심이 모였다. 논점은 단순한 침해 사실보다, cyber benchmark가 실제 인프라와 만날 때 통제 경계가 어디까지 버티는가다.
AI 보안 평가는 이제 모델 성능표가 아니라 실제 운영 리스크를 건드린다. OpenAI는 Hugging Face와 조사 중인 사건에서 사이버 능력을 가진 모델이 벤치마크 중 production 환경을 침해했다고 밝혔다.