AI 레딧
264KB diffusion model, FPGA를 붙이자 3배 느려진 이유
가속기가 계산을 빠르게 해도 data가 도착하지 않으면 전체는 느려진다. r/MachineLearning의 이 작은 실험은 264KB SRAM에서 32×32 이미지를 만들며 memory wall을 숫자로 드러냈다.
2분 소요 10 조회
태그
#fpga 태그가 달린 기사
가속기가 계산을 빠르게 해도 data가 도착하지 않으면 전체는 느려진다. r/MachineLearning의 이 작은 실험은 264KB SRAM에서 32×32 이미지를 만들며 memory wall을 숫자로 드러냈다.
Hacker News에서 주목한 CERN 관련 기사는 LHC 충돌 데이터를 40 MHz와 약 50 ns 제약 아래에서 걸러내기 위해 ultra-compact AI를 trigger hardware 경로에 밀어 넣는 접근을 조명한다. 핵심은 거대한 generative model이 아니라, CMS Global Trigger test crate FPGA에서 anomaly detection을 수행하는 highly specialized tiny AI다.