AI 해커뉴스
67센트짜리 소형 transformer, ARC-AGI-1 44%의 의미
거대한 사전학습 모델 없이 1.5시간과 67센트로 ARC-AGI-1 44%를 기록한 실험에 관심이 모였다. 성적 자체보다 적은 표본으로 얼마나 빨리 학습할 수 있는지, 그리고 벤치마크 비용을 어떻게 비교해야 공정한지가 논점이다.
2분 소요
태그
#test-time-training 태그가 달린 기사
거대한 사전학습 모델 없이 1.5시간과 67센트로 ARC-AGI-1 44%를 기록한 실험에 관심이 모였다. 성적 자체보다 적은 표본으로 얼마나 빨리 학습할 수 있는지, 그리고 벤치마크 비용을 어떻게 비교해야 공정한지가 논점이다.