본문으로 건너뛰기

태그

#inference

#inference 태그가 달린 기사

RSS 피드
LLM X/Twitter

카르파티: LLM 메모리·연산 최적화의 핵심 — SRAM vs DRAM 트레이드오프

AI 연구자 안드레이 카르파티가 LLM 시대의 핵심 기술 과제로 메모리와 연산 자원의 최적 조합을 제시했다. 온칩 SRAM과 외부 DRAM의 트레이드오프를 이해하고 추론·훈련 워크플로우에서 최고의 처리량·지연시간·비용 효율을 달성하는 것이 현재 가장 흥미로운 기술적 과제라고 강조했다.

1분 소요 42 조회
LLM 레딧

Taalas: LLM을 실리콘에 직접 구워 초당 17,000 토큰 달성

스타트업 Taalas가 LLM의 가중치와 모델 아키텍처를 단일 실리콘 칩에 직접 구워, 초당 17,000 토큰 이상과 1밀리초 미만의 지연 시간을 달성했다고 주장합니다. Reddit r/singularity에서 814점을 받으며 AI 하드웨어 혁신 논의를 촉발했습니다.

1분 소요 49 조회