본문으로 건너뛰기

태그

#infrastructure

#infrastructure 태그가 달린 기사

RSS 피드
AI X/Twitter

DeepMind 4개 지역 12B 분산 훈련, 동기식 병목을 20배 속도로 돌파

Google DeepMind의 새 훈련 구조가 중요한 이유는 데이터센터 경계 자체가 최전선 병목이 되고 있기 때문이다. Decoupled DiLoCo는 2-5Gbps 광역 링크 위에서 4개 미국 지역에 걸쳐 12B Gemma 모델을 학습했고, 기존 동기화 방식보다 20배 넘게 빠르면서 평균 정확도는 64.1%로 기준선 64.4%에 거의 붙었다.

1분 소요 39 조회
AI

Anthropic, Google·Broadcom과 multi-gigawatt TPU 계약 체결

Anthropic는 April 6, 2026에 Google과 Broadcom으로부터 2027 시작 예정인 next-generation TPU capacity를 multi-gigawatt 단위로 확보했다고 밝혔다. run-rate revenue가 $30 billion을 넘고 million-dollar customers가 February 이후 두 배로 늘어난 상황에서, 이번 계약은 infrastructure scale과 demand surge를 함께 보여준다.

2분 소요 53 조회
AI

Microsoft, 태국에 US$1 billion 이상 투자… cloud·AI 인프라와 디지털 인재 육성 확대

Microsoft는 2026년부터 2028년까지 태국 cloud·AI 인프라에 US$1 billion 이상을 투자하고, 정책 협력과 workforce development까지 묶은 장기 계획을 공개했다. Bangkok 방문에서 공공부문 규제 협력, aCommerce 기반 generative AI 실증, Digital Council of Thailand와의 인재·startup 논의를 함께 제시했다.

2분 소요 46 조회
LLM X/Twitter

Anthropic, Managed Agents 설계 공개... 장기 실행 agent를 session·harness·sandbox로 분리

Anthropic는 2026년 4월 8일 X에서 Claude Platform용 장기 실행 agent 서비스인 Managed Agents의 설계를 설명하는 engineering post를 소개했다. Anthropic는 session, harness, sandbox를 분리해 failure 복구와 고객 인프라 연결, security boundary를 개선했다고 설명한다.

1분 소요 53 조회
AI X/Twitter

Cloudflare, AI bot traffic 주 100억 요청 돌파에 CDN cache 재설계 필요성 제기

Cloudflare는 2026년 4월 2일 AI bot traffic이 주당 100억 요청을 넘어서면서 CDN cache 설계 전제가 바뀌고 있다고 밝혔다. 회사는 human과 AI가 섞인 workload에서 SEIVE·S3FIFO 같은 AI-aware replacement policy와 장기적으로는 AI 전용 cache tier가 필요할 수 있다고 설명했다.

2분 소요 49 조회
AI

AWS·NVIDIA, 1 million GPU와 Bedrock integration으로 AI stack 확대

AWS는 2026년 3월 16일 NVIDIA와의 협력을 chip과 networking을 넘어 software, data movement, Amazon Bedrock model service까지 확대한다고 밝혔다. 양사는 2026년부터 AWS region 전반에 1 million개가 넘는 GPU를 제공하고 Blackwell, Nemotron, NIXL integration을 production AI workload에 맞춰 확장할 계획이다.

2분 소요 38 조회