Hacker News가 주목한 최신 LLM architecture 시각 레퍼런스
Sebastian Raschka의 LLM Architecture Gallery는 최근 open model 계열을 한 페이지의 비교 가능한 다이어그램으로 묶어 dense, MoE, hybrid design 차이를 빠르게 파악하게 해 준다고 HN에서 호응을 얻었다.
태그
#open-models 태그가 달린 기사
Sebastian Raschka의 LLM Architecture Gallery는 최근 open model 계열을 한 페이지의 비교 가능한 다이어그램으로 묶어 dense, MoE, hybrid design 차이를 빠르게 파악하게 해 준다고 HN에서 호응을 얻었다.
3월 15일 LocalLLaMA에서 높은 반응을 얻은 Nemotron license thread는 model release에서 weights만큼 중요한 것이 license wording임을 다시 보여 줬다. 공식 NVIDIA Nemotron Model License와 이전 Open Model License를 비교하면, community가 주목한 포인트는 예전 guardrail termination clause와 Trustworthy AI 참조가 사라지고, 대신 NOTICE 중심의 attribution 구조가 더 전면으로 나온 점이었다.
2026년 3월 15일 LocalLLaMA 게시물은 Hugging Face model card commit과 NVIDIA license 페이지를 근거로 Nemotron Super 3가 기존 NVIDIA Open Model License에서 NVIDIA Nemotron Open Model License로 이동했음을 짚었다.
r/MachineLearning에서는 가중치 변경 없이 중간 7개 층 블록만 복제해 leaderboard 성능을 끌어올렸다는 실험 노트가 큰 관심을 받고 있다.
NVIDIA AI Developer는 2026년 3월 11일 Nemotron 3 Super를 공개하며, 12B active parameters를 사용하는 오픈 120B-parameter hybrid MoE 모델과 native 1M-token context를 강조했다. NVIDIA는 이 모델이 이전 Nemotron Super 대비 최대 5배 높은 throughput으로 agentic workload를 겨냥한다고 설명했다.
Microsoft는 Fireworks AI가 Microsoft Foundry에 들어오면서 Azure에서 high-performance, low-latency open model inference를 제공한다고 밝혔다. day-zero access, custom model 반입, enterprise control을 한곳에서 제공하는 것이 핵심 메시지다.
LocalLLaMA에서 크게 주목받은 Sarvam AI의 발표는 Apache 2.0 기반의 reasoning model인 Sarvam 30B와 Sarvam 105B를 공개한다. 회사는 두 모델이 India에서 scratch부터 학습됐고, Mixture-of-Experts 구조를 바탕으로 reasoning, coding, agentic workflow, Indian-language 성능을 겨냥했다고 설명한다.
Mistral이 Apache 2.0 기반의 멀티모달 오픈 모델군 Mistral 3를 발표했다. 14B, 8B, 3B dense 모델과 41B active, 675B total 규모의 Mistral Large 3를 함께 제시했다.
NVIDIA는 2026년 1월 5일 Nemotron, Cosmos, Alpamayo, Isaac GR00T, Clara를 포함한 오픈 모델·데이터·도구 확장을 발표했다. 회사는 10 trillion 언어 토큰과 100 terabytes 차량 센서 데이터를 포함한 대규모 오픈 자산을 제시하며 enterprise AI 개발 속도와 배포 효율 개선을 강조했다.
r/LocalLLaMA에서 높은 반응을 얻은 MiniMax-M2.5 게시글은 모델의 Hugging Face 공개를 중심으로 확산됐다. 모델 카드에는 에이전트형 코딩/검색 성능, 비용, 배포 속도 관련 수치가 제시돼 있다.
LocalLLaMA 토론에서 공유된 SWE-rebench 1월 결과는 Claude Code 선두 속에 상위 모델 격차 축소와 오픈 모델 추격을 보여줬다.