HN 화제: LLVM 없이 AMD GFX11 바이너리를 만드는 C99 CUDA 컴파일러 BarraCUDA
Hacker News에서 주목받은 BarraCUDA는 CUDA `.cu` 코드를 LLVM 의존성 없이 AMD GFX11 `.hsaco`로 직접 변환하는 오픈소스 C99 컴파일러로 소개됐다.
카테고리
Insights의 LLM 기사
Hacker News에서 주목받은 BarraCUDA는 CUDA `.cu` 코드를 LLVM 의존성 없이 AMD GFX11 `.hsaco`로 직접 변환하는 오픈소스 C99 컴파일러로 소개됐다.
Hacker News 상위 글은 Peter Steinberger의 발표를 다뤘다. 그는 OpenAI 합류를 밝히는 동시에 OpenClaw를 독립 재단으로 전환해 오픈소스로 유지하겠다고 밝혔다.
r/LocalLLaMA의 고득점 스레드는 Hugging Face에 공개된 Qwen3.5-397B-A17B를 빠르게 확산시켰고, 모델 카드의 397B/17B 구조와 최대 약 1M 토큰 확장 컨텍스트가 핵심 논점으로 부상했다.
Hacker News에서 주목받은 arXiv:2602.11988은 AGENTS.md 같은 저장소 컨텍스트 파일이 코딩 에이전트의 작업 성공률을 오히려 낮추고 추론 비용은 20% 이상 늘릴 수 있다고 보고했다.
OpenAI는 2026년 2월 12일 GPT-5.3 Codex Spark를 발표하며 코드 생성·수정 워크로드에서 성능과 비용의 균형을 강조했습니다. 회사 발표 기준으로 지연 시간과 토큰 비용을 낮추면서 SWE-bench Verified 등 주요 지표를 제시했습니다.
OpenAI가 2026년 2월 12일 ChatGPT의 ‘deep research’를 발표했습니다. o3 기반 에이전트가 여러 웹 소스를 순차적으로 탐색하고 인용이 포함된 보고서를 생성하는 기능으로, 고난도 조사 업무의 자동화를 겨냥합니다.
r/LocalLLaMA의 Qwen3.5 릴리스 글은 점수 123, 댓글 13으로 빠르게 확산되며 오픈 웨이트 대형 모델 수요를 다시 확인시켰습니다. 링크된 모델 카드에는 397B total, 17B activated, 262,144 native context 등 구체 스펙이 공개됐습니다.
Hacker News에서 102점으로 상위권에 오른 Docker의 NanoClaw 샌드박스 가이드는, AI 에이전트를 호스트와 분리해 운영하는 실무 패턴을 단계별로 보여줍니다. 특히 파일시스템 격리와 프록시 기반 API 키 주입을 결합한 점이 핵심입니다.
r/singularity의 인기 글은 Google의 Gemini 3 Deep Think 대규모 업데이트를 공유했다. 공지에는 HLE 48.4%(no tools), ARC-AGI-2 84.6%, Codeforces Elo 3455 등 핵심 지표와 API early access 계획이 포함됐다.
Hacker News에서 주목받은 SkillsBench 논문은 86개 태스크·11개 도메인에서 Agent Skill의 실제 효용을 비교했다. curated skill은 평균 통과율을 크게 끌어올렸지만, 모델이 직접 만든 skill은 평균 개선 효과를 보이지 않았다.
Google DeepMind가 Gemma Scope 2를 공개하며 Gemma 3(270M~27B) 전 모델에 대한 interpretability 연구 범위를 확대했다. 회사는 약 110 Petabytes 데이터 저장과 1 trillion+ 파라미터 학습이 투입된 대규모 오픈소스 릴리스라고 밝혔다.
r/LocalLLaMA에서 높은 반응을 얻은 MiniMax-M2.5 게시글은 모델의 Hugging Face 공개를 중심으로 확산됐다. 모델 카드에는 에이전트형 코딩/검색 성능, 비용, 배포 속도 관련 수치가 제시돼 있다.