Claude Code 기본 도구 선택, 2,430회 벤치마크가 HN에서 논쟁 촉발
Hacker News에서 Claude Code 2,430회 실행 데이터가 공유되며 build-vs-buy 패턴과 기본 스택 편향, 개발팀 거버넌스 이슈가 집중적으로 논의됐다.
카테고리
Insights의 LLM 기사
Hacker News에서 Claude Code 2,430회 실행 데이터가 공유되며 build-vs-buy 패턴과 기본 스택 편향, 개발팀 거버넌스 이슈가 집중적으로 논의됐다.
Google DeepMind는 2026년 2월 19일 Gemini 3.1 Pro를 발표했다. 회사는 ARC-AGI-2에서 77.1% 검증 점수를 제시하며, 개발자·기업·일반 사용자 채널에 동시 롤아웃한다고 밝혔다.
Microsoft Azure는 X를 통해 Microsoft Foundry에서 GPT-Realtime-1.5, GPT-Audio-1.5, GPT-5.3-Codex를 사용할 수 있다고 발표했다. 저지연 음성 인터랙션과 장시간 엔지니어링 워크플로를 핵심 사용 시나리오로 제시했다.
높은 반응을 얻은 LocalLLaMA 후속 실험 글은 Qwen3.5-35B-A3B를 RTX 5080 환경에서 Q4_K_M, KV q8_0, 배치 플래그 없는 --fit 구성으로 운용할 때 가장 실용적인 결과를 제시했다.
Hacker News에서 주목받은 Mendral 글은 ClickHouse 위 SQL 인터페이스를 사용해 LLM 에이전트가 수십억 로그 라인 규모의 CI 장애 원인을 추적하는 방식을 공개했다.
OpenAI와 Figma가 Figma Make와 OpenAI Codex 워크플로를 연결하는 협력을 발표했다. 양사는 프롬프트-프로토타입-프로덕션 코드 전환 시간을 줄이는 것을 핵심 가치로 제시했다.
r/artificial에서 주목받은 보안 연구는 zero-width/Unicode Tags를 이용한 숨은 지시가 도구 사용형 LLM 에이전트에 미치는 영향을 분석했다. 공개 요약은 5개 모델, 8,308개 출력 평가를 제시한다.
Anthropic이 2026년 2월 18일 Claude Opus 4.6과 Sonnet 4.6을 발표했다. 두 모델은 즉시 응답과 extended thinking을 모두 지원하는 하이브리드 구조를 유지하면서, 코딩 신뢰성과 장기 추론 안정성을 개선했다.
OpenAI와 Snowflake가 2026년 2월 2일 확장 파트너십을 발표하고, OpenAI 모델을 Snowflake Cortex AI에 직접 통합한다고 밝혔다. 기업은 기존 데이터 거버넌스를 유지한 채 생성형 AI 워크로드를 SQL과 Python 기반으로 운영할 수 있게 된다.
Google DeepMind는 2026년 2월 26일 X에서 Nano Banana 2가 지시문을 데이터 중심 인포그래픽과 교육용 다이어그램으로 변환할 수 있다고 밝혔다. 게시물은 약 3만 조회를 기록했다.
Perplexity는 2026-02-26 X에서 `pplx-embed-v1`와 `pplx-embed-context-v1` 출시를 발표했다. 0.6B/4B 구성, INT8/Binary 출력, retrieval 중심 benchmark 수치가 핵심이다.
r/LocalLLaMA의 게시물은 144M 규모 Spiking Neural Network 언어모델을 FineWeb-Edu로 from scratch 학습했다는 실험 결과를 공유했다. 작성자는 97-98% inference sparsity, STDP 기반 online learning, GPT-2 Small 대비 주제 유지 특성, 그리고 아직 높은 loss(4.5) 등 한계를 동시에 공개했다.