LLM X/Twitter
Meta Muse Spark 1.3, 도구 호출 20%·토큰 25% 줄이고 장기 에이전트 강화
Meta의 Muse Spark 1.3이 이전 버전보다 도구 호출을 약 20%, 토큰 사용을 약 25% 줄이면서 장기 코딩·에이전트 작업을 강화했다. 모호한 지시에는 질문하고 중대한 행동 전에는 확인하는 방식으로 작업 지속성과 통제 가능성을 함께 높였으며, 공개 가중치도 예고했다.
2분 소요 1 조회
태그
#efficiency 태그가 달린 기사
Meta의 Muse Spark 1.3이 이전 버전보다 도구 호출을 약 20%, 토큰 사용을 약 25% 줄이면서 장기 코딩·에이전트 작업을 강화했다. 모호한 지시에는 질문하고 중대한 행동 전에는 확인하는 방식으로 작업 지속성과 통제 가능성을 함께 높였으며, 공개 가중치도 예고했다.
Hacker News에 올라온 Prism ML의 1-Bit Bonsai는 1.15GB 8B model부터 iPhone급 1.7B model까지, 1-bit weight로 edge inference economics를 다시 쓰겠다는 시도다. 핵심은 parameter count보다 intelligence density와 hardware fit을 전면에 내세운 점이다.
2026년 3월 9일 제출된 arXiv 논문 Ares는 multi-step LLM agent에서 단계별 reasoning effort를 동적으로 조절하는 방식을 제안했다. 저자들은 fixed high-effort 대비 reasoning token 사용량을 최대 52.7% 줄이면서 성공률 저하는 작았다고 보고했다.
DeepSeek가 mHC(Manifold-Constrained Hyper-Connections) 아키텍처를 발표하며 트랜스포머의 훈련 불안정성 문제를 해결했다. 6-7% 연산 오버헤드만으로 안정적인 대규모 모델 훈련이 가능해졌다.