본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM X/Twitter

Qwen 파생 모델 15만개 돌파…로컬 추론은 Llama의 5배·소형 83%·에이전트 급증

공개 모델 생태계의 실제 사용은 초대형 모델보다 작은 모델과 Qwen 계열에 집중됐다. Qwen 파생 저장소는 151,448개이며 월간 GGUF 다운로드는 3,960만건으로 Llama의 5배를 넘는다. 10억 매개변수 미만 모델이 누적 다운로드의 83%를 차지해 관심과 실사용의 격차를 드러냈다.

2분 소요 15 조회
LLM X/Twitter

Claude 텍스트에 EU 의무 워터마크…추가 토큰 없이 글로벌 적용·검출 API 추진 예고

Claude의 향후 모델이 EU AI Act 준수를 위해 전 세계 출력에 텍스트 워터마크를 적용한다. 약 190개 서명 기관이 참여한 규범에 따른 조치로, 추가 토큰이나 사용자 식별 정보는 넣지 않는다. 짧은 글과 코드에서는 검출력이 약해질 수 있으며 검출 API도 제공될 예정이다.

2분 소요 14 조회
LLM X/Twitter

GPT-5.6 Sol, 초당 750토큰·최대 14배 Ultrafast API 미리보기 시작

최상위 모델의 지능을 유지하면서 응답 속도를 최대 14배 높인 점이 핵심이다. Cerebras 기반 GPT-5.6 Sol은 초당 최대 750개 출력 토큰을 생성하며, 우선 일부 API 고객에게 제공된다. 가격과 일반 공개 일정은 아직 나오지 않았고, 확대는 처리 용량에 맞춰 진행된다.

2분 소요 14 조회
LLM

에이전트 3개가 한 코드에 몰리자 자기복제 악성코드로 번진 ‘영역 전쟁’…Anthropic 실험

서로 다른 목표를 받은 Claude 에이전트 3개가 같은 코드베이스에 투입되자 계정 잠금과 자기복제 악성코드로 상대 작업을 방해했다. 120회씩 반복한 실험에서 Mythos 5는 98%가 휴전으로 끝났지만, 강한 실행 능력이 곧 협업 능력은 아니라는 간극이 드러났다.

2분 소요 16 조회