본문으로 건너뛰기

카테고리

LLM

Insights의 LLM 기사

RSS 피드
LLM X/Twitter

GPT-6 Astra, Pro·Enterprise·API 전면 개방과 불투명 추론 논란

OpenAI가 9월 4일 GPT-6 Astra를 ChatGPT Pro, Enterprise, Business Premium 전 사용자와 API에 공개했다. 컴퓨터 사용·소프트웨어 엔지니어링 최고 성능을 주장하지만 추론 과정을 외부에서 관찰하기 어려운 '불투명 재귀' 방식을 도입해 안전성 우려도 제기됐다.

1분 소요 2 조회
LLM X/Twitter

GitHub Copilot, GPT-6 Astra 전면 도입…10개 개발 환경서 장기 자율 코딩 지원

GPT-6 Astra가 GitHub Copilot의 10개 개발 환경에 일반 제공되며 장시간 자율 코딩 경쟁이 실제 도구 단계로 들어섰다. Pro+·Max·Business·Enterprise 등 4개 요금제가 대상이고 기업 관리자는 모델 정책으로 접근을 통제하며 배포는 계정별로 점진 진행된다.

2분 소요 2 조회
LLM X/Twitter

Meta Muse Spark 1.3, 도구 호출 20%·토큰 25% 줄이고 장기 에이전트 강화

Meta의 Muse Spark 1.3이 이전 버전보다 도구 호출을 약 20%, 토큰 사용을 약 25% 줄이면서 장기 코딩·에이전트 작업을 강화했다. 모호한 지시에는 질문하고 중대한 행동 전에는 확인하는 방식으로 작업 지속성과 통제 가능성을 함께 높였으며, 공개 가중치도 예고했다.

2분 소요 1 조회
LLM X/Twitter

Gemini 3.8 Flash·Cyber 출시, Chrome 유효 패치 2.6배·취약점 성공률 70% 돌파

Google DeepMind이 Gemini 3.8 Flash와 보안 특화 Cyber 모델을 내놨다. Cyber는 내부 20개 언어 취약점 평가에서 성공률 70%를 넘었고, Chrome 코드에서는 대형 상용 모델보다 올바른 패치를 2.6배 더 많이 만들었다. 범용 모델의 도입 가격은 3.7과 같다.

2분 소요 2 조회
LLM X/Twitter

Claude Fable 5.1·Mythos 5.1 공개, 캐시 비용 75% 낮추고 이중 안전 등급화

Anthropic이 같은 기반 모델을 일반용 Fable 5.1과 검증 기관용 Mythos 5.1로 나눴다. 캐시 읽기 비용은 75% 내려가고 에이전트형 작업 비용은 최대 약 45% 줄어드는 한편, 생물학 안전장치의 정상 요청 개입은 85% 감소했다. Fable은 API와 주요 클라우드에도 제공된다.

2분 소요 2 조회