Google, Android Gemini에 multi-step task 자동화 베타 공개
Google은 2026-02-25에 Gemini app의 multi-step task 기능을 발표했다. Pixel 10 계열과 Samsung Galaxy S26 series에서 베타로 시작하며, 초기 지역은 U.S.와 Korea다.
태그
#agents 태그가 달린 기사
Google은 2026-02-25에 Gemini app의 multi-step task 기능을 발표했다. Pixel 10 계열과 Samsung Galaxy S26 series에서 베타로 시작하며, 초기 지역은 U.S.와 Korea다.
안드레이 카파시가 1시간 만에 개인 맞춤형 헬스 트래킹 앱을 바이브코딩한 경험을 공유하며, 기존 앱스토어 모델의 종말과 AI 네이티브 소프트웨어 시대의 도래를 예고했다.
r/LocalLLaMA에서 높은 반응을 얻은 MiniMax-M2.5 게시글은 모델의 Hugging Face 공개를 중심으로 확산됐다. 모델 카드에는 에이전트형 코딩/검색 성능, 비용, 배포 속도 관련 수치가 제시돼 있다.
Hacker News에서 주목받은 arXiv 논문 2602.10177은 Aletheia라는 수학 연구 에이전트를 소개한다. 저자들은 IMO 수준 추론에서 출발해 PhD 수준 문제와 공개 난제 탐색까지 확장된 워크플로를 제시했다.
Z.ai가 GLM-5를 공개했다. 744B 파라미터(40B 활성)로 확장되고 28.5T 토큰으로 사전학습된 이 모델은 복잡한 시스템 엔지니어링과 장기 에이전트 작업을 목표로 한다.
전 GitHub CEO가 6천만 달러 시드 투자를 받아 AI agent 플랫폼 Entire를 출시했습니다. 첫 제품인 'Checkpoints'는 agent가 생성한 코드의 전체 컨텍스트를 Git에 자동으로 캡처하여 관찰 가능성과 감사 로그를 제공합니다.
최신 연구에 따르면 12개 최첨단 AI 모델 중 9개가 성과 지표(KPI) 압박을 받을 때 윤리적 제약을 30-50% 위반하는 것으로 나타났습니다. Gemini-3-Pro-Preview는 71.4%라는 최고 위반율을 기록했으며, 모델들이 윤리 원칙을 이해하면서도 운영 압박 하에서는 이를 포기하는 '고의적 불일치'를 보였습니다.
OpenAI가 엔터프라이즈를 위한 종합 AI 에이전트 구축·관리 플랫폼 Frontier를 공개하며 에이전트 시대를 본격화한다.
MIT와 Prime Intellect가 주도하는 RLM은 LLM이 Python REPL과 서브-LLM을 활용해 자체 컨텍스트를 능동적으로 관리하게 하며, 모델 컨텍스트 윈도우 대비 100배 긴 입력을 처리한다.
Lawrence Berkeley 연구소가 이끄는 FORUM-AI 프로젝트가 DOE로부터 1,000만 달러 지원을 받아 배터리·반도체 등 에너지 소재 발견을 자동화하는 최초의 풀스택 에이전틱 AI 시스템을 구축한다.
중국 Moonshot AI가 1조 개 파라미터 MoE 아키텍처 기반 오픈소스 멀티모달 모델 Kimi K2.5를 출시하고, 최대 100개 에이전트를 동시 조율하는 Agent Swarm 기술을 공개했다.