Meta Muse Image, Instagram·WhatsApp까지 들어온 agentic 이미지 모델
Original: Introducing Muse Image and Muse Video View original →
이미지 생성이 채팅창 실험을 넘어 Instagram Stories와 WhatsApp 안으로 들어왔다. Meta의 Muse Image 공개에서 눈에 띄는 부분은 “더 예쁜 그림”보다 배포면이다. Meta AI 앱, meta.ai, 미국 Instagram Stories, 일부 국가의 WhatsApp에서 바로 쓰이기 시작했고 Facebook 적용도 예고됐다.
Muse Image는 프롬프트를 곧장 픽셀로 바꾸는 모델이라기보다 도구를 쓰는 이미지 에이전트에 가깝다. Meta는 모델이 검색을 통해 최신 사건이나 실재 사물을 더 정확히 반영하고, 코드를 작성·실행해 그래프와 QR 코드 같은 구조적 이미지를 맞추며, 생성 결과를 스스로 고쳐 나간다고 설명했다. 같은 계열의 Muse Spark와도 도구와 계획을 공유한다.
성능 수치도 공개됐다. Meta는 2026년 7월 5일 기준 Arena human-preference Elo에서 Muse Image가 text-to-image, single-image editing, multi-image editing 세 부문 모두 2위라고 밝혔다. 함께 공개된 Muse Video는 아직 미리보기 단계지만 text-to-video Arena에서 3위라고 적었다. Muse Video는 같은 사전학습 기반을 쓰며, native audio를 지원하지만 오디오-비디오 동기화와 빠른 물리 움직임은 개선 과제로 남겼다.
또 하나의 쟁점은 출처 표시다. Muse Image에는 보이지 않는 워터마킹 시스템인 Content Seal이 붙고, Meta AI 앱과 meta.ai에서 만든 이미지는 크롭, 압축, 리사이즈, 스크린샷 뒤에도 신호가 유지되도록 설계됐다. Meta는 이미지용 감지 도구를 미리보기로 내놨고 비디오에도 확장할 계획이다. 생성 품질 경쟁만큼이나, 소셜 피드 안에서 AI 이미지를 구분하는 체계가 실제 사용의 관문이 되고 있다.
Related Articles
시각 생성 모델 논의가 이미지 품질 비교를 넘어, 영상·소리·행동 예측을 같은 backbone에 넣을 수 있느냐로 옮겨갔다.
오픈 영상 생성 스택이 더 넓어지고 있다. MiniMax H3는 33B 파라미터 모델로 텍스트·이미지·참조 입력을 받아 4~15초 영상과 32kHz 스테레오 오디오를 생성한다.
세무 신고 7,000건을 98% 정확도로 처리한 운영 성과가 $2B 투자로 이어졌다. 기업가치 $12B를 인정받은 Thrive Holdings는 회계·IT를 넘어 데이터센터와 전력 시설의 인허가 업무까지 AI 적용 범위를 넓힌다.