
Meta AI 공식 발표에 따르면 Meta Superintelligence Labs는 2026년 7월 7일 이미지 생성 모델 Muse Image를 출시하고 영상 생성 모델 Muse Video를 미리 공개했다. Meta는 두 모델이 자사 초지능 연구 조직에서 개발한 첫 미디어 생성 모델이라고 설명했다.
Muse Image는 텍스트 지시를 이미지로 바로 변환하는 방식에 머물지 않고, 필요한 경우 검색과 코드 실행 도구를 호출하는 에이전트형 이미지 생성 모델로 소개됐다. Meta는 이 모델이 참조 이미지를 조합하고, 편집 지시를 정밀하게 따르며, Instagram의 공개 맥락을 활용해 사회적·시각적 단서를 반영할 수 있다고 밝혔다.
발표에서 특히 강조된 부분은 도구 사용이다. Meta는 Muse Image가 강화학습 과정에서 그래프나 QR 코드처럼 정확성이 필요한 이미지를 만들기 위해 코드를 작성하고 실행하는 방법을 학습했다고 설명했다. 검색 도구는 최신 사건이나 실제 세계 지식이 필요한 프롬프트에서 시각 참고 자료와 사실 정보를 보강하는 데 쓰인다.
모델의 자기 개선 능력도 공개됐다. Meta에 따르면 Muse Image는 생성 결과를 스스로 점검하고, 작은 오류는 국소 편집으로 고치거나 더 큰 문제가 있을 때는 새 이미지를 다시 만드는 방식으로 결과를 개선한다. 회사는 이러한 행동이 별도 규칙으로 설계된 것이 아니라 보상 최적화 과정에서 나타났다고 설명했다.
Muse Video는 같은 사전학습 기반 위에서 개발된 영상 생성 모델이다. Meta는 Muse Video가 프롬프트 준수, 시각적 품질, 시간적 일관성에서 경쟁력 있는 성능을 보이며 네이티브 오디오 지원을 포함한다고 밝혔다. 다만 영상과 음성의 동기화, 빠른 움직임의 물리적 정확성은 계속 개선 중인 영역으로 언급했다.
제공 범위는 이미지와 영상이 다르다. Muse Image는 Meta AI 앱과 meta.ai, 미국 내 Instagram Stories, 일부 국가의 WhatsApp에서 사용할 수 있으며 Facebook에도 곧 적용될 예정이다. Muse Video는 아직 정식 제공이 아니라 크리에이터와 Meta AI를 대상으로 한 향후 제공 계획으로 공개됐다.
Meta는 생성 이미지의 출처 확인을 위한 Content Seal도 함께 제시했다. Muse Image로 만든 이미지는 Meta AI 앱과 meta.ai에서 보이지 않는 워터마크 신호를 포함하며, 회사는 이 신호가 자르기, 압축, 크기 변경, 스크린샷 이후에도 유지되도록 설계됐다고 설명했다. 이미지에 Content Seal이 포함됐는지 확인하는 탐지 도구도 프리뷰로 제공된다.
이번 발표는 이미지·영상 생성 경쟁이 단순 품질 경쟁에서 에이전트형 제작 흐름으로 이동하고 있음을 보여준다. 모델이 검색, 코드 실행, 자기 수정, 출처 검증 신호를 함께 다루기 시작하면서 생성형 미디어 도구는 창작 보조 도구를 넘어 복합 작업 환경에 가까워지고 있다. 동시에 실제 서비스 적용 과정에서는 저작권, 초상권, 합성 콘텐츠 표시, 플랫폼 내 안전장치가 계속 쟁점이 될 전망이다.
출처: Meta AI https://ai.meta.com/blog/introducing-muse-image-muse-video-msl/