섹션별 상세
Meta Superintelligence Labs는 지난 9개월간 AI 스택을 완전히 재구축하여 Muse Spark 모델을 개발했다. 이 모델은 Muse 시리즈의 첫 번째 단계로, 작고 빠른 속도를 유지하면서도 복잡한 과학 및 수학적 추론을 수행할 수 있는 기초를 제공한다. 현재 Meta AI 앱과 웹사이트에 적용되어 복잡한 추론 작업과 멀티모달 작업을 지원한다.
근거
- Muse Spark는 과학, 수학, 건강 분야의 복잡한 질문을 추론할 수 있도록 설계되었다. — A New Model: Muse Spark 섹션
Meta AI 앱에 'Instant' 및 'Thinking' 모드가 도입되어 작업의 복잡도에 따라 최적화된 처리가 가능하다. 특히 복잡한 질문에 대해 여러 개의 서브에이전트를 병렬로 실행하여 각기 다른 세부 과제를 동시에 해결하는 구조를 갖췄다. 예를 들어 가족 여행 계획 시 일정 작성, 장소 비교, 활동 검색을 별도의 에이전트가 동시에 수행하여 더 빠르고 정확한 답변을 도출한다.

근거
- Meta AI는 여러 서브에이전트를 병렬로 실행하여 복잡한 질문을 처리할 수 있다. — What’s Changed With Meta AI 섹션
Muse Spark의 강력한 멀티모달 인지 기능은 텍스트 입력을 넘어 시각적 세계를 직접 이해하도록 설계됐다. 사용자가 공항 스낵 코너 사진을 찍으면 AI가 단백질 함량을 기준으로 순위를 매기거나, 제품을 스캔하여 대안 제품과 비교해주는 식의 상호작용이 가능하다. 이러한 시각적 이해 능력은 향후 AI 글래스와 결합되어 현실 세계의 맥락을 파악하는 데 핵심적인 역할을 수행한다.

건강 및 비주얼 코딩 분야에서 특화된 기능을 제공하여 실질적인 사용자 가치를 창출한다. 의료진과의 협업을 통해 건강 관련 질문과 차트 분석 능력을 강화했으며, 프롬프트만으로 대시보드나 미니 게임을 제작할 수 있는 비주얼 코딩 기능을 지원한다. 제작된 결과물은 친구들과 즉시 공유할 수 있어 창작 도구로서의 활용도가 높다.

용어 해설
- 멀티모달 인지(Multimodal Perception)
- — 텍스트뿐만 아니라 이미지, 영상, 오디오 등 다양한 형태의 데이터를 동시에 받아들이고 이해하는 능력이다. AI가 사진 속 음식을 인식하거나 차트를 분석하여 정보를 제공하는 등 현실 세계의 시각 정보를 처리하는 핵심 기술이다.
- 서브에이전트(Subagent)
- — 하나의 복잡한 작업을 해결하기 위해 메인 AI 시스템이 병렬로 실행하는 하위 실행 단위이다. 예를 들어 여행 계획 시 일정 수립, 숙소 비교, 활동 검색을 각각의 서브에이전트가 동시에 수행하여 효율성을 높인다.
- 비주얼 코딩(Visual Coding)
- — 사용자의 자연어 프롬프트를 기반으로 웹사이트, 대시보드, 미니 게임 등 시각적인 결과물을 즉시 생성하는 기능이다. 코딩 지식 없이도 AI를 통해 인터랙티브한 디지털 콘텐츠를 직접 제작하고 공유할 수 있게 한다.
기술
- Muse Spark
- Meta AI
- Multimodal Perception
활용 사례
- 음식 사진을 통한 칼로리 및 영양소 추정
- 병렬 에이전트를 활용한 복잡한 여행 계획 수립
- 프롬프트 기반 미니 게임 및 웹 대시보드 제작
언급된 리소스
DemoMeta AI 공식 웹사이트
AI 분석 전체 내용 보기
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
원문 발행 2026. 04. 09.수집 2026. 04. 09.출처 타입 RSS
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
