2026년 9월 8일 공개된 메타의 개인 AI 에이전트 Muse를 정리했습니다. 주당 1억 토큰 무료 할당, 월 20달러·100달러 요금 보도, 심부름 3건 전부 결제 실패한 초기 테스트까지 발표문과 실제 확인된 것을 나눠 담았습니다.
메타 뮤즈 에이전트 핵심만 먼저 정리하면
지금 시점에서 메타 뮤즈 에이전트는 “맡기는 도구”가 아니라 “지켜보며 쓰는 도구”입니다. 메타는 2026년 9월 8일 뉴스룸에서 Muse를 공개하며 질문에 답하는 챗봇이 아니라 목표를 받아 계획을 세우고 실제 작업을 수행하는 에이전트라고 소개했습니다. 그런데 출시 직후 PYMNTS가 시킨 생활 심부름 3건(아마존 화장지 재주문, 도미노 피자 주문, Resy 예약)은 3건 모두 결제 단계까지 가지 못했습니다. 반대로 무료 구간은 유난히 큽니다. 마크 저커버그가 Threads에 직접 밝힌 무료 사용량은 주당 1억 토큰이고, Gizmodo 리뷰어가 코드 생성과 게임 제작을 연속으로 돌린 뒤에도 주간 할당의 약 11%만 썼습니다. 다만 출시 범위가 미국 한정이라 한국에서는 아직 쓸 수 없고, 한국 출시 시점과 원화 가격은 확인되지 않았습니다. 이 글은 메타 공식 발표문에 적힌 것과 독립 매체·분석 기관이 확인한 것을 나눠서, 무엇이 사실이고 무엇이 아직 미확인인지 정리한 것입니다.
Q1. 메타 뮤즈 에이전트는 정확히 무엇이고 기존 챗봇과 어떻게 다른가요
메타 뮤즈 에이전트는 대화창에 답을 써주는 도구가 아닙니다. 목표를 받아 계획을 세우고 웹에서 직접 작업을 수행하는 개인 AI 에이전트입니다. 제품 공식 명칭은 “MetaMuse”가 아니라 Muse이고, 이를 구동하는 모델은 별도로 Muse Spark라는 이름을 갖습니다. 검색할 때 두 이름이 섞여 나오는 이유가 여기에 있습니다.
구조적으로 가장 큰 차이는 실행 환경입니다. Muse는 Muse Secure VM이라는 전용 보안 가상머신 안에서 자체 브라우저로 동작합니다. 같은 머신에는 시스템 수준으로 분리된 Sentinel 에이전트가 따로 돌고 있고, Sentinel의 승인 없이는 Muse의 행위가 인터넷에 도달하지 않는 구조라고 메타는 설명했습니다. “생각하는 쪽”과 “내보내도 되는지 판단하는 쪽”을 분리해둔 셈입니다.
| 항목 | 메타 공식 발표 내용 | 확인일 |
|---|---|---|
| 공개일 | 2026년 9월 8일 | 메타 뉴스룸 |
| 구동 모델 | Muse Spark | 메타 뉴스룸 |
| 실행 환경 | Muse Secure VM(자체 브라우저 포함) | 메타 뉴스룸 |
| 안전 장치 | Sentinel 승인 없이는 인터넷 도달 불가 | 메타 뉴스룸 |
| 출시 지역 | 미국 | 메타 뉴스룸 |
| 채널 | iOS·Android 앱, muse.ai 웹 | 메타 뉴스룸 |
| 광고 연동 | 대화·VM 내 데이터를 광고 시스템과 공유하지 않음 | 메타 뉴스룸 |
메타는 Muse의 대화 내용과 VM 안의 데이터를 자사 광고 시스템과 공유하지 않는다고 명시했습니다. 메타라는 회사 특성상 이 항목이 가장 먼저 의심받을 지점인데, 발표문 단계에서는 선을 그었습니다. 다만 이 주장이 외부 보안 전문가의 검증을 거치지 않았다는 지적이 TechCrunch에서 나왔다는 점도 함께 봐야 합니다.
용어 풀이
1. 에이전트(Agent) — 사용자가 답이 아니라 목표를 주면, 스스로 단계를 나눠 실제 작업까지 수행하는 AI를 말합니다.
2. 가상머신(VM) — 실제 컴퓨터 안에 소프트웨어로 만든 별도의 컴퓨터로, 여기서 벌어진 일이 바깥 시스템에 직접 닿지 않게 막는 격리 장치입니다.
3. 토큰(Token) — AI가 글을 처리하는 최소 단위로, 한국어는 대략 한 글자에서 두 글자가 1토큰에 해당합니다.
Q2. 주당 1억 토큰 무료라는데 실제로 얼마나 쓸 수 있는 양인가요

체감으로 말하면 개인이 일주일 내내 붙잡고 써도 다 쓰기 어려운 양입니다. 이 수치는 메타 뉴스룸 본문이 아니라 저커버그 본인이 Threads에 올린 게시물에서 나왔고, SiliconANGLE 등 매체가 교차 확인했습니다.
실제 소모량을 가늠할 수 있는 유일한 공개 기록은 Gizmodo 리뷰입니다. 이 리뷰어는 코드 생성, 게임 제작, 웹사이트 제작 같은 창작 과제를 연속으로 시켰습니다. 첫 과제인 초상화 재생성 하나가 주간 할당의 약 6%를 썼고, 여러 과제를 다 돌린 뒤에도 누적 소모는 약 11% 수준에 머물렀습니다.
| 사용 기록 | 소모한 주간 할당 비율 | 출처 성격 |
|---|---|---|
| 첫 과제(초상화 재생성) 단독 | 약 6% | 매체 리뷰(1인 사례) |
| 다수 창작 과제 연속 수행 후 누적 | 약 11% | 매체 리뷰(1인 사례) |
여기서 주의할 점이 하나 있습니다. 이 비율은 리뷰어 한 명의 사용 기록이지 메타가 공식 발표한 평균 소모량이 아닙니다. 이미지 생성이 많은 작업과 긴 문서를 반복 처리하는 작업은 토큰 소모 패턴이 다르므로, 자신의 사용 패턴에 그대로 대입하기는 어렵습니다.
그럼에도 이 무료 구간이 의미 있는 이유는 경쟁 제품과의 대비 때문입니다. 유료 에이전트 기능을 쓰려면 보통 월 구독부터 시작해야 하는데, Muse는 돈을 내기 전에 충분히 시험해볼 여지를 크게 열어둔 쪽을 택했습니다. 단, 무료 티어도 결제카드 등록을 요구한다는 보도가 있으나 이는 메타 공식 문서에서 확인되지 않은 항목입니다.
Q3. 요금제는 얼마이고 ChatGPT·Gemini와 비교하면 어느 쪽이 유리한가요

먼저 짚어야 할 것은 메타 뉴스룸 원문에는 요금 숫자가 없다는 점입니다. 발표문에는 “무료 + 구독 플랜”이라는 표현만 있고, Power 월 20달러·Maximum 월 100달러라는 금액은 TechCrunch 등 매체 취재로만 확인된 값입니다. 이 두 숫자는 공식 가격표에 적힌 것이 아니라 보도 기반이므로 확인이 필요한 항목입니다.
| 서비스 | 요금(2026년 9월 기준) | 근거 등급 |
|---|---|---|
| Muse Power | 월 20달러 | 매체 보도(공식 미확인) |
| Muse Maximum | 월 100달러 | 매체 보도(공식 미확인) |
| ChatGPT Go / Plus | 월 8달러 / 20달러 | 가격 정리 매체(공식 미확인) |
| ChatGPT Pro | 월 100달러 / 200달러 | 가격 정리 매체(공식 미확인) |
| Google AI Plus | 월 7,500원 | 구글 공식 페이지 |
| Google AI Ultra 하위 | 월 119,000원 | 구글 공식 페이지 |
| Google AI Ultra 상위 | 월 300,000원 | 구글 공식 페이지 |
가격대만 보면 Muse의 20달러·100달러는 ChatGPT의 Plus·Pro 구간과 정면으로 겹칩니다. 차별점은 요금이 아니라 무료 구간의 크기에 있습니다. 반대로 구글 쪽은 브라우저 에이전트인 Project Mariner가 상위 Ultra 전용이라는 보도가 있어, 에이전트 기능에 진입하는 비용이 셋 중 가장 비싼 편입니다. 한국 기준 월 119,000원에서 300,000원 구간이라 개인이 시험 삼아 쓰기에는 부담이 큽니다.
다만 Muse는 미국에서만 출시돼 한국 사용자에게는 아직 가격 비교 자체가 실질적 의미를 갖기 어렵습니다. 한국 출시 시점과 원화 가격은 발표된 바가 없습니다.
Q4. 벤치마크 점수가 높다던데 그 점수의 모델을 제가 쓸 수 있나요

이 질문이 이번 발표에서 가장 중요한 지점입니다. 결론부터 말하면 메타가 공개한 스코어카드의 점수는 일반 사용자가 접근할 수 없는 조건에서 나온 값입니다.
메타 개발자 페이지의 Muse Spark 1.3 점수는 전부 max 추론 노력 조건으로 측정됐습니다. 그런데 독립 분석 기관 Artificial Analysis는 max 변형이 메타 파트너 대상 limited preview이고, 일반 사용 가능한 것은 xhigh라고 명시했습니다. 발표 자료의 숫자와 실제로 살 수 있는 모델이 다르다는 뜻입니다.
| 벤치마크 | Muse Spark 1.3 (max) | GPT 5.6 Sol (max) | Claude Opus 5 (max) |
|---|---|---|---|
| MRCR 256K–512K | 98.5 | — | — |
| MRCR 512K–1M | 98.1 | — | — |
| Terminal-Bench 2.1 | 88.8 | 88.8 | — |
| DeepSWE v1.1 | 75.4 | 73.0 | 74.0 |
| GDPVal-AA v2 | 64.9 | 45.4 | 65.7 |
| OSWorld 2.0 | 90.3 | 93.1 | 90.4 |
| SWEAtlas CodeBase | 59.4 | 53.5 | 52.7 |
표에서 보듯 메타 자체 자료조차 전 항목 1위를 주장하지 않습니다. GDPVal-AA v2는 Opus 5가 65.7로 위이고, OSWorld 2.0은 GPT 5.6 Sol이 93.1로 앞섭니다.
독립 지표에서는 격차가 더 분명합니다. Artificial Analysis 지능 지수 기준으로 Muse Spark 1.3은 max가 62, xhigh가 61이며, Claude Fable 5.1(max) 66, Claude Opus 5(max) 63보다 아래이고 GPT-5.6 Sol(max)·Grok 4.6(high)과 동점입니다. 더 중요한 것은 점수를 얻는 방식입니다. 같은 분석에 따르면 max의 높은 에이전트 점수는 턴 수와 추론 토큰을 더 많이 쓴 결과로, GDPval-AA v2에서 62%, Tau3-Bench Banking에서 28% 더 많이 추론했습니다. 같은 조건에서의 비교가 아니라는 얘기입니다.
API를 직접 쓸 계획이라면 가격도 두 갈래로 갈립니다. 표준 가격은 100만 토큰당 입력 1.25달러·캐시 입력 0.15달러·출력 4.25달러이고, 별도 Contributor 티어는 입력 0.10달러·캐시 0.002달러·출력 0.20달러입니다. 10배 이상 싼 쪽은 데이터가 제품 개선에 사용된다는 조건이 붙어 있어, 사내 데이터를 그대로 태우기에는 적절하지 않습니다. 일부 집계 사이트가 이 Contributor 가격을 대표 가격처럼 표기하고 있으니 비교할 때 주의가 필요합니다.
용어 풀이
1. 추론 노력(reasoning effort) — 답을 내기 전 모델이 얼마나 많이 생각할지 정하는 설정값으로, 높일수록 정확도는 오르지만 토큰 비용과 응답 시간이 함께 늘어납니다.
2. 컨텍스트 윈도우 — 모델이 한 번에 기억하고 참조할 수 있는 텍스트의 최대 분량이며, Muse Spark 1.3은 1M(1,048,576) 토큰입니다.
3. 캐시 입력 — 이전에 보낸 것과 동일한 입력을 재사용할 때 적용되는 할인 단가로, 반복 호출이 많은 서비스에서 비용을 크게 좌우합니다.
Q5. 개인 메일·결제 권한을 넘겨도 안전한가요

지금 시점에서는 신중하게 접근해야 하는 항목입니다. 이 제품의 성격 자체가 메일·캘린더·결제 접근 권한을 넘겨받아 대신 작업하는 구조라, 보안 문제는 성능 문제와 성격이 다릅니다.
메타는 앞서 설명한 Secure VM과 Sentinel 승인 게이트를 방어책으로 내세웠고, 메타 AI 제품 담당 VP Vishal Shah는 4월로 예정돼 있던 출시를 보안 작업 때문에 미뤘다고 밝혔습니다. 준비를 안 한 것은 아닙니다.
문제는 그 이후 보도된 내용입니다. Reuters가 확인한 내부 게시물에 따르면 출시 전 테스트 과정에서 가드레일 우회로 개인 iCloud 사진이 노출되는 사례가 있었고, 15분 뒤 페이지 갱신이 멈추거나 모니터링이 자동 해제되는 현상도 보고됐습니다. 메타 CTO Andrew Bosworth 본인이 반복 로그아웃을 겪었다고 적었다는 내용도 포함돼 있습니다. TechCrunch는 여기에 더해 메타의 보안 주장이 아직 외부 보안 전문가의 검증을 거치지 않았다고 지적했습니다.
| 우려 항목 | 메타가 내세운 대응 | 별도로 보도된 사실 |
|---|---|---|
| 데이터 유출 | Secure VM 격리, Sentinel 승인 게이트 | 내부 테스트에서 개인 사진 노출 사례 보고 |
| 광고 활용 | 대화·VM 데이터를 광고와 공유하지 않음 | 외부 검증 미실시 지적 |
| 안정성 | 출시를 4월에서 9월로 연기 | 15분 뒤 갱신 중단·모니터링 자동 해제 보고 |
메타는 보안 문서로 Muse Spark Safety Preparedness Report(arXiv:2606.12429)를 2026년 6월 12일 공개했습니다. 목차에는 프롬프트 인젝션 저항과 에이전트 위해 평가 항목이 들어 있지만, 구체적인 정량 수치는 이번 조사에서 추출하지 못해 확인이 필요한 상태입니다. 이용 연령이 18세 이상이라는 내용도 다수 매체에서 언급됐으나 공식 문서에서는 확인되지 않았습니다.
한 가지 더 짚어둘 것은 앞서 언급한 PYMNTS 테스트의 실패 원인입니다. 심부름 3건이 멈춘 이유는 모델의 추론 능력 부족이 아니라 자격증명 공유, Gmail·캘린더 개별 승인, Stripe Link 결제 경유 같은 연동 마찰이었습니다. 참고로 같은 아마존 재주문을 사람이 직접 하면 30초가 채 걸리지 않았습니다. Shop Pay·1Password 연동, AI 안경 지원, 종단간 암호화 기반 Muse Confidential VM은 모두 아직 나오지 않은 예정 항목입니다.
정리
메타 뮤즈 에이전트는 2026년 9월 8일 미국에서 공개된 개인 AI 에이전트입니다. 모델 성능만 보면 독립 지수 62점으로 프런티어 3위권에 붙었지만 그 점수는 일반 사용자가 쓸 수 없는 max 조건에서 나온 값입니다. 실질적 차별점은 성능이 아니라 주당 1억 토큰이라는 무료 할당 규모와 메타 앱 접점에 있습니다. 반면 출시 직후 생활 심부름 3건이 전부 결제에 실패했고, 내부 테스트에서 개인 사진 노출이 보고된 만큼 지금은 권한을 통째로 넘기기보다 지켜보며 결과를 확인하는 방식이 맞습니다. 한국 출시 시점과 원화 가격, 소비자 앱이 실제로 쓰는 Muse Spark 버전과 추론 노력 설정은 아직 공개되지 않았습니다.
참고 자료
조사 기준일: 2026년 09월 10일
본문의 수치는 아래 자료에서 확인한 것입니다. 제조사 공식 자료(T1)와 전문 매체 실측(T2)을 구분해 표기했습니다. 가격·공급 상황은 변동이 크므로 기준일 이후의 값은 다시 확인해야 합니다.
Tier 1
– Meta 뉴스룸, “Introducing Muse: The World’s First Personal AI Agent Built for Everyone” — https://about.fb.com/news/2026/09/introducing-muse-personal-ai-agent/ (확인 2026-09-10, 2회 fetch 교차확인)
– Meta for Developers, Muse Spark 모델 페이지(스펙·가격·스코어카드) — https://developer.meta.com/ai/models/muse-spark/ (확인 2026-09-10, 2회 fetch 교차확인)
– Mark Zuckerberg Threads 계정(주당 1억 토큰 무료 언급) — https://www.threads.com/@zuck (확인 2026-09-10)
– Muse Spark Safety Preparedness Report, arXiv:2606.12429 — https://arxiv.org/pdf/2606.12429 (확인 2026-09-10, 본문 수치 추출 실패)
– Google, Gemini 구독 요금 페이지(한국 원화) — https://gemini.google/subscriptions/ (확인 2026-09-10)
Tier 2
– Artificial Analysis, “Muse Spark 1.3: Meta reaches the frontier” — https://artificialanalysis.ai/articles/muse-spark-1-3 (확인 2026-09-10)
– Artificial Analysis, Muse Spark 모델 페이지 — https://artificialanalysis.ai/models/muse-spark (확인 2026-09-10, 구버전 페이지로 파싱 신뢰도 낮음)
– TechCrunch, “Meta debuts its Muse AI agent. Will consumers trust it?” — https://techcrunch.com/2026/09/08/meta-debuts-its-muse-ai-agent-will-consumers-trust-it/ (확인 2026-09-10)
– PYMNTS, “Meta’s Muse Can’t Order a Pizza Without Help” — https://www.pymnts.com/news/artificial-intelligence/2026/meta-muse-cannot-order-pizza-without-help (확인 2026-09-10)
– Gizmodo, Muse 무료 컴퓨트 하드코어 사용 리뷰 — https://gizmodo.com/metas-muse-let-me-waste-a-mind-boggling-amount-of-free-compute-on-nothing-in-particular-2000808945 (확인 2026-09-10)
– SiliconANGLE, “Meta debuts its ‘secure by design’ personal AI agent Muse” — https://siliconangle.com/2026/09/08/meta-debuts-its-secure-by-design-personal-ai-agent-muse/ (확인 2026-09-10)
– Forkast, Muse 보안 공시 문제(Reuters 보도 인용) — https://forkast.news/metas-muse-launches-as-the-biggest-cross-app-ai-agent-yet-with-a-security-disclosure-problem/ (확인 2026-09-10)
– TestingCatalog, Muse 클로즈드 알파·초대코드 — https://www.testingcatalog.com/metas-muse-agent-enters-closed-alpha-with-invite-codes/ (확인 2026-09-10)
– llm-stats, Muse Spark 1.3 스펙(Contributor 가격을 대표가로 표기) — https://llm-stats.com/models/muse-spark-1.3 (확인 2026-09-10)
– Axios, CNBC, Forbes 해당 기사: HTTP 403으로 원문 대조 불가 — 이 문서에서는 해당 기사 단독 근거 수치를 쓰지 않았다.

답글 남기기