메타 뮤즈로 살펴본 AI 에이전트 경험 디자인
AI 챗봇과 설계부터 다르다
생성형 AI 열풍이 가장 먼저 촉발된 분야는 다름 아닌 디자인입니다👩🎨 UX 전문가이자 인공지능디자인협회를 설립, 회장을 맡고 있는 서울미디어대학원 유훈식 교수가 생성 AI 시대에 UI·UX 디자이너가 꼭 알아야 할 이슈, 트렌드를 정리합니다.
최근 메타(Meta)가 개인용 AI 에이전트 뮤즈(Muse)를 공개했다. 지금까지 AI는 대부분 이메일 초안을 써주고 여행 계획을 제안하는 정도에서 멈췄었는데 뮤즈는 자동으로 메일 회신 및 결제까지 대신한다.
이메일과 캘린더, 결제 수단에 대한 권한을 주면 혼자서도 일을 계속하는데, 흥미로운 점은 메타가 제품 발표와 함께 디자인 결정에 대한 문서와 보안 구조를 설명한 기술 문서를 따로 공개했다는 것이다. 이 자료를 바탕으로, 메타가 새롭게 만들어 가고 있는 개인 에이전트 경험(AX, Agent eXperience) 디자인을 살펴봤다.
오픈AI는 왜 첫 하드웨어로 키보드를 선택했을까?
손끝으로 제어하는 AI 에이전트
뮤즈의 핵심 특징 : 답하는 AI를 넘어 일하는 AI 경험
뮤즈는 메타 슈퍼인텔리전스 랩(Meta Superintelligence Labs)이 만든 개인 에이전트로, 메타의 모델 뮤즈 스파크(Muse Spark)로 동작한다. 메타는 뮤즈를 질문에 답하는 데서 그치지 않고 실제로 일을 해내는 에이전트 경험을 설계하는데 초점을 두었다.
이메일 보내기, 여행 예약, 요금 낮추기, 서식 작성 같은 작업부터 저장해 둔 인스타그램 레시피 릴스를 장보기 목록으로 바꾸고 친구들에게 파티 초대장을 보내는 일까지 할 수 있다고 메타는 소개했다. 목표를 알려주면 개인화된 계획을 세우고 시간과 자원을 조율한 뒤 스스로 일을 진행한다는 것이 메타의 설명이다.

뮤즈는 미국의 18세 이상 사용자만 쓸 수 있고, iOS와 안드로이드 앱, 웹(muse.ai), 그리고 왓츠앱(WhatsApp) 대화창에서 이용할 수 있다. 메타의 AI 안경에도 곧 들어올 예정이다. 기본은 무료이며, 사용량이 많은 사람을 위해 월 20달러의 Power, 월 100달러의 Maximum 요금제를 제공한다.
무료로 시작하더라도 결제 카드를 등록해야 한다. 구글의 Gemini Spark, 앤트로픽의 Claude Cowork처럼 사용자를 대신해 일하는 에이전트가 있었다면 뮤즈는 업무를 위한 사용자보다는 일상생활의 소비자를 위한 AI라고 볼 수 있다.
에이전트에 가상 컴퓨터를 한 대씩 주는 방식
뮤즈의 구조에서 가장 먼저 눈에 띄는 것은 사용자마다 클라우드 위에 전용 컴퓨터를 한 대씩 준다는 점이다. 메타는 이것을 ‘Muse Secure VM’이라 부른다. 파일 시스템과 터미널, 크로미움 기반 브라우저가 들어 있는 격리된 리눅스 환경으로, 뮤즈는 여기서 필요한 코드를 직접 짜고 작업에 필요한 도구를 스스로 만든다.
연결 방식은 세 겹이다. 메타가 서비스 제공자와 함께 만든 기본 커넥터가 있고, 공개 API가 있는 서비스는 사용자가 준 자격 증명으로 연결하며, API가 없으면 브라우저로 직접 접근한다. 사용자는 이 브라우저를 들여다볼 수 있고 언제든 제어권을 넘겨받을 수 있다.

이전 그록 봇에 봇마다 컴퓨터를 주었던 것과 같은 발상이지만, 뮤즈는 이 컴퓨터를 보안의 경계로 한층 적극적으로 설계했다. VM 안에는 뮤즈와 시스템 수준에서 분리된 센티넬(Sentinel)이라는 별도 에이전트가 있다.
뮤즈는 행동을 제안할 뿐이고, 외부 서비스에 대한 행동과 모든 네트워크 전송은 센티넬이 허용, 거부, 사용자에게 묻기 중 하나로 판정한다. 비밀번호와 결제 정보는 별도 저장소에 들어가며, 뮤즈는 실제 값 대신 대리 토큰만 본다. 은행 창구 직원이 고객의 요청을 접수하되 금고 열쇠는 별도 관리자만 가진 구조와 비슷하다. 다만 이 보안에 대한 안정성은 메타가 기술 블로그에서 밝힌 자사 주장이기 때문에 앞으로 실제 보안 성능을 지켜볼 필요가 있다.
에이전트 경험(AX) 디자이너들은 이런 구조에 대해서 한 번 생각해 보고 넘어가면 좋다. 앞으로 에이전트에 다양한 권한을 위임해야 하기 때문이다. 뮤즈의 경우 센티넬이 ‘묻기’로 결정하는 순간이 사용자가 보게 될 승인 화면을 만들어 주게 되고, 로그인 창을 에이전트가 아니라 사용자가 직접 채우는 화면으로 전달한다. 보안 아키텍처를 이해해야지만 적절한 에이전트의 경험을 설계할 수 있는 시대가 된 것이다.
한 번의 긴 대화 설계
뮤즈의 디자인을 이끈 모나 사란타코스와 크리스틴 아와드는 ‘How We Designed Muse‘라는 글에서 주요 에이전트 경험 디자인 이슈에 대한 결정들을 직접 설명했다. 첫 번째 결정은 대화 구조다. 대부분의 AI 앱은 질문 하나에 답 하나가 오가는 턴제(turn-by-turn) 방식인데, 뮤즈는 사람과 메신저로 대화하듯 하나의 긴 메인 대화를 기본으로 삼았다.
사용자는 답을 기다리지 않고 끼어들거나 여러 일을 한꺼번에 던질 수 있고, 메모리는 대화 전체에 걸쳐 이어진다. 다만 초기 테스트에서 주제별로 맥락을 나누고 싶다는 요구가 나와 사이드 채팅(side chats)을 추가했다.

두 번째 결정은 선제성(Proactivity)이다. 뮤즈는 사용자가 묻지 않아도 먼저 메시지를 보낸다. 디자인팀은 그래서 선제 메시지의 기준을 높게 잡았다고 말한다. 방해할 만한 가치가 있을 정도로 도움이 될 때만 보내야 하고, 사용자는 뮤즈에 말로 그 빈도를 줄이거나 늘릴 수 있다. 이 결정은 작은 시각 디자인 결정으로 이어졌다.
메시지가 순서 없이 도착하고 사용자도 연달아 여러 개를 보내면 끝없이 이어지는 대화록은 읽기 어려워진다. 뮤즈가 말풍선을 쓰는 이유는 한 생각이 끝나고 다음 생각이 시작되는 경계를 보여주기 위해서다. 에이전트의 행동 방식 하나가 말풍선이라는 가장 기본적인 UI 요소의 존재 이유를 바꿔놓은 셈이다.


이름과 얼굴을 가진 에이전트 경험
긴 대화를 나누다 보니 팀원들은 기업 로고와 이야기하는 것이 어색하다고 느꼈다. 각자 대화 상대를 다르게 상상하고 있었고, 저마다 자기 뮤즈를 만들기 시작했다. 여기서 디자인팀은 에이전트를 온전히 사용자의 것으로 만드는 일이 제품의 핵심이라고 판단했다. 사용자는 뮤즈에 이름을 붙이고, 아바타와 스타일을 고르고, 소통 방식을 설정할 수 있다. 사란타코스는 자신의 뮤즈에 지혜를 떠올리게 하는 산스크리트어 이름 ‘베다(Veda)’를 붙였다고 소개한다.


이 결정은 친근함 이상의 의미가 있다. 아바타는 곧 상태 표시판이 된다. 아바타 아래에는 뮤즈가 지금 하고 있는 일이 짧게 표시되고, 아바타를 누르면 전체 활동 기록과 승인한 권한이 열린다. 얼굴이 있어야 지금 무엇을 하고 있느냐고 물을 대상이 생긴다.
한편 유명 IT 외신 테크크런치는 이 개인화가 사용자가 에이전트와 더 연결되어 있다고 느끼게 해 메타에 대한 우려를 누그러뜨리려는 설계이기도 하다고 짚었다. 페르소나 디자인이 신뢰 설계와 맞닿아 있다는 점은 AX 디자이너가 양면으로 살펴야 할 지점이다.
보이지 않는 일을 가시적으로 만드는 경험
뮤즈는 앱이 닫혀 있는 동안에도 일정에 따라, 혹은 관련 사건이 생길 때마다 다음 단계를 진행한다. 백그라운드 작업이 끝나면 결과가 알릴 만한지 스스로 평가하고, 새롭거나 사용자 입력이 필요한 경우에만 알린다.
디자인팀은 이 능력이 동시에 불안을 낳는다는 점을 인정한다. 볼 수 없는 것은 신뢰할 수 없다는 것이 이들의 원칙이다. 그래서 활동 기록, 권한 화면, 설정, 그리고 사용자가 직접 읽고 고칠 수 있는 메모리 파일까지 투명성(Transparency)을 여러 층에 심었다.


목표(Goals) 탭도 같은 맥락에서 나왔다. 오래 걸리는 과제를 여러 개 맡기다 보니 활동 기록만으로는 부족했고, 뮤즈가 무엇을 추적하고 있으며 어떤 계획으로 가고 있는지를 한눈에 보여줄 화면이 필요했다. 사란타코스가 든 사례를 참고할만하다.
뮤즈에 아이들의 개학 준비를 맡겼더니, 학교 이메일 더미 속에 묻혀 있던 아들의 스포츠 입단 테스트 신청 마감이 12시간 남았다는 사실을 찾아 비행기 탑승 직전에 알려주었다는 것이다. 자사 사례이지만, 에이전트의 가치가 대신하는 일뿐 아니라 대신 알아차리는 일에 있다는 점을 잘 보여준다. 디자이너가 설계할 것은 작업 화면을 넘어, 사람이 에이전트의 일을 언제 얼마나 확인할지 빈도이다.
승인 설계 경험
뮤즈는 많은 일을 대화로 처리하지만, 디자인팀은 몇몇 영역에선 대화만으로 부족하다고 판단했다. 승인과 거절이 명확한 구조화된 승인 카드, 그리고 자격 증명을 위한 보안 저장소가 그것이다.
이들은 이 영역을 결정론적(Deterministic) UI가 양보할 수 없는 곳으로 정했다. 기술 문서에 따르면 승인 요청은 뮤즈와의 대화가 아니라 앱 화면의 별도 대화상자로 뜨고, 사용자의 답은 센티넬에 직접 전달된다. 에이전트가 말로만 허락을 받았다고 주장할 여지를 구조적으로 없앤 것이다.


승인 빈도에 대한 고민도 구체적이다. 디자인팀은 사람들이 귀찮아서 무엇이든 승인해 버리는 배너 무시(Banner blindness)를 경계했다. 그래서 기본값은 일반적인 웹 탐색은 허용하고 되돌리기 어려운 행동에서만 멈추는 것이다. 승인 범위도 한 번, 세션, 작업, 기간 한정, 영구 중에서 고를 수 있고, 이메일처럼 읽기와 보내기가 나뉘는 서비스는 권한을 따로 준다.
결제는 가장 보수적으로 다룬다. 스트라이프(Stripe)의 Link로 결제할 때는 특정 가맹점과 금액에만 쓸 수 있는 일회용 카드 번호가 발급되고, 매번 사람의 승인을 거친다. Human-in-the-loop(HITL)을 모든 것을 묻는 장치가 아니라 동의가 중요한 곳에만 두는 것으로 정의한 셈이다. 자율주행차가 고속도로에서는 스스로 달리다가 복잡한 교차로에서 운전자에게 핸들을 넘기듯, 좋은 승인 경험 디자인은 AI가 멈출 곳을 선정하는 일이다.
생성형 UI 경험 : 뮤즈의 아티팩트
디자인팀은 텍스트 덩어리가 늘 올바른 답의 형태는 아니라고 말한다. 사람에게 여행 계획을 부탁하면 2000 단어의 글이 아니라 일정표를 원할 것이고, 지출을 추적한다면 매일의 메시지보다 살아 있는 대시보드가 낫다. 뮤즈는 문서, PDF, 웹페이지, 지출 추적기, 인터랙티브 학습 가이드 같은 결과물을 만들어 대화 안팎에서 쓸 수 있게 했다.
이를 아티팩트(Artifacts)라 부른다. 디자인팀은 사람들이 점점 채팅 텍스트보다 자신에게 맞춘 풍부한 인터페이스를 원하게 될 것이라고 전망한다. 인터페이스를 디자이너가 미리 그려두는 것이 아니라 에이전트가 필요에 따라 생성하는 것이다.


또 하나의 발견은 초기 테스트에서 나왔다. 뮤즈가 너무 많은 일을 할 수 있어서 사람들이 어디서부터 시작할지 몰랐다. 빈 입력창 앞에서 멈칫하는 이 문제를 풀기 위해 뮤즈는 사용자의 목표와 패턴을 바탕으로 할 수 있는 일을 먼저 제안한다. 온보딩 첫날의 팁, 아이디어(Ideas) 탭의 제안, 목표를 알고 난 뒤의 선제적 제안이 그 형태다. 능력이 커질수록 발견 가능성(Discoverability)이 새로운 디자인 과제가 된다는 교훈이다.
뮤즈가 가지는 현재적 한계
현재적 시점에서 뮤즈가 가지는 가장 큰 한계는 기술보다 신뢰 형성이라고 보인다. 뮤즈는 AI 에이전트에 이메일, 캘린더, 결제는 물론 건강, 스마트홈, 쇼핑 앱까지 권한을 줘야 하는데, 이는 소셜 미디어가 요구했던 것보다 훨씬 깊은 신뢰를 필요로 한다.
테크크런치는 메타가 2011년 개인정보 약속 위반으로 FTC와 합의했고 2019년에는 50억 달러 규모의 제재를 받았으며, 케임브리지 애널리티카 사건의 기억도 남아 있다는 점을 짚었다. 뮤즈 발표가 청소년 피해를 둘러싼 대규모 소송 합의 직후였다는 점도 지적했다.


보안 구조에도 단서가 붙는다. 메타는 현재 구조가 사용자 간 데이터를 격리하지만, 서비스 지원과 보안, 운영에 필요할 때 메타가 데이터에 접근하는 것까지 막지는 않는다고 스스로 밝혔다. 메타도 접근할 수 없게 암호화하는 Muse Confidential VM은 올해 안에 내놓겠다는 약속 단계이기 때문에 아직 완성되지 않았다는 뜻이다.
대화를 광고 시스템과 공유하지 않는다고 했지만, 뮤즈가 대신 방문한 쇼핑몰이 그 방문을 근거로 인스타그램 광고를 보여줄 수 있다는 간접 영향은 인정했다. 대화와 도구 호출 기록은 개인 식별 정보를 지운 뒤 기본값으로 모델 학습에 쓰이며, 원하지 않으면 사용자가 설정에서 직접 꺼야 한다.
프롬프트 인젝션(Prompt injection) 역시 업계 전체의 열린 문제다. 메타는 뮤즈가 실수할 수 있다고 인정하며 최대 30만 달러를 지급하는 버그 바운티를 공개했다. 미국 한정 출시, 무료 사용에도 카드 등록이 필요한 점, 유료 요금제의 구체적인 사용 한도가 출시 시점에 명확히 공개되지 않았다는 점도 따져볼 부분이다. 무엇보다 에이전트를 내 편처럼 느끼게 하는 이름과 아바타가 오히려 사용자의 판단을 흐리게 할 수 있다는 점은 에이전트 경험 디자이너가 비판적으로 봐야 할 지점이다.
뮤즈가 AX 디자이너에게 던지는 질문
뮤즈에서 생각해 볼 수 있는 점은 에이전트의 능력과 안전장치가 곧 인터페이스라는 점이다. 먼저 말을 걸어야 하니 말풍선이 인터페이스가 필요하고, AI 어떻게 일하는지 보여줘야 하는 아바타가 상태 표시판이 필요하다. 되돌릴 수 없는 행동에 대해서는 승인 경험을 설계해 줘야 한다.
AI 에이전트가 할 수 있는 일이 너무 많으니 아이디어 탭이 생겼고, 텍스트가 맞지 않는 답이 있으니 아티팩트가 생겼다. 모든 화면이 에이전트의 행동 방식에서 거꾸로 도출된 것이다. 이제 UX 시대와 AX 시대의 질문이 달라야 하는 것을 생각해 볼 수 있다.

디자인팀은 시스템 프롬프트의 첫 줄이 사용자의 삶을 더 낫게 만드는 것이 뮤즈의 목적이라는 문장이라고 밝혔다. 화면이 아니라 에이전트의 목적 문장에서 디자인이 시작된다는 점이 상징적이다.
그래서 디자이너가 던지는 질문도 바뀐다. “사용자가 이 화면에서 무엇을 누를까”에서 “에이전트가 언제 먼저 말을 걸어도 될까”로, “어떻게 하면 결과를 빨리 보여줄까”에서 “어디에서 멈추고 어떤 형태로 사람의 동의를 받을까”로 이동하고 있다. 뮤즈는 이 질문을 수십억 명 규모에서 풀어보려는 첫 시도이고, 그 답이 신뢰를 얻을지는 이제 하나씩 많은 시행착오를 거치며 만들어 가게 될 것이다.
UX 디자인과 클로드 5, AI 컨텍스트 엔지니어링
AI를 위한 최적의 환경과 정보 생태계 구축법
👉 원문 링크: 메타 뮤즈로 살펴보는 에이전트경험(AX)디자인
유훈식 교수
hsyoo@smit.ac.kr
AI & UX/UI 디자이너 오픈 채팅방
https://litt.ly/aidesign
뉴스콘텐츠는 저작권법 제7조 규정된 단서조항을 제외한 저작물로서 저작권법의 보호대상입니다. 본 기사를 개인블로그 및 홈페이지, 카페 등에 게재(링크)를 원하시는 분은 반드시 기사의 출처(로고)를 붙여주시기 바랍니다. 영리를 목적으로 하지 않더라도 출처 없이 본 기사를 재편집해 올린 해당 미디어에 대해서는 합법적인 절차(지적재산권법)에 따라 그 책임을 묻게 되며, 이에 따른 불이익은 책임지지 않습니다.
- 에디터김동욱 (jkkims@ditoday.com)

