**Meta testing a 'human concierge' for its new personal AI agent, Muse

로이터


1. 주요 사건 개요: '인간 컨시어지(Human Concierge)' 시험과 중단**

**배경:** 메타는 최근 출시해 미국 앱 다운로드 차트 1위를 기록한 AI 에이전트 '뮤즈'에 매장 예약, 재고 확인, 견적 문의 등을 대신 전화해 주는 기능을 추가했습니다.

**비밀 테스트:** AI의 전화 성공률이 낮고 상대방이 AI 음성을 듣고 끊어버리는 문제가 지속되자, 메타는 사내 임직원 절반을 대상으로 외주 인력이 대신 전화를 걸어주는 '인간 에이전트(Human Concierge)' 방식을 조용히 적용했습니다.

**조치 및 롤백:** 사전 고지 없이 사람을 투입한 점에 대한 내부 비판과 문제가 불거지자, 메타의 초지능 연구소(Superintelligence Labs) 부사장은 "사전 고지 없이 계약직 통화를 시험한 것은 실수(miss)"였다고 인정하며 해당 기능을 즉각 롤백(회수)했습니다.


**2. 제기된 주요 문제점**

**개인정보 유출 위험:** 직원들은 콜센터 외주 직원에게 사용자의 민감한 개인정보나 대화 내용이 무방비로 노출될 수 있다는 점을 지적했습니다. ("버그 하나면 불필요한 정보가 사람 상담사에게 그대로 유출될 수 있다.")

**보안 및 신뢰성 훼손:** 메타는 뮤즈 출시 당시 "사용자마다 전용 가상 머신(VM)을 배정해 세션을 격리하고 비밀번호 등 민감 정보를 분리 보관한다"며 최고 수준의 보안을 마케팅 포인트로 내세웠으나, 외주 인력 투입으로 이 핵심 셀링 포인트가 무색해졌습니다.

**휴먼 리스크(사고 발생):** 한 직원이 인터넷 요금 협상을 뮤즈에 맡겼을 때, 실제 전화를 건 인간 계약직 직원이 통화 중 인종차별적 발언을 한 사실이 녹취록으로 드러났습니다. (메타 측은 사과 후 해당 계약직을 프로젝트에서 배제 조치)


**3. 업계 관점 및 시사점: '자율 AI'의 현실적 한계**

**과거 'M' 프로젝트의 기시감:** 메타는 약 10년 전에도 메신저 기반 비서 서비스 'M'을 운영했으나, 당시 실제 업무의 약 70%를 인간이 처리했다는 사실이 밝혀진 바 있습니다. 이번 사태 역시 당시의 한계를 떠올리게 합니다.

**성공률 격차:** 메타 내부 데이터에 따르면 AI가 직접 전화를 걸었을 때보다 인간이 개입했을 때 작업 성공률이 95~98% 수준으로 급상승한 것으로 나타났습니다. 이는 완전 자율 AI 에이전트가 현실의 음성 인터랙션 환경에서 여전히 상당한 기술적 장벽에 부딪히고 있음을 방증합니다.

**향후 계획:** 메타 대변인은 정식 공개 전 안전 장치와 개인정보 보호를 강화하기 위한 내부 피드백 수집 과정이었다고 해명하며, 향후 충분한 사전 고지와 준비가 완료된 후에만 통화 기능을 선보일 것이라고 밝혔습니다.