AI의 다음 변화는 더 긴 답변이나 더 많은 기능 목록에만 있지 않다. 사용자가 화면을 열고 질문하는 순간을 기다리는 대신, AI가 주변을 보고 대화의 맥락을 이해하며 필요한 일을 이어가는 인터페이스가 등장하고 있다. 메타의 AI 안경과 구글의 Gemini Live Avatar는 서로 다른 제품이지만 이 변화를 같은 방향에서 보여준다.
메타는 9월 24일 열린 Connect 2026에서 개인 AI 에이전트 Muse를 앞으로 AI 안경에서 사용할 수 있게 하겠다고 밝혔다. 구글은 9월 24일 실시간 음성 대화에 영상과 표정을 결합한 Gemini 3.8 Live with Live Avatar를 공개했다. 하나는 현실 세계를 바라보는 안경이고, 다른 하나는 화면 속 대화에 시각적 존재감을 더하는 아바타다.
안경은 주변을 보고, 아바타는 대화에 들어온다
메타가 공개한 방향은 안경을 단순한 카메라나 이어폰이 아니라 개인 에이전트의 접점으로 만드는 것이다. 사용자는 눈앞의 상품이나 벽에 붙은 전단, 긴 준비물 목록을 직접 설명하지 않고도 Muse에게 물어볼 수 있다. 메타는 Muse가 시야에 들어온 대상을 바탕으로 행동할 수 있다고 설명했으며, 쇼핑·여행·업무 도구와 연결되는 커넥터도 확대하겠다고 밝혔다.
다만 ‘앞으로 몇 달 안에’ 제공될 기능과 현재 누구나 쓸 수 있는 기능은 구분해야 한다. 메타는 Connect 발표에서 AI 안경에 Muse를 연결하는 계획을 공개한 것이며, 모든 지역과 제품에서 즉시 동일하게 제공된다고 발표한 것은 아니다.
구글의 Gemini 3.8 Live with Live Avatar는 기업용 대화 경험을 겨냥한다. 실시간 음성 대화에 영상 생성과 자연스러운 표정, 입 모양, 시선의 흐름을 더해 고객 안내나 대화형 워크스루를 보다 사람다운 화면으로 만들겠다는 구상이다. 구글은 이 기능이 Gemini Enterprise에서 제공되며, 대화 중에도 도구를 호출해 작업을 이어갈 수 있다고 밝혔다.
구글은 Live Avatar가 97개 언어 사이를 전환할 수 있고, 생성된 음성과 영상에는 SynthID 워터마크를 넣는다고 설명했다. 이는 아바타를 단순한 얼굴 애니메이션이 아니라 듣고 보고 말하면서 뒤에서 일을 처리하는 기업용 인터페이스로 확장하려는 시도다.
두 기술이 공유하는 세 가지 변화
첫째는 멀티모달화다. 안경은 카메라로 들어온 장면과 음성을 함께 다루고, 아바타는 음성·영상·표정·도구 호출을 한 흐름으로 묶는다. AI에게 텍스트만 건네던 방식에서 벗어나 사용자의 시선, 목소리, 장소, 대화 분위기까지 입력의 일부가 된다.
둘째는 상시성이다. 사용자가 매번 앱을 열고 처음부터 설명하지 않아도 AI가 현재 상황을 이어받는 방향이다. 안경에서는 이동 중 필요한 정보를 얻고, 아바타에서는 대화가 진행되는 동안 자료를 찾거나 다음 작업을 준비할 수 있다. AI가 답변하는 도구에서 상황 속에 놓인 조력자로 이동하는 셈이다.
셋째는 행동성이다. 두 발표 모두 AI가 말로만 설명하는 데서 멈추지 않고, 쇼핑·업무·고객 안내처럼 연결된 서비스에서 다음 단계를 수행하는 모습을 전제로 한다. 중요한 기준도 여기서 바뀐다. 얼마나 그럴듯하게 말하는가보다 어떤 권한으로 무엇을 실행하고, 언제 사람의 확인을 받는가가 더 중요해진다.
AI 교육과 기업 업무의 질문이 달라진다
이 변화는 AI 교육의 초점도 바꿀 수 있다. 지금까지는 좋은 질문을 입력하고 결과를 수정하는 법이 중심이었다면, 앞으로는 어떤 상황을 AI에게 보여줄지, 어떤 정보를 기억하게 할지, 어느 단계에서 실행을 멈추게 할지를 설계해야 한다. 교실에서는 AI 아바타의 자연스러운 말투보다 학습 목표와 피드백의 질이 먼저이고, 기업에서는 안경이나 아바타의 화려한 시연보다 업무 데이터와 권한의 경계가 먼저다.
특히 주변을 보는 AI는 편리함과 감시의 경계가 가까워진다. 카메라에 잡힌 사람과 문서, 음성 대화가 어디에서 처리되고 얼마나 오래 남는지 확인해야 한다. 기업용 아바타 역시 표정이 자연스럽다는 이유만으로 상담 품질이나 신뢰가 보장되는 것은 아니다. 실제 도입에서는 데이터 보관, 접근권한, 사용자의 동의, 오류 발생 시 책임자를 함께 정해야 한다.
‘앱을 여는 AI’에서 ‘환경에 스며든 AI’로
메타와 구글의 발표가 보여주는 공통된 비전은 AI를 하나의 앱에 가두지 않는 것이다. AI는 안경을 통해 현실을 보고, 아바타를 통해 대화에 참여하며, 연결된 도구를 통해 뒤에서 작업을 수행한다. 사용자는 기술의 이름을 기억하기보다 필요한 순간 자연스럽게 도움을 받는 경험을 하게 될 수 있다.
그러나 이 비전이 신뢰받는 일상으로 이어지려면 ‘더 사람 같은 AI’보다 ‘더 분명한 AI’가 필요하다. 무엇을 보고 있는지, 무엇을 기억하는지, 어떤 권한으로 행동하는지, 결과가 틀렸을 때 누가 바로잡는지를 사용자가 알아야 한다. 안경과 아바타의 경쟁은 결국 화면의 모양이 아니라 인간의 목표와 AI의 행동 사이에 얼마나 투명한 다리를 놓느냐의 경쟁이 될 전망이다.






댓글 0
이름을 비우면 익명으로 등록됩니다. 삭제할 때 사용할 비밀번호를 입력해 주세요.