구글, 대화형 AI에 실시간 영상 아바타 붙여 기업용 출시…맞춤형 제작은 제한

구글이 음성 대화에 맞춰 입 모양·표정이 움직이는 AI 아바타를 기업용으로 내놨다. 맞춤 아바타 제작은 별도 허가가 필요하고, 공개 발표에는 오용 차단률이 제시되지 않았다.

밝은 사무실의 노트북 화면에 얼굴 없는 디지털 형상과 음성 파형이 보이는 개념 일러스트. AI 생성 이미지 / 데이마크
밝은 사무실의 노트북 화면에 얼굴 없는 디지털 형상과 음성 파형이 보이는 개념 일러스트. AI 생성 이미지 / 데이마크. 사진은 기사 이해를 돕기 위한 자료 이미지입니다.

구글이 24일(현지시간) 음성 대화에 맞춰 얼굴 표정과 입 모양이 움직이는 '제미나이 3.8 라이브 위드 라이브 아바타'를 공개했다. 일반 이용자용 제미나이 앱 기능이 아니라 기업용 제미나이 엔터프라이즈에서 쓰는 대화형 영상 기능이다.

구글은 고객 상담이나 안내 서비스를 예로 들었다. 이용자의 음성과 영상 입력을 받으면서 답변 음성에 맞춘 아바타 영상을 내보내고, 외부 도구 호출은 대화를 멈추지 않고 백그라운드에서 처리한다는 설명이다. 이는 구글이 제시한 기능으로, 실제 서비스 환경의 지연 시간이나 상담 품질을 독립적으로 평가한 결과는 아니다.

기본 아바타 제공, 맞춤 제작은 허가 대상

기업은 구글이 준비한 아바타를 고를 수 있다. 사진을 바탕으로 특정한 외양의 아바타를 만드는 기능은 기업 고객 가운데 별도 허가를 받은 곳에만 열려 있다. 구글 클라우드는 미국과 유럽연합의 서비스 접속 지점을 안내하고 기업용 처리량 계약을 언급했다. 국내 접속 지점이나 한국어 서비스의 별도 출시 일정은 두 발표에 명시되지 않았다.

구글은 이 기능이 97개 언어 사이를 전환하며 음성과 입 모양을 맞춘다고 설명했다. 숫자는 회사가 밝힌 지원 범위이며, 각 언어별 표현의 정확도까지 확인해 주는 독립 시험 성적은 공개 발표에서 제시되지 않았다.

생성 영상 식별은 별도 검증 필요

구글에 따르면 생성된 음성과 영상에는 눈에 보이지 않는 신스ID(SynthID) 워터마크가 들어간다. 맞춤 아바타에 허가 절차도 적용한다. 다만 워터마크나 허가 절차가 모든 오용을 막는다는 근거로 해석해서는 안 된다. 구글의 공개 발표는 적용 방침을 설명할 뿐 실제 악용 차단률을 제시하지 않았다.

IT 매체 더버지는 25일 한국시간 새벽 보도에서 현재 이용 범위가 기업 고객으로 제한된다고 확인했다. 구글이 앞서 선보인 음성 대화 모델 '제미나이 3.8 라이브'와 달리 이번 발표의 초점은 음성에 맞춰 반응하는 화면 속 아바타다.

대표 이미지: AI 생성 이미지 / 데이마크

출처: 구글 제품 발표(9월 24일) https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-with-live-avatar/ · 구글 클라우드 기업용 출시 안내(9월 25일) https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-8-live-with-live-avatar-is-now-generally-available · 더버지 보도(9월 25일 KST) https://www.theverge.com/tech/1000328/google-gemini-ai-live-avatar-face