Google은 6월 9일 연속 음성 번역 시스템인 Gemini 3.5 Live Translate를 발표했다. 회사는 이 시스템이 70개가 넘는 언어를 자동 감지하고 한 회의에서 2천 개 넘는 언어 조합을 처리할 수 있다고 밝혔다. 참가자가 매번 언어를 고르고 정해진 순서로 차례를 기다리지 않아도 대화가 이어지도록 설계됐다.

Google에 따르면 모델은 음성을 단어로만 바꾸지 않고 억양, 속도와 높낮이를 보존하려 한다. 화자가 말을 끊거나 머뭇거리고 특정 표현을 강조할 때 이런 요소도 의미를 전달한다. 발표는 의도한 동작을 설명하지만, 지원되는 모든 언어 조합에서 정확도와 자연스러움이 같다는 점을 입증하지는 않는다.

공개 미리보기는 Gemini Live API와 Google AI Studio를 통해 시작됐다. Google Translate와 Google Meet 통합은 향후 계획으로 발표됐다. 따라서 미리보기 접근을 소비자와 업무용 Google 제품 전반의 완전한 출시로 혼동해서는 안 된다. 개발 전 최신 문서에서 가격, 지역 접근과 모델 ID를 확인해야 한다.

사람들이 말하는 동안 번역이 계속 작동하기 때문에 여행, 회의, 고객 지원과 언어 학습에 유용할 수 있다. 동시에 이런 상황은 한계를 드러내기 쉽다. 억양, 여러 언어를 섞는 발화, 겹치는 목소리와 배경 소음은 깨끗한 시연에서 잘 작동한 시스템에도 영향을 줄 수 있다.

언어 수는 출발점에 불과하다. 의미 있는 비교에는 같은 녹음, 화자와 평가 방식이 필요하며, 원어민이 말투와 의미가 보존됐는지 판단해야 한다. 그런 증거가 나오기 전까지 Google의 범위와 품질 주장은 회사 주장으로 남겨야 하며 최고 번역기 순위로 바꿔서는 안 된다.

다음에 주목할 점

외부 다국어 시험과 Google Translate, Meet, 지역별 제공 여부와 가격에 관한 확정된 출시 정보가 다음 판단 자료가 될 것이다.

출처

이 회고 기사는 2026년 8월 3일 Google의 발표, 모델 카드와 API 문서, 그리고 배경 설명을 위한 Ars Technica 보도를 바탕으로 작성됐다. AI News of Today는 다국어 시험을 하지 않았다.

가능한 경우 원문 자료와 현장 취재 보도로 연결합니다.

  1. Google announcement1차 자료 · 2026년 6월 9일
  2. Google DeepMind audio model card1차 자료 · 2026년 6월 9일
  3. Gemini API model documentation배경 자료 · 2026년 6월 9일
  4. Ars Technica coverage언론 보도 · 2026년 6월 9일