
제미나이 3.8 라이브는 말하는 도중에 작업을 처리하는 음성 모델이고, CC는 가족 여섯 명이 하나로 같이 쓰는 에이전트다. 둘 다 2026년 9월에 나왔다. 그리고 CC는 지금 한국에서 쓸 수 없다.
발표가 이틀 간격으로 붙어 있어서 따로 읽으면 각각 사소해 보인다. 붙여 놓으면 방향이 보인다.
이 글의 표기 기준
기능과 사양은 구글 공식 발표문과 제미나이 API 개발자 문서를 기준으로 했다. 벤치마크 수치는 구글 발표문에 공개된 값이며, 일부는 외부 벤치마크 결과를 구글이 인용한 것이다. 평가 방식과 순위는 갱신에 따라 바뀔 수 있다.
2026년 9월 18일 확인 기준이며, 이후 변경될 수 있다.
9월에 나온 네 가지
3주 사이에 구글이 내놓은 발표를 시간순으로 놓으면 이렇다.

| 시점 | 발표 | 움직인 축 |
|---|---|---|
| 9월 2일 | 제미나이 3.8 플래시 · 3.8 플래시 사이버 | 모델 |
| 9월 10일 | 윈도우용 제미나이 데스크톱 앱 | 접점 |
| 9월 15일 | 제미나이 3.8 라이브 · 3.8 라이브 익스텐디드 씽킹 | 모델 |
| 9월 17일 | CC 가족·가구용 확장 | 주체 |
모델은 말하면서 일하게 됐고, 접점은 브라우저 밖 PC 안으로 들어왔고, 주체는 한 사람에서 여섯 사람으로 늘었다. 세 축이 같은 달에 동시에 움직였다.
제미나이 3.8 라이브 — 무엇이 달라졌나
기존 음성 비서의 고질적 문제는 단순했다. 복잡한 요청을 받으면 침묵한다. 검색을 하거나 API를 부르는 동안 대화가 멈춘다.
이게 체감 문제가 아니라 구조 문제였다는 걸 개발자 문서에서 확인할 수 있다. 직전 세대인 3.1 플래시 라이브는 함수 호출이 순차적으로만 동작했다. 도구 응답이 도착하기 전까지 모델이 답변을 시작하지 않는 구조였다.
3.8 라이브는 이걸 비동기로 바꿨다. 도구를 호출해 두고 대화를 계속한다. 문서상 표기는 NON_BLOCKING이고, 3.8 라이브에서는 이게 기본값이다.
공식 문서의 세 모델 비교를 정리하면 이렇다.

| 항목 | 3.1 플래시 라이브 | 3.8 라이브 | 3.8 라이브 익스텐디드 씽킹 |
|---|---|---|---|
| 위치 | 레거시 프리뷰. 문서가 3.8로 이전 권고 | 저지연 음성 에이전트 기본 선택 | 배경 추론이 더 필요할 때 |
| 비동기 함수 호출 | 미지원. 순차 실행만 | 지원, 기본값. 차단 모드도 선택 가능 | 비동기만 지원. 차단 모드 불가 |
| 추론 깊이 설정 | minimal~high, 기본 minimal | 설정 불가. 대화에 섞여 동작 | low·medium·high 선택 |
| 작업 완료 판정 | 발화 종료로 판단 | 발화 종료로 판단 | 발화가 끝나도 배경 작업이 남을 수 있어 별도 상태값으로 확인 |
| 감정 반응·선제 응답 | 미지원 | 지원 | 지원 |
익스텐디드 씽킹의 마지막 항목은 개발자에게 특히 중요하다. 모델이 말을 마쳐도 세션이 끝난 게 아니다. 뒤에서 작업이 돌고 있을 수 있어서, 발화 종료 신호만 보고 연결을 닫으면 결과를 놓친다.
두 모델을 나눠 낸 이유
- 제미나이 3.8 라이브 — 저지연·대량 처리용. 문의 라우팅, 음성 검색, 짧은 기기 조작처럼 빠른 응답이 중요한 쪽
- 3.8 라이브 익스텐디드 씽킹 — 다단계 추론용. 여러 로그를 훑는 기술 지원, 항공권과 숙소를 동시에 비교하는 예약처럼 생각할 시간이 필요한 쪽
일반 사용자에게는 모델별 제공 경로가 다르다. 익스텐디드 씽킹은 제미나이 라이브에 적용이 시작됐고, 지메일·독스·킵의 라이브 기능에도 쓰인다. 구글은 이 모델 계열로 제미나이 앱과 워크스페이스, 검색에서의 음성 대화가 더 매끄러워진다고 설명했다.
실제로 쓸 때 걸리는 제약
개발자 문서에 적힌 한계가 몇 가지 있다. 기사에는 잘 안 나오는데 실무에서는 이쪽이 먼저 부딪힌다.
- 세션 길이 — 오디오만 쓰면 15분, 영상까지 붙이면 2분. 세션 관리 기법으로 연장은 가능하다
- 컨텍스트 — 네이티브 오디오 출력 모델은 12만 8천 토큰
- 영상 입력 — 초당 1프레임까지
- 오디오 규격 — 입력 16kHz, 출력 24kHz 원시 PCM
- 응답 형식 — 네이티브 오디오 모델은 음성 출력만 지원한다. 텍스트가 필요하면 음성 전사 기능을 쓴다
성능과 가격
구글은 익스텐디드 씽킹이 아티피셜 애널리시스의 음성 대 음성 품질 지수에서 82.6으로 1위에 올랐다고 밝혔다. 오디오 추론 지표에서는 97.7%, 에이전트 작업 완료 지표에서는 68.6%를 기록했다고 함께 공개했다.
가격은 공식 단가로 직접 계산하는 게 정확하다. API 기준으로 오디오 입력이 분당 0.005달러, 출력이 분당 0.018달러다. 입력과 출력이 각각 10분씩 발생한다고 단순 계산하면 약 0.23달러가 나온다. 실제 비용은 도구 호출과 텍스트 토큰에 따라 달라진다. (2026년 9월 18일 확인)
음성 에이전트를 실제로 굴리는 쪽에서는 이 단가가 벤치마크 순위보다 먼저 보는 숫자다.
구글 CC — 가족 여섯 명이 함께 쓰는 에이전트
CC는 이번에 처음 나온 제품이 아니다. 경로를 보면 세 번째 형태다.
- 2025년 12월 — 1인용 실험으로 공개. 지메일·캘린더·드라이브를 연결해 매일 아침 “오늘의 일정” 브리핑을 메일로 발송
- 2026년 5월 — 이 개념이 제미나이 앱에 데일리 브리프로 편입
- 2026년 9월 17일 — 랩스의 CC는 최대 6인 가족용으로 확장
랩스에서 실험하고, 검증되면 제미나이 본체가 흡수하고, 랩스는 다음 단계로 간다. 이 패턴이 한 번 이미 반복됐다.
확장된 CC가 하는 일은 일정 정리에서 끝나지 않는다. 활동 등록 PDF를 미리 채우고, 준비물 목록을 만들고, 주간 식단을 짜고, 연속된 일정 사이의 실제 이동시간을 지도 API로 확인한다. 공유 문서와 시트도 만든다.
구글이 AI에게 계정을 준 이유
이번 발표에서 기능보다 중요한 건 이 대목이다. CC는 자체 검증된 구글 계정을 갖는다.

지금까지 개인 AI는 대체로 위임 구조였다. 내 계정으로 로그인한 AI가 내 권한을 그대로 물려받는다. 내가 볼 수 있는 건 AI도 다 본다. 편하지만 권한을 좁히기 어렵고, 무엇을 봤는지 분리해서 추적하기도 어렵다.
CC는 여기서 갈라진다. AI가 별도 신원을 갖고, 사람에게 자료를 공유하듯 각자가 CC 계정에 공유한다. CC는 그룹 구성원에게만 응답하고, 허가 없이는 그룹 밖으로 정보를 보내거나 행동하지 않는다.
여러 사람이 하나의 AI를 공유하려면 누가 어떤 정보를 넘겼고 AI가 어디까지 행동할 수 있는지를 분리하는 문제가 먼저 걸린다. 별도 계정은 구글이 그 문제를 푼 방식이다. 구조적으로 보면 기업 IT에서 쓰는 서비스 계정과 닮은 점이 있다.
공유 범위를 고르는 방식
실제 사용 감각은 여기서 갈린다.
- 상시 공유 지정 — 자녀 학교나 여행 예약처럼 항상 넘길 발신자를 미리 정해둔다. 매주 새로 등장한 발신자 목록을 개인적으로 받아 공유 여부를 고른다
- 일회성 전달 — 생일파티 초대장 사진이나 연습 일정 문자를 메일·챗으로 CC에 넘기면 캘린더가 갱신된다
- 기억의 분리 — 가구 전체에 해당하는 것과 한 사람에게 속한 것을 나눠 저장한다
마지막 항목이 멀티유저 AI의 진짜 난제다. 이 경계가 무너지면 가족 AI는 즉시 사고를 낸다. 준비 중인 선물이 공동 브리핑에 뜨는 식이다.
제약도 있다. CC가 모든 정보를 자동으로 읽는 구조는 아니다. 각 구성원이 공유할 메일·파일·캘린더를 직접 고르고, 언제든 바꿀 수 있다. 활동 등록 PDF 같은 서류는 내용을 미리 채워주는 데까지다. 구글도 CC를 초기 실험 단계라고 명시하고 있다.
한국에서는 지금 쓸 수 있나

CC는 미국 한정이다
웹과 모바일에서 미국의 18세 이상 개인 구글 계정 사용자만 쓸 수 있는 초기 실험이다. 기존 사용자에게는 업그레이드 안내 메일이 가고, 신규는 대기목록에 등록한다. 한국 출시에 관한 언급은 공식 발표 어디에도 없다.
제미나이 3.8 라이브는 사정이 다르다. 개발자는 제미나이 API와 AI 스튜디오에서 바로 쓸 수 있다.
한국어 지원도 확인된다. 라이브 API 개발자 문서에는 지원 언어가 표로 공개돼 있고 한국어(ko)가 목록에 들어 있다. 다만 숫자는 출처마다 다르다. 9월 15일 발표문은 97개로 소개했고, 개발자 문서는 9월 16일 갱신 기준 99개를 나열한다. 목록 자체가 계속 늘어나는 중이라고 보는 게 맞다.
모델이 한국어를 지원한다는 것과 제미나이 라이브·검색 라이브 같은 소비자 서비스에서 지금 그 기능을 쓸 수 있다는 건 별개다. 제공 범위는 지역과 계정 등급에 따라 달라진다.
Hoonyspot 해석 — 세 축이 만나는 지점
구글은 CC 발표문에서 그룹으로 확장하며 그 시작이 가족이라고 썼다. 여섯 명 한도, 공유 브리핑, 서류 작성, 이동시간 확인. 이 조합을 소규모 사업장이나 프로젝트 팀에 옮겨도 그대로 성립한다.
여기에 3.8 라이브를 겹치면 그림이 하나 나온다. 말하면서 일을 처리하는 모델, 항상 켜져 있는 데스크톱 접점, 여러 사람이 공유하는 에이전트 신원. 셋이 합쳐지면 팀이 말을 걸면 알아서 처리하는 공동 비서가 된다.
다만 이건 현재 발표만으로는 추정이다. 구글이 팀용 확장을 공식 언급한 적은 없다.
짚어둘 문제도 하나 있다. 계정 주체는 성인이지만, 실제로 CC에 들어가는 건 아이의 학교 메일과 가정통신문이다. 성인 계정을 경유해 아동 데이터가 공유 기억으로 들어가는 구조다. 한국에 들어온다면 이 지점이 가장 먼저 논점이 될 가능성이 높다.
참고 자료
· The new CC, an AI agent built for families — 구글 공식 블로그, 2026-09-17
· Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking — 구글 공식 블로그, 2026-09-15
· Live API capabilities guide — 구글 AI 개발자 문서, 2026-09-16 갱신 (모델 비교·지원 언어·세션 제한)
· Gemini 3.8 Live 모델 문서 — 구글 AI 개발자 문서
· The Gemini desktop app is now available for Windows — 구글 워크스페이스 업데이트
발표 내용과 실제 서비스 조건은 지역과 계정에 따라 달라질 수 있습니다. 사용 전에 공식 안내를 한 번 더 확인해 보시기 바랍니다. 제미나이 관련 다른 정리 글도 함께 보시면 흐름이 더 선명해집니다.