flowchart TD
N0["Gemini 3.8 Live 출시"]
N1["실시간 음성 백그라운드 추론"]
N2["입력 분당 0.005달러"]
N3["Search Live 및 앱 적용"]
N4["엔터프라이즈 비공개 프리뷰"]
N0 --> N1
N1 --> N2
N2 --> N3
N3 --> N4
Google이 말하면서 동시에 생각하는 혁신적인 음성 인공지능 모델을 공개했습니다. 복잡한 질문을 받아도 어색한 침묵 없이 연속적인 목소리로 답하며 뒤편에서 연산을 이어갑니다. 스마트폰이나 컴퓨터로 인공지능과 음성 대화를 나눌 때 답답함을 느꼈던 분들에게 직접적인 변화가 찾아옵니다.
기존 음성 도우미는 어려운 연산이나 외부 도구를 부를 때마다 대화를 멈추고 기다려야 했습니다. 이번 변화로 사용자는 사람과 이야기하듯 막힘없는 음성 안내를 직접 경험하게 됩니다. 개발자와 일반 사용자 모두의 일상적인 상호작용 방식이 음성 중심으로 크게 전환될 준비를 마쳤습니다.
먼저 알아둘 용어
- 지연 시간: 요청을 보내고 첫 답이 돌아오기까지 걸리는 시간입니다.
- 추론: 학습이 끝난 모델이 실제로 답을 만들어 내는 과정입니다. 이때 드는 계산 비용이 곧 사용료입니다.
- 멀티모달: 글뿐 아니라 이미지와 소리, 영상까지 함께 알아듣는 방식입니다.
- API: 다른 프로그램에서 이 기능을 불러다 쓸 수 있게 열어 둔 창구입니다.
- 프롬프트: AI에게 건네는 지시문입니다. 같은 모델도 지시문에 따라 결과가 크게 달라집니다.

