구글이 실시간 대화가 가능한 AI 모델 “Gemini 3.8 Live”와 “Gemini 3.8 Live Extended Thinking”를 출시했습니다. Gemini 3.8 Live Extended Thinking는 벤치마크 테스트에서 OpenAI 및 SpaceX AI의 라이벌 모델을 상회하는 점수를 기록했습니다. Gemini 3.8 Live & Gemini 3.8 Live Extended Thinking https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/ 새로운 Gemini 오디오 모델은 개발자를 위한 것 https://blog.google/innovation-and-ai/technology/developers-tools/build-real-time-voice-applications-gemini-audio/ Gemini 3.8 Live는 비용 효율성을 중시하여 설계된 모델이며, Gemini 3.8 Live Extended Thinking는 고도화된 지능과 다단계 추론 능력을 갖춘 모델입니다. 두 모델 모두 일본을 포함한 97개 언어에 대응하며 실시간으로 대화할 수 있습니다. 구글이 공개한 데모 영상에서는 “Gemini라고 부를 때만 응답해”라는 음성 지시를 따르면서 맥락에 맞게 실시간으로 응답하는 모습을 확인할 수 있습니다. Gemini Live API에 대한 최신 정보 - YouTube
Gemini 3.8 라이브 확장된 사고와 대화하면서 코딩하는 데모 영상도 공개되었습니다.
3.8 라이브 확장된 사고를 사용하여 프로그래밍 튜터 역할을 하는 방법을 시청하십시오. 두 모델은 다음과 같은 특징을 갖습니다: 🔵 업그레이드된 추론 🔵 거의 실시간 시각적 이해 🔵 97개 언어 자동 감지 🔵 채팅을 방해하지 않고 백그라운드 도구 호출
가장 어려운… pic.twitter.com/WHrNvqtHhl
아래 그래프는 가로축이 작업 완료율, 세로축이 대화 품질을 나타냅니다. Gemini 3.8 라이브와 Gemini 3.8 라이브 확장된 사고는 대화 품질과 작업 실행 정확도를 모두 달성할 수 있습니다.
제3자 기관인 Artificial Analysis가 실시한 테스트 결과, Gemini 3.8 Live Extended Thinking이 OpenAI의 GPT-Live-1-Astra와 SpaceXAI의 Grok Voice Think Fast 2.0을 상회했습니다.
또한, AI의 이름을 가린 상태에서 인間に 품질을 평가시키는 Speech Agent Arena에서는 Gemini 3.8 Live가 전체 1위의 성능으로 평가되었습니다. 특히, 1위는 Gemini 3.1 Flash Live Minimal입니다.
Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking은 API를 통해 사용 가능하며, API 문서 확인은 다음 링크에서 가능합니다: Live API 기능 가이드 | Gemini API | Google AI for Developers https://ai.google.dev/gemini-api/docs/live-api/capabilities?hl=ja#supported-languages
원문 보기 | 출처: Gigazine