Google представив дві нові моделі – Gemini 3.8 Live та Gemini 3.8 Live Extended Thinking, назвавши їх «найдосконалішими розмовними моделями на сьогодні». Обидві спрямовані на те, щоб спілкування з ШІ відчувалося природним і справді корисним. Про це повідомляє 9to5Google.
Новинки з’явились після березневого запуску 3.1 Flash Live. Google позиціонує їх як крок до більш інтуїтивного діалогу з ШІ – кожна модель орієнтована на свій сценарій використання.
Extended Thinking: для складних завдань
Gemini 3.8 Live Extended Thinking робить ставку на глибоке міркування та багатоетапне розв’язання задач. Саме вона лежить в основі нещодавно запущених Gmail Live (розмовний пошук), Docs Live (генерація та редагування чернеток) і Keep Live (створення нотаток). Сьогодні модель також починає з’являтися в Gemini Live.
Ключова особливість – модель «міркує й говорить одночасно». Під час виконання складних фонових завдань вона не замовкає: використовує природні вербальні маркери на кшталт «Зараз перевірю…» і паралельно розповідає, що відбувається в процесі. Це дозволяє зберегти безперервний діалог навіть під час ресурсоємних операцій.
За бенчмарками модель показує такі результати:
- 1-е місце в загальному заліку Speech to Speech Quality Index від Artificial Analysis – 82,6 балів
- 68,6% на τ-Voice – лідерство у виконанні агентських завдань
- 35,1% на Sierra τ-Voice-banking benchmark
- 97,7% на Big Bench Audio при збереженні конкурентної ціни порівняно з іншими топовими моделями
Base модель: швидкість і масштаб
Gemini 3.8 Live – базова версія – орієнтована на плавний діалог із візуальним розумінням контексту. Вона обробляє візуальні дані майже в реальному часі, а фонові виклики інструментів та API не перривають розмову.
Модель підтримує 97 мов і здатна перемикатися між ними прямо під час діалогу – без зупинок. Вона розрахована на масштабне розгортання й займає друге місце в Speech Agent Arena. Саме на Gemini 3.8 Live працюватиме функція Search Live в AI Mode.