Google викотила Gemini 3.8 Live: боти тепер міркують прямо під час балачки
Кремнієва долина вивела багатозадачність на лякаючий рівень: штучний інтелект навчився розмовляти наживо, одночасно смикати бекенд і коментувати власні думки без незручних пауз.
Свіжі моделі Gemini 3.8 Live та Gemini 3.8 Live Extended Thinking працюють у прямому режимі speech-to-speech, опрацьовуючи живий відеопотік і зображення понад 97 мовами без проміжного перетворення голосу на текст.
Архітектура підтримує асинхронні виклики API, завдяки чому асистент тягне дані зі сторонніх сервісів у фоні, не заїкаючись і не змушуючи співрозмовника слухати цифрову тишу в очікуванні відповіді.
Модифікація Live Extended Thinking отримала паралельне мислення: нейромережа розв'язує заплутану задачу й одночасно озвучує проміжний хід думок уголос, що забезпечило їй 82,6 бала в рейтингу мовленнєвих систем від Artificial Analysis.
Обидві версії вже відкрили через Gemini API та платформу Google AI Studio, а також почали вшивати в екосистеми Google Search та Google Workspace.
Тарифікація для розробників становить $0,005 за хвилину вхідного аудіо й $0,018 за хвилину генерованого мовлення, що в перерахунку дорівнює $3 та $12 за кожен мільйон відповідних аудіотокенів.
Незручні зависання колись давали користувачеві бодай ілюзію контролю над машиною, але поява балакучих агентів, здатних думати вголос і фоново смикати скрипти за лічені центи, залишає дедалі менше приводів тримати в колцентрах живих людей.
Джерело: Google Blog
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.