Google Gemini навчився ігнорувати нудні відео: чому це важливо
Google оновила Gemini 3.7, 3.6 та 3.5 Flash-Lite, навчивши нейронку не дивитися відео підряд, а вибирати лише цікаві моменти. Це геніальний крок, бо навіть штучний інтелект заслуговує на те, щоб не витрачати час на перегляд усього сміття в мережі.
Замість того, щоб ковтати відео кадр за кадром, агентний аналіз дозволяє Gemini самостійно вирішувати, які фрагменти варто вивчити детально, а які можна пропустити. Модель тепер використовує вбудовані інструменти для навігації по часовій шкалі, обираючи між відеорядом, звуком та транскриптом.
Завдяки такому підходу, Google вдалося знизити витрати токенів до 88% та здешевити аналіз відео на 66%, при цьому підвищивши точність розпізнавання на 7%. Це працює як професійний монтажер, який точно знає, де в годині лекції захована корисна відповідь.
Функція вже доступна через Gemini API, а в найближчі місяці вона з'явиться у Ask YouTube та мобільному додатку. Модель більше не зобов'язана дивитися все підряд — вона виділяє ресурси тільки на релевантні ділянки, що дозволяє знайти подію з точністю до часток секунди.
Це фінальний цвях у труну застарілих методів обробки відео, де за кожен кадр доводилося платити, як за політ у космос. Чи захочемо ми після цього взагалі дивитися щось самі, чи просто будемо питати Gemini: «що там було цікавого?»
Джерело: Google Blog
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.