Google зробив свого AI-асистента Gemini Live ще розумнішим. Нова версія отримала вдосконалене розуміння мов, підтримку живого відео та можливість шарити екран під час розмови. Це означає, що спілкування з асистентом стане більш інтерактивним і зручним.
Що змінилося
- Покращене розпізнавання мов, акцентів та діалектів
- Живе відео та обмін екраном для більш динамічних взаємодій
- Кращий переклад та розуміння контексту
- Використання нової моделі Gemini 2.0, яка покращує швидкість і точність
Але разом із новими можливостями приходить і знайома проблема — конфіденційність. Google хоче зберігати аудіо, відео та дані з екрану у вашому Gemini Apps Activity. За замовчуванням ця опція вимкнена, але користувачам доведеться вручну слідкувати за своїми налаштуваннями.
Як працює оновлений штучний інтелект
Нові можливості Gemini Live, схоже, працюють завдяки Multimodal Live API, представленому ще з Gemini 2.0. Ця технологія дозволяє асистенту обробляти текст, аудіо та відео в режимі реального часу.
Google вже називає це початком “ери агентів”, де AI не просто відповідає на питання, а прогнозує дії та виконує завдання самостійно. Це не просто покращений чат-бот, а система, здатна аналізувати, ухвалювати рішення і навіть діяти автономно.
Перша модель у новій лінійці — Gemini 2.0 Flash. Вона удвічі швидша за попередню версію Gemini Pro 1.5 і може працювати не лише як асистент, а й як повноцінний агент для вирішення складних завдань.
Що це означає для користувачів
Оновлений Gemini Live — це потенційно великий прорив у сфері штучного інтелекту. Він може спростити роботу в багатьох сферах, від освіти до медицини. Але водночас, як і всі розумні технології, він потребує більше персональних даних.
Оновлення вже поступово з’являється у користувачів. Та головне питання залишається відкритим: чи готові ми ділитися ще більше інформації заради зручності?

