iLenta Меню

Google представила Gemini Omni — ШІ для створення та редагування реалістичних відео

20 травня 2026, 13:06 | Anton Petrov [228]

Компанія Google офіційно анонсувала нову мультимодальну модель Gemini Omni, яка здатна генерувати реалістичні відео та редагувати їх за допомогою звичайних текстових команд. Першою користувачам стала доступна полегшена версія — Omni Flash, яку вже інтегрували у застосунок Gemini та платформу YouTube Shorts.

Google представила Gemini Omni — ШІ для створення та редагування реалістичних відео

Нова технологія поєднує можливості одразу кількох ШІ-рішень Google, включаючи Gemini Nano, Veo та Genie. Завдяки цьому система може створювати відео не лише з текстового опису, а й на основі фотографій, ескізів, зображень або навіть коротких сценаріїв.

У Google наголошують, що Gemini Omni краще розуміє фізику навколишнього світу. Модель враховує закони гравітації, інерцію, поведінку об’єктів під час руху та взаємодію персонажів із середовищем. Саме це дозволяє створювати ролики, які виглядають значно природніше порівняно з багатьма сучасними генераторами відео.

Редагування відео через звичайний діалог

Однією з ключових особливостей Gemini Omni стала можливість змінювати вже готові відеоролики через текстові запити. Користувачу достатньо описати потрібну зміну природною мовою — наприклад, змінити погоду, додати певний об’єкт або скоригувати стиль сцени.

При цьому модель аналізує контекст відео та вносить лише необхідні правки. Персонажі, композиція кадру та інші об’єкти залишаються незмінними, якщо користувач не попросив інакше. Такий підхід дозволяє уникнути типової проблеми генеративних моделей, коли після редагування сцени повністю змінюються деталі або зовнішність героїв.

Фактично Google робить ще один крок до формату «розмовного монтажу», де користувачеві більше не потрібні складні відеоредактори або професійні навички роботи з графікою.

Google активно заходить на ринок AI-відео

Запуск Gemini Omni демонструє, що Google серйозно посилює конкуренцію на ринку генеративного відео, де вже активно розвиваються рішення від OpenAI, Runway та інших компаній. Особливо важливим виглядає акцент саме на інтеграції з YouTube Shorts — це може суттєво прискорити масове використання AI-інструментів серед авторів контенту.

Аналітики індустрії звертають увагу, що Google робить ставку не лише на якість генерації, а й на швидкість роботи та доступність для звичайних користувачів. Omni Flash позиціонується як легша та швидша модель, яку можна використовувати прямо у мобільних сервісах без складного налаштування.

Окремий інтерес викликає здатність Gemini Omni працювати одразу з кількома типами контенту — текстом, зображеннями та відео. Саме мультимодальність зараз вважається одним із головних напрямків розвитку сучасного штучного інтелекту.

Gemini Omni вже доступна користувачам

На даний момент Gemini Omni Flash уже почала з’являтися у застосунку Gemini, а також серед інструментів для творців YouTube Shorts. Очікується, що надалі Google розширить функціональність моделі та відкриє доступ до повноцінної версії Omni з більш просунутими можливостями генерації та редагування відео.

© 2012-2026 iLenta. Всі права захищені.
Повна версія

AI

Meta випустила AI-застосунок для Mac із доступом до екрана та Google Workspace
Meta випустила AI-застосунок для Mac із доступом до екрана та Google Workspace
20 серпня 2026, 19:07 | Anton Petrov
Meta розширює присутність свого штучного інтелекту на комп’ютерах Apple. Компанія запустила новий застосунок Meta AI для Mac, який наразі доступний у статусі бета-версії. Насамперед сервіс орієнтований на бізнес і творців контенту, пропонуючи інтеграцію з Facebook, Instagram, аналітикою та інструментами Google Workspace.
Докладніше...
 
OpenAI запускає ChatGPT for Teens: підліткам змінять правила спілкування з ШІ
OpenAI запускає ChatGPT for Teens: підліткам змінять правила спілкування з ШІ
19 серпня 2026, 15:08 | Anton Petrov

OpenAI представила ChatGPT for Teens — окремий режим роботи ChatGPT для користувачів віком від 13 до 17 років. Компанія робить акцент не лише на блокуванні небезпечного контенту, а й на тому, як саме штучний інтелект спілкується з підлітками, допомагає їм навчатися та вибудовує межі у тривалих розмовах.

Докладніше...
 
Stripe купує OpenRouter більш ніж за $7 млрд: вартість ШІ-стартапу зросла вп’ятеро за три місяці
Stripe купує OpenRouter більш ніж за $7 млрд: вартість ШІ-стартапу зросла вп’ятеро за три місяці
17 серпня 2026, 20:07 | Oleksandr Bazanov
Stripe домовилася про придбання OpenRouter — платформи, яка об’єднує доступ до сотень моделей штучного інтелекту через єдиний інтерфейс. За даними Bloomberg, сума угоди перевищить $7 млрд, або близько 330 млрд грн за офіційним курсом НБУ. Водночас остаточна вартість ще може змінитися. Про угоду також повідомляє TechCrunch із посиланням на власні джерела.
Докладніше...
 
Новий ШІ-диктофон Comu сам перетворює розмови на презентації, листи та готові плани
Новий ШІ-диктофон Comu сам перетворює розмови на презентації, листи та готові плани
17 серпня 2026, 19:07 | Bazelas

Компанія Comu офіційно представила Action Pro — компактний ШІ-диктофон, який не просто записує та розшифровує розмови, а може перетворювати їх на презентації, електронні листи, документи, списки завдань і плани подальших дій. Головною особливістю новинки стала окрема кнопка для голосових команд штучному інтелекту.

Докладніше...
 
Feagine представила ШІ-модель, яка вчиться працювати з різними роботами
Feagine представила ШІ-модель, яка вчиться працювати з різними роботами
17 серпня 2026, 16:06 | Bazelas
Сучасний штучний інтелект для роботів часто тісно пов’язаний із конкретною конструкцією машини. Якщо замінити маніпулятор, змінити кількість сегментів або число ступенів свободи, раніше навчена система може потребувати суттєвої адаптації. Китайська компанія Feagine Robotics пропонує інший підхід: її модель Fi0 розробляється для роботи з роботами, які мають різну фізичну будову.
Докладніше...
 
Сторінки: 1 2 3 4 5 6
Повна версія
 
© 2012-2026 iLenta. All rights reserved.