Gemini Omni: Google перетворює відео на сюрреалістичні видіння

На сцені штучного інтелекту з’являється новий гравець – Gemini Omni, що виводить можливості генерації відео на кардинально новий рівень. Ця передова мультимодальна модель від Google, побудована на базі успіху Veo, здатна трансформувати відеоконтент, використовуючи найрізноманітніші вхідні дані: текст, аудіо, статичні зображення та навіть реальні відеофайли. Gemini Omni обіцяє розширити межі креативності, дозволяючи користувачам не просто створювати відео з нуля, а й модифікувати існуючі кадри, надаючи їм абсолютно нового виміру.

Революція у відеогенерації: Gemini Omni

Генерація відео за допомогою штучного інтелекту вже давно стала одним із найцікавіших напрямків у сфері креативних технологій. Платформа Google Veo, особливо її версія Gen 3, продемонструвала вражаючі можливості у створенні цілих сцен з послідовними елементами та високоякісним синхроном губ. Проте, Gemini Omni виходить за ці рамки, дозволяючи не тільки генерувати відеоконтент, але й перетворювати реальні зйомки на вражаючі кліпи, які раніше існували лише у сфері уяви.

Мультимодальність та трансформація реальності

Gemini Omni – це новий клас мультимодальних моделей, що здатні реформувати реальні кадри, надаючи їм форми, яка раніше була б неможливою без штучного інтелекту. Першою реалізацією стане Omni Flash, яка зможе комбінувати різноманітні вхідні дані – текст, аудіо, зображення та відео – для створення радикально нового контенту в будь-якому з цих форматів. Особливий акцент робиться на відео, де користувачі зможуть створювати відео, що відповідають найсміливішим фантазіям, забезпечуючи при цьому послідовність персонажів у множинних кадрах.

Глибокий аналіз та інтуїтивне редагування

Gemini Omni не просто генерує відео, а й осмислює розповідь, аналізуючи численні аспекти одночасно. Ще однією перевагою є можливість доопрацьовувати створені відео за допомогою природної мови, доки результат не відповідатиме вашому баченню або навіть перевершить його. Користувачі можуть починати роботу, надаючи референси для зображень, аудіо чи відео, або ж просто описувати своє бачення текстом. Також буде доступна опція завантаження власної цифрової версії та використання аватарів для створення відео з персонажами, які виглядають і звучать як користувач.

Фізична достовірність та приклади використання

Google наголошує, що відео, створені за допомогою Gemini Omni, будуть відповідати реальним фізичним законам, завдяки розумінню моделлю гравітації, кінетичної енергії та навіть гідродинаміки. Хоча, звісно, реальна ефективність цієї функції буде перевірена на практиці.

Для демонстрації можливостей Gemini Omni Google представила два приклади: один з участю коміка Адама Вахіда, а інший – з блогером Happy Kelli.

Gemini Omni: Google перетворює відео на сюрреалістичні видіння 3 Gemini Omni: Google перетворює відео на сюрреалістичні видіння 4

Доступність та варіанти використання

Gemini Omni, разом із новою моделлю Flash, буде поступово впроваджуватися в додатку Gemini. Він буде доступний для всіх платних підписників Google AI Plus, Pro та Ultra. Omni також буде інтегрований у Flow, інструмент Google для створення фільмів за допомогою ШІ.

Для користувачів, які бажають спробувати Gemini Omni безкоштовно, буде доступна опція через YouTube, де можна буде створювати “ремікси” існуючих Shorts. Окрім стандартного додатку YouTube, ця функціональність з’явиться і в YouTube Create. Проте, Google ще не надав інформації щодо того, чи зможуть автори обмежувати або забороняти реміксування свого контенту за допомогою ШІ.

Подробиці можна знайти на сайті: www.androidauthority.com

No votes yet.
Please wait...

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *