Gemini Omni отримала можливість продовжувати відео до 40 секунд та підвищувати роздільну здатність до 4K.
Євгеній Демківський – автор статей для видання "Межа" та справжній гік. Моя діяльність охоплює теми технологій, кіно та ігор, причому особливо захоплююся останніми.
Модель Gemini Omni 1.1 Flash отримала інструменти для продовження сцен, створення переходів між заданими кадрами та підвищення роздільної здатності готового відео до 4K. Оновлення представила Google.
Відео можна продовжувати 10-секундними фрагментами до сумарної тривалості 40 секунд. Під час кожного продовження модель аналізує до 10 секунд попередньої сцени, тоді як попередні версії враховували лише останню секунду. За словами Google, це допомагає краще зберігати зовнішність персонажів, оточення та послідовність подій.
Gemini Omni 1.1 Flash також дозволяє задати перший і останній кадри сцени. Модель генерує відео між ними, що можна використовувати для плавних рухів камери, переходів і зациклених роликів.
Щоб швидко перевірити запити, розробники мають можливість створювати чернетки в роздільній здатності 360p. Згідно з даними Google, такі чернетки з'являються до 60% швидше і вартують утричі менше, ніж звичайні відео в 720p. Після завершення процесу можна підвищити якість до 1080p або навіть 4K.
Ще одне цікаве нововведення дозволяє користувачам включати до запиту до трьох секунд відео, що демонструє рух, стиль або поведінку персонажа. Це нововведення доповнює вже існуючу підтримку текстових запитів, зображень і аудіофайлів.
Gemini Omni 1.1 Flash вже розгортається у Google AI Studio та корпоративній платформі Gemini Enterprise Agent Platform. Модель також доступна передплатникам Google AI Plus, Pro та Ultra у Flow.
Моделі, які були створені або змінені, містять невидимий цифровий водяний знак SynthID, а також інформацію про джерело контенту у форматі C2PA.
Нагадаємо, що в травні Google анонсувала початкову версію Gemini Omni Flash, здатну генерувати та редагувати відео, використовуючи текст, зображення, аудіофайли та інші відеоматеріали.