Sakhanda Wire
NVDA MSFT GOOGL META AMZN
← До новин

Gemini Omni 1.1 Flash дає змогу створювати з більшим контролем

Gemini Omni 1.1 Flash дає змогу створювати з більшим контролем

27 серпня 2026 р.

|

Тепер Omni забезпечує створення відео студійної якості, зокрема можливість продовжувати сцену, інтерполяцію першого й останнього кадрів, чітке масштабування до 4K, швидше прототипування та багато іншого.


Аніш Нанґіа

Менеджер продукту, Google DeepMind

Аліса Фортін

Менеджер продукту, Google DeepMind


Текст "Gemini Omni 1.1 Flash Available via APIs", оточений різноманітними зображеннями людей і білки
Прослухати статтю
[[duration]] хвилин

Сьогодні ми представляємо Gemini Omni 1.1 Flash — новий набір творчих засобів керування та можливостей генерації відео для підтримки розробників. Gemini Omni привніс міркування про реальний світ у генеративне створення, а сьогоднішні оновлення роблять Omni 1.1 готовим до професійного використання через Gemini API у Google AI Studio.

Незалежно від того, чи створюєте ви робочі процеси для генерації відео, творчі інструменти або програмне забезпечення для редагування медіа, ці оновлення роблять генеративне відео більш керованим, пришвидшують ітерації та забезпечують якість, готову до розгортання в реальних умовах. Ось що нового:

Продовжуйте сцени для довшого оповідання

Продовження сцени дає змогу взяти наявне відео й безперешкодно продовжити генерувати кадри з місця, на якому воно завершилося.

В Omni 1.1 модель тепер може аналізувати до 10 секунд попереднього контексту — значний крок уперед порівняно з попередніми моделями, які враховували лише останню секунду. У результаті покращуються візуальна узгодженість і дотримання сюжету, що дає змогу створювати довші історії або розгалужуватися в нових творчих напрямках. Ви можете продовжувати відео з кроком у 10 секунд, до загальної сукупної тривалості 40 секунд.

Промпт 1: Камера трохи панорамує, і тепер ми бачимо, що вона розмовляє з кучерявим чоловіком; видно спину чоловіка, він каже: «Я теж це бачу», драматична музика.

Промпт 2: Камера повільно від'їжджає, забуті запилені катакомби, драматична музика.
Промпт 3: Камера повільно від'їжджає, величезна бібліотека, де полиці та книги невагомо плавають у запиленій порожнечі, драматична музика.

Промпт 1: Продовжити відео. Виконати кінематографічний оптичний ефект наїзду з віддаленням. Камера рухається вперед, одночасно віддалюючи зображення, а застигле здивоване обличчя персонажа залишається точно такого самого розміру. Довгий коридор із кам'яними колонами на задньому плані драматично розтягується й поглиблюється через інтенсивне оптичне спотворення перспективи. Чиста архітектура, безперервний цілісний кадр.

Промпт 2: Продовжити відео. Камера виконує швидке механічне різке наближення прямо до широко розплющених очей персонажа. Стилізоване кінематографічне керування камерою.

Промпт 3: Продовжити відео. Час повністю завмирає в нерухомій миті: персонаж, його пальто, що розвівається на вітрі. Камера плавно й на високій швидкості обертається на 360 градусів навколо застиглого персонажа, демонструючи виразну тривимірну глибину та паралакс уздовж колонади. Бездоганна безперервність.

Промпт 1: Чоловік у синьому светрі відповідає: «Твій батько теж вийшов у море на човні?»

Промпт 2: Камера від'їжджає одним безперервним рухом, а він продовжує свою історію: «Він казав, що в цієї гавані є душа. І що човни — це частина нас». Музика наростає.

Промпт 1: Він прямо дивиться в камеру й розповідає, чим завершиться фінальний розділ!

Промпт 2: Потім він встає, обходить стіл, підходить до камери й каже: «Що б ви обрали?»

Ось як можна продовжити сцену за допомогою Gemini API:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[
        {"type": "text", "text": "Continue the scene."}
    ],
    response_format={
        "resolution": "360p",
    },
)

Укажіть перший та останній кадри

Досягайте плавних переходів і рухів камери, вказуючи початковий і кінцевий кадри зйомки. Omni 1.1 генерує безперервне відео між двома ключовими кадрами, що робить його ідеальним для складних обертів камери, переходів із масштабуванням або безшовних циклічних кліпів.

Промпт 1: Крупний план стильного барабанщика в бежевому костюмі, який грає на червоній ударній установці у великій залі; сцена переходить, коли камера різко панорамує вбік, відкриваючи старшого саксофоніста, який грає поруч із балериною, що обертається в білому вбранні під м'яким фіолетовим сценічним освітленням. Один безперервний кадр, без різких склеювань.

Промпт 2: Камера наближається до екрана телевізора, де ми бачимо ту саму жінку й ту саму сцену, що й на початку. Безшовне відео. Один безперервний кадр, без різких склеювань.

Ефективніше створюйте чернетки відео в роздільній здатності 360p

Генеруйте полегшені попередні перегляди в роздільній здатності 360p до 60% швидше* і за третину вартості порівняно зі стандартною роздільною здатністю Omni 1.1 720p. Це корисно для швидкого прототипування, ітерацій розкадрування та швидкого рендерингу на платформах для розробників.

*До 60% швидша генерація на основі пропускної здатності системи для роздільної здатності 360p порівняно з 720p

Промпт: Мікроскопічний вигляд райдужних морських діатомових водоростей зі складними, схожими на скло кремнеземними оболонками та захопливою природною симетрією. Кольори варіюються від глибокого вулканічного бурштину й теплого мідного до яскравого бірюзового та фіолетового, наслідуючи насичену палітру землі й океану. Крихітні, ніжні структури м'яко світяться на чистому тлі темного поля. Наукова візуалізація високої точності, чіткі деталі, органічні текстури, мікрофотографія. Зберігати ефект лінзи мікроскопа протягом усього відео.

Масштабуйте до роздільної здатності 4K

Генеруйте відшліфовані результати у високій роздільній здатності 1080p або 4K, готові до професійного виробництва, за допомогою Omni 1.1.

Промпт 1: Риба пливе, відстежувальний кадр.

Промпт 2: Маленький бурундук вибігає з лісу з лівого боку екрана й допитливо принюхується, перш ніж вибігти за межі кадру з правого боку.

Промпт 3: Кінематографічний макрокрупний план яскравого золотисто-помаранчевого японського кленового листя на ніжній гілці, що м'яко шелестить і погойдується під легким ритмічним осіннім вітерцем. Сонячне світло проходить крізь напівпрозоре листя, створюючи теплий сяйливий ефект. Мала глибина різкості, мрійливе боке на задньому плані, надзвичайно деталізовані текстури, фотореалістичність, 4K.

Додавайте відеореференси до мультимодального введення

Використовуйте до трьох секунд відео під час створення сцени, щоб зберігати візуальний контекст і узгодженість персонажів на основі відеореференсів.

Промпт: Використайте три завантажені відео танцюристів і замініть їх наданими персонажами. Нехай вони виконують свої індивідуальні танці з референсних відео всі разом у великому відкритому просторі з наданого зображення.

Персонаж-собака dog.png має виконувати класичний танець із dance3.mp4. Персонаж-восьминіг octo.png має виконувати хіп-хоп-танець із dance1.mp4, а ведмідь bear.png — брейкданс із dance2.mp4. Кінцевий результат має бути одним безперервним кадром без монтажних склеювань.

Надихаючі ідеї для того, що можна створити

Ось кілька ідей, які показують, як розробники можуть застосувати ці нові можливості у власних інструментах і творчих робочих процесах.

У цьому застосунку можна додати перший і останній кадри та згенерувати перехід між ними за допомогою готових пресетів або поля для промпту, оскільки повноконтекстне міркування Omni дає змогу отримувати реалістичні рухи камери.

Цей застосунок переміщує камеру кімнатами. Вона описує дугу, наближається, віддаляється. Він показує будинок у бажаному стані, у найкращий час доби. Він не додає меблів або деталей, яких не існує.

Творці вже генерують кілька відео, перш ніж зупинитися на потрібному. Draft Room робить це дослідження дешевим і структурованим: генеруйте 3–4 варіанти чернеток у 360p, змінюючи щоразу лише один параметр, і порівнюйте їх поруч.

Дізнайтеся, як клієнти використовують Omni Flash у виробництві

Наші клієнти вже здійснюють реальне виробництво за допомогою Gemini Omni Flash через API Agent Platform. Перегляньте створені ними відео й дізнайтеся нижче, як вони використовують модель.

Adobe інтегрувала Gemini Omni Flash в Adobe Firefly. Перегляньте це відео, щоб ознайомитися з його можливостями редагування відео.

«Gemini Omni Flash — одна з найпотужніших доступних моделей відео у Figma Weave, де полотно допомагає творчим командам розвивати кожну генерацію — додавати референси, створювати різні версії та формувати щось унікальне. Завдяки розширенням, багатшим референсним матеріалам і роздільній здатності 4K Gemini Omni Flash допомагає командам перейти від простого генерування відео до справжньої режисури». — Ітай Шифф, креативний директор Figma Weave.

«У GMI Cloud ми надаємо творцям централізований доступ до найпотужніших моделей у світі. Особливо вирізняється точність Gemini Omni Flash: деталі витримують ретельну перевірку. Для клієнтів, які створюють освітній та пояснювальний контент, де надзвичайно важливо все робити правильно, ця надійність важливіша за будь-яку окрему функцію. Omni зробила відео зі штучним інтелектом придатним для сегмента, який раніше не міг на нього покладатися». — Луїза Ґо, віцепрезидентка з маркетингу GMI Cloud.

«Omni Flash природно вписується в те, як люди вже використовують Runway: починають із промпту, зображення або відео, а потім генерують чи редагують на їхній основі. Це ще один спосіб, завдяки якому наші користувачі можуть швидко переходити між ідеями». — Джеймі Амферсон, головний креативний директор Runway.

Створюйте за допомогою Gemini Omni 1.1 Flash уже сьогодні

Таблиця цін на Gemini Omni 1.1 Flash.

Таблиця з цінами на модель Gemini Omni 1.1 Flash.

Omni 1.1 стає доступною в екосистемі розробників Google:

Відсьогодні Omni 1.1 також доступна всім передплатникам Google AI Plus, Pro та Ultra по всьому світу в Google Flow. Функція продовження сцен доступна всім передплатникам Google AI Plus, Pro та Ultra по всьому світу в застосунку Gemini.

Перекладено автоматично з англійської. Оригінал статті — за посиланням нижче.

Вперше опубліковано виданням DeepMind

Читати оригінал на DeepMind ↗

Текст і зображення належать DeepMind і наводяться тут із зазначенням авторства та посиланням на оригінальну публікацію.

← До новин

Ще новини

Усі останні новини