Google predstavil Gemini Omni 1.1 Flash pre tvorbu a úpravy videa cez API

Google uviedol model Gemini Omni 1.1 Flash, ktorý cez Gemini API prináša generovanie videa, predlžovanie scén, interpoláciu snímok aj iteratívne úpravy.

Google 27. augusta 2026 oznámil Gemini Omni 1.1 Flash, model pre generovanie a úpravu videa označený ako gemini-omni-1.1-flash. Vývojárom je dostupný cez Gemini API v prostredí Google AI Studio. Google zároveň uvádza jeho nasadenie v Gemini Enterprise Agent Platform.

Gemini Omni 1.1 Flash

Podľa technickej dokumentácie model prijíma textové aj obrazové vstupy. Cez Interactions API dokáže vytvárať video a následne ho iteratívne upravovať, teda vykonávať ďalšie zmeny nad už vytvoreným výstupom.

Gemini Omni 1.1 Flash prináša dlhšie scény a riadené prechody

Medzi oznámené funkcie patrí predĺženie existujúcej scény po 10-sekundových krokoch až do celkovej dĺžky 40 sekúnd. Model podporuje aj interpoláciu medzi prvým a posledným snímkom, čo má umožniť vytvorenie prechodu medzi dvoma zadanými obrazmi.

Ďalšou možnosťou sú video referencie s dĺžkou do troch sekúnd. Google ich uvádza ako vstupný materiál pre prácu modelu spolu s textom a obrázkami. Dokumentácia zároveň potvrdzuje podporu následných, konverzačne zadaných úprav videa.

Výstupy možno generovať v rozlíšení 360p a v predvolenom 720p. K dispozícii má byť aj upscalované 1080p alebo 4K. Google pri 360p náhľadoch deklaruje až o 60 % vyššiu rýchlosť a tretinové náklady oproti 720p. Podmienky a metodiku týchto meraní však v oznámení podrobnejšie neuviedol.

Dostupnosť cez API, Flow aj aplikáciu Gemini

Gemini Omni 1.1 Flash je podľa Google prístupný cez Gemini API v Google AI Studio. Funkcie modelu má Google nasadiť aj do služby Google Flow, kde majú byť globálne dostupné predplatiteľom programov Google AI Plus, Pro a Ultra.

Predlžovanie scén má byť pre tieto úrovne predplatného dostupné aj v aplikácii Gemini. Oznámenie však nerozpisuje úplný rozsah dostupnosti všetkých funkcií podľa krajín, ani detailné limity pre jednotlivé rozlíšenia, vstupné materiály či editovanie nahratého videa.

Pre vývojárov je podstatné najmä spojenie generovania s úpravami v API. Namiesto jednorazového vytvorenia krátkeho klipu môžu do pracovného postupu zaradiť predĺženie scény, určenie okrajových snímok pre prechod a ďalšie zmeny vytvoreného videa.

Čo bude potrebné overiť v praxi

Google vo svojich materiáloch používa vyjadrenia o štúdiovej kvalite, profesionálnej pripravenosti a lepšej konzistentnosti. Ide však o marketingové tvrdenia výrobcu, nie o nezávislé porovnávacie testy. Nezávisle zatiaľ nie je potvrdené, ako spoľahlivo model zachová identitu postáv, kontinuitu scén alebo presnosť požadovaných úprav v reálnych produkčných postupoch.

Pri nasadzovaní bude dôležitý aj cenník API, konkrétne obmedzenia jednotlivých režimov a regionálna dostupnosť. Pozornosť si vyžiadajú aj pravidlá označovania AI videí, ochrana autorských práv a obmedzenia pri práci s podobizňou ľudí.

Najbližšie testy ukážu, ako sa Gemini Omni 1.1 Flash porovná v kvalite, konzistencii a rýchlosti s konkurenčnými modelmi pre generatívne video.

Zdroje

  • Google Blog – Primárne oznámenie dátumu vydania, funkcií, integračných kanálov a deklarovanej dostupnosti v Google Flow a aplikácii Gemini.
  • Google AI for Developers – Gemini API documentation – Oficiálna technická dokumentácia potvrdzuje názov modelu, API použitie, podporované vstupy, rozlíšenia, interpoláciu a iteratívne úpravy videa.

Overené a aktualizované: 27. 08. 2026 20:33

Zdieľanie