Az Google új fejlesztése, az Gemini Omni 1.1 Flash jelentős előrelépést hoz az AI-alapú videógenerálás területén. A modell nemcsak gyorsabb és költséghatékonyabb, hanem új funkcióival a fejlesztők számára is rugalmasabb és kreatívabb lehetőségeket biztosít.
Az új modell már nem csak az utolsó másodpercet, hanem az elmúlt tíz másodpercet elemzi a jelenet meghosszabbításakor, így vizuálisan következetesebb folytatásokat képes generálni. Jeleneteket tíz másodperces lépésekben akár negyven másodpercig lehet bővíteni, ami jelentősen javítja az AI-videók minőségét és rugalmasságát [^1].
A fejlesztők mostantól akár három másodperces külső videót is feltölthetnek stílusreferenciaként, amely alapján a rendszer át tudja venni a karakterek vagy mozgások stílusát. Ezzel személyre szabottabb és egyedibb AI-videók készíthetők.
Újdonság, hogy lehetőség van kezdő- és végkép megadására, melyek között az Gemini Omni 1.1 Flash automatikusan generál kameramozgást. Ez a funkció különösen fontos lehet a filmszerű jelenetek készítésénél.
Egy 360p-s előnézeti mód akár 60%-kal gyorsabb működést kínál, harmad akkora költségen a 720p-hez képest. A videók minősége később feljavítható 1080p-re vagy 4K-ra is [^1].
Az Gemini Omni 1.1 Flash az Google AI Studio és a fejlesztői dokumentáció felületén is elérhető.
Az új funkciók – például a külső stílusreferenciák, a keyframe-ek és a gyorsabb, olcsóbb előnézeti mód – jelentősen kiszélesítik az AI-alapú videóalkalmazások lehetőségeit, a tartalomgyártástól a reklámiparon át a filmiparig.
Az Gemini Omni 1.1 Flash új korszakot nyit az AI-videógenerálásban, ahol a rugalmasság, a minőség és a költséghatékonyság egyszerre érvényesül. Az elérhető fejlesztői eszközök és kedvező árak révén a mesterséges intelligencia még több kreatív területen lehet meghatározó szereplő.
[^1]: The Decoder (2026-08-27). “Gemini Omni 1.1 Flash: Google macht KI-Videogenerierung günstiger und flexibler”. Közzétéve [2026. 08. 27.].