Generativní AI pro obrázky, video a kreativní média — Sora, DALL·E, Midjourney, Stable Diffusion a další.
978 článků
Důležitost:ZprávaGemini Omni multimodal video creation
Google představil Gemini Omni – multimodální AI model pro tvorbu a střih videa
Nový model Gemini Omni od Googlu umožňuje generovat a upravovat videa na základě textových promptů, ručně kreslených skic, ilustrací nebo existujících videí jako stylistických referencí. Model podporuje i strukturované skripty pro přesnější kontrolu nad výsledným obsahem. Zdroj: adgully.com
Důležitost:ZprávaNVIDIA LongLive-2.0 real-time video generation
NVIDIA představila LongLive-2.0: lehký AI model pro generování videa v reálném čase
Model LongLive-2.0 od NVIDIE je navržen s ohledem na FP4 kvantizaci, díky níž dosahuje vysoké kvality generování videa při nízkých nárocích na hardware. Cílem je umožnit generování videa v reálném čase i na méně výkonných zařízeních. Zdroj: gigazine.net
Důležitost:ZprávaGemini Omni video editing launch
Gemini Omni: Google míří na AI tvorbu a editaci videa
Nejnovější model Googlu umožňuje upravovat videa pomocí konverzačních promptů a zároveň udržuje kontinuitu napříč scénami, postavami i vizuálními prvky. Jde o výrazný krok vpřed v oblasti AI nástrojů pro videoobsah. Zdroj: afaqs.com
Důležitost:ZprávaGemini Omni video editing in Google Flow
Google přidává Gemini Omni pro střih videí do Flow
Google postupně nasazuje model Gemini Omni Flash do aplikace Gemini, nástroje Google Flow a platformy YouTube Shorts. Nová funkce výrazně rozšiřuje možnosti AI editace videí napříč produkty společnosti. Zdroj: letsdatascience.com
Důležitost:ZprávaGoogle Gemini Omni launch coverage
Google spouští Gemini Omni s rozšířenými AI schopnostmi
Google představil model Gemini Omni, který výrazně rozšiřuje možnosti generování obsahu poháněného AI. Nový model umožňuje uživatelům vytvářet plně integrovaná videa a posouvá schopnosti platformy Gemini na novou úroveň. Zdroj: entarabi.com
Důležitost:ZprávaAvatar video generation — open model release
Meituan zvyšuje tlak na startupy s avatary vydáním open-source modelu
Čínská společnost Meituan vydala open-source model LongCat-Video-Avatar 1.5 určený pro generování avatar videí s možností lokálního nasazení. Tento krok zvyšuje konkurenční tlak na startupy specializující se na syntetické video avatary. Zdroj: startupfortune.com
Důležitost:ZprávaYouTube AI video creator tools
YouTube umožní tvůrcům vkládat sebe sama do cizích videí pomocí AI
YouTube plánuje využít AI k tomu, aby tvůrci mohli digitálně vložit svou podobu do videí jiných autorů. Trh s AI generováním videí měl v roce 2025 hodnotu přibližně 551,7 milionu dolarů a očekává se jeho růst s ročním tempem 18,37 % až do roku 2035. Zdroj: sphericalinsights.com
Důležitost:ZprávaGoogle Gemini Omni multimodal video generation
Google unveils Gemini Omni, a multimodal AI model that generates video from text, images, and audio
Google DeepMind unveiled Gemini Omni at Google I/O, a multimodal AI model family for video generation with implications for decentralized compute and Web3... Zdroj: cryptobriefing.com
Důležitost:ZprávaGoogle Gemini Omni AI video production
Google Signals AI Video’s Shift From Clip Generation To Production
Google used its latest I/O event this week to introduce Gemini Omni Flash, a new AI model that can take text, photos, video, and audio as inputs,... Zdroj: forbes.com
Důležitost:NázorGemini Omni vs Seedance 2.0 comparison
Gemini Omni VS Seedance 2.0: Who is the true king of video models?
Gemini Omni is more like a future-oriented video editor, while Seedance 2.0 is a more mature AI video generation tool for today. Zdroj: panewslab.com
Důležitost:NázorGoogle I/O Gemini Omni recap
Google I/O Recap
Gemini Omni is a multi-modal video/audio/text input-output model that, as the “Nano Banana for video,” can restyle any video on command into another format. Zdroj: patmcguinness.substack.com
Důležitost:ZprávaAI video generation landscape
Závod v AI videu přesahuje pouhé efektní klipy
Google na letošním I/O představil Gemini Omni Flash, nový AI model schopný zpracovávat text, fotografie, video i zvuk. Závod v oblasti AI videa se rychle posouvá za hranice generování vizuálně atraktivního obsahu. Zdroj: forbes.com
Důležitost:Zprávacreative tools integration with Gemini
Adobe, Canva i CapCut míří do Gemini pro editaci AI obsahu
Populární kreativní nástroje Adobe, Canva a CapCut plánují nabídnout své funkce přímo uvnitř Google AI chatbotu Gemini. Uživatelé tak budou moci upravovat AI generovaný obsah bez nutnosti přepínat mezi aplikacemi. Zdroj: pcmag.com
Důležitost:ZprávaByteDance Lance multimodal model
ByteDance vydal multimodální model Lance jako open source
ByteDance zveřejnil multimodální model Lance, nativně jednotný systém zvládající porozumění, generování i editaci obrázků a videí. Model je dostupný jako open source a představuje ByteDance jako vážného hráče v oblasti unifikovaných multimodálních AI systémů. Zdroj: letsdatascience.com
Tencent's L2P vrací generování obrazu v pixel prostoru do hry
Výzkumníci z Tencent Youtu Lab a Nanjingské univerzity představili metodu L2P, která přenáší schopnosti latentních difuzních modelů – například od Alibaby – přímo do pixel prostoru. Přístup slibuje praktičtější využití generování obrazu bez závislosti na latentních reprezentacích. Zdroj: startupfortune.com
Důležitost:VýzkumByteDance Lance unified image/video model
ByteDance vydal Lance: jeden model pro obrázky i video
ByteDance představil Lance, nativně unifikovaný multimodální model s 3 miliardami parametrů určený pro porozumění, generování a editaci obrázků i videí. Jde o jeden model pokrývající tři klíčové modality najednou. Zdroj: marktechpost.com
Důležitost:ZprávaGemini Omni multimodal video generation
Google představil Gemini Omni: obraz, text, video i zvuk v jednom výstupu
Na Google I/O 2026 představil technologický gigant nový multimodální AI model Gemini Omni, který dokáže vytvářet a upravovat videa pomocí textu, obrázků, zvuku i videa. Model spojuje všechny čtyři modality do jediného výstupu, což výrazně rozšiřuje možnosti generativní AI. Zdroj: ndtvprofit.com
Důležitost:ZprávaGemini Omni video generation
Google spouští Gemini Omni: nová rodina AI modelů pro tvorbu videa
Google odhalil Gemini Omni, novou sadu generativních AI modelů schopných vytvářet a upravovat video z kombinace textu, obrázků, zvuku i existujících videí. Představení proběhlo v rámci každoroční konference Google I/O. Zdroj: thedailystar.net
Důležitost:NázorGemini Omni creative workflow impact
Gemini Omni: nová éra AI videa a kreativních workflow
Představení Gemini Omni na letošním Google I/O naznačuje novou fázi vývoje, v níž se AI video stává praktičtějším, lépe ovladatelným a použitelnějším pro každodenní tvůrčí práci. Model překračuje hranice dosavadního přístupu text-to-video. Zdroj: ipsnews.net
Důležitost:ZprávaGemini Omni video generation
Google spustil Gemini Omni – text a obrázky promění ve video
Google uvedl nový model Gemini Omni zaměřený na rozšíření generativních AI schopností v oblasti videa a vizuálního obsahu. Krok posiluje postavení společnosti v rychle rostoucím závodu o dominanci v AI videu. Zdroj: jawlah.co