AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/generování obrazu a videa

🎨 Generování obrazu a videa

Generativní AI pro obrázky, video a kreativní média — Sora, DALL·E, Midjourney, Stable Diffusion a další.

978 článků

Důležitost:ZprávaGemini Omni multimodal video creation

Google představil Gemini Omni – multimodální AI model pro tvorbu a střih videa

Nový model Gemini Omni od Googlu umožňuje generovat a upravovat videa na základě textových promptů, ručně kreslených skic, ilustrací nebo existujících videí jako stylistických referencí. Model podporuje i strukturované skripty pro přesnější kontrolu nad výsledným obsahem. Zdroj: adgully.com

Důležitost:ZprávaNVIDIA LongLive-2.0 real-time video generation

NVIDIA představila LongLive-2.0: lehký AI model pro generování videa v reálném čase

Model LongLive-2.0 od NVIDIE je navržen s ohledem na FP4 kvantizaci, díky níž dosahuje vysoké kvality generování videa při nízkých nárocích na hardware. Cílem je umožnit generování videa v reálném čase i na méně výkonných zařízeních. Zdroj: gigazine.net

Důležitost:ZprávaGemini Omni video editing launch

Gemini Omni: Google míří na AI tvorbu a editaci videa

Nejnovější model Googlu umožňuje upravovat videa pomocí konverzačních promptů a zároveň udržuje kontinuitu napříč scénami, postavami i vizuálními prvky. Jde o výrazný krok vpřed v oblasti AI nástrojů pro videoobsah. Zdroj: afaqs.com

Důležitost:ZprávaGemini Omni video editing in Google Flow

Google přidává Gemini Omni pro střih videí do Flow

Google postupně nasazuje model Gemini Omni Flash do aplikace Gemini, nástroje Google Flow a platformy YouTube Shorts. Nová funkce výrazně rozšiřuje možnosti AI editace videí napříč produkty společnosti. Zdroj: letsdatascience.com

Důležitost:ZprávaGoogle Gemini Omni launch coverage

Google spouští Gemini Omni s rozšířenými AI schopnostmi

Google představil model Gemini Omni, který výrazně rozšiřuje možnosti generování obsahu poháněného AI. Nový model umožňuje uživatelům vytvářet plně integrovaná videa a posouvá schopnosti platformy Gemini na novou úroveň. Zdroj: entarabi.com

Důležitost:ZprávaAvatar video generation — open model release

Meituan zvyšuje tlak na startupy s avatary vydáním open-source modelu

Čínská společnost Meituan vydala open-source model LongCat-Video-Avatar 1.5 určený pro generování avatar videí s možností lokálního nasazení. Tento krok zvyšuje konkurenční tlak na startupy specializující se na syntetické video avatary. Zdroj: startupfortune.com

Důležitost:ZprávaYouTube AI video creator tools

YouTube umožní tvůrcům vkládat sebe sama do cizích videí pomocí AI

YouTube plánuje využít AI k tomu, aby tvůrci mohli digitálně vložit svou podobu do videí jiných autorů. Trh s AI generováním videí měl v roce 2025 hodnotu přibližně 551,7 milionu dolarů a očekává se jeho růst s ročním tempem 18,37 % až do roku 2035. Zdroj: sphericalinsights.com

Důležitost:ZprávaGoogle Gemini Omni multimodal video generation

Google unveils Gemini Omni, a multimodal AI model that generates video from text, images, and audio

Google DeepMind unveiled Gemini Omni at Google I/O, a multimodal AI model family for video generation with implications for decentralized compute and Web3... Zdroj: cryptobriefing.com

Důležitost:ZprávaGoogle Gemini Omni AI video production

Google Signals AI Video’s Shift From Clip Generation To Production

Google used its latest I/O event this week to introduce Gemini Omni Flash, a new AI model that can take text, photos, video, and audio as inputs,... Zdroj: forbes.com

Důležitost:NázorGemini Omni vs Seedance 2.0 comparison

Gemini Omni VS Seedance 2.0: Who is the true king of video models?

Gemini Omni is more like a future-oriented video editor, while Seedance 2.0 is a more mature AI video generation tool for today. Zdroj: panewslab.com

Důležitost:NázorGoogle I/O Gemini Omni recap

Google I/O Recap

Gemini Omni is a multi-modal video/audio/text input-output model that, as the “Nano Banana for video,” can restyle any video on command into another format. Zdroj: patmcguinness.substack.com

Důležitost:ZprávaAI video generation landscape

Závod v AI videu přesahuje pouhé efektní klipy

Google na letošním I/O představil Gemini Omni Flash, nový AI model schopný zpracovávat text, fotografie, video i zvuk. Závod v oblasti AI videa se rychle posouvá za hranice generování vizuálně atraktivního obsahu. Zdroj: forbes.com

Důležitost:Zprávacreative tools integration with Gemini

Adobe, Canva i CapCut míří do Gemini pro editaci AI obsahu

Populární kreativní nástroje Adobe, Canva a CapCut plánují nabídnout své funkce přímo uvnitř Google AI chatbotu Gemini. Uživatelé tak budou moci upravovat AI generovaný obsah bez nutnosti přepínat mezi aplikacemi. Zdroj: pcmag.com

Důležitost:ZprávaByteDance Lance multimodal model

ByteDance vydal multimodální model Lance jako open source

ByteDance zveřejnil multimodální model Lance, nativně jednotný systém zvládající porozumění, generování i editaci obrázků a videí. Model je dostupný jako open source a představuje ByteDance jako vážného hráče v oblasti unifikovaných multimodálních AI systémů. Zdroj: letsdatascience.com

Důležitost:Výzkumpixel-space image generation / diffusion models

Tencent's L2P vrací generování obrazu v pixel prostoru do hry

Výzkumníci z Tencent Youtu Lab a Nanjingské univerzity představili metodu L2P, která přenáší schopnosti latentních difuzních modelů – například od Alibaby – přímo do pixel prostoru. Přístup slibuje praktičtější využití generování obrazu bez závislosti na latentních reprezentacích. Zdroj: startupfortune.com

Důležitost:VýzkumByteDance Lance unified image/video model

ByteDance vydal Lance: jeden model pro obrázky i video

ByteDance představil Lance, nativně unifikovaný multimodální model s 3 miliardami parametrů určený pro porozumění, generování a editaci obrázků i videí. Jde o jeden model pokrývající tři klíčové modality najednou. Zdroj: marktechpost.com

Důležitost:ZprávaGemini Omni multimodal video generation

Google představil Gemini Omni: obraz, text, video i zvuk v jednom výstupu

Na Google I/O 2026 představil technologický gigant nový multimodální AI model Gemini Omni, který dokáže vytvářet a upravovat videa pomocí textu, obrázků, zvuku i videa. Model spojuje všechny čtyři modality do jediného výstupu, což výrazně rozšiřuje možnosti generativní AI. Zdroj: ndtvprofit.com

Důležitost:ZprávaGemini Omni video generation

Google spouští Gemini Omni: nová rodina AI modelů pro tvorbu videa

Google odhalil Gemini Omni, novou sadu generativních AI modelů schopných vytvářet a upravovat video z kombinace textu, obrázků, zvuku i existujících videí. Představení proběhlo v rámci každoroční konference Google I/O. Zdroj: thedailystar.net

Důležitost:NázorGemini Omni creative workflow impact

Gemini Omni: nová éra AI videa a kreativních workflow

Představení Gemini Omni na letošním Google I/O naznačuje novou fázi vývoje, v níž se AI video stává praktičtějším, lépe ovladatelným a použitelnějším pro každodenní tvůrčí práci. Model překračuje hranice dosavadního přístupu text-to-video. Zdroj: ipsnews.net

Důležitost:ZprávaGemini Omni video generation

Google spustil Gemini Omni – text a obrázky promění ve video

Google uvedl nový model Gemini Omni zaměřený na rozšíření generativních AI schopností v oblasti videa a vizuálního obsahu. Krok posiluje postavení společnosti v rychle rostoucím závodu o dominanci v AI videu. Zdroj: jawlah.co