AIskimIQ

Denní přehled zpráv z AI & technologií

Archiv/generování obrazu a videa

🎨 Generování obrazu a videa

Generativní AI pro obrázky, video a kreativní média — Sora, DALL·E, Midjourney, Stable Diffusion a další.

978 článků

Důležitost:Spuštěnímultimodal embeddings

Gemini Embedding 2: multimodální RAG a další možnosti pro vývojáře

Google zpřístupnil Gemini Embedding 2, unifikovaný multimodální model, který převádí text, obrázky, video i audio do jednotného vektorového prostoru. Příspěvek na blogu ukazuje, jak model využít při budování agentních multimodálních RAG systémů. Zdroj: developers.googleblog.com

Důležitost:SpuštěníAI image/video generation on Google TV

Gemini na Google TV umí editovat obrázky i tvořit videa

Google přinesl na Google TV novinky poháněné umělou inteligencí Gemini – uživatelé nyní mohou upravovat obrázky, vytvářet videa a brzy se dočkají i personalizovaného feedu krátkých videí ve stylu Shorts. Funkce jsou zatím dostupné jen pro vybrané uživatele. Zdroj: business-standard.com

Důležitost:ZprávaAI image/video generation on Google TV

Google TV integruje Gemini AI a nový řádek s YouTube Shorts

Google postupně zavádí do zařízení Google TV sadu funkcí poháněných AI a přidává nový řádek s krátkými videi. Novinky byly oficiálně oznámeny na blogu Googlu a staví na technologii Gemini. Zdroj: letsdatascience.com

Důležitost:ZprávaAI image/video generation on Google TV

Google TV dostane AI generování obrázků, videí i sekci krátkých klipů

Google rozšiřuje Google TV o nástroje pro generování obrázků a videí pomocí umělé inteligence. Na domovské obrazovce se navíc brzy objeví sekce s personalizovaným výběrem krátkých videí. Zdroj: socialsamosa.com

Důležitost:ZprávaAI video generation tools

Jak vytvořit příběhová videa z textu a obrázků během pár minut

Tvorba video příběhů dříve vyžadovala zdlouhavé střihání a hodiny práce. Nové AI nástroje celý proces výrazně zjednodušují a zrychlují. Zdroj: markets.financialcontent.com

Důležitost:Spuštěnímultimodal AI model with video understanding

NVIDIA Nemotron 3 Nano Omni: multimodální agent v jediném efektivním modelu

Agentní systémy dnes musí zpracovávat obrazovky, dokumenty, audio, video i text v rámci jediné smyčky od vnímání k akci. NVIDIA Nemotron 3 Nano Omni je otevřený multimodální model navržený právě pro tyto scénáře, který zvládá komplexní uvažování bez nutnosti kombinovat více specializovaných modelů. Zdroj: developer.nvidia.com

Důležitost:Zprávatext-to-video model rankings

Generování videa z textu: nejlepší AI modely roku 2026

V dubnu 2026 obsadil první místo žebříčku model dreamina-seedance-2.0-720p, který na platformě Arena získal nejvyšší celkové hodnocení mezi nástroji pro převod textu na video. Konkurence v této oblasti rychle roste a kvalita výstupů se meziročně výrazně zlepšila. Zdroj: statista.com

Důležitost:ZprávaGrok image generation for creators

Generování obrázků v Groku: co by měli tvůrci vědět

Nástroje postavené na Groku posouvají možnosti AI generování vizuálního obsahu o další krok vpřed. Platforma nabízí tvorbu obrázků s méně omezeními, což otevírá nové možnosti i otázky pro kreativní tvůrce. Zdroj: thisdaylive.com

Důležitost:SpuštěníAI image generation tool

ReelTime spustil bezplatný AI nástroj pro generování obrázků s čitelným textem

Nástroj RI je dostupný zdarma na TryRINow.com a ReelTime u něj zdůrazňuje přidaný krok doostření výstupu. Výsledkem jsou čitelné texty přímo v obrázcích a layouty připravené pro marketing s minimem dodatečných úprav. Zdroj: stocktitan.net

Důležitost:Zprávamultimodal AI model with video understanding

Nvidia odhaluje zákulisí moderního multimodálního modelu s Nemotron 3 Nano Omni

Nvidia vydala otevřený multimodální model Nemotron 3 Nano Omni podporující text, obraz, video i zvuk. Zajímavý je nejen jeho výkon, ale také pohled do architektury a přístupů, které stojí za moderními multimodálními systémy. Zdroj: the-decoder.com

Důležitost:NázorSora discontinuation

Konec Sory odhaluje hlubší problémy s kreativním využitím AI

OpenAI oficiálně ukončilo provoz svého nástroje pro generování videí Sora dne 26. dubna 2026. Zánik tohoto produktu poukazuje na širší potíže, s nimiž se umělá inteligence potýká při praktickém uplatnění v kreativních oborech. Zdroj: theconversation.com

Důležitost:Zpráva

fal spouští HappyHorse-1.0: nejlépe hodnocený AI video model s API přístupem

Nový špičkový video model HappyHorse je od 27. dubna dostupný přes generativní mediální cloud platformy fal pro vývojáře i firmy. fal se stává oficiálním API partnerem pro tento model. Zdroj: streetinsider.com

Důležitost:Zpráva

Alibaba spouští HappyHorse 1.0 a integruje model do aplikace Qwen

Alibaba (09988.HK) oznámila zahájení beta testování svého video generativního modelu HappyHorse 1.0, který využívá společné zpracování audia a videa. Model je nově integrován také do aplikace Qwen, čímž se stává přístupným širšímu okruhu uživatelů. Zdroj: aastocks.com

Důležitost:Zpráva

Nano Banana mění přístup ke kvalitě prvního snímku ve videu

Při použití Nano Banana AI pro generování výchozího záběru ve skutečnosti nastavujete celkový vizuální tón a barevnou gradaci celého videa. Kvalita prvního snímku tak zásadně ovlivňuje výsledný dojem z celé produkce. Zdroj: nerdbot.com

Důležitost:Zpráva

Google Veo a Asset Studio: Stojí to za to?

Éra odkládání video produkce kvůli rozpočtu je minulostí. Kreativní AI suite Googlu zahrnující Veo a Nano Banana Pro v roce 2026 zpřístupňuje profesionální tvorbu videí i menším týmům a tvůrcům obsahu. Zdroj: browsermedia.agency

Důležitost:Zpráva

Instagram přidává AI generování videa z textových popisů

Instagram rozšiřuje svou platformu o nový AI nástroj, který uživatelům umožňuje vytvářet video klipy přímo z textových promptů. Novinka výrazně zjednodušuje tvorbu videí bez nutnosti složitého střihu nebo produkce. Zdroj: dataconomy.com

Důležitost:Zpráva

Prime Video odhalilo trailer k seriálu Spider-Noir s Nicolasem Cagem

Prime Video představilo nový trailer k živě hranému marvelovskému seriálu Spider-Noir, v němž Nicolas Cage ztvárňuje Bena Reillyho – vysloužilého vigilanta vráceného do stínů New Yorku 30. let. Datum premiéry zatím nebylo upřesněno. Zdroj: facebook.com

Důležitost:Zpráva

Alibaba spouští beta testování video modelu HappyHorse 1.0

Alibaba zahájila beta testování svého modelu HappyHorse 1.0 pro generování videa, který umožňuje vytvářet AI klipy až v délce 15 sekund. Model nabízí vícejazyčnou podporu a je určen pro vývojáře i firemní zákazníky. Zdroj: pandaily.com

Důležitost:Zpráva

Konec Sory odhalil nákladné limity AI generování videa

OpenAI officiálně ukončilo provoz svého nástroje pro generování videa Sora dne 26. dubna 2026. Odborníci na počítačové vědy, kteří s nástrojem pracovali, upozorňují na zásadní technická i kreativní omezení, která jeho využití komplikovaly. Zdroj: msn.com

Důležitost:Zpráva

OpenAI představuje Image Generation 2.0 s podporou složitých vizuálních scén

OpenAI uvedlo Image Generation 2.0, nový model zaměřený na tvorbu komplexních vizuálních kompozic a narativního umění. Model přináší výrazné zlepšení oproti předchozí generaci zejména v oblasti detailních a vícevrstvých scén. Zdroj: trendhunter.com