Nejzajímavější zpráva dneška vlastně není o žádném novém modelu, ale o tom, jak snadno se AI dá obrátit proti svému tvůrci. Bezpečnostní tým Wiz použil autonomního red-teamového agenta k proniknutí do interní Jiry Snowflaku – a cesta dovnitř vedla přes chybu, kterou do kódu propašoval GitHub Copilot v rámci běžného pull requestu. Nejde o exotický útok zvenčí, ale o důsledek běžné, každodenní praxe: vývojář si nechá poradit od AI asistenta, kód projde review a nikdo si nevšimne díry, dokud ji nenajde jiná AI. Je to elegantní ukázka toho, že bezpečnostní rizika agentické éry nevznikají jen tam, kde bychom je čekali – tedy u samotných agentů v provozu –, ale i v nástrojích, které používáme k jejich stavbě.
Apropos provoz – právě tam se podle mě láme chleba u celého tématu agentické AI. Čerstvý průzkum ukazuje to, co jsem už nějakou dobu tušil: skoro každá firma dnes AI nějak používá, ale jen hrstka dokáže agentický projekt dostat z pilotu do plného nasazení. Oracle na to reaguje typicky korporátně – nabízí kombinaci AI Data Platform a Oracle Integration s tím, že problém prý není agenty postavit, ale bezpečně je provozovat ve velkém měřítku. To je přesně ta věta, kterou bych čekal od firmy prodávající infrastrukturu, ale zároveň má pravdu. Postavit demo agenta je dnes otázka odpoledne. Udržet ho v produkci, kde má přístup k reálným datům a rozhoduje o reálných věcech, je úplně jiná liga.
Zajímavou odpověď na tenhle problém nabízí izraelský startup xpander, který právě získal 7,5 milionu dolarů v seed kole. Jejich sázka je jednoduchá: agentní framework je jen vyměnitelná komponenta, skutečnou hodnotu má vrstva kontroly a kontextu, kterou si firma drží pod vlastní rukou. Je to chytrý postřeh v době, kdy se firmy zaklínají LangSmithem nebo CrewAI, jako by šlo o strategické rozhodnutí na roky – přitom realita je taková, že tyhle frameworky se budou měnit rychleji než firemní procesy kolem nich. Že zároveň představili agenta Omni se skóre 90,9 % v benchmarku GAIA, beru s rezervou; benchmarky jsou marketing, vlastnictví a kontrola nad agenty ve firmě je byznys.
Mimochodem, pondělní několikahodinový výpadek GitHubu – včetně Copilota – je dobrá připomínka toho, jak křehká je infrastruktura, na které dnes stojí prakticky celý vývojářský svět. Když spadne jedna platforma, zastaví se práce milionům lidí najednou. Otázka, kterou bych si kladl: kolik firem má vůbec plán B, když jejich AI agenti a nástroje jsou tak silně navázané na jednu centralizovanou platformu?