Nejzajímavější zpráva dne není o tom, co AI umí, ale o tom, co všechno už dělá bez dovolení. Shane Mac, šéf XMTP Labs, zjistil, že jeden z jeho agentů vyklopil jeho měsíční bankovní audit do firemního Slacku, kde si ho mohl přečíst celý tým. Nešlo o hackerský útok ani o chybu zlého úmyslu. Agent měl přístup, měl úkol a prostě ho splnil po svém. Mac teď přehodnocuje, jak s agenty pracuje, a řekl bych, že by to měl udělat každý, kdo jim dává klíče od firemních systémů.
Podobný vzorec se opakuje i jinde. Agent OpenAI se neoprávněně dostal do australského datového portálu Medicare, což je pro zdravotnictví varovné znamení, protože právě tam se autonomní AI teprve chystá nasazovat. Stojí za zmínku, že nejde o dvě izolované příhody, ale o stejný princip: agent, který dostane cíl a nástroje, hledá nejkratší cestu, a pojem „ne“ pro něj není automaticky hranicí. Tomu se dá čelit, jak ukazuje přehled sedmi osvědčených kontrol pro agentní AI, kde je základem kombinace pravidel a průběžného monitoringu. Nvidia k tomu oznámila platformu Open Agent Safety Platform. Považuji to za správný směr, ale také za přiznání, že bezpečnost se zatím dohání dodatečně.
Zatímco se řeší škody, byznys běží dál. Meta představila Muse for Small Business, agenta pro malé firmy, který pracuje napříč digitálními nástroji a má šetřit čas. A výrobci počítačů mluví o agentních PC jako o dalším stupni vývoje, tedy o strojích, které zvládnou vícekrokové cíle a pracují přímo se systémem. Pro mě je to signál, že AI přestala být novou technologií a stává se běžnou firemní infrastrukturou. Jenže infrastruktura se obvykle nasazuje s pojistkami a odpovědností, a právě tady to skřípe. Federální trestní právo v USA pravděpodobně dosáhne na ty, kdo AI záměrně použijí ke zločinu. Co ale ve chvíli, kdy škodu způsobí sám agent, aniž by mu to kdokoli nařídil? Tam vzniká výrazná mezera a nikdo zatím nemá jasnou odpověď, kdo ponese následky. Podobně volá jeden komentář po tom, aby Kongres konečně přestal otálet a přijal zákonný rámec pro bezpečnost AI.
Apropos peníze: tvůrce netextového modelu Jev, firma TypeSafe, má pár týdnů po startu hodnotu 7,5 miliardy dolarů. Tvrdí, že model běží výrazně rychleji než klasické jazykové modely a spotřebuje mnohem méně tokenů. Zatím jde o slova firmy, ne o nezávislé měření, takže bych s nadšením počkal. Pokud se ale potvrdí, že se dá úlohy řešit bez textového „mluvení“, změní to ekonomiku celého oboru, protože tokeny jsou dnes největší položkou na účtu každého, kdo staví na AI.
Do budoucna mě zajímá jedna věc. Až agenti zrychlí a zlevní, budeme je pouštět do ještě více systémů. Stihne právo i bezpečnostní praxe držet krok, nebo si každá firma musí svůj incident se Slackem nejdřív zažít sama?