Zajímavé na dnešních zprávách není to, že Google vydal další špičkový model, ale to, kam míří jeho marketing. Gemini 4 Argon se neprezentuje jako chytřejší konverzační partner, nýbrž jako pracovní kůň pro programování, firemní znalostní práci a kybernetickou obranu. Soutěž o to, kdo má nejlepší chatbot, tiše končí a začíná soutěž o to, kdo nahradí skutečnou práci. Že Google označuje Argon za svůj dosud nejschopnější model, je samozřejmě standardní formule. Podstatné je, na jaké úlohy ho cílí.
Stejným směrem jde Microsoft. Copilota přestavěl od základů: přidal agenty Autopilot, možnost vytvářet aplikace v přirozeném jazyce přes Code a hlubší propojení s Office. Já v tom vidím posun od asistenta, který čeká na zadání, k agentovi, který si úkoly bere sám. A kdo dnes na Copilotovi nebo Gemini něco staví, měl by počítat s tím, že se pod ním podlaha mění rychleji, než stačí aktualizovat dokumentaci.
Apropos agenti. CGI Federal a Amazon Web Services sestavily katalog AI agentů pro federální agentury v USA, od kybernetické obrany přes odhalování podvodů po zpracování dávek. Stojí za zmínku, že vláda není zrovna segment, který by novinky přijímal první. Pokud se tam agenti katalogizují jako hotové stavební kameny, znamená to, že přestali být experimentem a stali se položkou v nákupním řádu. A právě tady se dotýkáme otázky, kterou nikdo nechce řešit příliš nahlas: kdo ručí, když agent, který rozhoduje o dávkách, udělá chybu?
Regulátoři a samotní výzkumníci se totiž začínají ptát podobně. Americký Federální obchodní úřad zahájil šetření předních laboratoří včetně Anthropicu a OpenAI kvůli rizikům pro spotřebitele. Současně současní i bývalí výzkumníci z OpenAI a Google DeepMind podle Reuters varují, že firmy spěchají se systémy, které se dokážou samy zlepšovat, a bezpečnostní obavy přitom zůstávají nevyřešené. Považuji to za znepokojivé hlavně kvůli časování. Přesně ve chvíli, kdy modely dostávají větší autonomii a vstupují do úřadů a firem, se zrychluje i vývoj těch nejméně pochopených schopností. Šetření FTC přitom sotva něco zabrzdí. Spíš ukazuje, že odpovědnost se bude řešit zpětně, až po škodě.
Pro vyváženost jedna lehčí poznámka. Anthropic minulý týden vydal Claude Opus 5.5, který používá o 99 procent méně dlouhých pomlček a zní lidštěji. Analýza ovšem v jeho textech stále nachází 2 548 typických znaků AI psaní. Připadá mi to symptomatické: kosmetika se zlepšuje rychleji než podstata. A Apple? Jeho Siri postavená na LLM, která má konkurovat ChatGPT, dorazí nejdřív s iOS 19, tedy v době, kdy ostatní už budou řešit agenty.
Otázka, kterou si z dnešního dne odnáším, zní: pokud schopnosti rostou rychleji než dohled, kdo se stane tím, kdo bude brzdit, a podle jakých pravidel?