Zatímco Alibaba tento týden mluvila o modelu s deseti biliony parametrů, mnohem zajímavější zprávu tvořila menší firma TypeSafe AI se svým modelem Jev. Deset bilionů parametrů zní impozantně, ale připomíná mi to spíš závody ve zbrojení, kde se vítězí velikostí, ne chytrostí. Jev jde přesně opačným směrem – tvrdí, že u klasifikačních úloh dokáže být 75krát rychlejší a 170krát levnější než modely OpenAI. Pokud se tato čísla aspoň zčásti potvrdí v nezávislých testech, jde o důležitý signál: ne každá firma potřebuje obří generalistický model, často stačí úzce specializovaný nástroj, který dělá jednu věc extrémně efektivně.
Alibaba mezitím řeší úplně jiný problém – jak vůbec takové modely provozovat. Firma spustila výrobu vlastního AI čipu, který má do roku 2032 pohánět 20 GW datacenter, a prezentuje ho jako reálného konkurenta Nvidii na čínském trhu. To dává smysl v kontextu amerických exportních omezení – Čína si prostě nemůže dovolit spoléhat na cizí hardware, pokud chce trénovat modely v řádu bilionů parametrů. Podobným směrem jde i výzkum týmu z Georgia Tech, Nvidie a Stanfordu, který představil systém BOOST. Ten během inference současně využívá HBM paměť i paměť hostitelského serveru, čímž odstraňuje jedno z hlavních úzkých hrdel při nasazení velkých modelů. Infrastruktura je letos možná nudnější téma než nové modely, ale právě tady se rozhoduje, kdo si AI vůbec bude moci dovolit provozovat ve velkém.
Zatímco jedni řeší rychlost a náklady, jiní řeší bezpečnost – a ne úspěšně. Anthropic, OpenAI i Google v poslední době čelily bezpečnostním incidentům u svých modelů, včetně Gemini. Opakující se průlomy naznačují, že současné obranné mechanismy LLM jsou spíš záplatami než skutečným řešením. Stojí za zmínku, že se to děje právě ve chvíli, kdy tyto firmy tlačí své modely do stále autonomnějších rolí – jako AI agenti, kteří nakupují, rozhodují a jednají jménem uživatelů.
Apropos agenti – spor mezi Amazonem a Metou kolem AI agenta Muse ukazuje, že tahle bezpečnostní nervozita už dorazila i do obchodu. Amazon Muse zablokoval kvůli obavám o data, zatímco Shopify mu naopak otevřel dveře k dokončování nákupů napříč partnerskými e-shopy. Vzniká tak zajímavé rozdělení trhu: jedna platforma agentům nedůvěřuje, druhá na ně vsází jako na konkurenční výhodu. Otázka, kdo bude mít pravdu, se podle mě rozhodne v příštím roce – a bude záviset hlavně na tom, jestli firmy jako Anthropic nebo OpenAI dokážou konečně vyřešit ty bezpečnostní díry, které zatím jen opakovaně objevují.