Čínský AI agent překonal Claude Code od Anthropic v autonomním výzkumu
Qiushi Engine z Zhejiang University se umístil na první příčce žebříčku ResearchClawBench, spolehlivě generovat nové vědecké objevy ale zatím neumí. scmp.com
středa 22. července 2026 | 42 článků
Čínský AI agent podle všeho překonal Claude Code od Anthropicu v úlohách autonomního výzkumu, zatímco nový index bezpečnosti AI zjistil, že žádná velká laboratoř nedosáhla hodnocení lepšího než C+, jelikož bezpečnostní závazky odvětví slábnou. Microsoft mezitím prohloubil partnerství s Mistralem s cílem poskytnout evropským podnikům a regulovaným odvětvím kontrolovatelnou špičkovou AI, a EU dokončila pravidla pro označování AI obsahu, přestože technologie zatím za tímto mandátem zaostává.
Zpráva, která by před dvěma lety zněla jako science fiction, dnes proklouzla mezi ostatními titulky skoro bez povšimnutí: čínský agent Qiushi Engine z Zhejiang University porazil Claude Code od Anthropic v žebříčku ResearchClawBench, který měří schopnost autonomně provádět výzkumnou práci. Ne, žádné nové vědecké objevy generovat zatím neumí – a to je důležitý detail, který se v nadpisech ztrácí. Ale fakt, že čínský model už dokáže lépe než přední americký nástroj plánovat a provádět výzkumné úkoly, je signál, který bych nepodceňoval. Ukazuje to, jak rychle se stírá technologický náskok, o kterém jsme si ještě před rokem mysleli, že je stabilní.
Zajímavé je, že tahle zpráva přichází ve stejném týdnu, kdy se čím dál víc mluví o „agent harness" – tedy o vrstvě, která agentům umožňuje běžet dlouhodobě, volat nástroje, ukládat si kontext a plánovat kroky napříč hodinami nebo dny. Firmy jako Harness Inc. se teď snaží tuhle vrstvu zkrotit tak, aby zapadla do zavedených vývojářských postupů – v podstatě přenášejí DevOps disciplínu na agenty. Souběžně vzniká i akademický rámec pro technické a politické řízení téhle runtime vrstvy a Phillip Spies řeší konkrétní bezpečnostní díru mezi daty a objekty v architekturách postavených na AWS službách. Všechno tohle dohromady ukazuje jedno: agentní AI přestává být demo a stává se infrastrukturou, kterou je potřeba spravovat, zabezpečit a auditovat stejně pečlivě jako jakýkoli jiný produkční systém. Kdo tohle podcení, bude řešit incidenty, ne inovace.
Apropos bezpečnost – nejnovější AI Safety Index přišel s dost otřesným zjištěním. Žádná velká laboratoř nezískala lepší známku než C+, tři propadly úplně a několik firem potichu ustupuje od bezpečnostních závazků, které samy dřív veřejně deklarovaly. To mi přijde jako mnohem větší story než jakýkoli benchmark. Máme tu odvětví, které si samo nastavuje laťku a pak ji samo snižuje, protože konkurenční tlak je silnější než opatrnost. Když se to dá dohromady s tím, jak rychle postupují agentní architektury s reálným přístupem k datům a nástrojům, vzniká kombinace, která si zaslouží víc pozornosti než další demo generátoru videa.
A abych nebyl jen skeptický – Microsoft dál prohlubuje partnerství s Mistralem, tentokrát multimiliardovou investicí do evropských datacenter. Je to logický tah: Microsoft potřebuje evropskou alternativu k OpenAI kvůli regulaci i geopolitice, Mistral potřebuje kapitál a distribuci. Otázka, kterou si kladu, zní: budeme za rok mluvit o bezpečnostních standardech agentních systémů se stejnou naléhavostí, jako dnes mluvíme o jejich výkonu? Zatím to tak nevypadá.
Qiushi Engine z Zhejiang University se umístil na první příčce žebříčku ResearchClawBench, spolehlivě generovat nové vědecké objevy ale zatím neumí. scmp.com
V rychle se vyvíjejícím světě AI a digitálních inovací se rýsuje zásadní posun paradigmatu, který změní budoucí směřování oboru. eu.36kr.com
Čínský startup Moonshot AI pozastavil nová předplatná svého nového modelu Kimi K3, protože rostoucí poptávka přetěžuje jeho výpočetní kapacity. koreatimes.co.kr
Článek od Phillipa Spiese z 21. července 2026 se zabývá tématem zabezpečení dat v architekturách AI agentů. Rozebírá služby jako Amazon Athena, Amazon Bedrock Agents, Amazon OpenSearch Service, Amazon Redshift a Amazon S3. aws.amazon.com
AI systémy se posouvají od jednorázové generace textu k dlouhodobě běžícím agentům, kteří dokážou plánovat, volat nástroje a využívat externí paměť. Autoři představují rámec pro technické a politické řízení této nové runtime vrstvy agentic AI. unu.edu
Poskytovatel platformy pro integrovaný vývoj softwaru Harness Inc. oznámil, že přepracovává životní cyklus vývoje pro AI agenty. Cílem je umožnit vývojářům nasazovat agenty pomocí nástrojů a procesů, které už dobře znají. siliconangle.com
Autor popisuje, jak dlouhodobě používaný AI nástroj už zná jeho historii, návyky i typy problémů, které denně řeší. Text naznačuje posun, kdy zákazníky firem budou stále častěji samotní AI agenti. fastcompany.com
Vědci zkoumají novou formu spolupráce založenou na agentic AI – tzv. co-scientists, kteří dokážou jednat samostatně a pomáhat lidem s generováním nápadů a dalšími fázemi výzkumu. med.stanford.edu
Text popisuje metriky pro hodnocení AI agentů zaměřené na spolehlivost, bezpečnost, trajektorii jednání a celkový výkon. Metriky jsou navrženy pro použití v reálných podnikových procesech. snowflake.com
Agentic AI nástroje – systémy schopné autonomně jednat a plnit vícekrokové úkoly bez zásahu uživatele – nabízejí týmu nový způsob práce. Popisuje se jejich nasazení v rámci konkrétní interní iniciativy. urban.org
AI modely dnes běžně využívají lidé po celém světě jak pracovně, tak soukromě. Nový AI agent nyní pomáhá připravovat experimentální měření na synchrotronu, což otevírá cestu k plně autonomnímu provozu. phys.org
Nejnovější AI Safety Index ukazuje propad hodnocení – žádná velká AI laboratoř nedosáhla lepšího známkování než C+ a tři propadly úplně. Přední firmy navíc ustupují od dříve učiněných bezpečnostních závazků. msn.com
Navzdory svým kontroverzím by se Elon Musk mohl nečekaně stát silou tlumící rivalitu mezi USA a Čínou, která zesiluje rizika spojená s AI. eurasiareview.com
Regulace umělé inteligence se rychle vyvíjí a regulátoři i mezinárodní instituce už mluví společným jazykem transparentnosti. devdiscourse.com
Curry Barker nezamýšlel natočit film o problému alignmentu, přesto vytvořil jednu z nejlepších ilustrací tohoto tématu. faroutmagazine.co.uk
Mistral navyšuje kapacitu AI výpočtů v Evropě a firma zároveň prohlubuje strategickou spolupráci s Microsoftem. Microsoft se zavázal podpořit tento rozvoj v rámci širšího partnerství. news.microsoft.com
„Multimiliardová“ dohoda podpoří datacentra Mistralu v Evropě a pomůže francouzské firmě prodávat její AI modely. Microsoft si od spolupráce slibuje posílení prodeje cloudu a AI služeb. wsj.com
Francouzská pojišťovací a investiční skupina AXA oznámila, že v rámci své AI strategie zavede Microsoft 365 Copilot mezi zaměstnance po celém světě. reinsurancene.ws
Druva vyvíjí ochranu AI agentů, přístup k záložním datům pro AI agenty i obranu proti samotným AI agentům. Firma zároveň zlepšuje vyšetřování incidentů v oblasti kybernetické odolnosti. blocksandfiles.com
Druva představila čtyři nové funkce pro odolnost AI zahrnující obnovu dat, governance, přístup a zálohování. Ochrana Copilotu zachovává prompty, odpovědi i další kontext. virtualizationreview.com
Canvasy mění AI na interaktivní pracovní prostor, kde lze vizualizovat informace, procházet pracovní postupy a provádět akce v rámci složitých úkolů. github.blog
Purview, Defender a Graph API se rozšiřují, aby sjednotily správu agentů běžících na zařízeních koncových uživatelů pod jednotný řídicí panel. cloudwars.com
Vývojáři často kopírují fragmenty kódu, části vláken ze Slacku a narychlo sepsaný prompt do Copilotu, Cursoru nebo Claude Code a očekávají kvalitní výsledek. Článek upozorňuje, že bez systematického přístupu k „context engineeringu“ tyto nástroje nevyužívají svůj potenciál. securityboulevard.com
Nová verze slučuje nástroje pro tvorbu videa z textu i obrázku a dlouhé produkce do jednoho workflow určeného tvůrcům, marketingovým týmům a malým firmám. manilatimes.net
Transparentní povinnosti podle článku 50 AI Act začnou platit 2. srpna 2026 a vyžadují označování chatbotů, deepfake obsahu a strojově čitelné značky AI obsahu. techtimes.com
Izraelský startup Bria tvrdí, že jeho generativní AI platforma umožňuje firmám vytvářet marketingový a mediální obsah odpovídající značce a zákonům ve velkém měřítku. ynetnews.com
AI nástroj DreamHost pro tvorbu webů a aplikací nyní umí generovat i video, má vylepšený engine pro obrázky a nový systém designu řízený zákazníkem. businesswire.com
Vynikající volba pro tvorbu AI obrázků s výkonnými editačními nástroji a štědrým bezplatným plánem. techradar.com
Akcie Samsung Electronics posílily poté, co firma založila novou robotickou divizi jako součást své expanze do fyzické AI. cnbc.com
Evropa má nového jednorožce. Je jím firma Humanoid, vyvíjející humanoidní roboty, která právě uzavřela sérii A ve výši 152 milionů dolarů. forbes.com
Výzkumníci z USC Viterbi vyvinuli kontextově uvědomělý systém AI, který robotům pomáhá rozlišit neškodný kontakt od rizikových kolizí ve složitém prostředí. viterbischool.usc.edu
Tento spin-off společnosti TRI si s financováním 300 milionů dolarů a valuací 1,1 miliardy dolarů klade za cíl upřednostnit lidi. Firma tvrdí, že jejím cílem je jiný přístup k fyzické AI. automate.org
Výzkum umělé inteligence od Dr. Nitina Agarwala z University of Arkansas at Little Rock získal mezinárodní uznání. Jeho práce byla přijata na jednu z nejprestižnějších světových konferencí věnovaných AI. ualr.edu
Strojové učení dokáže odhalit problematické ADMET vlastnosti mnohem dříve než dosud. Stále je ale klíčové vědět, kdy jeho výsledkům důvěřovat a kdy ne. drugdiscoverynews.com
Čínská AI společnost Moonshot, stojící za modelem Kimi K3, podle Bloombergu jedná o novém kole financování při valuaci nejméně 50 miliard dolarů. axios.com
Nové kolo financování vedené fondem Tiger Global má urychlit misi Augustus dolarizovat svět tím, že zahraničním fintechům a bankám poskytne přímý přístup k americkému dolaru. prnewswire.com
Britský robotický startup Humanoid v úterý oznámil, že v kole Series A získal 152 milionů dolarů při post-money valuaci 1,35 miliardy dolarů. Investice má firmě pomoci urychlit vývoj humanoidních robotů. reuters.com
Éra AI stojí na AI infrastruktuře a řada těchto pokročilých systémů vzniká a testuje se v Texasu. Wistron zde otevřel svůj první výrobní závod v USA. blogs.nvidia.com
Nvidia se stala nejhodnotnější firmou díky nenasytné poptávce po svých grafických čipech pro AI. Nyní ale chipový gigant rozšiřuje portfolio i mimo GPU. cnbc.com
Tchajwanský Wistron, dodavatel Nvidie, v úterý spustil v Texasu výrobní závod za 700 milionů dolarů určený k výrobě nejnovějších AI systémů amerického výrobce čipů. reuters.com
Budoucnost výroby AI technologií zakotvila v severním Texasu. Nvidia a Wistron v úterý slavnostně otevřely svůj nový výrobní závod. cbsnews.com
Na první pohled je letošní představení Vera Rubin dalším velkým platformovým milníkem Nvidie, která udržuje stálé tempo AI inovací. siliconangle.com